glm 模型还是很不错的,但是识别图片需要调用视觉 mcp 才可以,但是官方提供的这个识别 mcp 好慢啊,有没有更好的识别方案?
1
TimePPT 35 mins ago
国内可以试试 qwen 的多模态模型,国外 openai 、gemini 的多模理解都还不错,如果多模理解任务不复杂,都可以用小一点的模型,另外如果想速度快,调用多模态模型时候 image 输入尺寸可以压缩一下
|