@
andforce 我把你这个问题用中英文两种语言和 Claude ,Grok ,Gemini ,ChatGPT 四个平台,一共八个 conversation ,并且在每种语言的第一轮对话后,把另外三个平台的回复发送给它让重新思考。无法支持你所说的结论。
Grok 是其中分析深度明显更差的,只简单地考虑到了语言本身的编码效率。ChatGPT 思考更完善。最终的结论基本落脚在
1. 对于旧一些的模型,例如 GPT-4 ,Opus3.5 ,英文有明显优势。
2. 更 Modern 一些的模型中英文基本打平,因为在分词器上进行了不同语言的平权优化。
3. 只有国产模型,例如 DeepSeek ,QWen ,在分词器上对中文进行了特殊的加强优化,最终可以实现消耗 Token 更少。
4. Claude 的英文对话的结论是其他模型的结论对于语言平权优化的效果过于乐观。依然认为中文要消耗更多的 Token 。
所以不加定语地说:“结论就是中文消耗 token 更少。“明显是错误结论。