这是一篇基于日常实际使用(而非跑分)的横向观察。过去半年,我的中文 AI 对话基本在五个产品间轮转,这里是沉淀下来的选择逻辑。
一句话画像
- DeepSeek:逻辑推理的性价比之王,开源生态的旗手
- Kimi:长文档处理的标杆,200 万字上下文不是噱头
- 通义千问:全能型选手,企业级生态最完整
- 智谱 GLM:技术底蕴深厚,Agent 能力激进
- 豆包:产品化程度最高,多模态体验最顺滑
场景对号入座
写代码:DeepSeek 的推理链条最扎实,复杂算法题的正确率体感最高;日常 CRUD 则各家差距不大。
读长文档:Kimi 仍是独一档。实测扔进去一份 300 页的行业白皮书,问答的引用准确度明显优于其他家。
中文写作:豆包和通义的网感更好,Kimi 偏书面,DeepSeek 偶尔会用力过猛。
办公集成:通义(钉钉生态)和豆包(飞书生态)各有主场,选你所在生态的那家。
一个判断
国产模型已经从"追赶 GPT"进入"差异化并跑"阶段:DeepSeek 押注开源和推理,Kimi 押注长上下文,豆包押注多模态产品化。对用户的实际意义是——没有最好的模型,只有最匹配你场景的模型。
这也是我们建这个导航站的初衷:帮你按场景找到对的工具。
评论
加载中…