TTokenySpace
返回 AI 观察
行业分析

国产大模型半年横评:从追赶到并跑

基于日常使用体验,对 DeepSeek、Kimi、通义千问、智谱 GLM、豆包做了一次横向观察:各自的舒适区在哪,什么场景该选谁。

0

这是一篇基于日常实际使用(而非跑分)的横向观察。过去半年,我的中文 AI 对话基本在五个产品间轮转,这里是沉淀下来的选择逻辑。

一句话画像

  • DeepSeek:逻辑推理的性价比之王,开源生态的旗手
  • Kimi:长文档处理的标杆,200 万字上下文不是噱头
  • 通义千问:全能型选手,企业级生态最完整
  • 智谱 GLM:技术底蕴深厚,Agent 能力激进
  • 豆包:产品化程度最高,多模态体验最顺滑

场景对号入座

写代码:DeepSeek 的推理链条最扎实,复杂算法题的正确率体感最高;日常 CRUD 则各家差距不大。

读长文档:Kimi 仍是独一档。实测扔进去一份 300 页的行业白皮书,问答的引用准确度明显优于其他家。

中文写作:豆包和通义的网感更好,Kimi 偏书面,DeepSeek 偶尔会用力过猛。

办公集成:通义(钉钉生态)和豆包(飞书生态)各有主场,选你所在生态的那家。

一个判断

国产模型已经从"追赶 GPT"进入"差异化并跑"阶段:DeepSeek 押注开源和推理,Kimi 押注长上下文,豆包押注多模态产品化。对用户的实际意义是——没有最好的模型,只有最匹配你场景的模型。

这也是我们建这个导航站的初衷:帮你按场景找到对的工具。

评论

加载中…

本文提到的工具