彭博:DeepSeek助力,中美顶尖AI跑分差距缩至3%
彭博行业研究(Bloomberg Intelligence)10月5日发布的最新报告称,随着DeepSeek等中国AI实验室的模型持续进步,美国AI公司相对中国同行的性能领先优势已急剧缩小,降至历史最低水平。报告主笔、高级分析师罗伯特·利亚(Robert Lea)指出,在DeepSeek于9月推出V4.1 Flash之后,中国顶尖模型在基准测试得分上仅落后美国竞争对手约3%。

这一差距的收窄速度颇为明显。据报告数据,中美顶尖模型的基准分差在今年初约为15%,到5月已降至约9%,如今进一步缩至3%。利亚认为,性能的持续提升意味着中国竞争者将在全球市场进一步扩大份额。
DeepSeek的V4.1 Flash无疑是本轮赶超的关键。该模型上月在权威榜单LiveBench的全球排名中位列第六,创下这家创业公司自2025年凭推理模型R1取得突破以来,中国模型在该榜的最佳名次。LiveBench通过模型对问题、谜题与任务的分析回答来评分,被视为近似衡量"AI智商"的方式。DeepSeek最近一次LiveBench得分为81.1分,低于Anthropic旗下最高分的83.4分。利亚表示,这意味着DeepSeek模型的表现已"可与Anthropic、OpenAI的领先系统相媲美"。

不过报告也给出冷静提示:尽管分差已缩至3%,LiveBench前15名模型中仅有3个来自中国;且榜单本身会随新模型发布频繁变动,无论排名高低,AI模型的商业化变现都并非易事。利亚还指出,中国的进展建立在日益深厚的AI专业能力,以及研究人员针对国产硬件优化模型的能力之上,这也令外界重新质疑美国限制AI芯片出口的实际成效。
从更广阔的视角看,这场追赶正在重塑全球AI竞争格局。中国凭借更低成本的模型与对国产算力的适配,在用户规模上快速逼近美国同行;而美国方面,Anthropic与OpenAI正以万亿估值冲刺资本市场,强调自身能力优势。中美之间的技术角力,已从单纯的模型跑分延伸到芯片、算力、应用与商业化的全链条比拼。
读者评论 (1)
想参与讨论?请 登录 后发表评论。
3%的差距看着挺猛,但前15名里只有3个中国模型,这差距怕是还没完全消失