资讯›热点›正文

彭博:DeepSeek助力,中美顶尖AI跑分差距缩至3%

云端漫步 2026-10-5 12:52 阅读 7 评论 1热点
彭博行业研究最新报告显示,在DeepSeek于9月发布V4.1 Flash后,中国顶尖大模型与美国对手的基准得分差距已收窄至3%,为历史最低。报告认为这反映出中国模型能力的快速提升,也令美国技术出口管制成效再受质疑。

彭博行业研究(Bloomberg Intelligence)10月5日发布的最新报告称,随着DeepSeek等中国AI实验室的模型持续进步,美国AI公司相对中国同行的性能领先优势已急剧缩小,降至历史最低水平。报告主笔、高级分析师罗伯特·利亚(Robert Lea)指出,在DeepSeek于9月推出V4.1 Flash之后,中国顶尖模型在基准测试得分上仅落后美国竞争对手约3%。

彭博:DeepSeek助力,中美顶尖AI跑分差距缩至3%

这一差距的收窄速度颇为明显。据报告数据,中美顶尖模型的基准分差在今年初约为15%,到5月已降至约9%,如今进一步缩至3%。利亚认为,性能的持续提升意味着中国竞争者将在全球市场进一步扩大份额。

DeepSeek的V4.1 Flash无疑是本轮赶超的关键。该模型上月在权威榜单LiveBench的全球排名中位列第六,创下这家创业公司自2025年凭推理模型R1取得突破以来,中国模型在该榜的最佳名次。LiveBench通过模型对问题、谜题与任务的分析回答来评分,被视为近似衡量"AI智商"的方式。DeepSeek最近一次LiveBench得分为81.1分,低于Anthropic旗下最高分的83.4分。利亚表示,这意味着DeepSeek模型的表现已"可与Anthropic、OpenAI的领先系统相媲美"。

彭博:DeepSeek助力,中美顶尖AI跑分差距缩至3%

不过报告也给出冷静提示:尽管分差已缩至3%,LiveBench前15名模型中仅有3个来自中国;且榜单本身会随新模型发布频繁变动,无论排名高低,AI模型的商业化变现都并非易事。利亚还指出,中国的进展建立在日益深厚的AI专业能力,以及研究人员针对国产硬件优化模型的能力之上,这也令外界重新质疑美国限制AI芯片出口的实际成效。

从更广阔的视角看,这场追赶正在重塑全球AI竞争格局。中国凭借更低成本的模型与对国产算力的适配,在用户规模上快速逼近美国同行;而美国方面,Anthropic与OpenAI正以万亿估值冲刺资本市场,强调自身能力优势。中美之间的技术角力,已从单纯的模型跑分延伸到芯片、算力、应用与商业化的全链条比拼。

读者评论 (1)

想参与讨论?请 登录 后发表评论。

  • 听
    听风者2026-10-05 21:48

    3%的差距看着挺猛,但前15名里只有3个中国模型,这差距怕是还没完全消失