DeepSeek V4.1 Flash 发力,中美顶尖模型 LiveBench 跑分差距缩至 3%
文 / 小亚
2026-10-05 12:39:06
来源:亚汇网
北京时间10月5日,据彭博行业研究称,过去几个月,随着DeepSeek等中国AI实验室的模型不断进步,美国AI公司相对中国同行的性能领先优势急剧缩小,降至历史最低水平,这让美国的科技主导地位面临威胁。DeepSeek彭博行业研究高级分析师罗伯特·利亚(RobertLea)在周一的一份报告中写道,在DeepSeek9月发布V4.1Flash之后,中国顶尖模型在基准测试得分上仅落后美国竞争对手3%。这一差距较5月份的约9%和今年早些时候的15%有所收窄。他表示,这种性能的持续提升意味着中国竞争者将进一步扩大市场份额。彭博指出,中国模型技术的崛起得益于其AI专业能力的不断深化,以及研究人员针对国产硬件优化模型的能力。这些进展也让人们开始质疑美国限制技术出口的做法是否有效。利亚称,中国取得的进展“进一步让人质疑美国在AI领域的科技主导地位能否长期维持”。DeepSeek的V4.1Flash上月在LiveBench全球排名中位列第六,成为自这家创业公司2025年凭借其推理模型R1取得突破以来排名最高的中国模型。LiveBench根据AI模型对问题、谜题或任务的回答与分析进行评分,这一过程类似于衡量人类智商。DeepSeek最近一次在LiveBench上的得分为81.1分,低于Anthropic最高的83.4分。利亚表示,这意味着DeepSeek模型的表现已经“可以与Anthropic、OpenAI的领先AI系统相媲美”。不过,尽管双方的得分差距已经缩小至仅3%,LiveBench评选出的前15个模型中只有3个来自中国。利亚提醒称,这类排名会不断变化,而且无论模型在排行榜上的排名如何,变现都可能很困难。
















































