山东 「切换城市」

请选择您所在的城市:

    热门
    城市

    DeepSeek V4.1 Flash跑分逼近美国顶尖模型 LiveBench差距缩至3%

    来源:网络

       阅读:3218

       发布时间:2026-10-05 15:00:47

    [摘要] 北京时间 10 月 5 日,据彭博行业研究称,过去几个月,随着 DeepSeek 等中国 AI 实验室的模型不断进步,美国 AI 公司相对中国同行的性能领先优势急剧缩小,降至历史最低水平,这让美国的科技主导地位面临威胁。彭博行业研究高级分析师罗伯特 · 利亚 (Robert Lea) 在周一的一份报告中写道,在 DeepSeek 9 月发布 V4.1 Flash 之后,中国顶尖模型在基准测试得分

    10月5日北京时间消息,彭博行业研究指出,近几个月来,以DeepSeek为代表的中国AI实验室持续推出更先进的模型,导致美国AI企业相较中国同行的性能优势快速萎缩,已跌至有史以来的最低点,美国在科技领域的主导地位因此受到挑战。

    彭博行业研究高级分析师罗伯特·利亚在周一发布的报告中指出,DeepSeek于9月推出V4.1 Flash后,中国最顶尖的模型在基准测试得分上与美国竞争对手的差距仅为3%。相比之下,这一差距在5月份约为9%,今年早些时候则达到15%。

    利亚认为,中国竞争者性能的不断提升,预示着它们将进一步抢占市场份额。

    彭博分析认为,中国模型技术的快速崛起,一方面源于其AI专业能力的持续积累,另一方面也得益于研究人员针对国产硬件对模型进行优化的能力。这些进展引发了外界对美国技术出口限制措施有效性的质疑。

    利亚表示,中国所取得的进步“使人们进一步怀疑美国在AI领域的科技主导地位是否能够长期维系”。

    上个月,DeepSeek的V4.1 Flash在LiveBench全球排名中位居第六,这是自这家创业公司2025年凭借推理模型R1实现突破以来,中国模型取得的最高排名。LiveBench通过对AI模型回答问题、解谜或完成任务的表现进行分析来打分,其过程类似于衡量人类智商。

    DeepSeek最近一次在LiveBench上的得分为81.1分,而Anthropic的最高得分为83.4分。利亚指出,这表明DeepSeek模型的表现已经“能够与Anthropic和OpenAI的领先AI系统相匹敌”。不过,尽管双方得分差距已缩小至仅3%,LiveBench评出的前15个模型中,仅有3个来自中国。

    利亚同时提醒,此类排名会随时间变化,而且不论模型在排行榜上名次如何,实现商业变现都可能面临困难。

    关键词: DeepSeek 逼近 美国 顶尖 模型 LiveBench 差距 北京时间

    论坛热帖

    温馨提示:本文内容转载自各网络平台,仅作正能量信息传播、公益宣传使用。转载不代表本站观点,内容版权归原发布方所有。若涉及版权、内容异议,请联系我方及时处理,QQ:303378055

    精彩评论文明上网理性发言,请遵守评论服务协议

    共0条评论
    加载更多

    在线投稿

      入驻商铺