据悉,彭博行业研究最新报告显示,过去几个月,随着DeepSeek等中国AI实验室的模型不断进步,美国AI公司相对中国同行的性能领先优势急剧缩小,降至历史最低水平。在DeepSeek 9月发布V4.1 Flash之后,中国顶尖模型在LiveBench基准测试得分上仅落后美国竞争对手3%,较5月份的约9%和今年早些时候的15%大幅收窄。
DeepSeek的V4.1 Flash上月在LiveBench全球排名中位列第六,成为自2025年凭借推理模型R1取得突破以来排名最高的中国模型。其最近一次得分为81.1分,低于Anthropic最高的83.4分,表现已可与Anthropic、OpenAI的领先AI系统相媲美。中国模型技术的崛起得益于AI专业能力的深化和针对国产硬件优化模型的能力,这些进展也引发对美国限制技术出口有效性的质疑。
尽管得分差距缩小至仅3%,LiveBench前15个模型中只有3个来自中国。分析师提醒称,这类排名会不断变化,且无论模型在排行榜上的排名如何,变现都可能很困难。

粤公网安备 44010602000162号
网友评论