彭博行业研究高级分析师罗伯特・利亚10月5日发布报告称,随着DeepSeek于9月推出V4.1 Flash,中国顶尖模型在LiveBench基准测试上仅落后美国领先模型约3%。V4.1 Flash得分81.1,对比Anthropic旗舰模型的83.4;这一差距较5月的约9%和年初的15%大幅收窄。分析师认为,中国模型性能的持续提升意味着中国厂商将进一步扩大市场份额,中美在AI基础能力上的竞争正进入白热化阶段。

小典观察:从年初落后15%到如今逼近3%,中国大模型的追赶速度令人瞩目。差距快速收窄背后是工程与数据的长期积累。对全球开发者而言,选择更丰富、成本更优;这场竞争最终利好整个AI生态。
来源:网络