新闻正文
根据彭博行业研究(Bloomberg Intelligence)报告指出,随着 DeepSeek 等实验室急起直追,美国人工智能企业与中国同业在性能上的领先幅度,过去几个月内急遽缩小,创下历史新低,威胁美国科技霸主地位。
彭博行业研究资深分析师 Robert Lea 在周一(5日)发布的报告中指出,DeepSeek 于 9 月推出 V4.1 Flash 后,中国顶尖模型的基准测试分数仅落后美国竞争对手 3%,低于 5 月的约 9% 及今年稍早的 15%。
他表示,性能持续提升,意味中国业者有望进一步扩大市占率。
中国AI的崛起归功于其日益深厚的 AI 专长,以及研究人员针对本地硬件优化模型的能力。
这些进展令人质疑美国针对辉达(Nvidia)芯片等技术实施出口限制的成效,这些限制本意在于遏制中国 AI 发展,并阻止如华为等企业在自主替代方案上取得进展。
Lea 表示,中国的进展「让美国能否长期维持 AI 科技霸主地位,受到更多质疑」。
DeepSeek 的 V4.1 Flash 上月在 LiveBench 排名全球第六,成为这家新创公司于 2025 年推出突破性推理模型 R1 以来,排名最高的中国模型。LiveBench 依据 AI 模型回答及分析问题、谜题或任务的表现评分,过程类似人类智商测试。
DeepSeek 最近一次的 LiveBench 得分为 81.1,低于 Anthropic 的最高分 83.4。Lea 表示,这意味 DeepSeek 模型的性能已与 Anthropic 和 OpenAI 的领先 AI 系统「相当」。
不过,尽管分数差距已缩小至仅 3%,LiveBench 排名前 15 的模型中,仍只有三款来自中国。
Lea 提醒,这类排名会随时变动,而且无论排名分数如何,业者都可能难以将技术转化为营收。中国模型遭指控涉及模型蒸馏后,正面临美国日益严格的监管审查,甚至可能遭到禁用。
他也表示,中国 AI 产业可能直到 2030 年仍处于亏损状态。在本土市场充斥着超过 1100 个大型语言模型的情况下,过度聚焦于低利润的 Token 供应以及惨烈的价格战,恐让任何企业都难以在本土市场中创建竞争优势。
Lea 指出,字节跳动旗下豆包在 AI 应用程序商业化方面居于领先地位,DeepSeek 与腾讯等竞争对手的聊天机器人则仍免费提供。
他认为,要让中国的 AI 产业走上可持续获利的轨道,将有赖于竞争压力的降温、产业洗牌,以及更理性的定价策略。