AI 竞赛变得尴尬起来

AI 竞赛变得尴尬起来

Hacker News 摘要

原标题:The AI Race Just Got Awkward

这篇博文讨论了全球 AI 竞争格局中的微妙变化,重点探讨了西方 AI 实验室对中国开源技术突破的吸收和借鉴。

蒸馏争议与角色转变

文章指出,当前新闻常给人一种西方实验室被中国实验室全面压制的印象。例如,Anthropic 经常发布文章,指责中国团队在“蒸馏”其模型,并将其渲染为对人类的威胁。这种言论有助于其后续推动法律与监管层面的限制。然而,无脑蒸馏的时代已经结束,现在的局面演变为了西方实验室直接采用中国团队的研发成果。不同于西方公司倾向于使用的“窃取”一词,中国实验室几乎是公开分享了它们的技术方案。

关键的技术突破:KV 缓存优化

西方实验室在未予致谢的情况下,借鉴了 DeepSeek 公开分享的 KV 缓存优化突破。对于编程等长上下文场景,这项优化相比 DeepSeek-V1 将 KV 缓存占用降低了约 437 倍:

• DeepSeek 率先推出了 MLA 架构,将缓存压缩了约 15 倍。

• 随后又推出了 Compressed Sparse Attention 以及 Heavily Compressed Attention。

• 最新的 DeepSeek-V4.1-Flash 则进一步结合了 CSA2、跨层缓存复用、因果编码器-解码器架构以及 FP4 缓存技术,将全局 KV 缓存降低到了每令牌 890 字节。

对于长上下文模型服务而言,显存占用是最大的成本来源之一,因此这些优化极其关键。

西方公司的低调采用与成本骤降

中国实验室因受到先进 GPU 获取受限的影响,被迫将性能优化作为首要目标,并取得了显著成果。令人不解的是,中国团队完全免费公开了这些突破,而 Anthropic 和 OpenAI 则迅速在顶级模型中应用了这些技术。

因为借鉴了外部成果,西方公司在发布时显得有些尴尬,因此采取了低调静默发布的方式:

• 涉及的新模型包括 Claude Opus 5.5 和 GPT-6.1 Sol。

• 尽管宣传低调,但用户评价极高,且质量紧追各自的旗舰模型 Claude Fable 5.1 和 GPT-6 Astra。

• 成本数据直接印证了这些技术的落地:Opus 5.5 的缓存读取价格相比 Opus 5 降低了 60%;GPT-6.1 Sol 相比 GPT-5.6 Sol 在 7 月底的价格更是大幅降低了 80%。

文章总结认为,这些由中国实验室开源的技术,实际上为处于亏损状态的西方 AI 实验室送去了一条关键的生命线,大幅改善了它们的推理利润率。


原文:https://insufferable.dev/posts/the-ai-race-just-got-awkward/

评论:https://news.ycombinator.com/item?id=49910553

Report Page