人工智能

最强大的 AI 模型刚刚变得更便宜也更乏味了

Anthropic 发布 Opus 5.5,价格降低 20% 并改进了逻辑,标志着向高效、安全且无术语的 AI 开发转型。
最强大的 AI 模型刚刚变得更便宜也更乏味了

尽管科技界通常期待更新的人工智能模型变得更大、更华丽且更昂贵,但 Anthropic 刚刚打破了这一循环。周二发布的 Opus 5.5 标志着对传统原始算力竞赛的背离。大多数开发者原本期待 7 月发布的 Opus 5 模型会有一个庞大且耗费资源的继任者。然而,现实是一个更精简、更实惠且有意克制的系统。Anthropic 押注用户更倾向于高效工作的工具,而不是单纯追求最高参数的工具。

此次发布是首席执行官 Dario Amodei 公开承诺“控制前沿步调”(pacing the frontier)以来的首次重大举措。这一哲学涉及刻意放慢 AI 能力的进步速度,以确保安全协议能跟上技术的发展。在一个速度往往是唯一衡量指标的行业中,Anthropic 试图证明成熟度比势头更有价值。对于普通用户来说,这意味着他们依赖的软件在变得更强大的同时,也变得更加可预测。

廉价智能的实用数学

对于企业和开发者来说,最切实的改变是价格。数字智能通常以 Token 来衡量,它们本质上是文本的小块。一百万个 Token 大约相当于 750,000 个单词,或者大约七本平均长度的小说。在 Opus 5 的旧定价下,生成这么多文本需要花费 25 美元。而使用 Opus 5.5,该价格已降至 20 美元。虽然 5 美元的差价孤立来看很小,但对于每天处理数百万份文档的公司来说,其规模效应非常显著。

价格下降是效率提升的直接结果。Anthropic 成功减少了运行模型所需的计算能力。当模型处理请求所需的能源和硬件减少时,供应商可以将这些节省的成本转嫁给客户。这使得高端 AI 对于那些之前认为 Opus 级别对其预算来说过于昂贵的小型初创公司更具吸引力。从历史上看,最强大的模型一直是大型企业的专属领域,但目前的转变表明,顶级性能正在成为一种商品。

为什么性能更好意味着话更少

Opus 5.5 在几个关键基准测试中超过了体量更大的 Fable 模型,特别是在编程和复杂的知识性工作方面。奇怪的是,它在实现这一目标的同时,减少了困扰先前版本的华而不实、充斥术语的语言。Anthropic 修改了模型的交流方式,强制其在回答的开头提供最重要的信息。这一改变解决了一个常见的困扰,即用户必须阅读数段介绍性的废话才能找到问题的实际答案。

可以把 Opus 5.5 想象成一个不知疲倦的实习生,他终于明白老板想先看结论。以前的模型经常试图通过使用技术术语和复杂的句子结构来显得聪明。新版本优先考虑清晰度。对于寻求错误修复的程序员来说,这意味着立即获得代码块,而不是听一段关于软件架构的讲座。这种向简洁的转变减少了用户过滤 AI 生成噪音的时间,这是生产力上的实际胜利。

比较 Claude 系列

Anthropic 维持着一个三级体系以服务不同的需求。Opus 位于顶端,作为处理复杂任务的主力。Sonnet 充当平衡的中间地带,而 Haiku 为简单查询提供近乎即时的响应。随着 5.5 世代的推出,这些级别之间的性能差距正在发生变化。

模型级别 主要用例 状态 定价(每 100 万输出 Token)
Opus 5.5 高级编程、研究、策略 现已推出 $20.00
Sonnet 5.5 日常任务、内容审核 即将推出 待定
Haiku 5.5 聊天机器人、数据分类 即将推出 待定

Opus 5.5 在体量更大的 Fable 模型未能完成的非正式任务中取得了成功,这是当前市场方向的一个重要指标。它表明行业正处于大型模型收益递减的阶段。更多的数据并不总能带来更好的结果。相反,训练的质量和模型内部架构的逻辑正成为成功的核心驱动力。

控制前沿步调的逻辑

Dario Amodei 表示,全面应对 AI 风险需要更加审慎。在受风险投资驱动且面临快速发布功能压力的行业中,这种立场非常罕见。通过控制前沿步调,Anthropic 试图避免这样一种情况:AI 模型在公司拥有监控工具之前,就获得了发现危险生物漏洞或网络漏洞的能力。Opus 5.5 具有与 Fable 模型相同的安全防护措施,专门限制其帮助用户开发生物武器或在已编译的计算机程序中寻找漏洞的能力。

这些防护措施涉及来自 METR 和 Frontier Design 等组织的外部评估。这些团体充当数字安全检查团队,在模型接触公众之前测试其危险能力。虽然一些批评者认为这些限制阻碍了创新,但 Anthropic 将其视为基础性设施。随着 AI 成为现代生活更系统化的一部分,该公司认为公共政策和安全监控必须与代码同步演进。

这对你的工作流程意味着什么

如果你将 AI 用于专业任务,Opus 5.5 的发布改变了使用哪种模型的成本效益分析。以前,许多用户留在中端的 Sonnet 模型,因为 Opus 的价格在日常工作中难以证明其合理性。20% 的降价结合更快的处理速度,使得高端级别成为常规任务中更可行的选择。该模型不太可能用不必要的解释浪费你的时间,使其成为技术项目更高效的合作伙伴。

从大局来看,这次发布表明 AI 行业正进入精炼阶段。对 AI 能力的最初震撼正在消退,用户现在要求可靠性、更低的成本和更好的用户界面。21 世纪的数字原油——算力——正被更有效地利用,这稳定了市场并使技术在面对价格波动时更具韧性。

从消费者的角度来看,最重要的启示是 AI 正变得更像是一种公用事业,而不是实验室实验。你应该观察未来几周内你的数字工具如何响应。如果你注意到你的 AI 助手突然变得更直接且不再赘言,你可能正看到这种对对齐和效率的新关注所带来的结果。目标不再仅仅是制造一台能通过测试的机器,而是制造一台能进行有用、安全且负担得起的对话的机器。

bg
bg
bg

另一边见

我们的端到端加密电子邮件和云存储解决方案提供了最强大的安全通信手段,确保您的数据安全和隐私。

/ 创建免费账户