人工智能

为什么世界上最先进的 AI 突然变得更便宜了?

Anthropic 发布了 Claude Haiku 5.5,这是一款专为高容量任务设计的更快速且便宜 75% 的 AI 模型,在价格和速度上挑战了 OpenAI 的 GPT-6 Luna。
为什么世界上最先进的 AI 突然变得更便宜了?

你有没有注意到,你的数字工具在变得越来越聪明的同时,价格却没有变贵?对于普通用户来说,人工智能的兴起往往感觉像是一场通往更大、更复杂机器的竞赛,这些机器需要巨大的算力和更高的预算。Anthropic 刚刚改变了这一局面。随着 Claude Haiku 5.5 的发布,该公司不再追求软件的更高智商。相反,它专注于对你日常生活更实用的东西:让技术几乎免费且速度惊人。

这次发布完成了一系列更新,这些更新始于本月早些时候的 Opus 5.5 和 Sonnet 5.5。虽然那些较大的模型在复杂的编程和创意写作中充当重任,但 Haiku 5.5 更像是一个不知疲倦的实习生。它旨在处理维持企业运转的重复性、高容量任务,从分类数千封客户电子邮件到转瞬之间总结冗长的法律文件。这次发布最引人注目的是价格标签,它已经降得如此之低,以至于处理一百万字成本现在的单位是美分。

数字“不知疲倦实习生”的数学题

要理解这为何重要,我们必须看看这些公司如何为他们的服务收费。在 AI 世界里,货币是 Token。Token 是一小块文本,通常约为三个汉字或四分之三个单词。当开发者使用 Claude 构建应用程序时,他们会为 AI 阅读的每个 Token 和编写的每个 Token 付费。

从历史上看,这些成本是小型企业的主要障碍。之前的版本 Haiku 4.5 每百万输入 Token 的成本为 1 美元。而 Haiku 5.5 的成本仅为 0.10 美元。对于大多数请求来说,这是 90% 的降价。Anthropic 估计,典型企业的平均节省约为 75%。这在数字领域相当于汽油价格从每加仑 4.00 美元降至 1.00 美元。突然之间,那些因过于昂贵而无法自动化的任务在财务上变得可行了。

模型版本 输入成本(每 100 万 Token) 输出成本(每 100 万 Token) 最佳用例
Claude Haiku 4.5 $1.00 $5.00 基础自动化
Claude Haiku 5.5 $0.10 $0.50 高速支持
Claude Sonnet 5.5 $3.00 $15.00 复杂编程
GPT-6 Luna $0.10 $0.50 直接竞争对手

现实世界中速度与准确性的交汇

在模型权重和架构的术语背后,Haiku 5.5 是对一个非常人性化问题的回应:等待。如果你正在与客户服务机器人聊天,五秒钟的延迟感觉就像永恒。Anthropic 构建这个模型是为了几乎即时地做出响应。在我们的初步测试中,一个简单的逻辑问题得到的响应速度非常快,以至于在屏幕完成滚动之前就出现了。

然而,速度是有上限的。在同一次测试中,该模型对一个基础逻辑谜题给出了自信但错误的答案。这对于任何使用这些工具的人来说都是一个至关重要的提醒。一个更快的实习生并不总是一个更聪明的实习生。Haiku 5.5 非常适合总结 50 页的 PDF,因为它擅长提取事实,但你不应该在没有复核结果的情况下要求它解决复杂的建筑数学问题。它是一个处理容量的工具,而不一定是为了深层的哲学辩论。

从大局来看,这种速度使得 AI 能够代表你操作网络浏览器。想象一下,告诉你的电脑寻找去东京最便宜的机票,预订市中心两英里内的酒店,并将行程添加到你的日历中。Haiku 5.5 具备实时点击网站和填写表格所需的原始速度,而这项任务在更大、更慢的模型上会显得迟缓且令人沮丧。

对你的工作流真正重要的基准测试

Anthropic 分享了几项将 Haiku 5.5 与其主要竞争对手 OpenAI 的 GPT-6 Luna 进行比较的性能得分。其中最相关的测试之一是 OSWorld 2.1。该测试衡量 AI 在标准计算机操作系统中导航以完成多步骤任务的能力。Haiku 5.5 的成功率为 72.4%。相比之下,GPT-6 Luna 的得分为 48.9%。

在另一项名为 Terminal-Bench 4.0 的测试中(该测试要求 AI 通过在计算机终端输入命令来解决专业技术问题),Haiku 5.5 在第一次尝试时正确解决了 39.2% 的任务。它的前身 Haiku 4.5 在同一项测试中得分为 0%。虽然它仍然落后于更强大的 Sonnet 5.5 模型(得分为 70.6%),但从零到接近 40% 的飞跃代表了这种小型模型能力的巨大跨越。

在市场方面,这些数据表明廉价 AI 与昂贵 AI 之间的差距正在缩小。你不再需要最昂贵的模型来处理专业级的工作。这种转变对行业具有颠覆性,因为它迫使竞争对手要么降低价格,要么显著提高性能以证明更高成本的合理性。

波动市场中的效率代价

Anthropic 还在改变其处理模型已见过数据的方式。他们将中端模型 Sonnet 5.5 的缓存读取价格减半。当 AI 阅读一次长文档后,如果开发者使用名为“提示词缓存”(prompt caching)的功能,它可以记住该数据以用于未来的提问。现在的价格是每百万 Token 0.10 美元。

这一举动是对大规模运行 AI 高昂成本的直接打击。通过降低数据重用的成本,Anthropic 正在鼓励开发者构建更复杂的应用程序,这些程序可以记住你的偏好和历史,而不会耗尽资金。从消费者的角度来看,这意味着你的应用程序在接下来的几个月里可能会变得更加个性化和具备上下文感知能力。

调整“努力拨盘”以获得更好结果

Haiku 5.5 最有趣的补充之一是一个名为“可调节努力设置”的新功能。把它想象成 AI 大脑的数字恒温器。如果你正在做一个简单的任务,你可以调低努力程度以节省资金并获得更快的答案。如果你需要 AI 对特定问题进行更深入的思考,你可以调高努力程度。

这是 Anthropic 首次在其最小模型中加入此设置。它让用户在成本和质量之间的权衡中拥有更多控制权。在过去,你必须在廉价模型和聪明模型之间做出选择。现在,你可以使用同一个模型,只需告诉它在特定问题上投入多少能量。这种灵活性对于需要管理紧张预算同时仍为用户提供高质量服务的开发者来说是基础性的。

这对你的月度订阅意味着什么

Anthropic 不仅仅关注编写代码的开发者。他们还在为普通订阅者增加价值。本周,Max 和 Team 计划的用户将开始收到每月的 API 额度。Max 5x 订阅者可获得 100 美元的额度,而 Team 计划每个组织最多可获得 500 美元供共享。

从本质上讲,Anthropic 正在为你提供工具,让你作为现有订阅的一部分免费构建自己的定制 AI 助手。如果你曾经想建立一个只搜索你个人笔记或帮助你管理特定爱好的定制机器人,这些额度会让开始变得容易得多。这是在与 OpenAI 和 Google 的竞争依然激烈的环境下,将用户留在 Anthropic 生态系统中的明确举措。

你的数字习惯之底线

Haiku 5.5 的到来标志着昂贵 AI 第一时代的结束。我们正在进入一个智能本身正在成为一种商品的时期,就像电力或互联网带宽一样。你很快就会停止将 AI 视为你在网站上访问的独立工具,而开始将其视为你拥有的每个应用程序内部的隐形层。

这对你意味着一个软件响应更快且使用成本更低的世界。然而,早期测试中发现的逻辑错误证明,我们还不能将批判性思维外包。使用 Haiku 5.5 的最佳方式是将其视为信息的高速过滤器。让它承担阅读和分类的重任,但在做最终决定时,请握好方向盘。观察在接下来的几个月里,你有多少日常应用程序开始添加自动摘要或即时支持聊天等功能。这些就是这场价格战的切实成果。

资料来源:
Anthropic 官方新闻稿:推出 Claude Haiku 5.5
Anthropic 开发者文档:模型定价与规格
OSWorld 2.1 基准测试结果
Terminal-Bench 4.0 性能数据

bg
bg
bg

另一边见

我们的端到端加密电子邮件和云存储解决方案提供了最强大的安全通信手段,确保您的数据安全和隐私。

/ 创建免费账户