今天你有多少次在没有阅读旁边文字的情况下就点击了复选框?我们大多数人对待服务条款和权限提示就像对待数字苍蝇一样,只想把它们拍走。我们想要结果,但对过程几乎没有耐心。这种习惯正是 Anthropic 改变开发者与其 AI 工具之间基本关系的原因。从 8 月 14 日开始,该公司将为 Pro、Max 和 Team 账户的 Claude Code 用户默认开启自动模式(auto mode)。
这一转变使 Claude Code 从一个“请求许可”的工具变成了一个“请求原谅”的工具。几个月来,用户必须批准 AI 采取的每一个动作,从读取文件到编写新行代码。Anthropic 现在认为 AI 已经准备好在没有持续监督的情况下工作了。该公司将其宣传为平衡速度与控制的一种方式,但也反映了对人类如何与机器交互的更深层认识。当一个工具过于频繁地请求许可时,人类大脑就会停止评估风险,转而执行一种反射动作。
当 Anthropic 在 3 月份首次推出自动模式测试版时,它是为冒险者提供的可选功能。它允许 AI 串联多个任务,而无需在每一步都停下来询问“是”或“否”。现在,这种自主性已成为标准。如果你是 Claude 高级层级的订阅者,你的 AI 助手很快就会继续执行任务,除非它判定某个动作是不可逆的或具有破坏性的。
把 Claude Code 想象成坐在你办公桌前的一位不知疲倦的实习生。以前,这位实习生必须每隔五秒拍拍你的肩膀,问他们是否可以打开文件夹或移动文件。现在,实习生拿到了办公室的钥匙。只有当他们准备粉碎一份基础合同或走出大楼时,才会叫醒你。这一变化旨在消除减缓软件开发速度的摩擦,但也对系统识别自身极限的能力寄予了巨大的信任。
Anthropic 公告中最引人注目的数据之一涉及一项针对 1,053 名付费测试者的研究。结果出人意料。Anthropic 发现,自动模式拦截了 89% 的有害动作,而人类审查员仅拦截了 13.6%。这个数据令人震惊。AI 在发现自身潜在错误或恶意指令方面的效率,几乎是负责监督它的人类的七倍。
这种差异的存在是因为人工审查变得习以为常。Anthropic 指出,用户批准了 Claude Code 中 97% 的权限提示。当用户每天看到一百个提示时,第 101 个提示感觉就像是一种形式,而不是安全检查。我们对细节变得盲目,因为海量的信息在我们的注意力中造成了瓶颈。通过消除这些持续审批的需求,Anthropic 不仅仅是在加快工作速度。它承认在任务重复且量大的情况下,人类往往是安全链中最不可靠的部分。
默认设置是科技行业最强大的力量之一。大多数用户从不更改软件的原始配置,这赋予了制造商对产品使用方式的巨大影响力。通过将自动模式设为默认,Anthropic 信号了行业风险承受能力的转变。Claude Code 负责人 Boris Cherny 在 X 上提到,他的团队已经排他性地使用自动模式数月,无法想象回到权限提示的时代。
从市场角度来看,这一举措使 Claude 成为其他 AI 编程助手更精简的竞争对手。如果一个工具需要点击十几次才能完成任务,而另一个工具点击一次就能完成,市场几乎总是会倾向于阻力最小的路径。然而,这种便利伴随着责任的系统性转变。用户不再是每一个微小变化的活跃把关人。相反,用户变成了高级管理人员,只有在系统标记重大事件时才介入。
为了管理这种自主性的风险,Anthropic 正在引入新的安全层。其中一层是提示注入(prompt injection)筛选。在 AI 世界中,提示注入就像一种数字障眼法,恶意行为者试图诱骗 AI 忽略其原始指令。如果 AI 根据外部数据编写代码,该数据可能包含隐藏命令,告诉 AI 泄露信息或删除文件。
另一层包括可自定义的硬拒绝规则。这些规则充当数字围栏。即使 AI 处于自动模式,它也无法越过这些边界。例如,公司可以设置一条规则,防止 AI 向外部服务器发送数据。这解决了数据外泄的担忧,即从公司安全环境的后门偷偷带走信息。这些护栏是基础性的,因为它们提供了一个不依赖于人类注意力的安全网。
对于普通的开发者或团队负责人来说,向自动模式的转变起初会感到颠覆性。你会注意到 AI 在几秒钟内完成复杂的任务,而不是几分钟。你会花更少的时间点击“允许”,花更多的时间审查最终产品。但有一个实际的权衡需要考虑。因为 AI 移动得更快,它确实漏掉的错误可能更难通过一长串自主动作追溯回来。
从实际操作上讲,这一变化要求用户更擅长定义环境。如果你希望 AI 留在特定的沙盒中,你必须明确这些边界。该工具不再仅仅是一个计算器;它是一个智能体(agent)。智能体需要明确的使命和明确的限制。如果你提供模糊的指令,自主 AI 可能会采取逻辑上可行但并非所需的路径来达成目标。底线是,你在手动审批上节省的时间应该重新投入到更高层次的架构审查中。
如果你拥有 Pro、Max 或 Team 账户,你应该通过审查当前项目来为这一过渡做准备。Anthropic 表示,如果判定某个动作不可逆,AI 将会停止,但在不同的编码环境中,“不可逆”的定义可能是主观的。检查你的本地环境是否激活了备份或版本控制系统是值得的。这提供了一个二次安全网,以防 AI 做出技术上安全但在功能上不符合你特定需求的决策。
从大局来看,Anthropic 的这一举措预示了所有 AI 软件可能的发展方向。我们正在从作为双手延伸的工具转向作为意图延伸的工具。“你确定吗?”按钮的摩擦正在消失。取而代之的是一种建立在统计模型而非人类监督之上的新型数字信任。随着我们进入这个自主阶段,我们作为人类的价值将不再体现在点击按钮上,而更多地体现在设定目标上。
资料来源:



