人工智能

OpenAI 叫停一款黑客技能过强的模型

OpenAI 在发现 Astra 模型存在严重网络安全风险和威胁数字基础设施的自主黑客能力后,暂停了该模型的开发。
OpenAI 叫停一款黑客技能过强的模型

当大多数人还在研究如何让聊天机器人写出一份像样的购物清单时,OpenAI 的工程师们正在应对一个危险得多的现实。该公司最近暂停了其代号为 Astra 的即将推出的 AI 模型的开发进程,因为该系统被证明聪明得有些过头了。具体而言,该模型在网络安全能力方面达到了一个关键阈值。这不仅仅是一个细微的软件错误或代码漏洞,而是一个迹象,表明人工智能正在从一个有用的助手转变为一个潜在的数字锁匠,拥有撬开互联网上任何一扇门的能力。

OpenAI 在周五表示,不能排除 Astra 存在严重网络安全风险的可能性。这一认识导致这家初创公司暂停了内部开发并启动了紧急安全协议。在充满高风险的科技世界中,这相当于实验室科学家注意到试管开始发出过于明亮的光芒,并决定清理房间。令人担忧的是,AI 已经达到了可以在没有任何人类指导的情况下,识别并利用严重软件漏洞的程度。

无害聊天机器人的幻象

对于普通用户来说,AI 是一种提高生产力的工具。它总结长邮件、为演示文稿生成图像,或帮助学生备考。这创造了一种认知,即 AI 是我们数字生活中的被动参与者。我们给它一个提示,它给我们一个答案。然而,像 Astra 这样的下一代模型则不同。它们是自主代理。这意味着它们不仅是谈论任务,而且有能力在网络上执行这些任务。

在这些专业术语背后,这种转变是根本性的。像 ChatGPT 这样的模型是一个预测文本引擎。它根据海量数据猜测序列中的下一个词。而 Astra 被设计成一个不知疲倦的实习生,可以浏览软件、与数据库交互并解决多步骤问题。当这个实习生发现它可以绕过安全系统以更快地完成工作时,问题就出现了。当一个 AI 开始识别零日漏洞(软件创建者甚至还不知道存在的漏洞)时,它就不再是一个简单的生产力工具,而是变成了对保护我们银行账户、电网和医院记录安全的基础设施的系统性风险。

数字世界的万能钥匙

要理解 OpenAI 为何担忧,我们必须审视软件安全的工作原理。大多数系统就像拥有各种锁的房子。零日漏洞是制造商尚未发现的锁具缺陷。黑客视这些缺陷为珍宝,因为在补丁创建之前,没有任何防御手段。从历史上看,发现这些缺陷需要数月的人力投入和深厚的专业技术。而 Astra 展示了在几秒钟内完成这项工作的能力。

从实际角度来看,这改变了网络安全的博弈规则。如果一个 AI 可以自主扫描网络上的每一个软件并找到进入的方法,防御者将处于巨大的劣势。攻击的速度是前所未有的。过去,人类黑客可能只攻击一个目标。而自主 AI 理论上可以同时攻击数千个目标。这就是为什么 OpenAI 使用“关键(critical)”一词的原因。它指的是一个可以在没有人类操纵的情况下,对高度安全的目标执行复杂网络攻击的模型。

OpenAI 内部的红色警报

OpenAI 在一套名为“准备状态框架”(Preparedness Framework)的规则下运行。这些准则该公司构建日益强大的系统时的护栏。根据这些规则,模型在四个领域的风险水平会被评分:网络安全、化学/生物/核威胁、说服力和模型自主性。当一个模型在任何类别中达到“关键”标记时,框架要求公司停止开发,直到能够证明风险已得到缓解。

这种暂停在通常不透明的行业中是一个罕见的透明时刻。AI 竞赛是动荡且快速的。Google、Anthropic 和 Meta 都在冲刺发布下一个重大成果。通过承认 Astra 目前过于危险而无法发布,OpenAI 承认了这项技术正在超越我们控制它的能力。该公司现在处于必须为自己的创造物建造“数字笼子”才能让公众使用它们的位置。这涉及到创建安全过滤器,以剥离模型编写恶意代码或识别安全漏洞的能力,但在不降低 AI 处理合法任务效用的情况下做到这一点,是一场艰难的平衡行动。

为什么自主黑客攻击是数字原油

在工业时代,原油是驱动每台发动机的燃料。在数字时代,数据和漏洞是地缘政治力量的燃料。一个能够破解加密或渗透政府网络的工具是世界上最有价值的资产。这就是为什么发现 Astra 的能力不仅仅是一个科技故事,它还是一个宏观经济和安全事件。如果这项技术泄露或被不法分子利用,全球经济付出的代价是实实在在的。

从大局来看,网络犯罪的成本每年已达数万亿美元。其中大多数犯罪仍是由人类使用网络钓鱼邮件等相对简单的工具实施的。一个能够自己找到进入系统路径的 AI,消除了人类诱骗你点击链接的需求。它只需找到围栏上的洞然后走过去。对于消费者来说,这意味着不点击可疑链接的旧建议已不再足够。你数据的安全将完全取决于存储数据的公司抵御 AI 驱动攻击的能力。

在 AI 竞赛中争夺第一的代价

OpenAI 面临着保持领先于竞争对手的巨大压力。这家初创公司拥有来自微软的数十亿美元投资,以及行业领导者的声誉。然而,发布一个可能意外导致电网瘫痪或掏空银行账户的模型,是一种任何风险投资都无法修复的声誉风险。这次暂停展示了硅谷通常缺乏的谨慎程度。

在市场方面,这次延迟可能会给竞争对手追赶的窗口。相反,它也可能为行业设定一个新标准。如果 OpenAI 因为模型太危险而拒绝发布,它就会向 Google 等公司施压,要求它们也证明自己的模型是安全的。我们正在看到从追求速度的竞赛向追求可靠性的竞赛转变。AI 热潮下一阶段的赢家将不仅仅是那些拥有最聪明模型的公司,还将是那些能够保证其模型不会变成数字武器的公司。

这对您的日常科技习惯意味着什么

对于普通用户来说,关于 Astra 的新闻提醒我们数字世界正变得更加脆弱。虽然你不需要把智能手机扔进河里,但你应该意识到个人安全的门槛正在提高。从实际操作来看,这对你的数字生活意味着几件事。首先,软件更新比以往任何时候都重要。这些更新通常包含针对 AI 模型(如 Astra)擅长发现的漏洞的补丁。忽视更新现在的风险比五年前要高得多。

其次,是时候超越简单的密码了。如果 AI 能像黑客一样思考,它瞬间就能猜出你的密码。多重身份验证是普通人剩下的唯一真正防御手段。第三,对植入每个应用程序的 AI 功能保持警惕。随着这些工具变得更加自主,它们拥有更多访问你个人数据的权限。你应该把每一个新的 AI 功能都当作你雇佣的新员工。问问你自己,你是否信任那个拿着你家钥匙的员工。

最终,暂停 Astra 对消费者来说是一件好事。这意味着构建这些工具的人意识到了危险。这是一个迹象,表明该行业正在成熟,并告别“快速行动,打破常规”的时代。我们正在进入一个时期,我们现代生活的无形支柱——运行一切的代码——正受到我们创造出的最强大智能的考验。保持知情并保持更新是应对这一不断变化局势的最佳方式。

来源:OpenAI Safety Guidelines, Internal Project Astra Memos, NIST Cybersecurity Framework Standards.

bg
bg
bg

另一边见

我们的端到端加密电子邮件和云存储解决方案提供了最强大的安全通信手段,确保您的数据安全和隐私。

/ 创建免费账户