Anthropic AI发现人类无法发现的程序漏洞
Anthropic开发AI发现人类无法发现的漏洞,两国政府紧急行动
4月7日,Anthropic宣布了Project Glasswing项目,这是一个基于尚未发布的Claude Mythos Preview模型的受限访问计划。该模型已在所有主要操作系统和网络浏览器中发现了数千个零日漏洞。其中一些漏洞未被注意到已有数十年之久。最受关注的是OpenBSD中一个存在27年的漏洞,这是一个被信任用来保护防火墙和关键基础设施的操作系统。攻击者只需连接就能远程崩溃任何运行该系统的机器。修复程序现已上线。发现过程?完全自主,零人工干预。
还有FFmpeg中一个16年的漏洞,FFmpeg是几乎无处不在的视频编码库。自动化测试工具已经精确执行了那行代码五百万次。他们一次都没有发现它。Mythos Preview发现了。还有Linux内核链:该模型发现了几个独立的漏洞并将它们链接在一起,自主地从普通用户权限提升到完全机器控制权限。
为什么Anthropic拒绝发布它
故事在这里变得不寻常。Anthropic明确表示不会公开发布Mythos Preview。负责Anthropic前沿红队网络业务的Newton Cheng告诉VentureBeat:"我们不打算公开发布Claude Mythos Preview,因为它的网络安全能力。然而,鉴于AI的发展速度,这种能力不会很快扩散,可能会超出那些承诺安全部署它们的行动者。对经济、公共安全和国家安全的影响可能是严重的。"
再读一遍。构建该模型的公司表示它太危险而无法发布。但他们也表示,其他人构建等效产品只是时间问题。所以策略是:让防御者获得先机。现在限制访问,因为替代方案——等待坏人先赶上——更糟。
谁可以获得访问权限
玻璃之翼联盟汇集了关键基础设施领域的知名企业:Amazon Web Services、Apple、Broadcom、Cisco、CrowdStrike、Google、JPMorganChase、Linux基金会、Microsoft、Nvidia和Palo Alto Networks。十二家创始合作伙伴,加上四十多家构建或维护关键软件的额外组织。Anthropic为此投入高达1亿美元的信用额度,并向开源安全组织提供400万美元的直接捐赠。
理念很简单:让这些组织在拥有类似AI工具的恶意行为者利用之前,找到并修复基础系统中的漏洞。Anthropic还发布未修补漏洞详情的加密哈希值,计划仅在修复完成后才公布具体细节。这是一个负责任的披露流程,但规模前所未有。
美英监管机构回应
4月11日,路透社报道,美国财政部长斯科特·贝森特召集华尔街主要银行会议,讨论Mythos Preview的网络风险潜力。两天后,《金融时报》报道称,英格兰银行、金融行为监管局和HM财政部正与国家网络安全中心举行紧急会谈。预计在未来两周内,主要英国银行、保险公司和交易所的代表将在监管会议上得到简报。
两个政府,两种不同的监管回应,同一周内。担忧并非空穴来风。如果Mythos Preview能够自主链接Linux内核漏洞,整个金融行业的威胁模型将发生转变。银行运行的系统从未被设计用来抵御这种自动化攻击能力。监管机构清楚这一点。
收入、势头与大型计算交易
玻璃之翼项目并非凭空出现。Anthropic还披露,其年收入年化运行率已超过300亿美元,相比2025年底的约90亿美元大幅增长。年度支出超过100万美元的企业客户数量在不到两个月内翻了一番,现已超过1000家。公司同时宣布与Google和Broadcom建立多千兆瓦计算合作伙伴关系。彭博社报道称,Anthropic挖来了微软高级高管埃里克·博伊德,领导其基础设施建设。
这就是商业背景:一家以超常速度增长的公司,锁定计算资源供应,同时决定将其最强大的能力锁定而非变现。
令人不安的问题
目前还没有人能给出好的答案。Anthropic赌的是,通过控制性的防御性发布,能为世界争取足够时间来强化系统,直到同等能力模型被对手获取。也许这是真的。也许他们争取的是几个月,而不是几年。公司自己的话——"这样的能力不会很快普及"——表明他们知道时间窗口很窄。
向Glasswing承诺的1亿美元是真金白银,合作伙伴名单也令人印象深刻。但根本的紧张关系并未解决。你不能把能力放回盒子里。你只能希望好人修补漏洞的速度比坏人利用的速度更快。第一次,一家AI公司明确承认,其某个模型已经跨越了防御-进攻平衡的临界点。这种承认本身可能是这个故事最重要的部分。