Anthropic Mythos:华尔街入局AI安全

· AIX Cove 出品 · AIX Cove 评测 · AI 编程与开发
Anthropic Mythos:华尔街入局AI安全

模型发布一周内演变为银行业务问题

Anthropic于2026年4月7日发布了Claude Mythos预览版,这次发布立即突破了常规AI新闻的圈子。这并非又一次基准测试的展示。据路透社和金融时报报道,美国财政部长斯科特·贝森特召集华尔街主要银行讨论Mythos的网络安全风险潜力,而英国监管机构则为银行、保险公司、市场运营商和交易所准备了简报。对于任何语言模型来说,这都是一条不寻常的发展路径。大多数模型首先出现在GitHub仓库或聊天应用中,然后逐渐进入开发者工具领域。Mythos却直接触及了财政部和中央银行。

时机很重要。TechCrunch在4月12日报道,杰罗姆·鲍威尔与贝森特共同敦促银行高管测试该模型用于防御工作。摩根大通出现在Anthropic的初始合作伙伴中,彭博社的报道还提到高盛、花旗集团、美国银行和摩根士丹利是额外的测试者。一个前沿模型在五天内从旧金山实验室进入与系统性重要银行的实时对话,直白地讲述了一个故事:AI安全已不再是仅限于实验室的话题。

为何Anthropic拒绝广泛公开发布

Anthropic确实发布了技术细节,但没有提供广泛访问权限。在4月7日的技术说明中,该公司表示Mythos发现的安全漏洞中,超过99%尚未修复,这就是为什么细节保持私密。该公司通过Project Glasswing项目提供访问权限,这是一个面向关键行业合作伙伴和开源开发者的有限计划。这一决定使Mythos同时成为两个故事:安全警告和销售策略。

Anthropic自己的例子难以忽视。该公司表示,在测试过程中,Mythos识别并利用了所有主要操作系统和所有主要网络浏览器中的零日漏洞。它还表示,迄今为止披露的最古老的已修复漏洞是OpenBSD中的一个27年缺陷。在一个例子中,Anthropic称该模型编写了一个浏览器漏洞利用程序,它链接了四个漏洞,逃逸了渲染器沙箱,然后也突破了操作系统沙箱。在另一个例子中,它描述了FreeBSD的NFS服务器上的远程代码执行漏洞,该漏洞可以为未经身份验证的用户提供完全的root访问权限。

这些解释说明了为什么政府会关注此事。它们也解释了为什么批评者认为其中有表演成分。

炒作背后的数据,以及批评者反对的原因

Anthropic在同一Firefox基准测试中比较了Mythos与Opus 4.6。据报道,Opus 4.6在数百次尝试中仅成功生成2个可用漏洞利用程序。Mythos则生成了181个可用漏洞利用程序,并额外29次实现寄存器控制。在Anthropic的类OSS-Fuzz内部测试中,该公司表示Sonnet 4.6和Opus 4.6各仅实现了一个三级崩溃,而Mythos在10个完全修补的目标上实现了完整的控制流劫持。这些具体数字是这则新闻在过去24小时占据头条的原因。

但反对声音迅速出现。Tom's Hardware指出,Anthropic关于"数千个"严重零日漏洞的头条声明基于198次人工审查。The Guardian援引AI Now Institute首席AI科学家Heidy Khlaaf的话称,该模型的能力未经"证实"。进攻性安全专家Jameison O'Reilly告诉该报,Mythos确实是一项重要发展,但也认为在许多实际入侵中,零日漏洞发现的重要性被高估了。他的观点很简单:在超过10年的授权访问工作中,真正需要零日漏洞的案例数量"微乎其微"。

这种分歧才是真正的新闻。Mythos在漏洞利用生成方面可能确实如Anthropic所说那样强大,但仍可能被过度宣传为通往即时网络灾难的地图。

这对开发者为何比对AI八卦爱好者更重要

关于Mythos故事的简单版本是"新模型发现漏洞"。更复杂的版本是这对使用C或C++编写代码的软件团队意味着什么,这些代码存在于浏览器、内核、网络堆栈和仍带有陈旧假设的基础设施中。Anthropic表示,Mythos发现的许多漏洞已有10至20年的历史。一个OpenBSD漏洞存在了27年。这应该让每一位工程经理感到担忧。

这就是类别从AI戏剧转向AI编码现实的地方。一个能够可靠地从源代码审查过渡到漏洞利用框架构建的模型改变了防御工作的经济性。安全团队可以在更短时间内搜索更多代码。小型开源维护者可能获得比他们能负担的咨询更强的分类帮助。丑陋的一面同样明显:一旦具有Mythos级能力的模型超出有限访问范围,修补窗口将缩小。一个曾经安静存在数月的漏洞可能在周末就被武器化。

到2026年底,大型软件供应商将像云服务提供商曾经宣传正常运行时间一样推广"AI辅助安全开发"。这个标签将不是可选的。在Anthropic将银行监管机构卷入这场辩论后,董事会将开始提出一个更尖锐的问题:哪些团队已经在发布流程中运行模型辅助的漏洞检测,哪些团队仍在手动进行安全审查。

Anthropic的信誉问题并未消失

Anthropic希望公众看到的是克制,批评者看到的却是包装。该公司在4月初意外泄露了Claude的部分内部源代码,随后又花了一周时间辩称Mythos应该保持严格控制,因为它发现危险漏洞的能力太强。这一系列事件给了怀疑者一个他们绝不会错过的机会。

加里·马库斯在《卫报》中直言不讳地说:"Dario的技术能力远超Sam,但似乎毕业于同一所夸大和炒作的学校。"另一位匿名的科技公关人士告诉该报:"任何其他大型科技公司都会被嘲笑。"这些话之所以引起共鸣,是因为它们触及了AI领域现有的焦虑:现在每个实验室都在同时谈论安全性和能力,而外界已经学会去思考这句话中哪一部分更重要。

尽管如此,银行业的反应表明这并非空穴来风。政府不会仅仅因为一个巧妙的产品发布会就召集主要贷款机构。路透社报道称,英国金融机构正在准备在两周内听取有关风险的简报。如果报道属实,贝森特在华盛顿的会议意味着官员们认为该模型值得立即关注,即使在大规模推出之前也是如此。

接下来要关注什么

两个日期已经很重要。4月7日是Mythos Preview和Project Glasswing的发布日期。4月12日带来了路透社和《金融时报》关于美国和英国金融官员对该模型反应的报道。下一个日期是Anthropic尚未公布的日期:更广泛访问到来的时刻,或者公司决定更广泛的访问风险太大而无法证明其合理性。

如果Anthropic将Mythos限制在狭小的合作伙伴圈内数月,竞争对手将嗅到机会,推出"足够安全"但限制更少的网络安全模型。如果Anthropic很快开放访问,可以预见漏洞赏金计划、浏览器团队、Linux发行版和企业安全供应商之间将出现激烈竞争。无论如何,AI研究与生产安全工作之间的传统界限已经显得过时。Mythos不仅引发了关于模型能力的又一次辩论,它还迫使监管机构、银行和开发者同时面对相同的威胁模型。

如需逐工具对比,可查看AI编程工具清单与对比评测栏目。

来源:官方文档与定价页、标注的实测,以及社区反馈。价格核对于 2026 年 8 月,可能变动。