Anthropic黑客AI模型不公开原因深度解析

· AIX Cove 出品 · AIX Cove 评测 · AI 编程与开发
Anthropic黑客AI模型不公开原因深度解析

Anthropic黑客AI模型:强大到不敢公开发布

4月7日,Anthropic宣布了一款名为Mythos的新AI模型。两周后,该公司CEO坐在白宫,与白宫幕僚长讨论如何处理这款模型。从产品发布到总统会议,短短14天内完成这一轨迹,告诉你2026年AI能力已经达到了什么程度。

Anthropic将Mythos描述为"异常强大"。对于一个以安全优先AI建立品牌的公司来说,这不是典型的营销语言。该模型能够比人类网络安全专家更快地发现和利用软件漏洞。这一说法上了头条,但实际情况比标题所暗示的要复杂。

Mythos的实际功能

当前版本称为Mythos Preview,它不仅能发现漏洞,还能将多个漏洞串联起来创建完整的漏洞利用程序。Anthropic联合创始人兼政策主管Jack Clark在Semafor世界经济会议上描述了这一点:"我们将其发布给世界上一些最重要的公司和组织的子集,以便他们可以利用它来发现漏洞。"

该公司已限制访问权限,仅限选定客户使用。这并非因为供应限制或分阶段发布策略,而是因为该模型在错误的手中确实危险。英国AI安全研究所评估了Mythos,称其比之前的模型"更进一步",而之前的模型已经快速改进。他们的报告指出,"Mythos Preview可以利用安全薄弱的系统"。这是一种委婉的说法,意思是它可以攻入防御薄弱的网络。

Anthropic还与该模型一起启动了一个名为Project Glasswing的项目。该倡议汇集了亚马逊、苹果、谷歌、微软和摩根大通,以保护关键软件免受Mythos可能启发的这类攻击的威胁。当一家公司开发了一个工具,并立即组建一个防御联盟来对抗它时,这要么是负责任的行为,要么是非常复杂的表演。也许两者兼而有之。

白宫会议

4月17日周五,Anthropic首席执行官Dario Amodei与白宫办公厅主任Susie Wiles会面。政府称这次会面"富有成效且具有建设性"。Anthropic表示双方讨论了"网络安全、美国在AI竞赛中的领先地位以及AI安全"问题。

背景使这次会面比标准的技术高管访问更有趣。特朗普总统曾在2月试图禁止所有联邦机构使用Anthropic的Claude聊天机器人,在社交媒体上发帖称政府"不会再与他们做生意!"国防部长Pete Hegseth试图将Anthropic列为供应链风险,这是针对美国科技公司前所未有的举动。Anthropic在联邦法院挑战了这两项行动。法官Rita Lin在3月阻止了特朗普指令的执行。

摩擦始于Anthropic希望限制五角大楼如何使用其技术。该公司拒绝允许在全自动武器或国内监控中使用其技术。Hegseth的立场是,Anthropic必须允许国防部认为合法的任何用途。当被问及周五的白宫会议时,特朗普表示他"不知道"会议正在举行。

因此,试图将Anthropic列入黑名单的同一政府现在正与其首席执行官会面,讨论可能改变国家安全模式的合作。当利害关系变得真实时,华盛顿行动迅速。

威胁是真实的吗?

David Sacks,白宫前AI和加密货币负责人,一直是Anthropic最强烈的批评者之一。他公开质疑该公司是否为战略优势而夸大风险。但在他的"All-In"播客中,Sacks对Mythos采取了不同的语气。

"每当Anthropic吓唬人们时,你必须问,'这是一种策略吗?这是他们杞人忧天的例行公事的一部分吗?还是真实的?'Sacks说。"在网络方面,我实际上会在这个案例中给他们肯定,说这更偏向于真实的一面。"

他的推理很简单。编码模型在理解软件方面不断进步。更好的理解意味着更好的错误发现。更好的错误发现意味着更好的漏洞创建。这种能力从技术发展轨迹来看是合乎逻辑的。

斯坦福AI指数报告在同一周发布,证实了这一点。在SWE-bench编程基准测试中,模型性能在一年内从60%跃升至近100%。如果编程能力提升如此之快,那么进攻性安全应用也在同步增长。Mythos并非特例,而是当前趋势的必然结果。

中国时钟

克拉克在Semafor会议上发表的观点值得更多关注。"几个月内,其他公司也会推出类似的系统,"他说,"一年到一年半后,中国将推出具备这些能力的开源模型。"

数学计算很直接。Anthropic可以限制对其模型的访问,美国公司可以构建防御措施。但技术能力本身并非秘密,底层技术可复制。一旦中国实验室推出开源版本,任何拥有GPU集群的人都可以下载和部署它们,无需许可。斯坦福报告显示,美中模型之间的性能差距已缩小至2.7%。去年,中国申请了全球69.7%的AI专利。

这才是白宫会议背后的真正压力所在。问题不在于Anthropic和特朗普政府能否修复关系,而在于美国政府能否在对手将这些模型用于攻击性用途之前,想出如何防御性地使用这些模型。克拉克描述的时间线——竞争对手需要几个月,开源版本大约需要18个月——给政策制定者留下了极小的操作空间。

接下来会发生什么

据欧盟委员会发言人托马斯·雷格尼(Thomas Regnier)表示,Anthropic正与欧盟就Mythos和其他未发布模型进行谈判。欧盟《人工智能法案》已于2026年1月全面实施,而Mythos恰好处于监管机构最为关注的高风险类别中。

回到华盛顿,政府表示任何联邦政府使用的新技术都将经历技术评估期。评估需要多长时间,以及是否会比克拉克描述的开源时间线更快,仍是个未知数。

目前已有47个国家制定了积极的AI立法,但只有12个国家拥有执法机制。与AI部署的速度相比,监管基础设施仍然薄弱。Anthropic公司试图通过限制访问和构建Project Glasswing项目来制定自己的规则。一家曾被总统列入黑名单的公司,其自我监管能否作为长期策略坚持下去,坦率地说,前景并不确定。

Mythos情况并非仅仅关乎某家公司的某个模型。它关乎的是当AI能力跨越某个门槛时会发生什么——在这个门槛上,防御性应用和攻击性应用成为同一种能力,只是指向不同方向。构建这些模型的公司清楚这一点。急于应对的政府也清楚这一点。而开放权重替代方案的倒计时已经开始。

如需逐工具对比,可查看AI编程工具清单与对比评测栏目。

来源:官方文档与定价页、标注的实测,以及社区反馈。价格核对于 2026 年 8 月,可能变动。