DeepMind组建突击团队应对Anthropic编程智能体挑战
谷歌紧急编程团队罕见承认:Anthropic领先一步
谷歌通常不会公开示弱,哪怕只是暗示。正因如此,周一关于DeepMind“突击队”的报道才格外引人注目。据The Information报道,The Verge、Sherwood和Capital Brief也相继跟进,谷歌DeepMind在认定Anthropic的工具更胜一筹后,组建了一支特别团队来修复Gemini的编程短板。这不是普通的企业内部调整,而是一枚信号弹。
核心细节来自一份据称由谷歌联合创始人谢尔盖·布林撰写的备忘录。布林在备忘录中写道,“每位Gemini工程师都必须使用内部代理来处理复杂、多步骤的任务。”Sherwood引用的另一句话更加直白:“要赢得最后的冲刺,我们必须紧急弥合代理执行方面的差距,把我们的模型变成主要开发者。”公司在精心包装的主题演讲里会说很多漂亮话,内部备忘录往往更能说明问题。
为什么这条消息现在重要
时机很关键。这些报道发布于2026年4月20日,指向谷歌内部的一次急剧转向。过去一年,公众眼中的AI竞赛常常围绕聊天机器人、搜索和多模态演示展开。这条消息穿透了那些噪音。真正的较量可能已经变成:哪家公司能造出处理冗长、混乱的软件工程任务的编程代理,而不是在项目进行到一半就崩掉。
Capital Brief报道称,新的DeepMind团队专注于“长期编程任务”,这类任务要求模型阅读文件、跟踪意图、在代码库中做出有效修改。这比在基准测试里写一个漂亮的函数难得多。如果一家公司想让AI在大型软件组织里承担真正的工程工作,这才是需要解决的问题。
真正引人注目的是竞争目标。这次并非针对OpenAI,而是Anthropic。据报道,DeepMind的研究人员认为Anthropic的编程工具优于Gemini。这很能说明重心已经转移到哪里。Anthropic曾被视为谨慎的实验室,拥有强烈的安全意识和优秀的语言模型。到了2026年,它正迫使谷歌围绕代码进行重组。
Anthropic的领先优势每周都显得更非偶然
这种解读与过去几个月的其他信号相符。Anthropic一直在大力推广Claude Code,并且毫不避讳在内部使用自家工具。Capital Brief指出,Claude Code负责人Boris Cherny在1月表示,Anthropic“几乎100%”的代码是由AI编写的。这个数字听起来高得近乎挑衅,但它同时完成两件事:既推销了产品,又告诉竞争对手,Anthropic将编程代理视为基础设施,而非副业。
谷歌也在朝同一方向前进,只是势头稍弱。同一份报告显示,谷歌首席财务官Anat Ashkenazi在2月表示,公司约50%的代码由编程代理编写。一年前,50%这个数字听起来会令人震惊。如今,它更像是一个信号:谷歌知道前进方向,但尚未掌控节奏。
差距不仅在于模型质量,还在于工作流程。据报道,Brin指示工程师“必须被强制”使用内部代理,这很能说明问题,因为强制采用通常是管理层在工具具有战略重要性但尚未成为习惯时的做法。说白了,谷歌似乎相信,更好的代理来自大量内部使用、更多与真实工程任务相关的训练数据,以及产品团队与模型研究人员之间更紧密的循环。
参与人员本身就能说明问题
突击队成员的名字很重要。Capital Brief称,谷歌首席技术官Koray Kavukcuoglu直接参与其中。报告还指出,这项工作的负责人是DeepMind研究工程师Sebastian Borgeaud,他此前负责预训练工作。这些都不是小任命。当一家公司为特殊项目调集高级技术领导层时,通常意味着常规路线图推进得不够快。
还有一个细节值得更多关注。The Information通过Capital Brief报道称,谷歌正更加重视基于内部公司代码训练的模型。这些模型不能直接向公众发布,因为数据过于敏感。不过,这项工作可以改进后续的公开模型。这是前沿AI领域现在常见的模式:最有用的系统可能先出现在大公司内部,外界看到净化版本之前。
这不仅仅是功能竞赛
表面上看,谷歌想要一个比Claude Code更好的答案。这没错,但格局太小。更大的问题是,编码代理是否会成为自我改进AI系统的训练场。The Verge指出,布林认为在编码方面追赶Anthropic,是朝着构建能自我改进的AI迈出的一步。这句话比备忘录风波本身更重要。
如果最强的模型能阅读代码库、写补丁、跑测试、理解失败,并在下一轮调整,它们就不再像带自动补全的聊天界面。它们开始像不睡觉的初级开发者,然后像比那更强大的东西。作者怀疑这就是谷歌回应异常紧迫的原因。搜索很重要。聊天很重要。但编码代理可能决定谁能最快构建AI的下一层。
对谷歌来说,还有一种不那么好听的说法。公司拥有世界级的研究人才、庞大的计算资源,以及地球上最深厚的软件生态系统之一。如果2026年4月还需要一支突击队,因为Anthropic在编码代理上领先,那说明结构在碍事。初创公司能专注。巨头常常要协调。在AI领域,协调可能是种税。
接下来看什么
未来几个月应该回答两个具体问题。第一,谷歌能否把这次内部冲刺转化为Gemini编码性能的明显提升,尤其是在跨多个文件的长周期任务上?第二,Anthropic能否通过把内部使用转化为更快的产品改进,继续拉大差距?
底线是:过去24小时里最能说明问题的AI新闻,不是某个高调发布。而是谷歌,通过泄露的报道和一份异常尖锐的备忘录,实际上承认了Anthropic目前在编程代理方面占据上风。当谷歌这样体量的公司开始围绕对手的优势重新调整高层人才时,市场就该留意了。DeepMind内部的悄然慌乱,并不能证明Anthropic赢了这十年。它证明的是,这场竞赛进入了新阶段,而代码是压力最先显现的地方。