DeepSeek V4全面采用华为芯片:全球AI转折点
2026年4月6日 — 路透社4月4日确认,DeepSeek即将推出的V4模型将完全运行在华为Ascend 950PR芯片上,这可能是今年最具影响力的AI硬件消息——首次有前沿规模的AI模型在不依赖NVIDIA GPU的情况下,基于中国半导体基础设施构建。
为什么重要
目前所有主流前沿模型——GPT-5、Claude、Gemini——都运行在NVIDIA硬件上。DeepSeek V4打破了这种依赖。如果该模型达到报道中的基准测试成绩,将证明中国制造的芯片能够支撑尖端AI,直接挑战美国对先进半导体出口管制背后的假设。
据路透社报道,包括阿里巴巴、字节跳动和腾讯在内的中国科技巨头已批量订购数十万颗华为Ascend芯片,为V4的发布做准备。仅这一需求就推动芯片价格在近几周上涨20%。
关于DeepSeek V4的已知信息
DeepSeek V4是一个混合专家(MoE)模型,总参数约1万亿,每个token激活约370亿参数。目前报道的关键规格:
- 架构:MoE,约1T参数,每个token激活约37B
- 上下文窗口:100万token
- 模态:原生文本、图像和视频生成
- 硬件:华为Ascend 950PR + 寒武纪芯片
- 许可证:预计开源(MIT或Apache 2.0)
- 训练成本:报道约为520万美元
- 定价:预计约$0.28/百万输入token——约为Claude Opus定价的1/50
一个更轻量的变体V4-Lite已在API节点上被发现进行实时测试,开发者报告推理速度提升30%,上下文召回率大幅提高(128K token时达94%,而V3为45%)。
芯片故事:超越模型本身
据报道,DeepSeek拒绝让NVIDIA提前接触V4,同时给予中国芯片制造商独家集成窗口。该公司花了数月时间重写核心代码,以适配华为的CANN架构,而非NVIDIA的CUDA生态系统。
这带来三个主要影响:
- 非NVIDIA前沿AI的证明。如果V4表现具有竞争力,将表明美国芯片制裁并未阻止中国在国产硬件上构建最先进的模型。
- AI经济格局的转变。华为芯片大规模应用可能推动整个行业的API价格下降。DeepSeek泄露的V4定价(约每百万输入token 0.28美元)将使其成为价格低一个数量级的前沿模型。
- 生态系统碎片化。一个成功的非CUDA AI技术栈可能鼓励其他国家和企业探索NVIDIA主导供应链之外的替代方案。
预计发布时间
DeepSeek V4已两次延期——最初计划在2月中旬,然后是3月。路透社和The Information的最新报道指向2026年4月底发布。该模型目前处于最后的“压力测试”阶段。
考虑到地缘政治时机——特朗普与习近平会晤在即——一些分析师猜测,发布时机可能意在展示中国AI的同等水平,作为芯片出口管制谈判的筹码。
这对AI工具用户意味着什么
对于使用AI工具的开发者和企业来说,DeepSeek V4仅凭价格就可能改变游戏规则。如果该模型以1/50的成本提供接近Claude-Opus的质量,将大幅降低AI驱动应用的门槛——从内容生成到代码辅助再到数据分析。
开源发布(如果确认)还将支持本地部署,让组织完全掌控自己的AI基础设施,无需受制于供应商锁定。
随着发布临近,我们将密切关注。V4发布后,请回来查看更新的基准测试和实际测试结果。
来源:路透社、The Information、FindSkill.ai、华为中央、TechWire Asia