4月24日,中国AI公司DeepSeek发布了V4,其期待已久的新旗舰模型,说实话,这确实是个大新闻——即使它不会像前代R1那样撼动AI世界。V4凭借巧妙的新设计,能够处理更长的提示,它是开源的(所以任何人都可以下载、使用和修改),而且它引发关注的原因不仅仅是基准测试。

首先,价格。DeepSeek声称V4的性能媲美最优秀的模型,但成本只是其一小部分,这对那些不想为了支付AI费用而抵押初创公司的开发者来说是个好消息。V4有两个版本:V4-Pro,一个更强大的模型,用于编码和复杂任务;V4-Flash,一个更小、更快的版本。两者都有推理模式,让模型展示其思考过程,就像一个真正关心学生的数学老师。价格?V4-Pro每百万输入token收费1.74美元,每百万输出token收费3.48美元——与OpenAI和Anthropic相比简直是九牛一毛。V4-Flash更便宜,每百万输入token约0.14美元,每百万输出token约0.28美元,使其成为最便宜的顶级模型之一。这样的价格点让你想仅仅因为能而构建一个应用。

性能方面,V4相比R1是巨大的飞跃,这就像发现水是湿的一样不令人惊讶。在主要基准测试中,V4-Pro与Anthropic的Claude-Opus-4.6、OpenAI的GPT-5.4和Google的Gemini-3.1匹敌,并在编码、数学和STEM问题上击败了阿里巴巴的Qwen-3.5和Z.ai的GLM-5.1等开源竞争对手。它还在代理式编码任务和多步骤问题解决方面表现出色。DeepSeek对85名开发者的内部调查?超过90%的人将V4-Pro列为编码首选。对于代理式人群,V4针对Claude Code、OpenClaw和CodeBuddy等框架进行了优化——因为谁不希望自己的AI有个搭档呢?

现在,长上下文。两个V4版本都能处理100万token——足以容纳《指环王》三部曲和《霍比特人》的全部内容。那是很多霍比特人。但真正的创新在于DeepSeek的实现方式:他们调整了注意力机制,使其更具选择性,压缩旧信息并专注于当前重要的内容。与之前的V3.2相比,在100万token上下文中,计算能力降至27%,内存降至10%(V4-Flash仅使用10%的计算和7%的内存)。这意味着你可以构建一个AI编码助手,读取你的整个代码库,而不会忘记五分钟前读过的内容。

然后是地缘政治。V4是DeepSeek首个针对中国国产芯片优化的模型,特别是华为的昇腾。这很重要,因为这是对中国能否摆脱对Nvidia依赖的考验。美国出口管制切断了中国公司获得Nvidia最佳芯片的途径,因此北京正推动本土AI堆栈。据报道,DeepSeek仅向中国芯片制造商提供了早期访问权限,华为上周五宣布其昇腾950超级节点将支持V4。但别高兴得太早:DeepSeek的技术报告表明他们使用中国芯片进行推理,但训练可能仍依赖Nvidia。清华教授刘知远告诉《麻省理工科技评论》,V4的训练仅部分适配了中国芯片,多位匿名消息人士称,中国芯片更适合推理而非训练。尽管如此,DeepSeek表示,一旦华为昇腾950超级节点在今年下半年大规模出货,V4-Pro的价格可能会大幅下降。

那么,V4会像R1一样引起轰动吗?可能不会,但它表明中国正在构建一个并行的AI基础设施——而且价格会让你大跌眼镜。