4月24日,中国人工智能公司DeepSeek发布了V4,这是其期待已久的新旗舰模型,说实话,这确实是个大事——即使它不会像前代R1那样震撼AI界。V4凭借巧妙的新设计,可以处理更长的提示,它是开源的(所以任何人都可以下载、使用和修改),而且它引起轰动的原因不仅仅是基准测试。

首先,价格。DeepSeek声称V4的性能可与最优秀的模型媲美,但成本却只是零头,这对那些不想为了支付AI费用而抵押初创公司的开发者来说是个好消息。V4有两个版本:V4-Pro,一个更强大的模型,用于编码和复杂任务;V4-Flash,一个更小、更快的版本。两者都有推理模式,让模型展示其工作过程,就像一个真正关心的数学老师。价格?V4-Pro每百万输入令牌收费1.74美元,每百万输出令牌收费3.48美元——与OpenAI和Anthropic相比简直是九牛一毛。V4-Flash更便宜,每百万输入令牌约0.14美元,每百万输出令牌约0.28美元,使其成为最便宜的顶级模型之一。这样的价格点让你想仅仅因为可以就构建一个应用。

性能方面,V4相比R1是一个巨大的飞跃,这就像发现水是湿的一样不令人惊讶。在主要基准测试中,V4-Pro与Anthropic的Claude-Opus-4.6、OpenAI的GPT-5.4和Google的Gemini-3.1相当,并且在编码、数学和STEM问题上击败了阿里巴巴的Qwen-3.5和Z.ai的GLM-5.1等开源竞争对手。它在智能体编码任务和多步骤问题解决方面也表现出色。DeepSeek对85名开发者的内部调查?超过90%的人将V4-Pro列为编码首选。对于智能体人群,V4针对Claude Code、OpenClaw和CodeBuddy等框架进行了优化——因为谁不希望自己的AI有个搭档呢?

现在,长上下文的事情。两个V4版本都能处理100万令牌——足以容纳《指环王》三部曲和《霍比特人》的全部内容。那是很多霍比特人。但真正的创新在于DeepSeek如何做到的:他们调整了注意力机制,使其更具选择性,压缩旧信息并专注于当前重要的内容。与之前的V3.2模型相比,在100万令牌上下文中,这将计算能力降至27%,内存降至10%(V4-Flash仅使用10%的计算和7%的内存)。这意味着你可以构建一个AI编码助手,读取你的整个代码库,而不会忘记五分钟前读过的内容。

然后是地缘政治。V4是DeepSeek首个针对中国国产芯片优化的模型,特别是华为的昇腾。这很重要,因为这是对中国能否摆脱英伟达的考验。美国出口管制切断了中国公司获得英伟达最佳芯片的途径,因此北京正在推动本土AI堆栈。据报道,DeepSeek只向中国芯片制造商提供了早期访问权限,华为上周五宣布其昇腾950超级节点将支持V4。但让我们不要得意忘形:DeepSeek的技术报告表明,他们使用中国芯片进行推理,但训练可能仍依赖英伟达。清华大学教授刘志远告诉《麻省理工科技评论》,V4的训练只有部分适配了中国芯片,多位匿名消息人士表示,中国芯片更适合推理而非训练。尽管如此,DeepSeek表示,一旦华为昇腾950超级节点在今年下半年大规模出货,V4-Pro的价格可能会大幅下降。

那么,V4会像R1一样引起轰动吗?可能不会,但它表明中国正在构建一个并行的AI基础设施——而且价格会让你大跌眼镜。