DeepSeek 正式发布并开源 V4 系列模型,包括 671B 总参数的旗舰版与激活参数仅 14B 的轻量版。V4 在中文理解、数学推理与代码生成的开源评测中均登顶,部分基准追平了闭源旗舰。
架构与成本
V4 延续并强化了稀疏混合专家(MoE)路线,配合全新的负载均衡策略,将训练成本控制在同性能闭源模型的十分之一左右。官方技术报告罕见地公开了大部分训练细节,包括 RL 阶段的奖励设计。
生态影响
- 多家云厂商在发布数小时内宣布上架 V4 API,价格战一触即发。
- 开源社区已开始出现基于 V4 蒸馏的小型模型,进一步降低落地门槛。
- 有分析认为,V4 将加速企业侧模型选型向国产开源阵营倾斜。
DeepSeek 的每一次开源都在重新定义”够用”的门槛,这一次也不例外。