4月24日,DeepSeek正式开源DeepSeek-V4系列预览模型,并同步推出V4-Flash正式版——一款在架构、成本与智能交付能力上实现三重突破的工业级大模型。该模型采用稀疏化MoE设计,总参数达2840亿,仅激活130亿参数,支持百万token上下文,兼具非思考与思考双推理模式;其单token计算量较V3.2降低73%,KV Cache占用压缩至约10%,显著优化长链路任务的显存与算力开销。相比主打性能上限的V4-Pro-Preview(已在Agentic Coding、数学与竞赛编程等高难度评测中跻身开源第一梯队,表现逼近Claude Opus 4.6非思考模式及GPT-5.4),Flash正式版通过深度后训练,在Agent原生能力上实现跃升:全面适配Claude Code、OpenClaw、OpenCode、CodeBuddy等主流智能体框架,并原生兼容OpenAI Responses API格式与Codex生态——开发者无需修改Base URL即可无缝切换。值得注意的是,在API价格持续下探(如GPT-5.6 Luna降价80%)的行业背景下,V4-Flash以更低调用成本交付更强Agent生产力,印证了‘低价不等于低能’的技术演进逻辑:当价格门槛不断消融,真正的竞争高地正转向可落地的智能体交付能力。
来源:智东西
