DeepSeek-V4-Flash正式发布:284B MoE架构模型以13B激活量重塑Agent效能标杆

DeepSeek发布V4-Flash正式版:284B MoE模型仅激活13B参数,支持百万上下文与双推理模式,在Agent能力、长文本效率与生态兼容性上全面超越此前V4-Pro预览版,以低成本实现高质智能体交付,重新定义国产大模型效能新基准。

4月24日,DeepSeek正式开源DeepSeek-V4系列预览模型,并同步推出V4-Flash正式版——一款在架构、成本与智能交付能力上实现三重突破的工业级大模型。该模型采用稀疏化MoE设计,总参数达2840亿,仅激活130亿参数,支持百万token上下文,兼具非思考与思考双推理模式;其单token计算量较V3.2降低73%,KV Cache占用压缩至约10%,显著优化长链路任务的显存与算力开销。相比主打性能上限的V4-Pro-Preview(已在Agentic Coding、数学与竞赛编程等高难度评测中跻身开源第一梯队,表现逼近Claude Opus 4.6非思考模式及GPT-5.4),Flash正式版通过深度后训练,在Agent原生能力上实现跃升:全面适配Claude Code、OpenClaw、OpenCode、CodeBuddy等主流智能体框架,并原生兼容OpenAI Responses API格式与Codex生态——开发者无需修改Base URL即可无缝切换。值得注意的是,在API价格持续下探(如GPT-5.6 Luna降价80%)的行业背景下,V4-Flash以更低调用成本交付更强Agent生产力,印证了‘低价不等于低能’的技术演进逻辑:当价格门槛不断消融,真正的竞争高地正转向可落地的智能体交付能力。

来源:智东西

AI 前线

埃安全新Ray车系首发:以情绪价值破局年轻市场,直面小米SU7等新势力挑战

2026-7-31 5:42:08

AI 前线

小米澎程N90预售29.99万元:以‘昆仑架构’重构大七座SUV空间逻辑

2026-7-31 16:43:26

0 条回复 A文章作者 M管理员
    暂无讨论,说说你的看法吧
个人中心
购物车
优惠劵
今日签到
有新私信 私信列表
搜索