计算机行业点评报告:DeepSeek-V4-Flash超高性价比重塑Agent竞争格局
后训练驱动Agent能力跃迁,轻量模型突破执行能力边界
模型沿用V4系列MoE架构与2840亿总参数、130亿激活参数的基础规格,仅通过重新后训练便实现Agent能力跨越式提升,Terminal Bench2.1得分从预览版的61.8跃升至82.7,Toolathlon Verified达70.3分,在终端操作、代码仓库生成、网络安全攻防等九项智能体基准测试中全面反超自家V4-Pro预览版,验证了后训练优化在执行类任务上的杠杆效应远超参数堆叠。底座延续混合注意力机制设计,原生支持100万超长上下文与38.4万最大输出。三档推理模式灵活适配不同难度任务,Think Max档位在代码生成、数学推理等深度任务上已接近旗舰模型水平,在运维自动化、编程助手、安全审计等执行场景具备实用级落地能力。
构建超高性价比定价体系,重构Agent应用单位经济模型
产品维持预览版定价不变,采用缓存分级计费模式:缓存未命中输入1元/百万tokens、命中缓存输入低至0.02元/百万tokens、输出2元/百万tokens,综合成本显著低于海外闭源旗舰模型。单账号并发上限达2500,为V4-Pro的五倍,更适配高并发Agent应用场景。缓存定价策略针对性解决长链路Agent的成本痛点,多轮交互的边际调用成本大幅下降,配合DSpark推理优化带来的算力效率提升,同等硬件投入下有效产出大幅增长。对于自动化运维、代码审查、数据处理等重度依赖长序列生成的Agent场景,推理效率的提升有助于改善其成本结构,DeepSeek-V4-Flash的推出推进了企业级智能体部署的经济可行性。
全栈生态布局切入开发者腹地,加速Agent产业规模化落地
模型原生支持OpenAI Responses API格式,并针对性适配Codex客户端,覆盖命令行工具、桌面端及VS Code插件,提供一键配置迁移脚本,大幅降低OpenAI生态开发者的切换成本,直接切入代码智能体主流入口。自研DeepSeek Harness框架首次在官方测试中亮相,承载Agent运行时与持续学习能力,标志着DeepSeek从模型厂商向智能体全栈基础设施厂商演进。发布仅两日即登陆国家超算互联网,为政企信创场景提供合规部署路径。MIT开源协议兜底消除厂商锁定顾虑,配合高并发、低价格、强Agent能力的产品组合,正在重塑开发者对智能体底座的选型标准,推动Agent应用从原型验证阶段走向规模化商用落地。
受益标的
国产算力:寒武纪、海光信息、天数智芯、禾盛新材、沐曦股份、摩尔线程、中国长城、龙芯中科、芯原股份、品高股份、锐捷网络等、浪潮信息、工业富联、紫光股份、中科曙光、华勤技术等。
算力租赁:行云科技、宏景科技、利通电子、杰创智能、协创数据、航锦科技、润泽科技、东阳光、华策影视、亿田智能、平治信息、盛视科技、盈峰环境、熙菱信息等。
风险提示:AI模型竞争风险、AI应用竞争风险、AI模型发展不及预期风险等。