
点击蓝字,关注我们
2026年8月3日,开源证券发布了一篇计算机行业的研究报告,报告指出,DeepSeek-V4-Flash超高性价比重塑Agent竞争格局。
报告具体内容如下:
后训练驱动Agent能力跃迁,轻量模型突破执行能力边界 模型沿用V4系列MoE架构与2840亿总参数、130亿激活参数的基础规格,仅通过重新后训练便实现Agent能力跨越式提升,TerminalBench2.1得分从预览版的61.8跃升至82.7,ToolathlonVerified达70.3分,在终端操作、代码仓库生成、网络安全(885459)攻防等九项智能体基准测试中全面反超自家V4-Pro预览版,验证了后训练优化在执行类任务上的杠杆效应远超参数堆叠。底座延续混合注意力机制设计,原生支持100万超长上下文与38.4万最大输出。三档推理模式灵活适配不同难度任务,ThinkMax档位在代码生成、数学推理等深度任务上已接近旗舰模型水平,在运维自动化、编程助手、安全审计等执行场景具备实用级落地能力。 构建超高性价比定价体系,重构Agent应用单位经济模型
产品维持预览版定价不变,采用缓存分级计费模式:缓存未命中输入1元/百万tokens、命中缓存输入低至0.02元/百万tokens、输出2元/百万tokens,综合成本显著低于海外闭源旗舰模型。单账号并发上限达2500,为V4-Pro的五倍,更适配高并发Agent应用场景。缓存定价策略针对性解决长链路Agent的成本痛点,多轮交互的边际调用成本大幅下降,配合DSpark推理优化带来的算力效率提升,同等硬件投入下有效产出大幅增长。对于自动化运维、代码审查、数据处理等重度依赖长序列生成的Agent场景,推理效率的提升有助于改善其成本结构,DeepSeek-V4-Flash的推出推进了企业级智能体部署的经济可行性。
全栈生态布局切入开发者腹地,加速Agent产业规模化落地
模型原生支持OpenAIResponsesAPI格式,并针对性适配Codex客户端,覆盖命令行工具、桌面端及VSCode插件,提供一键配置迁移脚本,大幅降低OpenAI生态开发者的切换成本,直接切入代码智能体主流入口。自研DeepSeekHarness框架首次在官方测试中亮相,承载Agent运行时与持续学习能力,标志着DeepSeek从模型厂商向智能体全栈基础设施厂商演进。发布仅两日即登陆国家超算互联网,为政企信创场景提供合规部署路径。MIT开源协议兜底消除厂商锁定顾虑,配合高并发、低价格、强Agent能力的产品组合,正在重塑开发者对智能体底座的选型标准,推动Agent应用从原型验证阶段走向规模化商用落地。
受益标的
国产算力:寒武纪(688256)、海光信息(688041)、天数智芯(HK9903)、禾盛新材(002290)、沐曦股份(688802)、摩尔线程(688795)、中国长城(000066)、龙芯中科、芯原股份(688521)、品高股份(688227)、锐捷网络(301165)等、浪潮信息(000977)、工业富联(601138)、紫光股份(000938)、中科曙光(603019)、华勤技术(603296)等。
算力租赁:行云科技(300209)、宏景科技(301396)、利通电子(603629)、杰创智能(301248)、协创数据(300857)、航锦科技(000818)、润泽科技(300442)、东阳光(600673)、华策影视(300133)、亿田智能(300911)、平治信息(300571)、盛视科技(002990)、盈峰环境(000967)、熙菱信息(300588)等。
风险提示:AI模型竞争风险、AI应用竞争风险、AI模型发展不及预期风险等。
注:本公众号所发布的内容,没有注明“原创“字样的,均源于网络整理,版权归原作者所有,如有侵权,请后台联系我们。本平台将及时审查并删除被侵权的内容,本公众平台将不承担任何责任。
免责声明:文章内容和数据仅供参考,不构成投资建议。投资者根据此操作,风险自担。

研报速递
发表评论
发表评论: