DeepSeek V4 Flash发布验证后训练优化价值

  • 来源:广发证券
  • 发布时间:2026/08/11
  • 浏览次数:18
  • 举报
相关深度报告REPORTS

互联网传媒行业AI双周专题(六):Deepseek V4 Flash发布,后训练优化效果显著.pdf

全球人工智能行业正经历从基础模型竞争向后训练优化与应用落地深化的关键转折。DeepSeekV4Flash的发布成为这一趋势的标志性事件,其通过在固定参数规模下实施精细化后训练,显著提升了模型在复杂任务中的表现并大幅降低了调用成本,验证了高性价比模型推动行业渗透率提升的可能性。技术突破与成本优势DeepSeekV4Flash采用两阶段后训练范式,在保持284B总参数和13B激活参数不变的情况下,释放了底座潜力。其API价格极具竞争力,平均任务成本较同类头部模型低约60%。这种高性价比降低了复杂Agent多轮推理的门槛,促使AI需求从单次问答向高频、长链路任务扩张,为中小企业及开发者提供了接近头部...

DeepSeek V4 Flash 技术突破与性价比优势

DeepSeek V4 Flash 正式版的发布,进一步验证了模型后训练技术在提升输出能力方面的显著效果。在保持模型主体架构、284B 总参数及 13B 激活参数规模不变的前提下,通过精细化的后训练策略,显著释放了底座模型的潜力。这一技术路径使得小参数模型能够在多项任务中表现出色,实现了模型性能与成本的高性价比平衡。

从技术实现来看,V4 系列采用了两阶段后训练范式。第一阶段针对数学、代码、Agent 和指令遵循等特定领域培养独立专家;第二阶段采用在线策略蒸馏,将多个专家的能力整合至统一模型中。这种方法在降低能力融合损耗的同时,有效提升了任务的泛化能力和执行稳定性。基准测试数据显示,DeepSeek V4 Flash 正式版在大部分任务场景中的表现已优于 V4-Pro 预览版本,其智能程度正逐步追赶第一梯队模型。

在成本控制方面,DeepSeek V4 Flash 展现出极强的竞争力。其 API 输入和输出价格分别为每百万 Token 0.14 美元和 0.28 美元。相较于能力接近的其他头部模型,其平均任务成本大幅降低。这种低成本优势降低了复杂 Agent 多轮推理、反复试错以及多智能体协作的门槛,使得中小企业及个人开发者能够以更低预算调用接近头部模型的能力,有望推动 AI 需求从单次问答向高频、长链路任务扩张。

AI 产业链核心驱动与投资逻辑演变

当前 AI 产业链的核心驱动力正逐渐转向模型 Agentic Coding 能力的增强。以 Claude Code、Codex 为代表的编程工具正从辅助补全向自主协作跃迁,这一变化正在向上下游传导出多层投资机会。向上游看,Agentic Workload 对算力的消耗大幅提升,推动了云厂商 IaaS 和 MaaS 业务的高增长。这在一定程度上缓解了市场对于云厂商投入过剩导致 AI 泡沫的担忧,同时也减弱了对自由现金流利润率下降的敏感度。投资者应关注 CSP 算力约束的缓解情况以及订单增长的节奏。

向模型厂商自身来看,Agentic 任务驱动了 Token 消耗的飙升,头部模型的年度经常性收入加速提升。短期内的交易重点在于模型更新、ARR 数据、Token 价格与算力供应等边际变化。向下游应用看,Coding Agent 最先验证了产品市场契合度,后续应关注类似“Claude Code for X”式的场景复制以及 Token 经济性提升带来的扩展空间。

除了编码领域,模型技术的创新还在生成式推荐与多模态等方向延伸,并由此外溢至更广泛的应用场景。广告营销板块与内容平台的业务进展值得关注。整体而言,AI 发展带来的产业需求正在加速,建议围绕自研模型、算力与云生态的垂直整合进行标的选择。

国内外 AI 市场动态与数据跟踪

近期 OpenRouter 大模型 Token 调用量出现阶段性下降,但展望相对乐观。周度数据显示,通过 OpenRouter 调用的大模型 Token 数量略有回落,但这被视为阶段性因素,预期后续将有显著回升。在调用模型排名中,DeepSeek V4 Flash 的两个版本攀升至榜单前列,显示出市场对其高性价比的认可。国产模型中,DeepSeek 系列占据领先地位,而海外模型如 GPT-5.6 Luna 和 Gemini 3.6 Flash 的调用量也呈现环比大幅上升态势。

国内主要 AI 大模型产品方面,DeepSeek 在网页端访问量上保持领先,豆包在 iPhone 端下载量排名第一。海外市场中,ChatGPT、Gemini 和 Claude 依然占据主要市场份额,但 Meta AI 的访问量环比有所上升。此外,阿里发布了 Qwen3.8-Max 模型,重点提升复杂编程、办公自动化及长周期智能体任务能力;字节跳动发布了 SeedRealtime 音视频全双工大模型,强化了实时环境下的多模态理解能力。

在市场动态方面,DeepSeek 参与宇树科技科创板 IPO 战略配售,将大模型研发方与具身智能硬件公司在资本层面连接。智元创新已正式启动赴港上市流程,为其产品研发和产能扩张提供资本支持。同时,英国人工智能安全研究所的测试报告指出,高自主代理在权限边界和工具调用方面仍需完善,反映了 AI 安全性仍是行业发展的重要考量因素。

编辑:流星雨
  • 热门文档
  • 热门文章
  • 本年热门
  • 本季热门
  • 本月热门
  • 本年热门
  • 本季热门
  • 本月热门
分享至