DeepSeek V4后训练优化显著 AI高性价比落地提速

时间:2026年08月11日 10:46:31 中财网
  CFi.CN讯:数据显示,DeepSeek V4 Flash正式版发布,在284B总参数和13B激活参数规模不变的情况下,通过后训练显著提升模型输出能力,小参数模型即可出色完成复杂任务。同期阿里推出Qwen3.8-Max,采用MoE架构,总参数约2.4万亿、激活参数约950亿,支持100万token上下文,重点强化编程、办公自动化及智能体能力。OpenRouter数据显示,7月27日至8月2日大模型token调用量为56.8T,较前周58T略有下降,但DeepSeek V4 Flash相关版本已跃居调用量第一、二位,下周预计显著回升。

  一份研报观点认为,DeepSeek V4 Flash发布进一步验证了后训练对底座潜力的释放。研报指出,在模型性能提升的同时,通过后训练优化可实现更高性价比,有望加速AI应用落地并推动行业渗透率快速提升。本轮AI核心驱动来自模型agentic coding能力增强,将向上游云厂商传导算力需求增长,缓解市场对投入过剩的担忧;中游模型厂商token消耗与ARR加速提升;下游Coding Agent率先验证PMF,并向办公、营销、游戏等多场景复制。

  研报认为,这些变化将带动AI全产业链需求加速,围绕自研模型、算力、云生态垂直整合的企业,以及IP+AI视频、AI营销、AI游戏、AI医疗等领域公司有望明显受益,相关股票具备强劲上涨动力。

  中财网
各版头条