当前位置:首页 > AI资讯 > 正文内容

《AGI市场观察》发布:四款国产模型周用量破10万亿tokens,DeepSeek与混元占比近半

admin2小时前AI资讯4

《AGI市场观察》发布:四款国产模型周用量破10万亿tokens,DeepSeek与混元占比近半

引言

最新一期《AGI市场观察》给出清晰信号:国内大模型的“量能”正在被轻量级产品重塑。单周词元用量破10万亿的四款模型,全部是Flash/类Flash版本;DeepSeek在降价后,V4.1 Flash用量暴涨483.62%,直接跃升至第二;腾讯混元Hy4 preview以12.01万亿tokens位列第三,份额15.54%。头部四款(DeepSeek V4 Flash、V4.1 Flash、混元Hy4 preview、智谱GLM 5.3 Flash)合计约占66%,集中度继续上行。价格与性价比同样形成“剪刀差”:Top15中每百万tokens从1.25元到40元差距巨大,而基准任务成本最低者则由腾讯Hy3领衔,表明“按任务计”的效率正在成为新指标。

核心内容

轻量级模型的量能之战:Flash赢在“可得性”

抽象图:轻量级模型提升吞吐与可得性

  • 用量Top4全部是轻量级:DeepSeek V4 Flash(14.59万亿)、V4.1 Flash(12.93万亿)、混元Hy4 preview(12.01万亿)、GLM 5.3 Flash(11.62万亿)。
  • Flash/类Flash本质是“吞吐优化”:更低单价、更高并发、更短响应,适合摘要、检索增强问答、代码补全、Agent流水线中的中间环节等大规模调用场景。
  • 这解释了为何“量”被轻量级模型拿走:在海量调用里,边际性能提升不如单位成本下降更能撬动总用量。

价格杠杆的即时传导:从降价到爆量

  • 9月10日DeepSeek下调V4 Flash与V4.1 Flash定价,V4.1 Flash周用量随即增长483.62%,排名从第9升至第2。
  • 价格弹性被充分验证:当性能过关、生态可接入时,价格微调即可触发调用迁移,特别是在通过聚合平台路由流量的环境中。
  • 对开发与业务团队而言,“边际性价比”优先级快速上升——哪怕模型并非绝对最强,只要在目标任务上以更低成本达到可接受质量,就能赢得流量。

份额与集中度:平台效应强化头部

抽象图:市场份额集中度上升的网络结构

  • 市场份额上,DeepSeek V4 Flash(18.88%)、V4.1 Flash(16.73%)、混元Hy4 preview(15.54%)、GLM 5.3 Flash(15.04%)构成第一梯队,四者合计约66%。
  • 头部集聚的逻辑并不神秘:稳定性、可用性、工具链与文档、以及兼容性带来的“确定性红利”。当调用量跨越十万亿tokens级别,稳定与预测性比极限性能更关键。
  • 值得注意的是,新面孔亦在破门而入:上海创智学院Nex-N2.5 Pro、阿里Qwen3.8 Flash首次跻身Top15,说明渠道与定价仍能打开增量窗口,第二梯队的上升期尚未结束。

性价比版图:从“百万tokens价”到“单任务成本”

  • 价格区间拉大:Top15中每百万tokens最低1.25元(小米MiMo-V2.5),最高40元(月之暗面Kimi K3),差距38.75元。
  • 但单看“每百万tokens价”不足以决策。基准任务成本显示:腾讯Hy3低至0.308元/任务,其次是DeepSeek V4.1 Flash、MiniMax M3、GLM 5.3 Flash,这类模型在“经济好用”区间内对实际业务更友好。
  • 结论趋于一致:评估应转向“任务视角”(单位结果的成本与质量),并叠加SLA、延迟、失败重试率等运维指标,构成真实的TCO模型。

影响与展望

  • 对开发与企业选型
  • 任务分层:将Agent流水线拆分,用Flash承载高频、可容错的中间环节;将复杂推理、长链路决策交给更强模型,做“冷热分层”与“按需升配”。
  • 动态路由:基于置信度或上下文难度分流到不同模型,兼顾成本与质量;配合重试与缓存策略,优化整体TCO。
  • 指标体系:同时跟踪“单任务成本”“成功率”“P95时延”,而非只看tokens单价或单点基准分数。

  • 对模型厂商与平台

  • 价格战进入“精细化”阶段:不必全线降价,针对高弹性场景推出Flash/Plus梯度产品,以微调价格换取边际量。
  • 生态即护城河:SDK完善度、工具链整合、兼容主流推理与向量检索框架,将直接转化为份额。
  • 产品矩阵与蒸馏:通过蒸馏、量化与MoE路由,构建“旗舰+Flash”双轨,保证在高端口碑与低端规模两端都不失守。

  • 市场趋势判断

  • 集中度大概率继续走高,但“新入局者靠性价比与渠道突围”的窗口仍在,Nex与Qwen的上榜就是信号。
  • 指标重心从“综合大基准”转向“场景化任务成本”,谁能在企业真实工作流里跑出更低的单位任务成本,谁就更可能赢得稳定调用。
  • 随着Agent化工作流普及,模型将被当作“可替换部件”,路由层与调度层的竞争加剧,模型厂商需要在接口标准与服务质量上持续投入。

轻量级产品正在改写用量格局,价格与生态在短期内决定份额,而任务级成本将成为中长期的胜负手。对参与者而言,关键不再是“单点最强”,而是“在正确的任务上,以最经济的方式稳定地做好”。

标签: AGI市场观察 大语言模型 DeepSeek 腾讯混元 性价比

相关文章

字节跳动补强AI Agent底层架构

字节补上AI Agent的“底层骨架” 在AI大模型竞争进入深水区的2026年,人才争夺战早已不是简单的薪资比拼,而是战略卡位的关键一步。当DeepSeek前核心成员郭达雅的去向尘埃落定,字节跳动成为...

广汽2026科技日发布星灵架构4.0

从底层重构智能出行:广汽2026科技日的硬核突破 当智能汽车竞争进入深水区,真正的较量早已不是单一功能的堆砌,而是底层架构与核心技术的系统性突破。4月12日,2026广汽科技日在番禺总部拉开帷幕,以“...

服务业扩能提质国家战略新蓝图

服务业扩能提质:国家战略下的新增长极 近日,国务院印发《关于推进服务业扩能提质的意见》,明确提出到2030年服务业总规模突破100万亿元的目标。这一部署不仅为服务业高质量发展擘画蓝图,更释放出国家推动...

百度AI开发者大会聚焦智能体规模化落地

从企业到个体:AI智能体规模化落地的“双轮驱动” 5月13日至14日,北京国家会议中心二期将迎来一场AI领域的年度盛会——Create 2026百度AI开发者大会。与往届不同,本届大会迎来战略级升级:...

AI企业化落地三大关键跃迁解析

从模型到生态:AI企业化落地的三大关键跃迁 4月24日,全球AI产业迎来密集的技术与战略突破。OpenAI、NVIDIA、IBM、谷歌云、特斯拉与微软等科技巨头纷纷发布重磅动作,不仅标志着AI技术进入...

PPIO上线DeepSeek-V4:百万上下文AI新纪元

百万上下文时代到来:PPIO率先上线DeepSeek-V4,开源大模型迈入“即拿即用”新纪元 在AI大模型竞争日益激烈的当下,开源模型正以前所未有的速度推动技术民主化与产业落地。4月24日,DeepS...

发表评论

访客

◎欢迎参与讨论,请在这里发表您的看法和观点。