智能经济30人论坛AGI测评中心近期发布了2026年9月12日至18日的《AGI市场观察》。该报告基于OpenRouter词元消耗数据、厂商官方定价及Arena基准测评结果,对国产大语言模型进行了周度量化追踪。本期报告重点分析了模型用量、市场份额、集中度以及价格与性价比等核心指标,呈现出当前国产大模型市场在轻量级应用爆发和头部集聚效应方面的显著特征。

轻量级模型主导流量,头部厂商份额稳固

本期数据表明,词元用量超过10万亿tokens的模型均为轻量级或类Flash模型。具体来看,DeepSeek V4 Flash以14.59万亿tokens位居首位,DeepSeek V4.1 Flash为12.93万亿,腾讯Hy4 preview为12.01万亿,智谱AI GLM 5.3 Flash为11.62万亿。此外,上海创智学院Nex-N2.5 Pro和阿里巴巴Qwen3.8 Flash首次跻身Top 15行列。

在市场份额方面,上述四款模型构成了中国大模型词元用量的“第一梯队”。其中,DeepSeek V4 Flash占比18.88%,V4.1 Flash占比16.73%,腾讯Hy4 preview占比15.54%,智谱AI GLM 5.3 Flash占比15.04%。这四款模型合计占据了约66%的市场份额。数据显示,头部集聚态势依然明显,前三位模型贡献了近一半的用量份额,而前五位模型的占比更是超过了四分之三,显示出市场资源向头部高效模型集中的趋势。

价格策略影响用量波动,性价比成为竞争关键

价格调整对模型用量产生了直接且显著的影响。深度求索在9月10日下调了DeepSeek V4 Flash及V4.1 Flash的定价,随后V4.1 Flash的周用量增长了483.62%,位次从第9名迅速上升至第2名。这一变化印证了在当前市场环境下,价格弹性对开发者选择具有重要导向作用。

在价格与性价比层面,当期Top 15大模型每百万tokens的最高价与最低价相差38.75元,这一价差与上期持平。其中,小米MiMo-V2.5以1.25元/百万tokens成为最低价,月之暗面Kimi K3则以40元/百万tokens成为最高价。在基准任务成本方面,腾讯Hy3表现最优,低至0.308元/基准任务,紧随其后的DeepSeek V4.1 Flash、MiniMax M3和GLM 5.3 Flash也处于“经济好用”区间,表明主流厂商正在通过优化成本结构提升竞争力。

市场格局呈现集中化与轻量化双重特征

本期《AGI市场观察》反映出国产大模型市场正在经历结构性的调整。一方面,轻量级模型凭借低延迟和低成本优势,占据了绝大部分的词元消耗份额,成为开发者日常应用的主力;另一方面,市场集中度持续提升,头部几家厂商通过技术迭代和价格策略,进一步巩固了其在词元消耗总量中的主导地位。这种“头部集中+轻量主导”的格局,预计将在未来一段时间内持续影响云计算及IDC服务商的资源配置策略,推动算力资源向高效、低成本的大模型推理场景倾斜。