日前,智能经济30人论坛AGI测评中心发布最新一期《AGI市场观察》(2026年9月12日至18日)。报告以OpenRouter词元消耗数据、各厂商官方披露价格及Arena基准测评为依据,对国产大语言模型进行周度量化追踪,本期围绕用量、份额、集中度、价格与性价比等维度给出观察结果。数据显示,四款国产模型周词元用量突破10万亿tokens,DeepSeek与腾讯混元合计份额接近一半。
词元用量方面,周期内用量超过10万亿tokens的模型均为轻量级(Flash或类Flash)产品。其中,DeepSeek V4 Flash以14.59万亿tokens位居首位,DeepSeek V4.1 Flash以12.93万亿tokens紧随其后,腾讯Hy4 preview以12.01万亿tokens位列第三,智谱AI GLM 5.3 Flash以11.62万亿tokens排名第四。四款模型合计贡献了极高的用量规模,轻量级模型在词元消耗中的主导地位进一步巩固。
价格调整对用量格局产生了直接影响。深度求索于9月10日下调DeepSeek V4 Flash及V4.1 Flash定价,后者周用量随之增长483.62%,排名由第9位跃升至第2位。腾讯Hy4 preview以12.01万亿tokens位列第三,份额为15.54%,性价比位次与上期持平。此外,上海创智学院Nex-N2.5 Pro与阿里巴巴Qwen3.8 Flash首次跻身Top 15,显示出新进入者在轻量级赛道中的竞争力正在增强。
市场份额方面,DeepSeek V4 Flash(18.88%)、DeepSeek V4.1 Flash(16.73%)、腾讯Hy4 preview(15.54%)、智谱AI GLM 5.3 Flash(15.04%)四款模型同处中国大模型词元用量份额的“第一梯队”,四强合计约占66%。头部集聚态势保持不变,前三位模型贡献了近一半的用量份额,前五位模型合计占比超过四分之三。市场集中度维持高位,中小模型的份额空间仍然有限。
价格与性价比方面,当期Top15大模型每百万tokens最高价与最低价相差38.75元,与上期持平。其中最低价为小米MiMo-V2.5的1.25元,最高价为月之暗面Kimi K3的40元。在基准任务成本维度,腾讯Hy3最低,低至0.308元/基准任务,其次分别为DeepSeek V4.1 Flash、MiniMax M3和GLM 5.3 Flash,同处于“经济好用”区间。这一数据表明,轻量级模型在成本效率上的优势已成为其用量增长的核心驱动力。
据悉,智能经济30人论坛是由中国(深圳)综合开发研究院等机构联合发起,汇聚全国人工智能、数字经济领域的专家学者与企业家,共同推动智库交流与合作。AGI测评中心作为其下设机构,持续对国产大模型市场进行周度量化追踪。
从本期数据来看,国产大模型市场呈现两个显著特征:一是轻量级模型在词元消耗中的集中度持续提升,价格调整对用量排名的撬动效应明显;二是头部厂商凭借性价比优势进一步巩固份额,新进入者虽有个别突破,但整体格局尚未出现结构性变化。随着厂商在定价策略和模型效率上的竞争加剧,后续周度数据中头部排位是否会出现新的变动,值得持续关注。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。