AICOR/咨询报告/大模型市场与定价

2026 大模型市场与定价产业报告

四款轻量模型周调用齐破 10 万亿、Top15 价差 32 倍——轻量化分层正在重构大模型市场。品牌市场部 · 产业研究组 · 编制

AICOR 品牌市场部 · 产业研究报告

2026 大模型市场与定价产业报告:四款轻量模型周调用齐破 10 万亿、Top15 价差 32 倍——轻量化分层正在重构大模型市场

轻量化迁移、定价层谱、一体机第二战场、组合采购新范式——大模型市场结构变迁全景拆解。

出品|AICOR(AI核)品牌市场部·产业研究组 主体|重庆科悦睿博网络科技有限公司 周期|2026.06 — 2026.09 完成|2026.09.26 编制人|产业研究组(AICOR) 版本|V1.0

核心摘要

2026 年大模型市场的结构正被「轻量化」改写。OpenRouter 数据显示,9 月中旬全球大模型周调用量达 129 万亿 token,中国模型达 67.46 万亿、为美国的 4.7 倍、连续 21 周全球第一;更关键的是调用结构——DeepSeek V4 Flash、V4.1 Flash、腾讯混元 Hy4、智谱 GLM-5.3 Flash 四款轻量模型周调用量全部突破 10 万亿,合计约占中国模型份额的 66%。定价层同步拉开 32 倍价差:每百万 token 从小米 MiMo-V2.5 的 1.25 元到 Kimi K3 的 40 元。瑞银测算中国模型 API 定价约为海外同级的 10%-20%、毛利仍达 20%-40%,约 60% 的企业已为 token 开支设限。企业采购正从「单旗舰订阅」走向「旗舰+轻量」的组合分层。

129 万亿
全球大模型周调用量(token,OpenRouter 口径,9 月 14-20 日当周)
4.7 倍
中国大模型周调用量为美国的倍数,连续 21 周全球第一
10 万亿+
单款轻量(Flash)模型周调用门槛,四款模型同周齐破
1.25 vs 40 元
中国 Top15 大模型每百万 token 最低与最高价(32 倍价差)
60%
已为 token 开支设限的企业比例(瑞银证券)
2937 亿元
2026 年中国大模型一体机市场规模预测(同比 +137.6%)

01 结构突变:轻量模型吃掉了调用的长尾

周调用 129 万亿 token:中国连续 21 周第一、达美国 4.7 倍

调用量的全球格局在 9 月继续强化。据《每日经济新闻》基于 OpenRouter 数据的测算,9 月 14-20 日当周全球大模型总调用量达 129 万亿 token, 其中中国模型 67.46 万亿(环比 +10.28%)、美国模型 14.21 万亿(环比 -34.7%)——中国调用规模达美国的 4.7 倍,且已连续 21 周位居全球第一。 头部座次由轻量模型包办:DeepSeek V4.1-Flash 以 15.8 万亿 token(环比 +219%)升至全球第一,智谱 GLM 5.3 Flash(14.1 万亿)、 腾讯混元 Hy4 preview(12.5 万亿)分列二三位,DeepSeek V4 Flash 正式版以 9.44 万亿位列第五——全球前五中四席属于中国轻量模型。

智库侧的周度追踪印证了同一结构。智能经济 30 人论坛 AGI 测评中心《AGI 市场观察》(9 月 12-18 日当周)显示:周调用量突破 10 万亿 token 的 四款模型全部为轻量级(Flash/类 Flash)——DeepSeek V4 Flash(14.59 万亿)、DeepSeek V4.1 Flash(12.93 万亿)、混元 Hy4 preview(12.01 万亿)、 GLM 5.3 Flash(11.62 万亿);四款模型在中国大模型词元用量中的份额分别为 18.88%、16.73%、15.54% 与 15.04%,合计约 66%, 前五位合计超过四分之三。价格杠杆的作用立竿见影:DeepSeek 于 9 月 10 日下调 V4.1 Flash 定价后,该模型周调用量环比暴增 483.62%、 位次从第 9 跃升至第 2;其上线不到 24 小时即处理约 1 万亿 token。一年之前,OpenRouter 调用量前十中中国模型仅占 2 席、份额不足 20%—— 如今前十中中国已占 7 席、整体份额超 45%。

指标数值说明
全球周调用量(9/14-20)129 万亿 tokenOpenRouter 口径,环比口径见各家测算
中国 vs 美国67.46 万亿 vs 14.21 万亿(4.7 倍)中国连续 21 周全球第一(每日经济新闻测算)
周调用破 10 万亿的模型4 款,全部为 Flash/类 Flash 轻量模型AGI 测评中心《AGI 市场观察》(9/12-18)
中国四强份额合计约 66%(前五位超 75%)V4 Flash 18.88%/V4.1 Flash 16.73%/Hy4 15.54%/GLM 15.04%
降价弹性V4.1 Flash 降价后周调用 +483.62%9 月 10 日调价,位次第 9→第 2
一年格局变化前十中中国 2 席/份额<20% → 7 席/份额超 45%OpenRouter 口径(2025.09 → 2026.09)
对企业经营的含义:调用量的「轻量化迁移」说明企业已想明白一件事——中低复杂度的日常任务(问答、摘要、工单、检索) 不需要每次都调用最强模型。把长尾负载从旗舰模型迁到 Flash 层,是当前性价比最高的成本优化动作,没有之一。

02 定价层谱:32 倍价差与「基准任务成本」新标尺

从 1.25 元到 40 元:定价带宽拉开 32 倍

轻量化分层的另一面是定价带宽的急剧拉宽。AGI 测评中心对 Top15 中国大模型的追踪显示,每百万 token 最高价与最低价相差 38.75 元: 最低为小米 MiMo-V2.5 的 1.25 元,最高为月之暗面 Kimi K3 的 40 元——同一张榜单上并存着 32 倍的价格差,且两者都活得好好的。 横向对比海外,中国信息通信研究院副院长敖立在 9 月 21 日北京互联网大会上给出的口径是:输入定价方面 Kimi-2.5 约为 Claude Opus-4.6 的 六分之一,输出定价方面 MiniMax M2.5 约为海外模型的十分之一至二十分之一。瑞银证券的测算更系统:中国模型 API 定价约为海外对标模型 平均定价的 10%-20%,且仍能保持 20%-40% 的毛利水平。

需求侧的约束同样明确:瑞银报告显示,约 60% 的企业已为 token 开支设置上限。预算封顶改变了采购逻辑——企业开始用「基准任务成本」 而非「token 单价」比价:AGI 测评中心按统一基准任务折算,腾讯 Hy3 的单任务成本低至 0.308 元,与 DeepSeek V4.1 Flash、MiniMax M3、 GLM 5.3 Flash 同处「经济好用」区间。这解释了一个表面矛盾:Kimi K3 卖 40 元/百万 token 的旗舰价,与 MiMo-V2.5 卖 1.25 元的轻量价, 面向的其实是预算表上不同的科目——前者买的是高价值任务的确定性,后者买的是长尾任务的规模经济。

层级代表模型与定价对应负载采购逻辑
轻量层(Flash/类 Flash)小米 MiMo-V2.5:1.25 元/百万 token(Top15 最低)问答、摘要、检索、工单等高频长尾按基准任务成本比价,预算敏感
经济层腾讯 Hy3:单基准任务 0.308 元;DeepSeek V4.1 Flash、MiniMax M3、GLM 5.3 Flash 同区间常规生产任务性价比+稳定性平衡
旗舰层月之暗面 Kimi K3:40 元/百万 token(Top15 最高)高价值高风险任务为确定性付溢价,用量可控
中外价差中国模型 API 定价约为海外对标的 10%-20%整体市场瑞银:毛利仍达 20%-40%
预算约束约 60% 企业已为 token 开支设限企业侧瑞银证券口径
对企业经营的含义:token 单价正在失去比价意义——32 倍价差的榜单上,便宜与昂贵都是理性的。建议采购指标切换为 「每完成一个标准任务的成本」(含重试与质检),并以「任务分层路由」重构用量结构:旗舰处理峰值与高难度,轻量层承载一切确定性长尾。

03 第二战场:一体机与政企中标市场

API 之外的另一条曲线:一体机两年复合增速约 110%

当舆论聚焦 API 价格战时,市场同时在另一条曲线上放量——私有化部署的大模型一体机。中国信通院与浙商证券的口径显示:2025 年中国大模型 一体机市场规模 1,236 亿元、出货约 15 万台;2026 年预计跃升至 2,937 亿元、出货 39 万台(同比 +137.6%);2027 年有望进一步突破 5,208 亿元、 出货 72 万台。驱动力是合规而非价格:公安、金融、医疗、政务等数据敏感行业受合规约束无法将核心数据上公有云,一体机成为「数据不出域」的 最优解,2026 年整机国产化率已普遍超过 80%。需求结构上,政务与公安占 38%、金融与能源占 27%、制造与医疗占 19%。价值重心也在迁移—— 中标金额高企的项目多为「服务+持续运营」性质,产业价值正从「卖盒子」走向「卖能力」。

年度市场规模出货量关键特征
2025 年1,236 亿元约 15 万台从实验室产品到工业化落地的跨越
2026 年(预测)2,937 亿元(+137.6%)约 39 万台国产化率超 80%;合规驱动,数据不出域
2027 年(预测)5,208 亿元约 72 万台两年复合增速约 110%;从卖盒子到卖能力

政企中标榜:讯飞领跑、百度拿下 Agent 数量第一

公开招投标数据勾勒了政企大模型采购的真实座次。据行业媒体对公开中标信息的统计,科大讯飞 2025 年全年大模型相关项目中标金额达 23.16 亿元、 超过第二名至第六名的总和,2026 年上半年中标数量与金额继续位居全行业第一;其交付模式以「从芯片到应用」的全栈国产化方案为标签, 山东肥城的县域级 50P 国产化智算中心项目将算力费用较传统模式降低约 40%。云厂商侧,2025 年中国主流云厂商大模型相关项目累计中标 341 个、 总金额约 27 亿元,百度智能云以 109 个项目、约 9 亿元拿下数量与金额双第一,2026 年上半年公开披露中标金额已达 13.85 亿元; 更值得注意的结构信号是:2026 年上半年应用类项目已占公开中标大模型项目的近一半,采购需求正从「知识问答、办公助手」升级为 「智能审核与分析决策」。渠道侧,三大运营商扮演「超级入口」:中国移动 2026 年上半年算力服务收入已达 529 亿元,并联合科大讯飞等启动 Token 运营生态联盟;中国电信星辰 TokenHub 汇聚 142 个大模型、开发 420 余个行业智能体;中国联通元景 MaaS 平台汇聚超 230 个全模态大模型。

玩家2025 年成绩2026 年进展定位
科大讯飞中标 23.16 亿元,超 2-6 名总和上半年数量与金额双第一全栈国产化方案商
百度智能云109 个项目/约 9 亿元,云厂商双第一上半年中标 13.85 亿元;Agent 中标数量连续两年居首智能体规模化交付
中国移动——上半年算力服务收入 529 亿元;Token 运营生态联盟渠道+算力入口
中国电信——星辰 TokenHub 汇聚 142 个大模型、420+ 行业智能体模型聚合分发
中国联通——元景 MaaS 汇聚 230+ 全模态大模型算力+数据+模型三位一体
对企业经营的含义:一体机市场的爆发意味着「AI 员工的私有化编制」成为现实选项——数据不出域的核心流程可以自建智能体底座。 但需警惕「AI 保健品」:近百家厂商涌入后,大量产品只是服务器硬件加开源模型的简单捆绑。采购评估的关键不是算力参数,而是行业场景的 深度优化、端到端执行能力与持续运营承诺。

04 格局走向:从「单旗舰订阅」到「组合采购」

中国模型的全球化:从流量到客户

调用量的领先正在转化为真实的商业渗透。据世界互联网大会官网综述(参考人民日报、界面新闻等报道),DoorDash、Airbnb 等企业与多家欧洲 头部车企已开始采用中国大模型优化业务流程;AWS、微软 Azure 等全球云平台均已接入多款中国模型;新加坡、马来西亚等国基于中国开源模型 构建本土主权 AI;非洲初创企业采用中国开源模型后成本最高可降九成。信通院副院长敖立将「Token 出海」定义为中国 AI 推理能力以数据要素 形式的跨境输出——其背后是能源供给、数据与场景、工程迭代速度的综合优势。竞争维度随之切换:当调用规模与价格优势已确立, 下半场的分水岭是企业级交付能力——谁能把调用量变成留存与利润。

企业侧的采购结构正在发生根本变化:从「单旗舰订阅」走向「组合采购」。逻辑链条是——60% 的企业给 token 开支封顶(瑞银), 封顶之后必然分层;分层之后必然多供应商:旗舰层保留一家最强模型处理高价值任务,轻量层在 Flash 模型池中按基准任务成本动态比价。 这正是四款轻量模型周调用齐破 10 万亿的企业侧注脚。投研机构 Macrostream 的企业侧追踪亦显示,中国企业日均 token 消耗份额中阿里云升至 约 32%、豆包约 21.3%、DeepSeek 约 18.4%(投研口径,供方向性参考)——头部集中与多供应商并存同时成立,印证「组合」而非「单选」。

采购要素旧范式(2024-2025)新范式(2026)
模型选择单旗舰订阅,绑定单一厂商旗舰+轻量组合,多供应商并存
比价指标每百万 token 单价每完成一个标准任务的成本
预算约束按用量自然增长60% 企业设置 token 开支上限
部署形态公有云 API 为主API 与一体机并行(一体机 2026 年预计 2,937 亿元)
采购入口直接对接模型厂商云厂商与运营商渠道占比上升(移动算力收入 529 亿元)
对企业经营的含义:大模型定价的「轻量化分层」本质上是 AI 员工「人力成本」的急剧下降——当长尾任务的单位成本降到 旗舰的几十分之一,企业终于负担得起「为每个流程配一个数字员工」。真正的经营问题从「用不用 AI」变成「如何给 AI 员工设计任务分层与预算编制」: 旗舰层是专家外聘,轻量层是常规编制,一体机是自建园区。组合采购的能力,就是新时代的流程治理能力。

数据口径与来源说明

[1] 每日经济新闻(2026-09-22,基于 OpenRouter 数据测算):9/14-20 当周全球大模型总调用量 129 万亿 token;中国 67.46 万亿(+10.28%)、美国 14.21 万亿(-34.7%)、中国为美国 4.7 倍、连续 21 周第一;DeepSeek V4.1-Flash 15.8 万亿(+219%)升至第一、GLM 5.3 Flash 14.1 万亿第二、混元 Hy4 preview 12.5 万亿第三、V4 Flash 正式版 9.44 万亿第五。 https://www.toutiao.com/article/7688364070273057341/
[2] 中国信息通信研究院副院长敖立于 2026(第二十三届)北京互联网大会(9 月 21 日)发言(经每日经济新闻报道):Token 出海定义;Kimi-2.5 输入定价约为 Opus-4.6 的 1/6、MiniMax M2.5 输出定价约为海外的 1/10-1/20;瑞银证券:中国模型 API 定价约为海外对标平均的 10%-20%、毛利 20%-40%;瑞银报告约 60% 企业已为 token 开支设限。 https://www.toutiao.com/article/7688364070273057341/
[3] 新浪财经/格隆汇(2026-09-14,基于 OpenRouter 数据):9/7-13 当周全球 127 万亿 token(+10.43%);中国 61.17 万亿(+7.85%)、美国 21.76 万亿(+31.56%)、中国连续 20 周超美国;混元 Hy4 16.8 万亿第二、GLM 5.3 Flash 11.9 万亿第三、DeepSeek V4 Flash 11.6 万亿第四、小米 MiMo-V2.5 7.77 万亿第五(+230%)、DeepSeek V4.1 Flash 4.94 万亿第六。 https://finance.sina.com.cn/stock/bxjj/2026-09-14/doc-iniruhxe4089842.shtml
[4] 智能经济 30 人论坛 AGI 测评中心《AGI 市场观察》(9 月 12-18 日当周,经腾讯新闻转载 2026-09-23):四款 Flash/类 Flash 模型周用量破 10 万亿(14.59/12.93/12.01/11.62 万亿);四强份额 18.88%/16.73%/15.54%/15.04%、合计约 66%、前五超 75%;Top15 每百万 token 价差 38.75 元(小米 MiMo-V2.5 1.25 元最低、Kimi K3 40 元最高);V4.1 Flash 降价后周用量 +483.62%、位次 9→2;腾讯 Hy3 基准任务成本 0.308 元最低。 https://so.html5.qq.com/page/real/search_news?docid=70000021_6606ab380eb15752
[5] 世界互联网大会官网综述(2026-09-18,参考人民日报、参考消息、界面新闻、华尔街见闻等):DeepSeek V4.1 Flash 上线不到 24 小时处理约 1 万亿 token;一年前 OpenRouter 前十中国仅 2 席/份额不足 20%、如今 7 席/整体超 45%;DoorDash、Airbnb 及多家欧洲头部车企采用中国模型;AWS/Azure 接入多款中国模型;非洲初创成本最高降九成。 https://www.toutiao.com/article/7686829484435194418
[6] 智研咨询《2026 年中国大模型一体机行业市场全景分析报告》:2025 年出货约 15 万台、2026 年预计 39 万台/规模突破 2,937 亿元、2027 年 72 万台;公安/金融/医疗/政务合规驱动本地化部署;价值从「卖盒子」向「卖能力」迁移;截至 2025 年 10 月 48.9% 布局企业同时推出推理与训推一体机。 https://www.chyxx.com/research/1271090.html
[7] 中国信通院与浙商证券口径(经万物纵横/腾讯证券等转引,2026):一体机 2025 年 1,236 亿元/15 万台、2026 年 2,937 亿元/39 万台(+137.6%)、2027 年 5,208 亿元/72 万台;国产化率超 80%;下游需求政务公安 38%、金融能源 27%、制造医疗 19%、教育科研中小企业 16%;「AI 保健品」同质化风险。 https://www.iotdt.com/news/xingyezixun/2654.html
[8] 科大讯飞中标数据(行业媒体对公开招标信息统计,2026-09-07):2025 全年大模型相关项目中标 23.16 亿元、超 2-6 名总和;2026 上半年中标数量与金额双第一;肥城县域 50P 国产化智算中心算力费用较传统模式低约 40%。 https://www.toutiao.com/article/7682674960350872127/
[9] 扬子晚报(2026-09-09,百度智能云超级智能体大会):2025 年主流云厂商大模型相关项目累计中标 341 个/约 27 亿元,百度 109 个/约 9 亿元双第一;2026 上半年百度中标 13.85 亿元、Agent 中标数量连续两年居首;应用类项目占公开中标近一半,场景从知识问答升级为智能审核与分析决策。 https://www.toutiao.com/article/7683513840956473919
[10] 三大运营商数据(经行业媒体整理,2026-09):中国移动 2026 上半年算力服务收入 529 亿元、联合科大讯飞等启动 Token 运营生态联盟;中国电信星辰 TokenHub 汇聚 142 个大模型、420 余个行业智能体;中国联通元景 MaaS 平台汇聚超 230 个全模态大模型。 https://www.toutiao.com/article/7682674960350872127/
[11] Macrostream 投研报告 AI Series #71(2026-09):2026 下半年中国企业日均 token 消耗份额阿里云约 32%(上半年 17.7%)、豆包约 21.3%、DeepSeek 约 18.4%;9/7-13 当周中国模型 61.2 万亿 vs 美国 21.8 万亿 token。 https://www.macrostream.ai/articles/6aa789db6fa5837594321ae0

估计值与口径声明:OpenRouter 调用量数据为单一聚合平台口径,仅覆盖经其路由的流量,非全市场统计;不同当周的环比增速受新模型上线与统计窗口影响较大。
智能经济 30 人论坛 AGI 测评中心为智库性质的第三方追踪(依托 OpenRouter 数据、厂商官方价格与 Arena 基准),其份额与价格为周度观察口径。
一体机市场规模(1,236 亿/2,937 亿/5,208 亿元)与出货量(15 万/39 万/72 万台)为中国信通院与浙商证券口径(经多家机构转引),不同机构存在口径差异,2026-2027 年为预测值。
科大讯飞与百度智能云中标金额为对公开招标信息的第三方统计,未含未公开披露项目,与厂商实际收入口径不同。
Macrostream 企业 token 份额为投研机构口径,样本与统计方法未完全公开,仅作方向性参考。
文中未注明币种处,中国企业与市场数据为人民币、海外价格为美元。
← 返回咨询报告列表

看懂产业之后,
下一步是一次真实诊断

报告识别的是市场机会,诊断解决的是你的企业机会——2 分钟在线定位,45 分钟真人专家诊断。