56.72万亿对16.54万亿Token、前五占四席、腾讯Hy4登顶——调用量是真金白银的投票,企业该怎么接住这波"高性价比智能"红利?
🔥 56.72万亿Token/周 ✅ 连续19周全球第一 ✅ 百炼输入 ¥0.8/M Token 🚀 新用户每模型送百万TokenOpenRouter是全球最大的AI模型API聚合平台之一,其周度调用数据被业内视为大模型"真实消费量"的风向标。上周(8月31日-9月6日)榜单核心数据如下(据每日经济新闻测算):
| 指标 | 本周数据 | 环比 |
|---|---|---|
| 全球总调用量 | 115万亿Token | +1.77% |
| 中国模型周调用量 | 56.72万亿Token | +2.83% |
| 美国模型周调用量 | 16.54万亿Token | -3.1% |
| 中美调用量之比 | 约 3.4 : 1 | 连续19周中国领先 |
| 全球前五中国模型数 | 4 款 | Hy4/GLM/DeepSeek×2 |
| 排名 | 模型 | 厂商/国别 | 周调用量 | 环比 |
|---|---|---|---|---|
| 1 | 混元 Hy4 preview | 腾讯 · 中国 | 14.7万亿 | +379% |
| 2 | GPT-5.6 Luna | OpenAI · 美国 | 12.9万亿 | +66% |
| 3 | GLM-5.3 Flash | 智谱 · 中国 | 12.4万亿 | +101% |
| 4 | DeepSeek-V4-Flash 正式版 | 深度求索 · 中国 | 12.4万亿 | — |
| 5 | DeepSeek-V4-Flash 预览版 | 深度求索 · 中国 | 5.19万亿 | — |
| 6 | MiniMax M3 | MiniMax · 中国 | 5.02万亿 | +95% |
小米MiMo-V2.5、Gemini 3.7 Flash本周跌出榜单。数据来源:OpenRouter,经每日经济新闻、新浪财经、CNMO等公开报道整理(2026年9月7日)。
本周最大黑马是腾讯混元Hy4 preview:8月28日正式发布并开源,发布一周即以14.7万亿Token登顶OpenRouter周榜,环比暴增379%。其核心规格(据公开资料整理):
| 维度 | 规格 |
|---|---|
| 架构 | MoE,总参数770B / 激活49B |
| 上下文 | 1M Token(约150万字中文) |
| 开源协议 | Apache 2.0(HuggingFace/GitHub/ModelScope可下载) |
| 重点场景 | Agent、Coding、生产力;一句话生成可玩游戏原型 |
| 工程盲测 | 163名专家、203个工程任务,均分2.99/4.00,优于GLM-5.3与Kimi K3 |
| 轻量版 | 9月1日推出,权重从1.5TB压缩到约214GB(自研Sherry三值量化),本地部署门槛大降 |
| API价格(媒体整理) | 输入约6元 / 输出约18元 每百万Token,以官方实时价为准 |
同期,智谱GLM-5.3 Flash、DeepSeek-V4-Flash、MiniMax M3等中国模型同样霸榜,且都走"开源权重 + 极低API价格 + Agent/Coding专项优化"路线。中国模型的集体崛起不是单个爆款,而是集群式突围。
调用量暴增的背后,是一个对企业极其有利的事实:顶级能力的模型API已经便宜到可以"敞开用"。问题不再是"用不用得起AI",而是"通过哪个渠道用最稳、最省、最合规"。
对国内和出海企业,阿里云百炼(Model Studio)是最省心的统一入口——一个平台、一个API Key,聚合多家主流模型:
| 能力 | 说明 |
|---|---|
| 模型聚合 | 千问Qwen3.8系列、DeepSeek-V4、MiniMax等,文本/图像/视频/语音全覆盖,按需切换 |
| 接口兼容 | 兼容OpenAI、Anthropic接口标准,存量代码几乎零改动迁移 |
| 工具生态 | 支持 Qwen Code、Claude Code、Qoder、OpenClaw 等主流AI编程与智能体工具直接接入 |
| 新人福利 | 每模型100万Token免费额度,90天有效(华北2北京地域) |
| 成本控制 | 支持"免费额度用完即停"开关,余量20%/耗尽时短信邮件告警,杜绝意外扣费 |
| 企业级 | 多租户隔离、高峰期不排队;承诺不使用对话数据训练模型;企业合同/发票/SLA齐全 |
| 模型/计费项 | 输入 | 输出 | 缓存命中 |
|---|---|---|---|
| Qwen3.8-Flash(百炼) | ¥0.8 /百万Token | ¥2.7 | ¥0.1 |
| Qwen3-VL-Rerank(8/31起) | ¥0.5(文本/多模态同价) | — | — |
| 免费额度 | 每模型100万Token / 90天,主账号与RAM子账号共享 | ||
| 坐席档位 | 限时价/月 | Credits额度 | 适合 |
|---|---|---|---|
| 标准坐席 | ¥150(原价198) | 2.5万 | 轻度AI辅助的成员 |
| 高级坐席 | ¥550(原价698) | 10万 | 日常高频AI编程/办公 |
| 尊享坐席 | ¥1,398 | 25万 | 重度依赖AI的核心开发者 |
| 共享用量包 | ¥5,000/个 | 62.5万 | 跨坐席弹性抵扣 |
限时权益:每晚22:00-次日08:00调用 deepseek-v4-pro/flash 部分模型Credits消耗享5折。以上为官方帮助中心公开信息(2026年9月整理),价格与活动以百炼官方页面实时公示为准。
调用量反映的是真实使用规模和性价比选择,不等同于所有技术维度全面领先。客观看:中国模型在开源、价格、Agent/Coding优化、中文场景上优势明显,全球开发者用脚投票;前沿闭源模型在部分复杂推理任务上仍各有千秋。对企业而言,务实的做法是多模型混合、按任务选型。
不是。百炼聚合了千问Qwen系列、DeepSeek、MiniMax等多家主流模型,文本、图像、视频、语音都能调用,一个API Key统一计量、按需切换,并兼容OpenAI/Anthropic接口标准。
个人和小团队先用按量付费 + 免费额度即可,成本极低。Token Plan团队版适合需要席位管理、用量分析、预算封顶的团队(标准坐席限时150元/月起),管理员可分配/回收席位、查看成员用量。
绝大多数企业调API更划算——无需采购GPU、无需运维、随用随付、新模型自动可用。只有对数据不出域有硬性合规要求、或调用量极大到摊薄GPU成本的场景,才考虑在阿里云GPU实例上自部署开源权重(如Hy4、DeepSeek、Qwen)。
新用户每模型送100万Token · 兼容OpenAI/Claude接口 · 一个Key调用千问/DeepSeek/MiniMax
免费领取百炼Token → ECS特惠 99元/年起