👉 新用户上手百炼: 打开百炼控制台 每个模型自动送 100 万 Token; 国际版新用户再领 $200 信用额度

📅 数据说明(2026年9月1日):文中价格同步自阿里云官方 百炼模型价格页 与国际版 Model Studio Pricing(官方页面更新于 2026 年 8 月 31 日)。展示的均为标准刊例价,限时促销(如 Qwen3.7-Max 五折)单独标注;生产预算请以控制台实时价格为准。

一、百炼是怎么计费的

阿里云百炼(国际版称 Model Studio)是阿里的一站式大模型平台:通义千问 Qwen 全系列、DeepSeek、千问 VL 视觉、QwQ 推理、嵌入/重排、语音与图像生成,全部通过 OpenAI 兼容 API 调用。计费规则很简单:

二、国内版价格表(人民币,每百万 Token)

面向国内业务、部署在华北2(北京)的常用模型:

模型输入单价输出单价备注 / 免费额度
qwen-turbo(等同 qwen-turbo-2025-04-28)¥0.367¥1.468Batch 半价
qwen-plus(qwen-plus-2025-04-28 等)¥0.8¥2各 100 万 Token
qwen3.6-plus(≤32K 档)¥2¥12(思考模式)各 100 万 Token
qwq-plus(仅思考模式)¥1.6¥4各 100 万 Token,90 天
qwen-long(长文档)¥0.5¥2各 100 万 Token;Batch 半价
qvq-plus(视觉推理)¥2¥5各 100 万 Token
qvq-max¥8¥32各 100 万 Token
qwen3-vl-flash(≤32K)¥0.15¥1.532K–128K 档 ¥0.3/¥3;Batch 半价

来源:阿里云帮助中心 · 百炼模型价格。旗舰 Qwen3.8-Max 国际版统一价 $2/$6(约合 ¥14/¥43),国内专属部署价格以控制台为准。

三、国际版价格表(美元,每百万 Token)

海外业务走新加坡 International 部署,标准实时价:

ModelInput ($/1M)Output ($/1M)上下文
Qwen3.8-Max(2026/8/3 GA 旗舰)$2.00 统一价$6.00 统一价1M
Qwen3.7-Max$2.50 刊例 (五折 $1.25)$7.50 刊例 (五折 $3.75)1M
Qwen3-Max$1.2 → $2.4 → $3.0$6 → $12 → $15262K(32K/128K 分档)
Qwen3.7-Plus$0.48(>256K:$1.44)$1.92(>256K:$5.76)1M
Qwen-Plus低至 $0.40低至 $1.201M
Qwen-Flash低至 $0.05低至 $0.401M
Qwen3.7-Flash约 $0.03–0.07约 $0.13–0.201M
Qwen-Turbo(旧版停更)约 $0.05约 $0.201M

来源:Alibaba Cloud Model Studio Pricing(2026-08-31 更新)。Batch 支持的模型直接半价;缓存与闲时折扣见第四节。

四、选模型就是选成本:四档怎么挑

五、真实业务月费测算

业务场景月调用量推荐模型预估月费
客服机器人,5 万次对话2000 万输入 / 400 万输出Qwen-Flash约 $2.6(¥19)
知识库 RAG 助手,10 万次查询5000 万输入 / 1000 万输出Qwen3.7-Plus约 $43(¥310)
编程 Agent,5000 个重任务3000 万输入 / 1000 万输出Qwen3.8-Max约 $120(¥860)
同上,改走 Batch 离线3000 万输入 / 1000 万输出Qwen3.8-Max Batch约 $60(¥430)
长文档批量处理1 亿输入 / 500 万输出qwen-long(国内 ¥)约 ¥60($8)

结论很清楚:除重度 Agent 场景外,绝大多数生产应用的大模型月开销在几十到几百元区间;而前期开发测试基本被 7000 万免费 Token 全额覆盖。

六、免费额度的准确规则

七、再省一笔的三个杠杆

  1. 开上下文缓存:系统提示词和检索文档跨用户重复时,缓存命中输入仅约一折,RAG 类应用普遍能省 60–80% 输入费。
  2. 非实时任务走 Batch:评测、夜间摘要、批量处理五折,效果完全一致。
  3. 模型路由:Flash 处理简单意图,只把 5–10% 的难请求升级到 Plus/Max。「全程 Max」的应用通常浪费 80% 以上预算。

八、10 分钟上手

  1. 打开 百炼控制台 开通服务,免费 Token 自动到账;海外业务注册国际版并 领取 $200 信用额度
  2. 创建 API Key,用现成的 OpenAI SDK 把 base_url 改成百炼兼容端点即可调用,代码几乎不用改。
  3. 默认从 Flash / Plus 起步,质量不够再升级 Max;提示词稳定后开启缓存。
  4. 需要 7×24 跑自建 Agent 或开源模型的,搭配一台 阿里云 ECS(新用户 38 元/年起) 即可部署网关与调度。

常见问题

Qwen API 免费吗?

托管 API 按 Token 付费,但新账号每个模型送 100 万 Token(合计约 7000 万),90 天有效。Qwen 多数模型同时开源权重,稳定高量业务也可以租 GPU 服务器自建,零 Token 费用。

Qwen3.8-Max 多少钱?

国际版每百万输入 Token $2、输出 $6,1M 上下文全窗口统一价;Batch 半价后实际约 $1/$3。国内价格以百炼控制台为准。

Qwen 和 DeepSeek 谁便宜?

DeepSeek-V4-Flash 输出价更低,Qwen-Plus 输入价略低;两者在百炼同一账号内都能调,建议直接 A/B——对多数业务,模型与任务的适配差异比价差更重要。

价格会经常变吗?

阿里随新模型发布持续降价:Qwen3.7-Max 目前五折、Flash 档不断下探。长期预算建议按刊例价估,促销当作额外空间。

立即开始用 Qwen 构建

国际版 $200 信用额度 · 约 7000 万免费 Token · OpenAI 兼容接口 · 北京 / 新加坡双地域

进入百炼控制台 领取国际版 $200