本文系统梳理了阿里云大模型服务平台”百炼”支持的各类大模型的计费规则与最新价格。涵盖文本生成模型(千问Max/Plus/Long/Omni/VL/OCR/Audio等系列)、开源模型(Qwen3.8/Qwen3.6/Qwen3.5/Qwen3系列)、第三方模型(DeepSeek/Kimi/GLM/MiniMax等系列)、图像生成模型(千问图像/万相/可灵/Vidu等)、音乐生成、语音合成(TTS)、语音识别(ASR)、视频生成(HappyHorse/万相3.0等)等全品类AI模型的按量计费价格表。文档详细列出了各模型在不同地域(华北2北京、美国弗吉尼亚、新加坡、德国法兰克福、日本东京)的输入/输出单价,部分模型实行阶梯计费(按单次请求Token量分档定价),并介绍了上下文缓存折扣、Batch调用半价、免费额度、Token Plan订阅套餐、Night Plan夜间优惠、模型限时折扣等降本策略。更多模型详情与体验入口,请访问 千问大模型体验中心:https://www.aliyun.com/exp/llm

一、计费模式总览与核心规则
在深入各类模型的具体价格之前,理解百炼平台的基础计费逻辑至关重要。平台默认采用按量计费模式,即根据实际调用的Token数量或生成结果进行扣费。为了满足不同场景下的成本优化需求,百炼提供了多种灵活的计费机制:
1. 阶梯计费规则详解
部分高性能模型实行阶梯计费,其核心逻辑是:单价取决于单次请求的输入Token总量,该请求的所有Token均按对应阶梯单价结算。这意味着,如果你的单次请求输入Token量跨越了某个阶梯阈值,那么整次请求的输入Token都将按照更高阶梯的单价进行计费,而不仅仅是超出的部分。在价格表中,K代表1000,M代表1,000,000。例如,某模型设有两档计费区间:0 < Token ≤ 32K 和 32K < Token ≤ 128K。若输入100K Token,因数值落在第二区间(32K < 100K ≤ 128K),所有Token均按第二档单价结算。开发者在构建应用时,应尽量控制单次请求的上下文长度,避免不必要的Token浪费。
2. 上下文缓存(Context Cache)
对于需要频繁读取相同长文档或系统提示词的场景,百炼提供了显式缓存功能。创建缓存时,按标准输入单价的125%计费;而在后续请求中命中该缓存时,仅需按标准输入单价的10%计费,大幅降低长文本交互成本。
3. Batch调用(异步批量推理)
针对非实时、高吞吐量的数据处理任务,Batch调用模式下的输入和输出Token单价均按实时推理价格的50%计费。适用场景包括大规模数据标注、批量内容生成等。
4. 免费额度与Token Plan
绝大多数模型在首次开通时均提供100万Token的免费额度,部分图像和视频模型提供按张数或秒数计算的免费体验包。此外,百炼推出了Token Plan订阅计划,为高频用户提供更具性价比的包月套餐及用量包。
二、文本生成模型详细价格体系
文本生成是百炼平台最核心的能力板块,涵盖了从旗舰级推理模型到轻量级开源模型的完整产品矩阵。下面按模型系列逐一展开各地域的详细定价。
1. 千问Max系列(旗舰推理)
千问Max系列是百炼平台性能最强的文本生成模型家族,面向复杂推理、专业代码生成、长文档分析等高要求场景。以华北2(北京)地域为例,该系列包含多个版本满足不同需求:
- qwen3.8-max-prime:顶配版本,不区分思考/非思考模式,输入24元/百万Token,输出72元/百万Token,无免费额度。适合对智能水平有极致要求的场景。
- qwen3.8-max:主力旗舰版本,输入12元/百万Token,输出36元/百万Token,提供100万Token免费额度(有效期90天)。支持Batch调用半价(输入6元/输出18元)与上下文缓存折扣(缓存命中输入仅1.5元/百万Token)。
- qwen3.8-max-0902:快照版本,价格与qwen3.8-max一致(输入12元/输出36元),同样提供100万Token免费额度,支持上下文缓存折扣。
- qwen3.7-max系列:包括qwen3.7-max(等同于qwen3.7-max-2026-05-20)、qwen3.7-max-2026-06-08、qwen3.7-max-2026-05-20等版本,统一价格输入12元/输出36元,均含100万Token免费额度,支持Batch半价与上下文缓存折扣。另有qwen3.7-max-preview(仅思考模式)价格相同。
- qwen3.6-max-preview:支持上下文缓存折扣,采用阶梯计费:0-128K区间输入9元/输出54元,128K-256K区间输入15元/输出90元,含100万Token免费额度。
- qwen3-max系列:包括qwen3-max(等同于qwen3-max-2026-01-23)、qwen3-max-2026-01-23、qwen3-max-2025-09-23(仅非思考模式)等版本。采用阶梯计费:0-32K区间输入2.5元/输出10元,32K-128K区间输入4元/输出16元,128K-256K区间输入7元/输出28元,均含100万Token免费额度。
- qwen-max:经典版本,无阶梯计费,统一输入2.4元/百万Token,输出9.6元/百万Token,含100万Token免费额度。
在地域方面,美国弗吉尼亚地域的qwen3.8-max(全球部署)价格与北京一致(输入12元/输出36元),但qwen3.7-max-us(美国部署)价格更高(输入18.736元/输出56.207元)。新加坡地域的qwen3.8-max(国际部署)输入14.988元/输出44.965元,qwen3.7-max系列输入18.736元/输出56.207元。德国法兰克福与日本东京地域的qwen3.8-max系列与北京同价(全球部署),但qwen3-max在法兰克福有欧盟专属版本(输入8.993元/输出44.965元起),高于全球版价格。
2. 千问Plus系列(高性价比)
千问Plus系列在性能与成本之间取得了极佳的平衡,非常适合日常对话、内容创作、客服机器人等高频应用场景。以华北2(北京)地域为例:
- qwen3.7-plus(等同于qwen3.7-plus-2026-05-26):支持0-256K区间输入原价2元(限时8折)、输出8元(限时8折),256K-1M区间输入6元(限时8折)、输出24元(限时8折),含100万Token免费额度,支持Batch半价与上下文缓存折扣。
- qwen3.6-plus系列:0-256K区间输入2元/输出12元,256K-1M区间输入8元/输出48元,含100万Token免费额度。
- qwen3.5-plus系列:0-128K区间输入0.8元/输出4.8元,128K-256K区间输入2元/输出12元,256K-1M区间输入4元/输出24元,含100万Token免费额度。
- qwen-plus系列:0-128K区间输入0.8元/输出2元(思考模式输出8元),128K-256K区间输入2.4元/输出20元(思考24元),256K-1M区间输入4.8元/输出48元(思考64元),含100万Token免费额度,支持Batch半价。
美国弗吉尼亚地域的qwen-plus系列价格与北京一致(全球部署),但qwen-plus-us(美国部署)价格更高。新加坡地域的qwen-plus系列(国际部署)价格约为北京的1.2-1.5倍。德国法兰克福地域的qwen-plus系列有全球版和欧盟版两种定价。
3. 千问Long系列(超长文本)
qwen-long系列专为超长文本处理设计,适合文档摘要、长文阅读等场景。华北2(北京)地域统一价格:输入0.5元/百万Token,输出2元/百万Token,含100万Token免费额度,支持Batch半价。
4. 千问Omni系列(全模态)
千问Omni系列支持文本、图片、视频、音频多模态输入输出,是全能力覆盖的旗舰级多模态模型。华北2(北京)地域定价如下:
- qwen3.5-omni-plus:文本/图片/视频输入7元/百万Token,音频输入53元/百万Token;文本输出40元/百万Token,文本+音频输出213元/百万Token,含100万Token免费额度。
- qwen3.5-omni-flash:文本/图片/视频输入2.2元/百万Token,音频输入18元/百万Token;文本输出13.3元/百万Token,文本+音频输出72元/百万Token,含100万Token免费额度。
- qwen3-omni-flash:文本输入1.8元,音频15.8元,图片/视频3.3元;文本输出6.9元,多模态输入12.7元,文本+音频输出62.6元,含100万Token免费额度。
- qwen-omni-turbo:文本输入0.4元,音频25元,图片/视频1.5元;文本输出1.6元,多模态输入4.5元,文本+音频输出50元,含100万Token免费额度。
5. 千问Omni-Realtime系列(实时语音交互)
面向实时语音对话场景,支持文本和音频的输入输出。华北2(北京)地域:
- qwen3.5-omni-plus-realtime:文本/图片输入10元/百万Token,音频输入80元/百万Token;文本输出60元/百万Token,文本+音频输出300元/百万Token,含100万Token免费额度。
- qwen3.5-omni-flash-realtime:文本/图片输入3.3元,音频27元;文本输出20元,文本+音频输出107元,含100万Token免费额度。
- qwen3-omni-flash-realtime:文本输入2.2元,音频18.9元,图片3.9元;文本输出8.3元,多模态输入15.2元,文本+音频输出75.1元,含100万Token免费额度。
- qwen-omni-turbo-realtime:文本输入1.6元,音频25元,图片6元;文本输出6.4元,多模态输入18元,文本+音频输出50元,含100万Token免费额度。
6. QVQ系列(视觉推理)
- qvq-max:输入8元/百万Token,输出32元/百万Token,含100万Token免费额度。
- qvq-plus:输入2元/百万Token,输出5元/百万Token,含100万Token免费额度。
新加坡地域qvq-max输入8.807元/输出35.228元。
7. 千问VL系列(视觉语言)
千问VL系列支持图像和视频理解。华北2(北京)地域:
- qwen3-vl-plus:0-32K输入1元/输出10元(思维链+回答),32K-128K输入1.5元/输出15元,128K-256K输入3元/输出30元,含100万Token免费额度,支持Batch半价与上下文缓存折扣。
- qwen3-vl-flash:0-32K输入0.15元/输出1.5元,32K-128K输入0.3元/输出3元,128K-256K输入0.6元/输出6元,含100万Token免费额度,支持Batch半价与上下文缓存折扣。
- qwen-vl-max:无阶梯计费,输入1.6元/输出4元,含100万Token免费额度。
- qwen-vl-plus:无阶梯计费,输入0.8元/输出2元,含100万Token免费额度。
美国弗吉尼亚和新加坡、德国法兰克福等地域均有对应定价,新加坡地域价格约为北京的1.2-1.5倍。
8. 千问OCR系列(文档识别)
- qwen3.5-ocr:输入0.5元/百万Token,输出2元/百万Token,含100万Token免费额度。
- qwen-vl-ocr:输入0.3元/百万Token,输出0.5元/百万Token,含100万Token免费额度,支持Batch半价。
- 旧版qwen-vl-ocr(2025-08-28等):输入5元/输出5元,含100万Token免费额度。
9. 千问Audio系列(音频处理)
- qwen-audio-turbo:目前仅供免费体验,免费额度用完后不可调用,推荐使用qwen3.5-omni-plus作为替代模型。
10. 千问专业垂直模型
- 数学模型:qwen-math-plus输入4元/输出12元(100万Token免费);qwen-math-turbo输入2元/输出6元。
- Coder代码模型:qwen3-coder-plus采用阶梯计费(0-32K输入4元/输出16元,32K-128K输入6元/输出24元,128K-256K输入10元/输出40元,256K-1M输入20元/输出200元),含100万Token免费额度,支持上下文缓存折扣。qwen3-coder-flash价格更低(0-32K输入1元/输出4元),含100万Token免费额度。qwen-coder-plus无阶梯统一输入3.5元/输出7元;qwen-coder-turbo无阶梯统一输入2元/输出6元。
- 翻译模型:qwen-mt-plus输入1.8元/输出5.4元(100万Token免费);qwen-mt-flash输入0.7元/输出1.95元;qwen-mt-lite输入0.6元/输出1.6元;qwen-mt-turbo输入0.7元/输出1.95元。
- 数据挖掘:qwen-doc-turbo输入0.6元/输出1元(无免费额度)。
- 深入研究:qwen-deep-research输入54元/输出163元(无免费额度);qwen-deep-research-2025-12-15输入79元/输出236元。
- 通义法睿:farui-plus输入20元/输出20元(无免费额度)。
- 意图理解:tongyi-intent-detect-v3输入0.4元/输出1元(100万Token免费)。
- 角色扮演:qwen-plus-character输入0.8元/输出2元(100万Token免费,Session Cache折扣);qwen-flash-character输入0.25元/输出1.5元;qwen-flash-character-2026-02-26输入0.18元/输出1.5元。新加坡地域qwen-plus-character输入3.747元/输出10.492元。
- 界面交互:gui-plus输入1.5元/输出4.5元(100万Token免费)。
三、开源模型详细价格体系
百炼平台全面开放了通义千问系列开源模型的API服务,开发者可以在云端直接调用开源版本,享受与闭源模型同等的接入体验。
1. Qwen3.8开源版
- qwen3.8-2.4t-a95b:采用2.4万亿参数稀疏MoE架构,每步激活约950亿参数。华北2(北京)输入12元/输出36元(100万Token免费),支持上下文缓存折扣。新加坡(国际)输入14.988元/输出44.965元。
- qwen3.8-27b:27B参数Dense模型。华北2(北京)输入3元/输出12元(100万Token免费),支持上下文缓存折扣。新加坡输入3.646元/输出21.875元。
2. Qwen3.6开源版
华北2(北京):qwen3.6-35b-a3b输入1.8元/输出10.8元(100万Token免费);qwen3.6-27b输入3元/输出18元。美国弗吉尼亚(全球)qwen3.6-35b-a3b价格与北京一致。新加坡(国际)qwen3.6-35b-a3b输入2.81元/输出16.86元;qwen3.6-27b输入4.50元/输出26.98元。德国法兰克福(全球)qwen3.6-35b-a3b价格与北京一致。
3. Qwen3.5开源版
华北2(北京):qwen3.5-397b-a17b(0-128K输入1.2元/输出7.2元,128K-256K输入3元/输出18元);qwen3.5-122b-a10b(0-128K输入0.8元/输出6.4元,128K-256K输入2元/输出16元);qwen3.5-27b(0-128K输入0.6元/输出4.8元,128K-256K输入1.8元/输出14.4元);qwen3.5-35b-a3b(0-128K输入0.4元/输出3.2元,128K-256K输入1.6元/输出12.8元)。均含100万Token免费额度。美国弗吉尼亚(全球)价格与北京一致。新加坡(国际)价格约为北京的1.5倍左右。德国法兰克福(全球)价格与北京一致。
4. Qwen3开源版
华北2(北京):qwen3-next-80b-a3b-thinking(仅思考模式输入1元/输出10元);qwen3-next-80b-a3b-instruct(仅非思考模式输入1元/输出4元);qwen3-235b-a22b-thinking-2507(仅思考模式输入2元/输出20元);qwen3-235b-a22b-instruct-2507(仅非思考模式输入2元/输出8元);qwen3-235b-a22b(输入2元/输出8元,思考20元);qwen3-32b(输入2元/输出8元,思考20元);qwen3-30b-a3b(输入0.75元/输出3元,思考7.5元);qwen3-14b(输入1元/输出4元,思考10元);qwen3-8b(输入0.5元/输出2元,思考5元)。均含100万Token免费额度。美国弗吉尼亚(全球)qwen3-32b输入1.174元/输出4.697元等。新加坡(国际)部分模型无免费额度,价格约为北京的1.1-2.5倍。德国法兰克福(全球)价格与北京一致。
5. Qwen-Omni开源版
华北2(北京):qwen2.5-omni-7b输入文本0.6元/音频38元/图片视频2元;输出文本2.4元/多模态输入6元/文本+音频76元,含100万Token免费额度。新加坡(国际)输入文本0.734元/音频49.61元/图片视频2.055元;输出文本2.936元/多模态输入6.165元/文本+音频99.15元。
6. Qwen3-Omni-Captioner
华北2(北京):qwen3-omni-30b-a3b-captioner输入15.8元/输出12.7元,含100万Token免费额度。新加坡输入27.962元/输出22.458元。
7. Qwen-VL开源版
华北2(北京):qwen3-vl-235b-a22b-thinking(仅思考输入2元/输出20元);qwen3-vl-235b-a22b-instruct(仅非思考输入2元/输出8元);qwen3-vl-32b-thinking(仅思考输入2元/输出20元);qwen3-vl-32b-instruct(仅非思考输入2元/输出8元);qwen3-vl-30b-a3b-thinking(仅思考输入0.75元/输出7.5元);qwen3-vl-30b-a3b-instruct(仅非思考输入0.75元/输出3元);qwen3-vl-8b-thinking(仅思考输入0.5元/输出5元);qwen3-vl-8b-instruct(仅非思考输入0.5元/输出2元)。均含100万Token免费额度。美国弗吉尼亚(全球)价格与北京基本一致。新加坡(国际)价格约为北京的1.2-1.5倍。德国法兰克福(全球)价格与北京一致。
8. Qwen-Audio开源版
华北2(北京):qwen2-audio-instruct目前仅供免费体验,免费额度用完后不可调用,推荐使用qwen-omni-turbo作为替代模型。
9. Qwen-Coder开源版
华北2(北京):qwen3-coder-next(0-32K输入1元/输出4元,32K-128K输入1.5元/输出6元,128K-256K输入2.5元/输出10元);qwen3-coder-480b-a35b-instruct(0-32K输入6元/输出24元,32K-128K输入9元/输出36元,128K-200K输入15元/输出60元);qwen3-coder-30b-a3b-instruct(0-32K输入1.5元/输出6元,32K-128K输入2.25元/输出9元,128K-200K输入3.75元/输出15元)。均含100万Token免费额度。美国弗吉尼亚(全球)价格与北京一致。新加坡(国际)qwen3-coder-next输入2.202元/输出11.009元起等。德国法兰克福(全球)qwen3-coder-30b-a3b-instruct价格与北京一致;qwen3-coder-next在欧盟有专属定价。
四、第三方模型详细价格体系
百炼平台不仅提供自研千问系列模型,还全面接入了多家顶尖AI厂商的模型服务,为用户提供了丰富的选择。
1. DeepSeek系列(阿里云直供)
华北2(北京)地域:deepseek-v4.1-flash支持忙闲时差异化定价(忙时输入2元/输出8元,闲时输入1元/输出4元),含100万Token免费额度,支持上下文缓存折扣。deepseek-v4-pro统一输入12元/输出24元(100万Token免费)。deepseek-v4-pro-0813支持忙闲时定价(忙时输入9元/输出27元,闲时输入4.5元/输出13.5元)。deepseek-v4-flash-0731支持忙闲时定价(忙时输入3元/输出9元,闲时输入1.5元/输出4.5元),含100万Token免费额度。deepseek-v4-flash统一输入1元/输出2元(100万Token免费)。deepseek-v3.2/v3.2-exp输入2元/输出3元(100万Token免费)。deepseek-v3.1输入4元/输出12元。deepseek-r1输入4元/输出16元(支持Batch半价,100万Token免费)。deepseek-r1-distill-qwen-1.5b限时免费。deepseek-r1-distill-qwen-7b输入0.5元/输出1元。deepseek-r1-distill-qwen-14b输入1元/输出3元。deepseek-r1-distill-qwen-32b输入2元/输出6元。deepseek-r1-distill-llama-8b已下线。deepseek-r1-distill-llama-70b目前仅供免费体验。
美国弗吉尼亚、新加坡、德国法兰克福、日本东京等地域均有对应定价,美国专属版本价格略高。
2. DeepSeek-硅基流动
华北2(北京):siliconflow/deepseek-v3.2输入2元/输出3元(无免费额度);siliconflow/deepseek-v3.1-terminus输入4元/输出12元;siliconflow/deepseek-r1-0528输入4元/输出16元;siliconflow/deepseek-v3-0324输入2元/输出8元。
3. DeepSeek-快手万擎
华北2(北京):vanchin/deepseek-v3.2-think输入2元/输出3元(无免费额度,支持上下文缓存折扣);vanchin/deepseek-v3.1-terminus输入4元/输出12元;vanchin/deepseek-r1输入4元/输出16元;vanchin/deepseek-v3输入2元/输出8元;vanchin/deepseek-ocr输入0.216元/输出0.216元;vanchin/deepseek-v4-pro输入12元/输出24元;vanchin/deepseek-v4-pro-0813输入9元/输出27元。
4. Kimi系列(直接接入)
华北2(北京):kimi-k3(仅思考模式输入20元/输出100元,100万Token免费);kimi-k2.7-code(仅思考模式输入6.5元/输出27元,100万Token免费);kimi-k2.6(非思考和思考模式输入6.5元/输出27元,100万Token免费);kimi-k2.5(非思考和思考模式输入4元/输出21元,100万Token免费);kimi-k2-thinking(仅思考模式输入4元/输出16元,100万Token免费);Moonshot-Kimi-K2-Instruct(非思考模式输入4元/输出16元,100万Token免费)。美国弗吉尼亚、德国法兰克福、日本东京(全球部署)价格与北京一致。新加坡(国际)kimi-k3输入21.875元/输出109.376元等。
5. Kimi-月之暗面(代理接入)
华北2(北京):kimi/kimi-k3输入20元/输出100元(无免费额度,支持上下文缓存折扣);kimi/kimi-k2.7-code-highspeed输入13元/输出54元;kimi/kimi-k2.7-code输入6.5元/输出27元;kimi/kimi-k2.6输入6.5元/输出27元;kimi/kimi-k2.5输入4元/输出21元。
6. GLM系列(智谱AI直供)
华北2(北京):glm-5.2(非思考和思考模式不区分阶梯输入8元/输出28元,100万Token免费);glm-5.2-fast-preview(不区分阶梯输入16元/输出56元,无免费额度);glm-5.1(0-32K输入6元/输出24元,32K-200K输入8元/输出28元,100万Token免费);glm-5(0-32K输入4元/输出18元,32K-198K输入6元/输出22元,100万Token免费);glm-4.7(0-32K输入3元/输出14元,32K-166K输入4元/输出16元,100万Token免费);glm-4.6(0-32K输入3元/输出14元,32K-166K输入4元/输出16元,100万Token免费);glm-4.5(0-32K输入3元/输出14元,32K-96K输入4元/输出16元,100万Token免费);glm-4.5-air(0-32K输入0.8元/输出6元,32K-96K输入1.2元/输出8元,100万Token免费)。美国弗吉尼亚(全球)glm-5.2输入8元/输出28元;glm-5.2-us(美国)输入10.492元/输出32.974元。新加坡(国际)glm-5.2输入10.492元/输出32.974元(100万Token免费);glm-5.1输入10.492元/输出32.974元(100万Token免费)。德国法兰克福(全球)glm-5.2输入8元/输出28元;glm-5.1输入6元/输出24元(0-32K)或8元/输出28元(32K-200K)。日本东京(全球)glm-5.1支持上下文缓存折扣。
7. GLM-智谱(代理接入)
华北2(北京):ZHIPU/GLM-5.3输入8元/输出28元(无免费额度);ZHIPU/GLM-5.3-Flash仅思考模式输入0.8元/输出2.8元;ZHIPU/GLM-5.2输入8元/输出28元;ZHIPU/GLM-5.1输入8元/输出28元;ZHIPU/GLM-5输入6元/输出22元。均无免费额度。
8. MiniMax(直接接入)
华北2(北京):MiniMax-M2.5(仅思考模式输入2.1元/输出8.4元,100万Token免费);MiniMax-M2.1(仅思考模式输入2.1元/输出8.4元,100万Token免费)。
9. MiniMax-稀宇科技(代理接入)
华北2(北京):MiniMax/MiniMax-M3(非思考和思考模式输入4.2元/输出16.8元,无免费额度,支持上下文缓存折扣);MiniMax/MiniMax-M2.7(仅思考模式输入2.1元/输出8.4元);MiniMax/MiniMax-M2.5(仅思考模式输入2.1元/输出8.4元);MiniMax/MiniMax-M2.1(仅思考模式输入2.1元/输出8.4元)。均支持上下文缓存折扣。
10. MiMo-小米
华北2(北京):xiaomi/mimo-v2.5-pro(0-256K输入7元/输出21元,256K-1M输入14元/输出42元,无免费额度)。
11. Stepfun-阶跃星辰
华北2(北京):stepfun/step-3.7-flash输入1.35元/输出8.1元(无免费额度)。
12. Unisound-云知声
华北2(北京):unisound/unisound-u2输入1元/输出2元(无免费额度)。
五、图像与视频生成模型收费标准
多模态生成是百炼平台的另一大亮点,涵盖文生图、图像编辑、文生视频等丰富能力。
1. 图像生成与编辑
图像模型通常按输出图像张数计费,部分模型对输入也收取微量费用。
- 千问图像3.0:qwen-image-3.0-pro生成1K分辨率图像0.25元/张(输入0.02元/张),2K为0.5元/张(输入0.5元/张);输入输出共10张免费。qwen-image-3.0生成1K分辨率图像0.18元/张(输入0.02元/张),2K为0.18元/张(输入0.5元/张);输入输出共10张免费。
- 千问文生图:qwen-image-2.0-pro系列0.5元/张(100张免费);qwen-image-2.0系列0.2元/张(100张免费);qwen-image-max系列0.5元/张(100张免费);qwen-image-plus系列0.2元/张(100张免费);qwen-image 0.25元/张(100张免费)。
- 千问图像编辑:qwen-image-2.0-pro系列0.5元/张(100张免费);qwen-image-edit-max系列0.5元/张(100张免费);qwen-image-edit-plus系列0.2元/张(100张免费);qwen-image-edit 0.3元/张(100张免费)。
- 千问图像翻译:qwen-mt-image-2.0 0.004元/张(100张免费);qwen-mt-image 0.003元/张(100张免费)。
- Z-Image:z-image-turbo关闭提示词改写0.1元/张,开启提示词改写0.2元/张(100张免费)。
- 万相文生图:wan2.6-t2i和wan2.5-t2i-preview均为0.20元/张(50张免费);wan2.2-t2i-plus 0.20元/张(100张免费);wan2.2-t2i-flash 0.14元/张(100张免费);wanx2.1-t2i-plus 0.20元/张(500张免费);wanx2.1-t2i-turbo 0.14元/张(500张免费);wanx2.0-t2i-turbo 0.04元/张(500张免费);wanx-v1 0.16元/张(500张免费)。
- 万相图像生成与编辑:wan2.7-image-pro 0.50元/张(50张免费);wan2.7-image 0.20元/张(50张免费);wan2.6-image 0.20元/张(50张免费)。
- 万相通用图像编辑:wan2.5-i2i-preview 0.20元/张(50张免费);wanx2.1-imageedit 0.14元/张(500张免费)。
- 万相涂鸦作画:wanx-sketch-to-image-lite 0.06元/张(500张免费)。
- 万相图像局部重绘:wanx-x-painting目前仅供免费体验(500张免费)。
- 人像风格重绘:wanx-style-repaint-v1 0.12元/张(500张免费)。
- 图像背景生成:wanx-background-generation-v2 0.08元/张(500张免费)。
- 图像画面扩展:image-out-painting 0.18元/张(500张免费)。
- 人物实例分割:image-instance-segmentation目前仅供免费体验(500张免费)。
- 图像擦除补全:image-erase-completion目前仅供免费体验(500张免费)。
- 虚拟模特:wanx-virtualmodel/virtualmodel-v2目前仅供免费体验(各500张免费)。
- 鞋靴模特:shoemodel-v1目前仅供免费体验(500张免费)。
- 创意海报生成:wanx-poster-generation-v1目前仅供免费体验(500张免费)。
- 人物写真生成-FaceChain:facechain-facedetect限时免费;facechain-finetune 2.5元/次(50次免费);facechain-generation 0.18元/张(500张免费)。
- 创意文字生成-WordArt锦书:wordart-texture 0.08元/张(500张免费);wordart-semantic 0.24元/张。
- AI试衣-OutfitAnyone:aitryon 0.20元/张(400张免费),阶梯折扣生成量越大单价越低,超过2.5万张可享5折优惠(0.15元/张);aitryon-plus 0.50元/张(400张免费);aitryon-parsing-v1 0.004元/张(400张免费);aitryon-refiner阶梯定价,生成数量≤25张0.30元/张,25-125张0.275元/张(9.2折),125-250张0.25元/张(8.4折),250-1250张0.225元/张(7.5折),1250-2500张0.20元/张(6.7折),2500-2.5万张0.175元/张(5.8折),>2.5万张0.15元/张(5折)。
2. 第三方图像生成
- 可灵图像生成:kling/kling-v3-image-generation 1K输出0.2元/张,2K输出0.2元/张(无免费额度);kling/kling-v3-omni-image-generation 1K/2K输出0.2元/张,4K输出0.4元/张。
- Vidu图像生成:vidu/vidu-image_reference2image 1K输出0.625元/张,2K输出1元/张,4K输出1.46875元/张(无免费额度);vidu/vidu-image-pro_reference2image 1K输出1.6875元/张,2K输出3.1875元/张,4K输出5.125元/张;vidu/vidu-image-lite_reference2image 1K输出0.3125元/张,2K输出0.34375元/张,4K输出0.40625元/张;vidu/viduq3-fast_reference2image 1K输出0.46875元/张,2K输出0.78125元/张,4K输出1.09375元/张;vidu/viduq2-pro_reference2image 1K输出0.9375元/张,2K输出0.9375元/张,4K输出1.71875元/张;vidu/viduq2-fast_reference2image 1K输出0.28125元/张。
3. 视频生成
视频生成模型输入通常不计费,仅按输出视频秒数计费。
- HappyHorse文生视频:happyhorse-1.1-t2v 480P输出0.45元/秒,720P输出0.9元/秒,1080P输出1.2元/秒(10秒免费);happyhorse-1.0-t2v 720P输出0.9元/秒,1080P输出1.6元/秒(10秒免费)。
- HappyHorse图生视频-基于首帧:happyhorse-1.1-i2v 480P输出0.45元/秒,720P输出0.9元/秒,1080P输出1.2元/秒(10秒免费);happyhorse-1.0-i2v 720P输出0.9元/秒,1080P输出1.6元/秒(10秒免费)。
- HappyHorse参考生视频:happyhorse-1.1-r2v 480P输出0.45元/秒,720P输出0.9元/秒,1080P输出1.2元/秒(10秒免费);happyhorse-1.0-r2v 720P输出0.9元/秒,1080P输出1.6元/秒(10秒免费)。
- HappyHorse视频编辑:happyhorse-1.0-video-edit 720P输入和输出0.9元/秒(限时8折),1080P输入和输出1.6元/秒(限时8折)(10秒免费)。
- 万相3.0视频生成:wan3.0-video-prime 480P输入和输出0.45元/秒,720P输入和输出0.9元/秒,1080P输入和输出1.8元/秒(30秒免费);wan3.0-video目前享受限时7折优惠,480P输入和输出原价0.3元/秒(折后0.21元/秒),720P输入和输出原价0.6元/秒(折后0.42元/秒),1080P输入和输出原价1.2元/秒(折后0.84元/秒)(30秒免费)。
- 万相文生视频:wan2.7-t2v系列 720P输出0.6元/秒,1080P输出1元/秒(50秒免费);wan2.6-t2v 720P输出0.6元/秒,1080P输出1元/秒(50秒免费);wan2.5-t2v-preview 480P输出0.3元/秒,720P输出0.6元/秒,1080P输出1元/秒(50秒免费);wan2.2-t2v-plus 480P输出0.14元/秒,1080P输出0.70元/秒(50秒免费);wanx2.1-t2v-turbo 480P输出0.24元/秒,720P输出0.24元/秒(200秒免费);wanx2.1-t2v-plus 720P输出0.70元/秒(200秒免费)。
- 万相图生视频:wan2.7-i2v有声视频720P输出0.6元/秒,1080P输出1元/秒(50秒免费)。
- 万相图生视频-基于首帧:wan2.6-i2v-flash有声视频720P输出0.3元/秒,1080P输出0.5元/秒;无声视频720P输出0.15元/秒,1080P输出0.25元/秒(50秒免费);wan2.6-i2v有声视频720P输出0.6元/秒,1080P输出1元/秒(50秒免费);wan2.5-i2v-preview有声视频480P输出0.3元/秒,720P输出0.6元/秒,1080P输出1元/秒(50秒免费);wan2.2-i2v-flash无声视频480P输出0.10元/秒,720P输出0.20元/秒,1080P输出0.48元/秒(50秒免费);wan2.2-i2v-plus无声视频480P输出0.14元/秒,1080P输出0.70元/秒(50秒免费);wanx2.1-i2v-turbo无声视频480P输出0.24元/秒,720P输出0.24元/秒(200秒免费);wanx2.1-i2v-plus无声视频720P输出0.70元/秒(200秒免费)。
六、语音与音乐生成模型收费标准
1. 音乐生成
华北2(北京):fun-music-preview 0.005元/秒(1000秒免费);fun-music-v1 0.002元/秒。
2. 语音合成(TTS)
语音合成主要按输入字符数或Token数计费,输出音频不计费。
- Qwen-Audio-TTS:qwen-audio-3.0-tts-plus输入1.4元/万字符(1万字符免费);qwen-audio-3.0-tts-flash输入1元/万字符(1万字符免费)。
- Qwen-TTS:qwen3-tts-instruct-flash系列输入0.8元/万字符(1万字符免费),输出不计费;qwen3-tts-vd系列输入0.8元/万字符(1万字符免费),输出不计费;qwen3-tts-vc系列输入0.8元/万字符(1万字符免费),输出不计费;qwen3-tts-flash系列输入0.8元/万字符(1万字符免费),输出不计费;qwen-tts-flash系列输入1.6元/百万Token,输出10元/百万Token(100万Token免费)。
- Qwen-TTS-Realtime:qwen3-tts-instruct-flash-realtime系列输入1元/万字符(1万字符免费),输出不计费;qwen3-tts-vd-realtime系列输入1元/万字符(1万字符免费),输出不计费;qwen3-tts-vc-realtime系列输入1元/万字符(1万字符免费),输出不计费;qwen3-tts-flash-realtime系列输入1元/万字符(1万字符免费),输出不计费;qwen-tts-realtime系列输入2.4元/百万Token,输出12元/百万Token(100万Token免费)。
- Qwen-TTS声音复刻:qwen-voice-enrollment 0.01元/个音色(1000个音色/账号免费)。
- Qwen-TTS声音设计:qwen-voice-design 0.2元/个音色(10个音色/账号免费)。
- CosyVoice:cosyvoice-v3.5-plus输入1.5元/万字符(1万字符免费);cosyvoice-v3.5-flash输入0.8元/万字符(1万字符免费);cosyvoice-v3-plus输入2元/万字符(1万字符免费);cosyvoice-v3-flash输入1元/万字符(1万字符免费);cosyvoice-v2输入2元/万字符(1万字符免费);cosyvoice-v1输入2元/万字符(1万字符免费)。
- Sambert:1元/万字符(每主账号每模型每月3万字符免费)。
- MiniMax语音合成:MiniMax/speech-2.8-hd 3.5元/万字符,复刻音色9.9元;MiniMax/speech-02-hd 3.5元/万字符;MiniMax/speech-2.8-turbo 2元/万字符;MiniMax/speech-02-turbo 2元/万字符。复刻音色费用在首次使用该音色进行语音合成时收取。
3. 语音识别(ASR)与实时对话
- 千问-LiveTranslate-Flash-Realtime:qwen3.5-livetranslate-flash-realtime输入音频40元/百万Token,输入图片3.3元/百万Token,输出文本100元/百万Token,输出音频160元/百万Token(100万Token免费);qwen3-livetranslate-flash-realtime输入音频64元/百万Token,输入图片8元/百万Token,输出文本64元/百万Token,输出音频240元/百万Token(100万Token免费)。
- 千问-LiveTranslate-Flash:qwen3-livetranslate-flash输入音频10元/百万Token,输入图片4元/百万Token,输出文本10元/百万Token,输出音频40元/百万Token(100万Token免费)。
- Qwen-Audio-3.0-ASR-Flash-Streaming:qwen-audio-3.0-asr-flash-streaming 0.00033元/秒(36000秒/10小时免费)。
- Qwen-Audio-3.0-ASR-Flash-Filetrans:qwen-audio-3.0-asr-flash-filetrans 0.00022元/秒(36000秒/10小时免费)。
- Qwen-Audio-3.0-ASR-Flash:qwen-audio-3.0-asr-flash 0.00022元/秒(36000秒/10小时免费)。
- 千问ASR:qwen3-asr-flash-filetrans 0.00022元/秒(36000秒/10小时免费),输出不计费;qwen3-asr-flash 36000秒/10小时免费。
- 千问ASR-Realtime:qwen3-asr-flash-realtime 0.00033元/秒(36000秒/10小时免费)。
- Fun-ASR录音文件识别:fun-asr 0.00022元/秒(36000秒/10小时免费);fun-asr-flash-2026-06-15 0.00022元/秒(36000秒/10小时免费)。
- Fun-ASR实时语音识别:fun-asr-realtime 0.00033元/秒(36000秒/10小时免费);fun-asr-flash-8k-realtime 0.00022元/秒(36000秒/10小时免费)。
- Paraformer录音文件识别:paraformer-v2 0.00008元/秒(36000秒/10小时免费,每月1日0点自动发放有效期1个月)。
- Paraformer实时语音识别:paraformer-realtime-v2 0.00024元/秒(36000秒/10小时免费,每月1日0点自动发放有效期1个月)。
4. 实时语音对话
实时语音对话模型支持文本和音频的输入与输出,按输入Token和输出Token分别计费。音频Token按时长折算:总Token数 = 音频时长(单位:秒)× 12.5,不足1秒按1秒计算。华北2(北京)地域:
- qwen-audio-3.0-realtime-plus:文本输入5元/百万Token,音频输入40元/百万Token,文本输出40元/百万Token,音频输出150元/百万Token(100万Token免费)。
- qwen-audio-3.0-realtime-flash:文本输入3元/百万Token,音频输入30元/百万Token,文本输出30元/百万Token,音频输出100元/百万Token(100万Token免费)。
随着对话轮次增加,上下文累积的Token数量会逐步增长。建议合理控制单次会话的对话轮数,或在适当时机开启新会话,以优化使用成本。
七、Token消耗与成本控制建议
在使用百炼平台的过程中,合理的架构设计与调用策略能显著降低使用成本:
- 文件传输优化:通过URL读取文件时,文件传输本身不消耗Token,仅在解析后转化为输入Token计费。建议尽量使用URL传参而非Base64编码。如果需要处理大文件,建议使用知识库切片索引以降低Token消耗。
- 控制上下文长度:单次请求Credits消耗异常高,通常是因为输入Token量过大或启用了Agent模式(会产生大量system prompt、工具定义及思考内容开销)。建议定期压缩历史消息、适时新开对话、在非必要场景关闭思考模式,或切换至Flash等轻量模型。
- 善用缓存与Batch:对于重复的System Prompt或长文档,务必开启上下文缓存;对于离线任务,坚决使用Batch调用以享受半价优惠。两者不能同时生效,需根据场景选择最优策略。
- 低频场景选型:对于简单的意图识别、分类或轻量级对话,推荐使用Qwen Flash系列或开源小模型,成本可降低数个数量级。
- 注意已下线模型:Qwen2.5系列等已下线模型不再可用,也无法查询价格,请使用新版模型替代。
八、最新优惠活动与Token Plan订阅计划
为了帮助开发者更低成本地接入大模型,百炼推出了丰富的订阅计划与限时活动。
1. 免费额度
- 新用户赠送:新用户开通百炼平台即可领取超1亿免费Tokens,有效期为90天。这一额度足以支撑中小规模的完整POC验证。
- 模型体验额度:登录后每个模型免费赠送100万tokens推理额度,方便用户在多款模型之间横向实测对比。
- 额度管理:用户可在控制台开启”免费额度用完即停”功能,避免免费额度耗尽后产生意外扣费。
更多免费额度详情可参考 新免费额度说明。

2. Token Plan个人版限时优惠
Token Plan是百炼推出的订阅制套餐,目前Qwen3.8-Max已同步首发并支持个人版订阅,曾有限时加量活动。
- Lite套餐:限时39元/月(原价60元/月),每7天限额2,500 Credits。适合轻度使用的个人开发者与AI爱好者。
- Standard套餐:限时139元/月(原价180元/月),每7天限额10,000 Credits。面向日常有稳定调用需求的自由职业者与小型团队。
- Pro套餐:限时499元/月(原价600元/月),每7天限额40,000 Credits。为重度用户和专业开发者提供充足额度。
- 用量包:100元/个/月,包含20,000 Credits,不受7天窗口限额约束。需有效订阅后购买。
活动详情可参考:https://www.aliyun.com/benefit/scene/tokenplan

3. Night Plan夜间优惠
针对非实时业务,百炼推出了夜间折扣。Qwen3.8-Max、Qwen3.8-Flash等模型在22:00后调用可享限时折扣,低至4折起,Qoder/Meoo客户直接生效。团队版部分模型(deepseek-v4-pro-0813、deepseek-v4-flash-0731、deepseek-v4.1-flash)每晚22:00至次日08:00期间Credits消耗享5折优惠。活动详情可参考:https://www.aliyun.com/benefit/client/nightplan

4. Harness权益(Standard与Pro套餐附赠)
Standard与Pro套餐附赠Harness权益,每月提供免费额度覆盖联网搜索增强版、垂类搜索、网页解析、图像生成、语音合成、语音识别、代码解释器等AgentStudio工具,额度按月发放且不占用套餐Credits。免费额度用尽后,超出部分按原目录价88折继续计费。Harness权益使用百炼API Key(sk-xxx)调用,与Token Plan专属API Key(sk-sp-xxx)不可混用。
5. Token Plan团队版
- 标准座席:限时150元/座席/月(原价198元),月度额度25,000 Credits/月,无7天窗口限额。
- 高级座席:限时550元/座席/月(原价698元),月度额度100,000 Credits/月,无7天窗口限额。
- 尊享座席:1,398元/座席/月,月度额度250,000 Credits/月,无7天窗口限额。
- 共享用量包:5,000元/个/月,包含625,000 Credits。
6. 视频生成限时折扣
即日起至9月23日,阿里云百炼和千问AI平台的Wan3.0标准版API调用,Wan3.0视频生成模型享受后付费限时7折优惠,折后价格:480P 0.21元/秒、720P 0.42元/秒、1080P 0.84元/秒。对于需要将文本理解(Qwen系列)与视频生成(Wan系列)结合的多模态内容创作管线,这是构建端到端AI视频工作流的好时机。活动详情可参考:https://www.aliyun.com/benefit/scene/wan

7. 模型限时折扣
- Qwen3.7-Plus和Qwen3.7-Flash的部分计费项展示有限时8折优惠。
- Qwen3.8-Max的Batch Chat计费项展示有限时5折优惠——这意味着在北京地域使用Batch Chat调用Max,输入可低至6元、输出可低至18元每百万tokens,旗舰级智能以中端价格获取。
注意事项
- Token Plan目前仅支持华北2(北京)地域,需在控制台切换地域后购买使用。
- 个人版不支持自助退订,Harness权益随订阅失效而终止。
- 以上价格、折扣及额度信息可能随活动调整,请以 Token Plan购买页 或 阿里云百炼平台 实时显示为准。
👉友情提示:购买之前,别忘了先领阿里云免费赠送的折扣优惠券:
https://www.aliyun.com/minisite/goods 领了之后再买活动中的所有云产品,均可享受活动价格额外折扣,最高可减12500元。

九、结语与选型建议
阿里云百炼平台构建了从基础文本推理到全模态生成的完整模型矩阵,其阶梯计费、缓存机制与丰富的订阅计划为不同规模的开发者提供了极大的灵活性。本文系统梳理了平台支持的各类模型的收费体系,从旗舰级的千问Max系列到轻量级的Flash系列,从自研模型到第三方模型,从文本生成到图像、视频、语音等多模态能力,涵盖了开发者可能涉及的全部场景。
选型建议:
- 追求极致性能与复杂推理:首选 qwen3.8-max 或 deepseek-r1,配合上下文缓存降低成本。
- 日常业务与高并发对话:qwen3.7-plus 或 qwen-plus 是性价比之王,建议结合Token Plan Standard套餐使用。
- 长文本处理与文档分析:使用 qwen-long 或 qwen3.5-plus 的长上下文窗口。
- 多媒体内容创作:图像生成推荐 wan2.6-t2i 或 qwen-image-3.0;视频生成首选享受7折优惠的 wan3.0-video。
- 语音与实时交互:TTS推荐 cosyvoice-v3.5-flash;实时语音对话使用 qwen-audio-3.0-realtime-flash。
- 成本敏感型离线任务:务必使用Batch调用,并优先选择Flash系列或开源小模型。
- 开源部署需求:qwen3.8-2.4t-a95b 和 qwen3.8-27b 提供开源版本,可根据算力条件选择。
开发者应密切关注百炼平台的 最新公告,根据业务场景的动态变化灵活调整模型组合与计费策略,以实现技术效果与商业成本的最优平衡。