API 按量计费说明
千问AI平台提供新人免费额度。详见免费额度。
各模型的具体单价请前往模型市场查看。
文本生成
按百万 token 计费,输入和输出分别计价。
阶梯计费:部分模型采用阶梯定价——单价取决于单次请求的输入 token 总量,该请求的所有 token 均按匹配到的阶梯单价结算。
阶梯计费示例
阶梯计费示例
假设某模型设有两档计费区间:0 < token ≤ 32K 和 32K < token ≤ 128K。若单次请求输入 100K token,因数值落在第二区间(32K < 100K ≤ 128K),该请求的所有 token 均按第二档单价结算——而非前 32K 按第一档、后 68K 按第二档。
- Batch 调用 — 输入和输出 token 单价均按实时推理价格的 50% 计费。了解详情 →
- 上下文缓存 — 缓存命中的输入 token 享有折扣,具体折扣比例因模型而异。了解详情 →
- 思考模式 — 思考 token 计入输出 token,按输出价格计费。了解详情 →
- Batch 折扣和缓存折扣不能同时用于同一请求。
图像生成
按输入图像和成功生成的图像张数计费。未说明输入图像价格的模型,输入不计费,仅输出计费。
计费公式:
- 部分模型按输出图像分辨率分档定价。
- 文生图无输入图像,不产生输入费用。
- 请求失败不产生任何费用,也不消耗免费额度。
图像生成计费示例
图像生成计费示例
假设某模型对输入图像和输出图像分别计费,输入单价为 0.02 元/张,输出单价按分辨率分档:1k 档 0.18 元/张、2k 档 0.50 元/张。示例 1:图生图,输出 1k 分辨率,生成 1 张
- 输入费用:0.02 × 1 = 0.02 元
- 输出费用:0.18 × 1 = 0.18 元
- 合计:0.20 元
- 输出费用:0.50 × 2 = 1.00 元
- 合计:1.00 元
视频生成
输入不计费,输出按成功生成的视频秒数计费。
计费公式:
- 部分模型按输出视频分辨率定价(如 720P / 1080P 价格不同)。
- 部分模型按输出视频模式定价(如标准版 / 专业版价格不同)。
- 部分模型按输出视频画幅定价(如 1:1 / 3:4 价格不同)。
- 部分模型采用统一定价,与分辨率、模式或画幅无关。
- 请求失败不产生任何费用,也不消耗免费额度。
视频生成计费示例
视频生成计费示例
假设某模型 720P 单价为 0.60 元/秒。您请求生成一段视频,实际输出 5 秒:
- 费用:0.60 × 5 = 3.00 元
- 费用:1.00 × 5 = 5.00 元
文本转语音
按输入文本的字符数计费(每万字符),输出不计费。
字符计算规则:
- 一个汉字(含简体、繁体、日文汉字、韩文汉字)计为 2 个字符。
- 其他字符(英文字母、数字、标点、空格、日文假名、韩文字母)计为 1 个字符。
- 使用 SSML 时,SSML 标签本身不计入字符数,仅统计待合成的文本内容。
语音转文本
按输入音频的秒数计费,输出不计费。适用于实时语音识别和录音文件识别。
语音对话
语音对话模型(Qwen-Omni 系列)支持文本、音频和图像/视频的输入与输出,按百万 token 计费,不同模态费率不同。
多轮对话计费:与文本模型一致,模型维护完整的对话上下文。历史对话内容会作为后续轮次的输入计费,因此每轮的输入 token 数会随对话轮次增加而逐步增长。
各模态的 token 转换规则因模型而异,详见 Token 计算 →。
向量化与重排序
按百万输入 token 计费,输出不计费。
影响计费的因素:若模型支持 Batch 调用,输入 token 单价按实时推理价格的 50% 计费。
内置工具
部分内置工具除模型 token 费用外,还会收取额外的调用费。
Function calling 和 MCP 不收取工具费——工具描述按输入 token 计费。
降低成本
更多计算示例和进阶策略,请参见成本优化 →。
了解更多
- 免费额度 — 资格与开通方式
- 成本优化 — 进阶优化策略
- Token Plan — AI 编程工具的订阅制方案(按 Credits 计费)
- 账单常见问题 — 常见问题解答
- 账单管理 — 查看用量与发票