跳转到主要内容
非实时

非实时语音合成 Qwen-Audio-TTS/CosyVoice HTTP API

非实时语音合成 HTTP 调用方法,支持非流式和流式两种调用模式。

POST
/services/audio/tts/SpeechSynthesizer
curl -X POST https://dashscope.aliyuncs.com/api/v1/services/audio/tts/SpeechSynthesizer \
-H "Authorization: Bearer $DASHSCOPE_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"qwen-audio-3.0-tts-flash","input":{"text":"我家的后面有一个很大的花园。","voice":"longanhuan_v3.6","format":"wav","sample_rate":24000}}'
{
  "request_id": "ee88b03d-0457-9286-8c67-xxxx",
  "output": {
    "finish_reason": "stop",
    "audio": {
      "data": "",
      "url": "http://dashscope-result-bj.oss-cn-beijing.aliyuncs.com/.../ee88b03d.wav",
      "id": "audio_ee88b03d",
      "expires_at": 1772697707
    }
  },
  "usage": {
    "characters": 15
  }
}
使用指南:模型概览和音色选择请参见语音合成模型;SSML 与 LaTeX 用法请参见 SSML 非实时语音合成支持非流式(一次性返回完整音频)和流式(边合成边返回)两种调用模式。

鉴权

string
header
必填

格式为Bearer $DASHSCOPE_API_KEY。

Header 参数

enum<string>

流式合成时设为enable。

enable

请求体

application/json
enum<string>
必填

语音合成模型。

取值范围:

  • qwen-audio-3.0-tts-plus
  • qwen-audio-3.0-tts-flash
  • cosyvoice-v3.5-plus
  • cosyvoice-v3.5-flash
  • cosyvoice-v3-plus
  • cosyvoice-v3-flash
  • cosyvoice-v2
qwen-audio-3.0-tts-plus,qwen-audio-3.0-tts-flash,cosyvoice-v3.5-plus,cosyvoice-v3.5-flash,cosyvoice-v3-plus,cosyvoice-v3-flash,cosyvoice-v2
object
必填

响应

200-application/json
string

本次调用的唯一标识符。

object
object