跳转到主要内容
对话模型

Anthropic Messages API 参考

通过 Anthropic SDK 调用 Qwen 模型

POST
/apps/anthropic/v1/messages
import anthropic
import os

client = anthropic.Anthropic(
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    base_url="https://dashscope.aliyuncs.com/apps/anthropic",
)

message = client.messages.create(
    model="qwen3.7-plus",
    max_tokens=1024,
    system="You are a helpful assistant",
    messages=[
        {
            "role": "user",
            "content": "你是谁?"
        }
    ],
    thinking={"type": "disabled"},
)

print(message.content[0].text)
{
  "id": "msg_e2898f19-fc0e-4cb3-bd9b-5b7dc4ea3bc9",
  "type": "message",
  "role": "assistant",
  "model": "qwen3.7-plus",
  "content": [
    {
      "type": "thinking",
      "thinking": "让我分析一下这个问题...",
      "signature": ""
    },
    {
      "type": "text",
      "text": "你好!我是通义千问..."
    }
  ],
  "stop_reason": "end_turn",
  "stop_sequence": null,
  "usage": {
    "input_tokens": 22,
    "output_tokens": 223,
    "cache_creation_input_tokens": 0,
    "cache_read_input_tokens": 0
  }
}

FAQ

配置 Claude Desktop 或 Claude Code 后,连接测试报 Model discovery — Gateway /v1/models returned HTTP 404,或请求 URL 中出现 /v1/v1/models,如何解决? Claude Desktop、Claude Code 等客户端的模型发现功能会自动在配置的 base URL 后追加 /v1/models。请检查以下两点:
  • base URL 不要以 /v1/ 结尾:应以 /apps/anthropic 结尾(例如 https://dashscope.aliyuncs.com/apps/anthropic)。如果误输入 .../apps/anthropic/v1/,客户端追加后会产生重复路径 /v1/v1/models,返回 HTTP 404。
  • 手动添加模型以跳过发现:Anthropic 兼容端点仅提供 Messages API(/v1/messages),不提供模型列表端点(/v1/models),因此模型发现请求也会返回 404。在客户端的 Models 中手动添加模型(例如 qwen3.8-max)即可跳过自动发现。

鉴权

string
header
必填

通过 x-api-key 请求头传入千问AI平台 API Key。也支持 Authorization: Bearer 请求头,二者选其一即可。

请求体

application/json
string
必填

模型名称。支持范围如下:

千问Max:qwen3.8-max、qwen3.7-max、qwen3.7-max-2026-06-08、qwen3.7-max-2026-05-20、qwen3.6-max-preview、qwen3-max、qwen3-max-2026-01-23、qwen3-max-preview

千问Plus:qwen3.6-plus、qwen3.6-plus-2026-04-02、qwen3.5-plus、qwen3.5-plus-2026-04-20、qwen3.5-plus-2026-02-15、qwen-plus、qwen-plus-latest、qwen-plus-2025-09-11

千问Flash:qwen3.7-flash、qwen3.7-flash-2026-07-15、qwen3.6-flash、qwen3.6-flash-2026-04-16、qwen3.5-flash、qwen3.5-flash-2026-02-23、qwen-flash、qwen-flash-2025-07-28

千问Turbo:qwen-turbo、qwen-turbo-latest

千问Coder:qwen3-coder-next、qwen3-coder-plus、qwen3-coder-plus-2025-09-23、qwen3-coder-flash

千问VL:qwen3-vl-plus、qwen3-vl-flash、qwen-vl-max、qwen-vl-plus

千问开源模型:qwen3.6-27b、qwen3.5-397b-a17b、qwen3.5-122b-a10b、qwen3.5-27b、qwen3.5-35b-a3b、qwen3.8-2.4t-a95b

第三方模型:deepseek-v4-pro-0813、deepseek-v4-pro、deepseek-v4-flash、deepseek-v4-flash-0731、deepseek-v3.2、kimi-k2.7-code、kimi-k2.6、kimi-k2.5、kimi-k2-thinking、glm-5.2、glm-5.1、glm-5、glm-4.7、glm-4.6、MiniMax-M2.5、MiniMax-M2.1

integer
必填

模型回复内容的最大 Token 数。模型输出超过此值时生成将提前停止,stop_reasonmax_tokens

  • deepseek-v4-pro-0813、deepseek-v4-pro、deepseek-v4-flash、deepseek-v4-flash-0731、qwen3.8-max:max_tokens 为模型回复内容和思维链内容之和的最大 Token 数,限制模型回复内容+思考过程的长度。开启深度思考时,max_tokens > thinking.budget_tokens
  • glm-5.2:不传入 thinking.budget_tokens 参数时,max_tokens 为模型回复内容和思维链内容之和的最大 Token 数,模型输出超过此值时生成将提前停止,stop_reasonmax_tokens;传入 thinking.budget_tokens 参数时,max_tokens 仅为模型回复内容的最大 Token 数,思考部分的 Token 数由 thinking.budget_tokens 单独控制。
  • 其他模型:max_tokens 不限制思考过程的长度。开启深度思考时,思考部分的 Token 数由 thinking.budget_tokens 单独控制。
object[]
必填

消息数组,按对话顺序排列。

string

系统提示词,用于设定模型的角色或行为。system 通过顶层参数传入,messages 数组中不接受 system 角色。传入字符串等价于单个 type="text" 的内容块。当需要为系统提示词标记显式缓存断点时,必须传入数组形式。

boolean
默认值false

是否启用流式输出,默认为 false

number

控制生成文本的多样性,取值范围 [0, 2)。值越大,生成结果越随机。该范围与 Anthropic 官方的 [0.0, 1.0] 不同,从 Anthropic 迁移时请确认该参数取值。

qwen3.8-max 说明:思考模式下默认值为 0.6,传入值小于 0.6 时自动调整为 0.6。

number

核采样的概率阈值,控制生成文本的多样性。temperaturetop_p 均可控制多样性,建议只设置其中一个值。

integer

生成过程中采样候选集的大小。

string[]

指定停止生成的文本序列。模型生成到该序列前会停止输出,且不包含该序列本身。命中后,响应的 stop_reason 仍为 end_turn,响应不会回填命中的序列。

object

深度思考配置。开启后,模型会在生成回复前先进行推理,以提升回答准确度。开启后,响应会包含 thinking 类型的内容块。

object[]

工具定义数组,用于 Function Call 场景。

object

工具选择策略。{"type": "auto"}:模型自行决定是否调用工具(默认)。{"type": "any"}:强制调用任意一个工具。{"type": "none"}:禁止调用工具。{"type": "tool", "name": "tool_name"}:强制调用指定工具。

object

输出参数设置。

响应

200-application/json
string

消息的唯一标识。

enum<string>

固定为 message

message
enum<string>

固定为 assistant

assistant
string

使用的模型名称。

object[]

内容数组,元素类型可为 text(文本信息)、thinking(思考信息,开启深度思考时返回)或 tool_use(工具调用信息)。

enum<string>

停止原因:end_turn(正常结束)、max_tokens(达到 Token 上限)、tool_use(工具调用)。

end_turn,max_tokens,tool_use
string | null

固定为 null

object

Token 用量统计。流式调用中,message_start 事件的 usage 仅包含 input_tokensoutput_tokens;完整 4 个字段在 message_delta 事件中返回。