跳转到主要内容
重排序

DashScope 重排序

DashScope 重排序 API

POST
/services/rerank/text-rerank/text-rerank
curl --location 'https://dashscope.aliyuncs.com/api/v1/services/rerank/text-rerank/text-rerank' \
  --header "Authorization: Bearer $DASHSCOPE_API_KEY" \
  --header 'Content-Type: application/json' \
  --data '{
  "model": "qwen3.7-text-rerank",
  "input": {
    "query": "什么是文本排序模型",
    "documents": [
      "文本排序模型广泛用于搜索引擎和推荐系统中,它们根据文本相关性对候选文本进行排序",
      "量子计算是计算科学的一个前沿领域",
      "预训练语言模型的发展给文本排序模型带来了新的进展"
    ]
  },
  "parameters": {
    "top_n": 2,
    "instruct": "Given a web search query, retrieve relevant passages that answer the query."
  }
}'
{
  "output": {
    "results": [
      {
        "document": {
          "text": "<string>"
        },
        "index": 0,
        "relevance_score": 0.9334521178273196
      }
    ]
  },
  "usage": {
    "prompt_tokens": 0,
    "total_tokens": 0
  },
  "request_id": "85ba5752-1900-47d2-8896-23f99b13f6e1"
}
使用 qwen3-rerank 模型根据语义相关性对文档进行重排序。采用嵌套请求结构,通过 inputparameters 组织请求参数。
开始之前:获取 API Key将其设置为环境变量,如果使用 SDK,还需安装 DashScope SDK

接入点

  • HTTP:POST https://dashscope.aliyuncs.com/api/v1/services/rerank/text-rerank/text-rerank
  • SDK base_http_api_urlhttps://dashscope.aliyuncs.com/api/v1

模型概览

模型最大文档数单文档最大 Token 数请求最大 Token 数支持语言适用场景
qwen3-rerank5004,000120,000100+ 种语言文本语义搜索、RAG
关于模型计费,请参见模型市场 参数说明
  • 单文档最大 Token 数:单条查询或文档允许的最大 Token 数量。单条查询或文档的输入超过该限制时,API 会返回 HTTP 400 错误,不会截断输入内容。
  • 最大文档数:单次请求允许的最大文档数量。
  • 请求最大 Token 数:计算公式为 查询 Token 数 x 文档数量 + 所有文档 Token 总数,不得超过此限制。

鉴权

string
header
必填

千问AI平台 API Key。详见获取 API Key

请求体

application/json
enum<string>
必填

模型名称。可选值:qwen3.7-text-rerankqwen3-vl-rerankgte-rerank-v2(将于 2026-05-30 下线,推荐使用 qwen3-rerank)。

qwen3.7-text-rerank,qwen3-vl-rerank,gte-rerank-v2
qwen3-vl-rerank
object
必填

输入数据,包含查询和待排序文档。

object

重排序请求的配置参数,需封装在此 parameters 对象中。

响应

200-application/json
object

输出包装对象,包含排序结果。

object

Token 用量统计。

string

请求的唯一标识符。

85ba5752-1900-47d2-8896-23f99b13f6e1