云梯TokenHub

重排序(Rerank)

接口概述

给定查询与候选文档列表,输出按相关性排序的结果,常用于检索后精排。统一使用扁平请求体,不同模型的结果结构差异见下。

接口地址

POST https://openai.jw-info.com/v1/rerank

请求头

请求头是否必填说明
Content-Typeapplication/json
AuthorizationBearer {API_KEY},或 x-api-key

请求参数

参数名类型是否必填默认值说明
modelstring-重排模型名,如 gte-rerank-v2qwen3-rerank
querystring-查询文本
documentsarray-待排序文档列表(字符串数组)
top_ninteger全部只返回前 n 条
return_documentsbooleantrue是否在结果中带回原文

请求示例

curl https://openai.jw-info.com/v1/rerank \
  -H "Authorization: Bearer sk-你的密钥" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gte-rerank-v2",
    "query": "什么是向量检索",
    "documents": ["向量检索按相似度找最近邻", "今天天气不错"]
  }'

响应参数

结果按相关性降序排列。返回结构随模型系列略有差异:

系列结果路径说明
gte-rerankoutput.results[]每项含 indexrelevance_score
qwen3-rerankresults[]每项含 indexrelevance_scoremeta.tokens 给用量

响应示例

{
  "output": {
    "results": [
      { "index": 0, "relevance_score": 0.91 },
      { "index": 1, "relevance_score": 0.02 }
    ]
  },
  "usage": { "total_tokens": 17 }
}

在模型广场查看支持「重排序」的模型 →