Skip to content

重排序(Rerank)

根据查询内容重新计算候选文档的相关性分数,并按相关性排序。

常用于 RAG、知识库检索和搜索结果优化。

请求接口

http
POST https://api.nexusmodels.cn/v1/rerank

请求头

http
Authorization: Bearer YOUR_NEXUSMODELS_API_KEY
Content-Type: application/json

请求参数

参数类型必填说明
modelstring重排序模型名称
querystring用于计算相关性的查询文本
documentsarray需要重新排序的候选文档
top_ninteger返回相关性最高的文档数量
return_documentsboolean是否在响应中返回文档内容

请求示例

bash
curl -sS -X POST \
  'https://api.nexusmodels.cn/v1/rerank' \
  -H 'Authorization: Bearer YOUR_NEXUSMODELS_API_KEY' \
  -H 'Content-Type: application/json' \
  -d '{
    "model": "YOUR_RERANK_MODEL",
    "query": "什么是向量数据库?",
    "documents": [
      "向量数据库用于保存和检索高维向量。",
      "关系型数据库通常使用表结构存储数据。",
      "天气预报用于预测未来的天气状况。"
    ],
    "top_n": 2,
    "return_documents": true
  }'

响应示例

json
{
  "id": "rerank-request-id",
  "results": [
    {
      "index": 0,
      "relevance_score": 0.97,
      "document": {
        "text": "向量数据库用于保存和检索高维向量。"
      }
    },
    {
      "index": 1,
      "relevance_score": 0.21,
      "document": {
        "text": "关系型数据库通常使用表结构存储数据。"
      }
    }
  ]
}

响应字段

字段说明
index文档在原始 documents 数组中的位置
relevance_score查询和文档的相关性分数
document原文档内容,仅在支持并开启返回文档时出现