重排序(Rerank)
根据查询内容重新计算候选文档的相关性分数,并按相关性排序。
常用于 RAG、知识库检索和搜索结果优化。
请求接口
http
POST https://api.nexusmodels.cn/v1/rerank请求头
http
Authorization: Bearer YOUR_NEXUSMODELS_API_KEY
Content-Type: application/json请求参数
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
model | string | 是 | 重排序模型名称 |
query | string | 是 | 用于计算相关性的查询文本 |
documents | array | 是 | 需要重新排序的候选文档 |
top_n | integer | 否 | 返回相关性最高的文档数量 |
return_documents | boolean | 否 | 是否在响应中返回文档内容 |
请求示例
bash
curl -sS -X POST \
'https://api.nexusmodels.cn/v1/rerank' \
-H 'Authorization: Bearer YOUR_NEXUSMODELS_API_KEY' \
-H 'Content-Type: application/json' \
-d '{
"model": "YOUR_RERANK_MODEL",
"query": "什么是向量数据库?",
"documents": [
"向量数据库用于保存和检索高维向量。",
"关系型数据库通常使用表结构存储数据。",
"天气预报用于预测未来的天气状况。"
],
"top_n": 2,
"return_documents": true
}'响应示例
json
{
"id": "rerank-request-id",
"results": [
{
"index": 0,
"relevance_score": 0.97,
"document": {
"text": "向量数据库用于保存和检索高维向量。"
}
},
{
"index": 1,
"relevance_score": 0.21,
"document": {
"text": "关系型数据库通常使用表结构存储数据。"
}
}
]
}响应字段
| 字段 | 说明 |
|---|---|
index | 文档在原始 documents 数组中的位置 |
relevance_score | 查询和文档的相关性分数 |
document | 原文档内容,仅在支持并开启返回文档时出现 |