星海智算开发文档
模型 API

向量化与相关性重排

将文本转为向量,或按照查询对候选内容重新排序。

文本向量

POST /embeddings 提交模型别名和 input。可输入字符串或该服务允许数量的字符串数组。

{"model":"<EMBEDDING_MODEL_ALIAS>","input":["成都的历史","成都的天气"]}

成功后使用 data[].index 对齐输入,读取 data[].embedding。维度由模型决定,不在存储层写死另一模型的向量长度。批量大小和字符上限见当前参考及服务能力。

重排候选内容

先自行检索候选集合,再调用 POST /rerank。重排不会替代检索库,也不会自动抓取网页。

{"model":"<RERANK_MODEL_ALIAS>","query":"如何开始使用模型 API?","documents":["创建 API Key 后在服务端调用。","应用可以使用运行会话。"],"top_n":2}

按照响应 results[].index 回到原候选,并读取相关性分数。不要把分数当作已校准的概率;是否返回原文、候选数和 top_n 范围以模型合同为准。

失败处理

输入超长、批量过大或向量模型与重排接口混用时,应先修正输入。不自动拆成大量请求绕过限制。响应结构与错误码见对应接口参考。

本页目录