模型加载中
正在打开模型详情…
正在打开模型详情…
模型能力与计费维度与提供方保持一致,对外统一使用 OpenAI 兼容地址和模型代码。
Qwen3 VL Rerank 是来自 Alibaba Cloud / Qwen 的重排模型。当前页面展示按 token 价格,可通过 `/v1/rerank` 调用。
搜索重排 / 检索质量优化 / 结果排序
仅标准 Chat SKU 可结算;缓存、Batch 等上游价格不构成可购买 SKU。
当前页面不承诺额外免费额度;实际赠送、活动和用量抵扣以控制台账户状态和正式账单为准。
默认按账户、模型和上游可用性动态调度。生产接入前建议先用小流量压测确认并发、延迟和错误率。
复制以下示例,替换网关地址与 API Key后即可直接调用。
import requests
resp = requests.post(
"https://modelxing.com/v1/rerank",
headers={"Authorization": "Bearer YOUR_API_KEY"},
json={
"model": "qwen3-vl-rerank",
"query": "best GPU for inference",
"documents": ["A fast GPU document", "A storage document"],
"top_n": 2,
},
)
print(resp.json())该模型所属接口类型支持的请求参数参考。具体可用取值以上游模型能力为准。
| 参数 | 类型 / 必填 | 默认 / 可选值 | 说明 |
|---|---|---|---|
| model | string 是 | 默认— 可选值— | 要调用的模型 id。 |
| query | string 是 | 默认— 可选值— | 用于对文档排序的查询。 |
| documents | string[] 是 | 默认— 可选值— | 要重排的候选文档。 |
| top_n | integer 否 | 默认— 可选值— | 只返回排名前 N 的文档。 |
| return_documents | boolean 否 | 默认true 可选值— | 响应中是否包含文档文本。 |
要调用的模型 id。
用于对文档排序的查询。
要重排的候选文档。
只返回排名前 N 的文档。
响应中是否包含文档文本。
以下参数契约整理自官方文档,供调用参考;取值以上游最终校验为准(网关不预拦截),完整机器可读契约可经 GET /v1/models/{id} 获取。
| 参数 | 取值域 | 默认 | 说明 |
|---|---|---|---|
| query | 任意取值 | — | 查询文本;缺失时网关直接返回 400 rerank_query_required |
| documents | 任意取值 | — | 待排序文档数组(字符串或 {text|content|document} 对象均可);兼容别名 docs、input_documents;缺失时 400 rerank_documents_required |
| top_n | 整数 | 全部文档数 | 只返回相关性最高的前 N 条;省略时返回全部文档的排序结果 |
| return_documents | 任意取值 | false | 响应里是否附带文档原文;默认只返回 index 与 relevance_score |
通义多模态向量 Plus (2026-03-06) 是来自 Alibaba Cloud / Qwen 的嵌入模型。当前页面展示按 token 价格,可通过 `/v1/embeddings` 调用。
Qwen3 VL Embedding 是来自 Alibaba Cloud / Qwen 的嵌入模型。当前页面展示按 token 价格,可通过 `/v1/embeddings` 调用。
通义多模态向量 Flash (2026-03-06) 是来自 Alibaba Cloud / Qwen 的嵌入模型。当前页面展示按 token 价格,可通过 `/v1/embeddings` 调用。
常见问题
星模XModel 以公开价格展示 Qwen3 VL Rerank(按 token),便于对比和预算规划。
这个模型系列可使用 `/v1/rerank` 调用。