Pilot 派诺信息星模XModel
首页模型榜单价格工具文档博客
登录 / 注册
模型

模型加载中

正在打开模型详情…

Pilot 派诺信息星模XModel

星模XModel:一个 OpenAI 兼容端点接入主流大模型,按量计费,支持 BYOK 与团队预算管理。

产品

模型市场榜单价格

工具

成本计算器迁移检测价格对比账单分析凭证验证

接入文档

快速开始OpenAI 迁移计费

法务

隐私政策服务条款退款政策

参考资源

低价 LLM APIOpenRouter 替代方案
© 2026 星模XModel主办单位:贵州派诺数海观澜数字产业发展有限公司黔ICP备2026008986号-2
Alibaba Cloud / Qwen 模型

Qwen3 VL Rerank

Qwen3 VL Rerank 是来自 Alibaba Cloud / Qwen 的重排模型。当前页面展示按 token 价格,可通过 `/v1/rerank` 调用。

阅读快速开始→成本估算
Alibaba Cloud / Qwen提供方公开定价生产可用
视觉JSON 模式
输入价格
¥1.8 / 百万tokens
输出价格
¥0 / 百万tokens
可用性
生产可用
模型代码模型介绍模型能力星模结算价免费额度模型限流与上下文API 代码示例请求参数调用契约与参数

模型代码

模型能力与计费维度与提供方保持一致,对外统一使用 OpenAI 兼容地址和模型代码。

模型代码
qwen3-vl-rerank
网关地址
https://modelxing.com/v1
接口兼容
原生重排接口
阅读快速开始

模型介绍

Qwen3 VL Rerank 是来自 Alibaba Cloud / Qwen 的重排模型。当前页面展示按 token 价格,可通过 `/v1/rerank` 调用。

  • 已提供人民币计价的公开按 token 价格。
  • 已进入公开模型市场,可用于横向对比。
  • 可通过 `/v1/rerank` 调用。
  • 支持多模态或视觉类任务。

模型能力

搜索重排 / 检索质量优化 / 结果排序

输入模态
文本、图像
输出模态
文本
支持参数
流式输出、JSON
视觉JSON 模式

星模结算价

仅标准 Chat SKU 可结算;缓存、Batch 等上游价格不构成可购买 SKU。

输入
¥1.80 / M Token
每百万输入 token
输出
¥0 / M Token
每百万输出 token

免费额度

当前页面不承诺额外免费额度;实际赠送、活动和用量抵扣以控制台账户状态和正式账单为准。

免费额度
暂无免费额度信息

模型限流与上下文

默认按账户、模型和上游可用性动态调度。生产接入前建议先用小流量压测确认并发、延迟和错误率。

限流说明
已配置
延迟估算
300-1600ms

API 代码示例

复制以下示例,替换网关地址与 API Key后即可直接调用。

Python
import requests

resp = requests.post(
    "https://modelxing.com/v1/rerank",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={
        "model": "qwen3-vl-rerank",
        "query": "best GPU for inference",
        "documents": ["A fast GPU document", "A storage document"],
        "top_n": 2,
    },
)
print(resp.json())

请求参数

该模型所属接口类型支持的请求参数参考。具体可用取值以上游模型能力为准。

参数类型 / 必填默认 / 可选值说明
model
string
是
默认—
可选值—
要调用的模型 id。
query
string
是
默认—
可选值—
用于对文档排序的查询。
documents
string[]
是
默认—
可选值—
要重排的候选文档。
top_n
integer
否
默认—
可选值—
只返回排名前 N 的文档。
return_documents
boolean
否
默认true
可选值—
响应中是否包含文档文本。

model

是
类型
string
默认
—
可选值
—

要调用的模型 id。

query

是
类型
string
默认
—
可选值
—

用于对文档排序的查询。

documents

是
类型
string[]
默认
—
可选值
—

要重排的候选文档。

top_n

否
类型
integer
默认
—
可选值
—

只返回排名前 N 的文档。

return_documents

否
类型
boolean
默认
true
可选值
—

响应中是否包含文档文本。

调用契约与参数

以下参数契约整理自官方文档,供调用参考;取值以上游最终校验为准(网关不预拦截),完整机器可读契约可经 GET /v1/models/{id} 获取。

调用端点
/v1/rerank
参数契约来源
阿里云官方 API 文档
  • 计费按 token 用量(上游价格表:文本输入 0.7 元/百万 token)。
  • 上游原生支持多模态排序(查询/文档可含图片、视频);网关当前仅转发文本文档(provider 契约为字符串数组)。

参数契约

参数取值域默认说明
query任意取值—查询文本;缺失时网关直接返回 400 rerank_query_required
documents任意取值—待排序文档数组(字符串或 {text|content|document} 对象均可);兼容别名 docs、input_documents;缺失时 400 rerank_documents_required
top_n整数全部文档数只返回相关性最高的前 N 条;省略时返回全部文档的排序结果
return_documents任意取值false响应里是否附带文档原文;默认只返回 index 与 relevance_score

可替代模型

Alibaba Cloud / Qwen生产可用

通义多模态向量 Plus (2026-03-06)

通义多模态向量 Plus (2026-03-06) 是来自 Alibaba Cloud / Qwen 的嵌入模型。当前页面展示按 token 价格,可通过 `/v1/embeddings` 调用。

¥0.5 / M Token输入—上下文单向计费计费
视觉JSON 模式
查看详情
Alibaba Cloud / Qwen生产可用

Qwen3 VL Embedding

Qwen3 VL Embedding 是来自 Alibaba Cloud / Qwen 的嵌入模型。当前页面展示按 token 价格,可通过 `/v1/embeddings` 调用。

¥1.80 / M Token输入—上下文单向计费计费
视觉JSON 模式
查看详情
Alibaba Cloud / Qwen生产可用

通义多模态向量 Flash (2026-03-06)

通义多模态向量 Flash (2026-03-06) 是来自 Alibaba Cloud / Qwen 的嵌入模型。当前页面展示按 token 价格,可通过 `/v1/embeddings` 调用。

¥0.15 / M Token输入—上下文单向计费计费
视觉JSON 模式
查看详情

模型指标

可用性
生产可用
路由状态
已配置
延迟估算
300-1600ms

常见问题

Qwen3 VL Rerank API 问题

Qwen3 VL Rerank 在星模XModel 中如何计费?

星模XModel 以公开价格展示 Qwen3 VL Rerank(按 token),便于对比和预算规划。

如何调用 Qwen3 VL Rerank?

这个模型系列可使用 `/v1/rerank` 调用。