伶鹊 对话分析 Flash 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按 token 价格,可通过 `/v1/chat/completions` 调用。
上下文长度
结合价格、能力与场景表现筛选出的候选模型。
伶鹊 对话分析 Flash 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按 token 价格,可通过 `/v1/chat/completions` 调用。
伶鹊 对话分析 Pro 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按 token 价格,可通过 `/v1/chat/completions` 调用。
Qwen3 VL Embedding 是来自 Alibaba Cloud / Qwen 的嵌入模型。当前页面展示按 token 价格,可通过 `/v1/embeddings` 调用。
Qwen3 VL Rerank 是来自 Alibaba Cloud / Qwen 的重排模型。当前页面展示按 token 价格,可通过 `/v1/rerank` 调用。
对比表
对比候选模型的价格、上下文与能力。
| 模型 | 提供方 | 输入 | 输出 | 上下文 | 能力 | 适用场景 | 延迟 | 状态 |
|---|---|---|---|---|---|---|---|---|
| 伶鹊 对话分析 Flashtongyi-xiaomi-analysis-flash | Alibaba Cloud / Qwen | ¥0.2 / 1M tokens | ¥0.4 / 1M tokens | — | JSON 模式流式输出 | 中文问答, 结构化输出 | 800-3200ms | 生产可用 |
| 伶鹊 对话分析 Protongyi-xiaomi-analysis-pro | Alibaba Cloud / Qwen | ¥1 / 1M tokens | ¥2.70 / 1M tokens | — | JSON 模式流式输出 | 中文问答, 结构化输出 | 800-3200ms | 生产可用 |
| Qwen3 VL Embeddingqwen3-vl-embedding | Alibaba Cloud / Qwen | ¥1.80 / 1M tokens | 单向计费 | — | 视觉JSON 模式 | 检索索引, 语义搜索 | 300-1600ms | 生产可用 |
| Qwen3 VL Rerankqwen3-vl-rerank | Alibaba Cloud / Qwen | ¥1.80 / 1M tokens | 单向计费 | — | 视觉JSON 模式 | 搜索重排, 检索质量优化 | 300-1600ms | 生产可用 |
| 通义多模态向量 Flash (2026-03-06)tongyi-embedding-vision-flash-2026-03-06 | Alibaba Cloud / Qwen | ¥0.15 / 1M tokens | 单向计费 | — | 视觉JSON 模式 | 检索索引, 语义搜索 | 300-1600ms | 生产可用 |
| 通义多模态向量 Plus (2026-03-06)tongyi-embedding-vision-plus-2026-03-06 | Alibaba Cloud / Qwen | ¥0.5 / 1M tokens | 单向计费 | — | 视觉JSON 模式 | 检索索引, 语义搜索 | 300-1600ms | 生产可用 |