按量付费
模型费率每个模型公开输入/输出每百万 token 单价,与提供方公开价格对齐。
- 适合 PoC 和单项目快速验证
- 上线前用计算器估算成本
- OpenAI 兼容请求格式直接可用
按量付费
模型费率每个模型公开输入/输出每百万 token 单价,与提供方公开价格对齐。
额度
预付额度预付购买额度、余额随用量扣减,花费可控。
团队
团队用量按项目、部门和环境查看用量并控制花费。
BYOK
自带密钥绑定你自己的提供方密钥,密钥与成本自主可控。
企业版
定制面向企业的容量、组合与支持方案。
计算器
选择模型并输入预估的请求次数与 token 用量,实时得出月度支出估算。
成本 = 请求次数 × token × 单价 / 1,000,000。
示例:Qwen3 Max 处理 100 万输入 token 约 ¥2.20。
根据模型价格、token 数量和请求量估算月度支出。
低成本参考
按输入价格升序的低成本模型,适合大批量、成本敏感的任务。
| 模型 | 提供方 | 输入 | 输出 | 上下文 | 能力 | 适用场景 | 延迟 | 状态 |
|---|---|---|---|---|---|---|---|---|
| DeepSeek R1 Distill Qwen 1.5Bdeepseek-r1-distill-qwen-1.5b | DeepSeek | ¥0 / 1M tokens | 单向计费 | — | JSON 模式流式输出 | 通用对话, 结构化输出 | 800-3200ms | 生产可用 |
| Sambert语音合成 Bethsambert-beth-v1 | Alibaba Cloud / Qwen | ¥0 / 1M tokens | 单向计费 | — | 中文问答, 结构化输出 | 900-4200ms | 生产可用 | |
| Sambert语音合成 Bettysambert-betty-v1 | Alibaba Cloud / Qwen | ¥0 / 1M tokens | 单向计费 | — | 中文问答, 结构化输出 | 900-4200ms | 生产可用 | |
| Sambert语音合成 Briansambert-brian-v1 | Alibaba Cloud / Qwen | ¥0 / 1M tokens | 单向计费 | — | 中文问答, 结构化输出 | 900-4200ms | 生产可用 | |
| Sambert语音合成 Callysambert-cally-v1 | Alibaba Cloud / Qwen | ¥0 / 1M tokens | 单向计费 | — | 中文问答, 结构化输出 | 900-4200ms | 生产可用 | |
| Sambert语音合成 Camilasambert-camila-v1 | Alibaba Cloud / Qwen | ¥0 / 1M tokens | 单向计费 | — | 中文问答, 结构化输出 | 900-4200ms | 生产可用 | |
| Sambert语音合成 Cindysambert-cindy-v1 | Alibaba Cloud / Qwen | ¥0 / 1M tokens | 单向计费 | — | 中文问答, 结构化输出 | 900-4200ms | 生产可用 | |
| Sambert语音合成 Clarasambert-clara-v1 | Alibaba Cloud / Qwen | ¥0 / 1M tokens | 单向计费 | — | 中文问答, 结构化输出 | 900-4200ms | 生产可用 |
常见问题
在控制台「充值」页在线购买额度,购买后即可用于所有模型的调用扣减。
没有。额度预充、按 token 用量扣减,不调用不产生费用。
模型市场为每个模型展示输入/输出每百万 token 单价及价格来源标签,与提供方公开价格对齐,透明可查。
控制台按项目、API Key 维度统计用量,可随时查看明细,方便财务对账。
额度与退款规则详见退款政策页面。
在控制台绑定你自己的提供方密钥后,模型市场与调用方式保持一致,详见认证文档。