模型加载中
正在打开模型详情…
正在打开模型详情…
模型能力与计费维度与提供方保持一致,对外统一使用 OpenAI 兼容地址和模型代码。
声音复刻CosyVoice大模型 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按万字符价格,可通过 `/v1/audio/assets` 调用。
中文问答 / 结构化输出 / 智能体工作流
该模型按用量单位计费(如每秒、每张),以下为各规格档的结算价。
仅供参考,不作为星模结算依据。
来源: 上游公开页面(平台采集) · 采集时间: 2026-09-04T16:55:38.195Z当前页面不承诺额外免费额度;实际赠送、活动和用量抵扣以控制台账户状态和正式账单为准。
默认按账户、模型和上游可用性动态调度。生产接入前建议先用小流量压测确认并发、延迟和错误率。
复制以下示例,替换网关地址与 API Key后即可直接调用。
import requests
asset = requests.post(
"https://modelxing.com/v1/audio/assets",
headers={"Authorization": "Bearer YOUR_API_KEY"},
json={"model":"cosyvoice-clone-v1","sample_audio_url":"https://example.com/voice.wav","name":"voiceclone"},
)
print(asset.json())该模型所属接口类型支持的请求参数参考。具体可用取值以上游模型能力为准。
| 参数 | 类型 / 必填 | 默认 / 可选值 | 说明 |
|---|---|---|---|
| model | string 是 | 默认— 可选值— | 要调用的模型 id。 |
| voice_prompt | string 是 | 默认— 可选值— | 驱动音色资产的描述或样本。 |
| name | string 是 | 默认— 可选值— | 所创建资产的可读名称。 |
| preview_text | string 否 | 默认— 可选值— | 用于生成预览片段的文本。 |
要调用的模型 id。
驱动音色资产的描述或样本。
所创建资产的可读名称。
用于生成预览片段的文本。
该模型通过声音复刻动态获得音色:先在 /v1/audio/assets 创建复刻音色,再用返回的音色 ID 进行语音合成。
Fun ASR Flash (2026-06-15) 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按秒价格,可通过 `/v1/audio/transcriptions` 调用。
Fun ASR MTL 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按秒价格,可通过 `/v1/audio/transcriptions` 调用。
Fun ASR多语言语音识别 (2025-08-25) 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按秒价格,可通过 `/v1/audio/transcriptions` 调用。
常见问题
星模XModel 以公开价格展示 声音复刻CosyVoice大模型(按万字符),便于对比和预算规划。
这个模型系列可使用 `/v1/audio/assets` 调用。