模型加载中
正在打开模型详情…
正在打开模型详情…
模型能力与计费维度与提供方保持一致,对外统一使用 OpenAI 兼容地址和模型代码。
Paraformer语音识别 V2 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按秒价格,可通过 `/v1/audio/transcriptions` 调用。
中文问答 / 结构化输出 / 智能体工作流
常见问题
星模XModel 以公开价格展示 Paraformer语音识别 V2(按秒),便于对比和预算规划。
这个模型系列可使用 `/v1/audio/transcriptions` 调用。
该模型按用量单位计费(如每秒、每张),以下为各规格档的结算价。
仅供参考,不作为星模结算依据。
来源: 上游公开页面(平台采集) · 采集时间: 2026-09-03T11:34:04.371Z当前页面不承诺额外免费额度;实际赠送、活动和用量抵扣以控制台账户状态和正式账单为准。
默认按账户、模型和上游可用性动态调度。生产接入前建议先用小流量压测确认并发、延迟和错误率。
复制以下示例,替换网关地址与 API Key后即可直接调用。
import requests
resp = requests.post(
"https://modelxing.com/v1/audio/transcriptions",
headers={"Authorization": "Bearer YOUR_API_KEY"},
json={"model":"paraformer-v2","file_url":"https://example.com/audio.wav"},
)
print(resp.json())该模型所属接口类型支持的请求参数参考。具体可用取值以上游模型能力为准。
| 参数 | 类型 / 必填 | 默认 / 可选值 | 说明 |
|---|---|---|---|
| model | string 是 | 默认— 可选值— | 要调用的模型 id。 |
| file | string 是 | 默认— 可选值— | 要转写的音频文件或 url。 |
| language | string 否 | 默认— 可选值— | ISO-639-1 语言提示,如 zh、en。 |
| response_format | string 否 | 默认json 可选值json | text | srt | verbose_json | vtt | 转写输出格式。 |
| prompt | string 否 | 默认— 可选值— | 可选提示,用于引导转写。 |
| temperature | number 否 | 默认0 可选值— | 采样温度,0–1。 |
要调用的模型 id。
要转写的音频文件或 url。
ISO-639-1 语言提示,如 zh、en。
转写输出格式。
可选提示,用于引导转写。
Fun ASR Flash (2026-06-15) 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按秒价格,可通过 `/v1/audio/transcriptions` 调用。
Fun ASR MTL 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按秒价格,可通过 `/v1/audio/transcriptions` 调用。
Fun ASR多语言语音识别 (2025-08-25) 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按秒价格,可通过 `/v1/audio/transcriptions` 调用。
采样温度,0–1。