Pilot 派诺信息星模XModel
首页模型榜单价格工具文档博客
登录 / 注册
模型

模型加载中

正在打开模型详情…

Pilot 派诺信息星模XModel

星模XModel:一个 OpenAI 兼容端点接入主流大模型,按量计费,支持 BYOK 与团队预算管理。

产品

模型市场榜单价格

工具

成本计算器迁移检测价格对比账单分析凭证验证

接入文档

快速开始OpenAI 迁移计费

法务

隐私政策服务条款退款政策

参考资源

低价 LLM APIOpenRouter 替代方案
© 2026 星模XModel主办单位:贵州派诺数海观澜数字产业发展有限公司黔ICP备2026008986号-2
Alibaba Cloud / Qwen 模型

Qwen3 TTS Instruct Flash Realtime

Qwen3 TTS Instruct Flash Realtime 是来自 Alibaba Cloud / Qwen 的实时模型。当前页面展示按万字符价格,可通过 `/v1/realtime` 调用。

阅读快速开始→成本估算
Alibaba Cloud / Qwen提供方公开定价生产可用
流式输出
价格
¥1 / 万字
可用性
生产可用
模型代码模型介绍模型能力星模结算价免费额度模型限流与上下文API 代码示例请求参数调用契约与音色

模型代码

模型能力与计费维度与提供方保持一致,对外统一使用 OpenAI 兼容地址和模型代码。

模型代码
qwen3-tts-instruct-flash-realtime
网关地址
https://modelxing.com/v1
接口兼容
实时会话接口
阅读快速开始

模型介绍

Qwen3 TTS Instruct Flash Realtime 是来自 Alibaba Cloud / Qwen 的实时模型。当前页面展示按万字符价格,可通过 `/v1/realtime` 调用。

  • 已提供人民币计价的公开按万字符价格。
  • 已进入公开模型市场,可用于横向对比。
  • 可通过 `/v1/realtime` 调用。
  • 注意:实时模型需要客户端处理 WebSocket 会话。

模型能力

语音合成 / 语音智能体 / 语音回复

输入模态
文本
输出模态
文本
支持参数
流式输出
流式输出

星模结算价

该模型按用量单位计费(如每秒、每张),以下为各规格档的结算价。

语音合成
¥1 / 万字
上游公开价格参考

仅供参考,不作为星模结算依据。

来源: 上游公开页面(平台采集) · 采集时间: 2026-09-03T11:34:04.371Z
  • 语音合成 · per_10k_chars: ¥1

免费额度

当前页面不承诺额外免费额度;实际赠送、活动和用量抵扣以控制台账户状态和正式账单为准。

免费额度
暂无免费额度信息

模型限流与上下文

默认按账户、模型和上游可用性动态调度。生产接入前建议先用小流量压测确认并发、延迟和错误率。

限流说明
已配置
延迟估算
400-1600ms

API 代码示例

复制以下示例,替换网关地址与 API Key后即可直接调用。

Python
import requests

session = requests.post(
    "https://modelxing.com/v1/realtime",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    json={"model":"qwen3-tts-instruct-flash-realtime","modalities":["text"]},
).json()

print(session["websocket"]["url"])

请求参数

该模型所属接口类型支持的请求参数参考。具体可用取值以上游模型能力为准。

参数类型 / 必填默认 / 可选值说明
model
string
是
默认—
可选值—
要调用的模型 id。
modalities
string[]
否
默认["text","audio"]
可选值—
启用的会话模态。
voice
string
否
默认—
可选值—
音频输出的音色 id。
input_audio_format
string
否
默认pcm16
可选值pcm16 | g711_ulaw | g711_alaw
上行音频编码。
output_audio_format
string
否
默认pcm16
可选值pcm16 | g711_ulaw | g711_alaw
下行音频编码。

model

是
类型
string
默认
—
可选值
—

要调用的模型 id。

modalities

否
类型
string[]
默认
["text","audio"]
可选值
—

启用的会话模态。

voice

否
类型
string
默认
—
可选值
—

音频输出的音色 id。

input_audio_format

否
类型
string
默认
pcm16
可选值
pcm16 | g711_ulaw | g711_alaw

上行音频编码。

output_audio_format

否
类型
string
默认
pcm16
可选值
pcm16 | g711_ulaw | g711_alaw

下行音频编码。

调用契约与音色

实时会话模型:voice 在会话创建时指定,完整调用契约可经 GET /v1/models/{id} 获取。

调用端点
/v1/realtime
默认音色(不带 voice 时)
Cherry
音色来源
阿里云官方音色文档
  • voice 在会话创建(session.update)时指定;大小写敏感;不带时网关默认 Cherry。

音色列表

voice音色名描述支持语种
Cherry默认芊悦阳光积极、亲切自然小姐姐(女性)中文(普通话)、英语、法语 等10种
Serena苏瑶温柔小姐姐(女性)中文(普通话)、英语、法语 等10种
Ethan晨煦标准普通话,带部分北方口音。阳光、温暖、活力、朝气(男性)中文(普通话)、英语、法语 等10种
Chelsie千雪二次元虚拟女友(女性)中文(普通话)、英语、法语 等10种
Momo茉兔撒娇搞怪,逗你开心(女性)中文(普通话)、英语、法语 等10种
Vivian十三拽拽的、可爱的小暴躁(女性)中文(普通话)、英语、法语 等10种
Moon月白率性帅气的月白(男性)中文(普通话)、英语、法语 等10种
Maia四月知性与温柔的碰撞(女性)中文(普通话)、英语、法语 等10种
Kai凯耳朵的一场SPA(男性)中文(普通话)、英语、法语 等10种
Nofish不吃鱼不会翘舌音的设计师(男性)中文(普通话)、英语、法语 等10种
Bella萌宝喝酒不打醉拳的小萝莉(女性)中文(普通话)、英语、法语 等10种
Eldric Sage沧明子沉稳睿智的老者,沧桑如松却心明如镜(男性)中文(普通话)、英语、法语 等10种
Mia乖小妹温顺如春水,乖巧如初雪(女性)中文(普通话)、英语、法语 等10种
Mochi沙小弥聪明伶俐的小大人,童真未泯却早慧如禅(男性)中文(普通话)、英语、法语 等10种
Bellona燕铮莺声音洪亮,吐字清晰,人物鲜活,听得人热血沸腾;金戈铁马入梦来,字正腔圆间尽显千面人声的江湖(女性)中文(普通话)、英语、法语 等10种
Vincent田叔一口独特的沙哑烟嗓,一开口便道尽了千军万马与江湖豪情(男性)中文(普通话)、英语、法语 等10种
Bunny萌小姬“萌属性”爆棚的小萝莉(女性)中文(普通话)、英语、法语 等10种
Neil阿闻平直的基线语调,字正腔圆的咬字发音,这就是最专业的新闻主持人(男性)中文(普通话)、英语、法语 等10种
Elias墨讲师既保持学科严谨性,又通过叙事技巧将复杂知识转化为可消化的认知模块(女性)中文(普通话)、英语、法语 等10种
Arthur徐大爷被岁月和旱烟浸泡过的质朴嗓音,不疾不徐地摇开了满村的奇闻异事(男性)中文(普通话)、英语、法语 等10种
Nini邻家妹妹糯米糍一样又软又黏的嗓音,那一声声拉长了的“哥哥”,甜得能把人的骨头都叫酥了(女性)中文(普通话)、英语、法语 等10种
Seren小婉温和舒缓的声线,助你更快地进入睡眠,晚安,好梦(女性)中文(普通话)、英语、法语 等10种
Pip顽屁小孩调皮捣蛋却充满童真的他来了,这是你记忆中的小新吗(男性)中文(普通话)、英语、法语 等10种
Stella少女阿月平时是甜到发腻的迷糊少女音,但在喊出“代表月亮消灭你”时,瞬间充满不容置疑的爱与正义(女性)中文(普通话)、英语、法语 等10种

历史版本

Qwen3 TTS Instruct Flash Realtime (2026-01-22)

可替代模型

Alibaba Cloud / Qwen生产可用

Fun ASR Flash 8k实时语音识别

Fun ASR Flash 8k实时语音识别 是来自 Alibaba Cloud / Qwen 的实时语音识别模型。当前页面展示按秒价格,可通过 `/v1/realtime` 调用。

¥0.0002 / 每秒价格—上下文每秒计费
流式输出
查看详情
Alibaba Cloud / Qwen生产可用

Fun ASR Flash 8k实时语音识别 (2026-01-28)

Fun ASR Flash 8k实时语音识别 (2026-01-28) 是来自 Alibaba Cloud / Qwen 的实时语音识别模型。当前页面展示按秒价格,可通过 `/v1/realtime` 调用。

¥0.0002 / 每秒价格—上下文每秒计费
流式输出
查看详情
Alibaba Cloud / Qwen生产可用

Fun ASR实时语音识别

Fun ASR实时语音识别 是来自 Alibaba Cloud / Qwen 的实时语音识别模型。当前页面展示按秒价格,可通过 `/v1/realtime` 调用。

¥0.0003 / 每秒价格—上下文每秒计费
流式输出
查看详情

模型指标

可用性
生产可用
路由状态
已配置
延迟估算
400-1600ms

常见问题

Qwen3 TTS Instruct Flash Realtime API 问题

Qwen3 TTS Instruct Flash Realtime 在星模XModel 中如何计费?

星模XModel 以公开价格展示 Qwen3 TTS Instruct Flash Realtime(按万字符),便于对比和预算规划。

如何调用 Qwen3 TTS Instruct Flash Realtime?

这个模型系列可使用 `/v1/realtime` 调用。