Pilot 派诺信息星模XModel
首页模型榜单价格工具文档博客
登录 / 注册
模型

模型加载中

正在打开模型详情…

Pilot 派诺信息星模XModel

星模XModel:一个 OpenAI 兼容端点接入主流大模型,按量计费,支持 BYOK 与团队预算管理。

产品

模型市场榜单价格

工具

成本计算器迁移检测价格对比账单分析凭证验证

接入文档

快速开始OpenAI 迁移计费

法务

隐私政策服务条款退款政策

参考资源

低价 LLM APIOpenRouter 替代方案
© 2026 星模XModel主办单位:贵州派诺数海观澜数字产业发展有限公司黔ICP备2026008986号-2
Alibaba Cloud / Qwen 模型

Qwen Audio 3.0 ASR Flash Filetrans

Qwen Audio 3.0 ASR Flash Filetrans 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按秒价格,可通过 `/v1/audio/transcriptions` 调用。

阅读快速开始→成本估算
Alibaba Cloud / Qwen提供方公开定价生产可用
JSON 模式
价格
¥0 / 秒
可用性
生产可用
模型代码模型介绍模型能力星模结算价免费额度模型限流与上下文API 代码示例请求参数调用契约与参数

模型代码

模型能力与计费维度与提供方保持一致,对外统一使用 OpenAI 兼容地址和模型代码。

模型代码
qwen-audio-3.0-asr-flash-filetrans
网关地址
https://modelxing.com/v1
接口兼容
OpenAI 兼容语音转写接口
阅读快速开始

模型介绍

Qwen Audio 3.0 ASR Flash Filetrans 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按秒价格,可通过 `/v1/audio/transcriptions` 调用。

  • 已提供人民币计价的公开按秒价格。
  • 已进入公开模型市场,可用于横向对比。
  • 可通过 `/v1/audio/transcriptions` 调用。
  • 注意:音频和实时模型按用量计费,不按 token 计费。

模型能力

语音识别 / 会议转写 / 语音输入

输入模态
文本
输出模态
文本
支持参数
流式输出、JSON
JSON 模式

星模结算价

该模型按用量单位计费(如每秒、每张),以下为各规格档的结算价。

音频时长
¥0 / 秒
上游公开价格参考

仅供参考,不作为星模结算依据。

来源: 上游公开页面(平台采集) · 采集时间: 2026-09-04T16:55:38.195Z
  • 音频时长 · 每秒: ¥0

免费额度

当前页面不承诺额外免费额度;实际赠送、活动和用量抵扣以控制台账户状态和正式账单为准。

免费额度
暂无免费额度信息

模型限流与上下文

默认按账户、模型和上游可用性动态调度。生产接入前建议先用小流量压测确认并发、延迟和错误率。

限流说明
已配置
延迟估算
900-4200ms

API 代码示例

复制以下示例,替换网关地址与 API Key后即可直接调用。

Python
import requests

resp = requests.post(
    "https://modelxing.com/v1/audio/transcriptions",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": ("audio.wav", open("audio.wav", "rb"), "audio/wav")},
    data={"model": "qwen-audio-3.0-asr-flash-filetrans"},
)
print(resp.json())

请求参数

该模型所属接口类型支持的请求参数参考。具体可用取值以上游模型能力为准。

参数类型 / 必填默认 / 可选值说明
model
string
是
默认—
可选值—
要调用的模型 id。
file
string
是
默认—
可选值—
要转写的音频文件或 url。
language
string
否
默认—
可选值—
ISO-639-1 语言提示,如 zh、en。
response_format
string
否
默认json
可选值json | text | srt | verbose_json | vtt
转写输出格式。
prompt
string
否
默认—
可选值—
可选提示,用于引导转写。
temperature
number
否
默认0
可选值—
采样温度,0–1。

model

是
类型
string
默认
—
可选值
—

要调用的模型 id。

file

是
类型
string
默认
—
可选值
—

要转写的音频文件或 url。

language

否
类型
string
默认
—
可选值
—

ISO-639-1 语言提示,如 zh、en。

response_format

否
类型
string
默认
json
可选值
json | text | srt | verbose_json | vtt

转写输出格式。

prompt

否
类型
string
默认
—
可选值
—

可选提示,用于引导转写。

temperature

否
类型
number
默认
0
可选值
—

采样温度,0–1。

调用契约与参数

以下参数契约整理自官方文档,供调用参考;取值以上游最终校验为准(网关不预拦截),完整机器可读契约可经 GET /v1/models/{id} 获取。

调用端点
/v1/audio/transcriptions
参数契约来源
阿里云官方 API 文档
  • 上游限制:单文件 ≤2GB、时长 ≤12 小时;任意采样率。
  • 2026-08-28 起 multipart 表单字段 file_url 支持公网 URL 直传(与 file 二选一),绕过 25MB 上传上限。

参数契约

参数取值域默认说明
file_format取值:wav、mp3、m4a、flac、ogg、aac、amr、opus、webm、mp4、wma、pcm—由上传文件扩展名推断并转发上游;音频内容需与扩展名一致,否则上游转写失败
file_url任意取值—公网可访问的音频 URL(multipart 的 file 与 file_url 二选一);走 file_url 绕过网关 25MB 上传上限,直达上游 2GB/12 小时限制;格式从 URL 扩展名推断,须与音频实际内容一致

可替代模型

Alibaba Cloud / Qwen生产可用

Fun ASR Flash (2026-06-15)

Fun ASR Flash (2026-06-15) 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按秒价格,可通过 `/v1/audio/transcriptions` 调用。

¥0.0002 / 每秒价格—上下文每秒计费
JSON 模式
查看详情
Alibaba Cloud / Qwen生产可用

Fun ASR MTL

Fun ASR MTL 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按秒价格,可通过 `/v1/audio/transcriptions` 调用。

¥0.0002 / 每秒价格—上下文每秒计费
JSON 模式
查看详情
Alibaba Cloud / Qwen生产可用

Fun ASR多语言语音识别 (2025-08-25)

Fun ASR多语言语音识别 (2025-08-25) 是来自 Alibaba Cloud / Qwen 的文本对话模型。当前页面展示按秒价格,可通过 `/v1/audio/transcriptions` 调用。

¥0.0002 / 每秒价格—上下文每秒计费
JSON 模式
查看详情

模型指标

可用性
生产可用
路由状态
已配置
延迟估算
900-4200ms

常见问题

Qwen Audio 3.0 ASR Flash Filetrans API 问题

Qwen Audio 3.0 ASR Flash Filetrans 在星模XModel 中如何计费?

星模XModel 以公开价格展示 Qwen Audio 3.0 ASR Flash Filetrans(按秒),便于对比和预算规划。

如何调用 Qwen Audio 3.0 ASR Flash Filetrans?

这个模型系列可使用 `/v1/audio/transcriptions` 调用。