模型库Qwen: Qwen3 ASR Flash
Qwen · 官方接入 · 语音识别
Qwen: Qwen3 ASR Flash
限时 50% 折扣
通义千问语音识别模型,音频输入(base64 ≤10MB 或公网 URL),输出转写文本不计费。
文本音频文本
—上下文窗口
¥0输出 · 转写不另计费
官方接入供给类型
Supply Channels
供给渠道
官方渠道直连供给;网关统一鉴权、计费与可观测,与其它模型共用同一个 API Key。
Qwen 官方渠道暂无数据
延迟 P95—
吞吐量—
可用率—
近期可用率 · 最近 48 小时24h 滚动
渠道按近 24h 请求量降序排列(首张 = 主力),名称为该路供给的服务方;未标注服务方的渠道以「渠道 A/B」编号。可用率 / 延迟 / 吞吐为 24h 滚动统计,时间线逐小时着色(绿=正常 · 琥珀=波动 · 红=异常 · 灰=无流量,悬停查看每小时实际值)。按平台统一标价计费,与实际承接渠道无关;切换过程对调用方透明。
Quick Start
三分钟接入
OpenAI 协议兼容:语音识别通过对话接口传入音频(input_audio),转写文本随响应返回。
POST /v1/chat/completionsOpenAI Chat
OpenAI SDK
cURL
import base64
from openai import OpenAI
client = OpenAI(
base_url="https://api.goodputai.cn/v1",
api_key="GOODPUT_API_KEY",
)
with open("speech.wav", "rb") as f:
audio_b64 = base64.b64encode(f.read()).decode()
resp = client.chat.completions.create(
model="qwen/qwen3-asr-flash",
messages=[{
"role": "user",
"content": [{
"type": "input_audio",
"input_audio": {"data": audio_b64, "format": "wav"},
}],
}],
)
print(resp.choices[0].message.content) # 转写文本计费方式:按音频输入 token 计费:¥4.4 / 百万 tokens;转写文本不另计费。
Related Models