模型库Qwen: Qwen3.5 Omni Flash
Qwen · 官方接入 · 对话模型
Qwen: Qwen3.5 Omni Flash
通义千问全模态理解模型(音频/图片/视频输入,必须流式调用)。定位音频/多模态理解:输出统一按多模态价计费,纯文本调用同价;音频输入按官方 7 token/秒折算单独计价。
文本图像音频视频文本深度推理
—上下文窗口
¥2.2文本输入 · ¥/百万 tokens
¥18音频输入 · ¥/百万 tokens
¥72输出 · ¥/百万 tokens
Supply Channels
供给渠道
官方渠道直连供给;网关统一鉴权、计费与可观测,与其它模型共用同一个 API Key。
Qwen 官方渠道暂无数据
延迟 P95—
吞吐量—
可用率—
近期可用率 · 最近 48 小时24h 滚动
渠道按近 24h 请求量降序排列(首张 = 主力),名称为该路供给的服务方;未标注服务方的渠道以「渠道 A/B」编号。可用率 / 延迟 / 吞吐为 24h 滚动统计,时间线逐小时着色(绿=正常 · 琥珀=波动 · 红=异常 · 灰=无流量,悬停查看每小时实际值)。按平台统一标价计费,与实际承接渠道无关;切换过程对调用方透明。
Quick Start
三分钟接入
OpenAI / Anthropic 双协议兼容:现有代码改一个 base URL,模型名换成 qwen/qwen3.5-omni-flash 即可。
POST /v1/chat/completionsOpenAI ChatPOST /v1/messagesAnthropic Messages
OpenAI SDK
Anthropic SDK
cURL
Claude Code
from openai import OpenAI
client = OpenAI(
base_url="https://api.goodputai.cn/v1",
api_key="GOODPUT_API_KEY",
)
resp = client.chat.completions.create(
model="qwen/qwen3.5-omni-flash",
messages=[{
"role": "user",
"content": [
{"type": "image_url", "image_url": {"url": "https://example.com/demo.jpg"}},
{"type": "text", "text": "这张图里有什么?"},
],
}],
# 音频 / 视频输入同构:input_audio / video_url content 块
)
print(resp.choices[0].message.content)计费方式:按 token 用量计费:文本输入 ¥2.2 · 输出 ¥72(¥ / 百万 tokens)。音频输入按独立单价计费:¥18 / 百万 tokens。
支持参数temperaturemax_tokens
Related Models