模型库Qwen: Qwen3.7 Flash
Qwen · 官方接入 · 对话模型
Qwen: Qwen3.7 Flash
通义千问轻量低成本模型,效果接近旗舰,百万 token 上下文。
文本文本工具调用深度推理结构化输出提示词缓存
1M上下文窗口
¥0.20输入 · ¥/百万 tokens
¥0.80输出 · ¥/百万 tokens
¥0.02缓存读 · ¥/百万 tokens
Long-Context Pricing
长上下文分段价格
单次请求的输入量(含缓存读写的全量)达到档位起点时,该笔请求整体按对应档位价格计费; 未达任何档位则按标准价。价格为最终扣费单价(¥/百万 tokens)。 下表为标准时段档价;有分时段价格的模型在各时段以该时段价为基础叠加档位, 每笔请求命中的时段与档位以调用日志的扣费明细为准。
| 输入量档位 | 输入 | 输出 | 缓存读取 | 缓存写入 |
|---|---|---|---|---|
| 标准(基础档) | ¥0.20 | ¥0.80 | ¥0.02 | — |
| ≥ 32,001 tokens | ¥0.60 | ¥2.4 | ¥0.06 | — |
| ≥ 256,001 tokens | ¥1.2 | ¥4.8 | ¥0.12 | — |
Supply Channels
供给渠道
官方渠道直连供给;网关统一鉴权、计费与可观测,与其它模型共用同一个 API Key。
Alibaba Cloud正常
延迟 P95251.8s
吞吐量691tps
可用率100.00%
近期可用率 · 最近 48 小时24h 滚动
渠道按近 24h 请求量降序排列(首张 = 主力),名称为该路供给的服务方;未标注服务方的渠道以「渠道 A/B」编号。可用率 / 延迟 / 吞吐为 24h 滚动统计,时间线逐小时着色(绿=正常 · 琥珀=波动 · 红=异常 · 灰=无流量,悬停查看每小时实际值)。按平台统一标价计费,与实际承接渠道无关;切换过程对调用方透明。
Quick Start
三分钟接入
OpenAI / Anthropic 双协议兼容:现有代码改一个 base URL,模型名换成 qwen/qwen3.7-flash 即可。
POST /v1/chat/completionsOpenAI ChatPOST /v1/messagesAnthropic Messages
OpenAI SDK
Anthropic SDK
cURL
Claude Code
from openai import OpenAI
client = OpenAI(
base_url="https://api.goodputai.cn/v1",
api_key="GOODPUT_API_KEY",
)
resp = client.chat.completions.create(
model="qwen/qwen3.7-flash",
messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)计费方式:按 token 用量计费:输入 ¥0.20 · 输出 ¥0.80(¥ / 百万 tokens)。
支持参数toolsresponse_formatreasoning_efforttemperaturemax_tokens
Related Models