GLM-5.3 限时五折查看模型
模型库Qwen: Qwen3 VL Plus
Qwen
Qwen · 官方接入 · 对话模型

Qwen: Qwen3 VL Plus

通义千问视觉理解模型,支持图像输入与思考模式。

文本图像文本工具调用深度推理提示词缓存
256K上下文窗口
¥1输入 · ¥/百万 tokens
¥10输出 · ¥/百万 tokens
¥0.10缓存读 · ¥/百万 tokens
Long-Context Pricing

长上下文分段价格

单次请求的输入量(含缓存读写的全量)达到档位起点时,该笔请求整体按对应档位价格计费; 未达任何档位则按标准价。价格为最终扣费单价(¥/百万 tokens)。 下表为标准时段档价;有分时段价格的模型在各时段以该时段价为基础叠加档位, 每笔请求命中的时段与档位以调用日志的扣费明细为准。

输入量档位输入输出缓存读取缓存写入
标准(基础档)¥1¥10¥0.10
32,001 tokens¥1.5¥15¥0.15
128,001 tokens¥3¥30¥0.30
Supply Channels

供给渠道

官方渠道直连供给;网关统一鉴权、计费与可观测,与其它模型共用同一个 API Key。

Alibaba Cloud正常
延迟 P9529.0s
吞吐量33tps
可用率100.00%
近期可用率 · 最近 48 小时24h 滚动

渠道按近 24h 请求量降序排列(首张 = 主力),名称为该路供给的服务方;未标注服务方的渠道以「渠道 A/B」编号。可用率 / 延迟 / 吞吐为 24h 滚动统计,时间线逐小时着色(绿=正常 · 琥珀=波动 · 红=异常 · 灰=无流量,悬停查看每小时实际值)。按平台统一标价计费,与实际承接渠道无关;切换过程对调用方透明。

Quick Start

三分钟接入

OpenAI / Anthropic 双协议兼容:现有代码改一个 base URL,模型名换成 qwen/qwen3-vl-plus 即可。

POST /v1/chat/completionsOpenAI ChatPOST /v1/messagesAnthropic Messages
from openai import OpenAI

client = OpenAI(
    base_url="https://api.goodputai.cn/v1",
    api_key="GOODPUT_API_KEY",
)

resp = client.chat.completions.create(
    model="qwen/qwen3-vl-plus",
    messages=[{
        "role": "user",
        "content": [
            {"type": "image_url", "image_url": {"url": "https://example.com/demo.jpg"}},
            {"type": "text", "text": "这张图里有什么?"},
        ],
    }],
)
print(resp.choices[0].message.content)

计费方式:按 token 用量计费:输入 ¥1 · 输出 ¥10(¥ / 百万 tokens)。

支持参数toolstemperaturemax_tokens
本服务基于生成式人工智能技术提供,生成内容可能存在不准确之处,请自行核实,不构成专业 建议。本模型由 Qwen 提供,其生成式人工智能服务的备案情况以该提供方的 公示为准;本站的 备案公示见此。如发现违法不良信息或需投诉举报,请见 投诉举报
Related Models

相关模型

Get Started

现在把 Qwen: Qwen3 VL Plus 接进你的应用

改一个 base URL 的事,注册后即可调用。