Z.AI: GLM 5.3
GLM-5.3 是 Z.AI GLM 系列的新一代模型,支持最长 1M 上下文与 128K 输出,原生支持深度思考、工具调用与结构化输出,适合长文档理解、代码生成与复杂推理场景。由自营算力提供服务,兼容 OpenAI 与 Anthropic 两种调用协议。
供给渠道
自营算力多路供给:任何一路限流或故障自动切换,业务无感。
渠道按近 24h 请求量降序排列(首张 = 主力),名称为该路供给的服务方;未标注服务方的渠道以「渠道 A/B」编号。可用率 / 延迟 / 吞吐为 24h 滚动统计,时间线逐小时着色(绿=正常 · 琥珀=波动 · 红=异常 · 灰=无流量,悬停查看每小时实际值)。按平台统一标价计费,与实际承接渠道无关;切换过程对调用方透明。
三分钟接入
OpenAI / Anthropic 双协议兼容:现有代码改一个 base URL,模型名换成 z-ai/glm-5.3 即可。
from openai import OpenAI
client = OpenAI(
base_url="https://api.goodputai.cn/v1",
api_key="GOODPUT_API_KEY",
)
resp = client.chat.completions.create(
model="z-ai/glm-5.3",
messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)计费方式:按 token 用量计费:输入 ¥4 · 输出 ¥14(¥ / 百万 tokens)。网络搜索调用按次另计:¥0 / 次。
相关模型
GLM-5.2 supports a larger context window and output length, with up to 1M context and 128K output tokens. It adds streaming output for tool calls via `tool_stream=true`, enabling real-time access to tool call arguments. Like the GLM-4.7 series, it supports deep thinking with `thinking={ type: "enabled" }`, where thinking is enforced once enabled, and introduces `reasoning_effort` to control reasoning intensity under chain-of-thought mode. It also delivers stronger coding performance and more advanced reason
MiniMax H3 视频生成模型:支持文生视频、图生视频(首帧 / 首尾帧)与参考生视频,可输入文本、图片、音频、视频作为参考。输出 768P,默认连同声音一起生成。按成功生成的视频时长计费,正式价 0.50 元/秒,推广期特惠中(实际价格以页面标价为准)。生成失败不计费;参考图、参考音频、参考视频等输入素材限时免费。
MiniMax H3 视频生成模型:支持文生视频、图生视频(首帧 / 首尾帧)与参考生视频,可输入文本、图片、音频、视频作为参考。输出 768P,默认连同声音一起生成。按成功生成的视频时长计费,正式价 0.50 元/秒,推广期特惠中(实际价格以页面标价为准)。生成失败不计费;参考图、参考音频、参考视频等输入素材限时免费。 H3 Fast 由拉模式任务队列调度:提交即返回任务 id,按秒计费。画布只支持 1344x768(16:9,默认)与 768x1344(9:16);时长 5–14 秒(默认 5 秒),成片会按帧网格略长于请求时长(至多约 0.7 秒),按请求秒数计费。其余参数与 MiniMax H3 相同。