GLM-5.3 限时五折查看模型
GoodPut AI词元之芯旗下

一个 Key,打开 AI 的大门

自建国产算力 + 官方渠道并行——更全、更稳、更省,数据不出境。Claude Code / Codex 开箱即用。

base_url="https://api.goodputai.cn"
实时路由近 24h 请求 4,860
输出 26.4 tokens/s可用性 96.89%TTFT 均值 4.82sfallback 就绪
18,984 M本月 Token 处理量
20+首批上线模型
8国产供应商与算力源
99.95%网关可用性
Why GoodPut

自建国产算力,不只是聚合

多数聚合站只是转租上游——我们自己有算力。国产旗舰开源模型跑在词元之芯自建的加速卡集群上,从推理内核到调度层层打磨:算力自主,可用性、延迟与价格才由自己说了算;国产官方渠道并行兜底,任一路波动自动切换,业务不停摆。

双协议完整兼容

OpenAI 与 Anthropic 两套协议都完整实现——现有代码改一个 base URL 即可迁移,SDK 零改动。

python
from openai import OpenAI

client = OpenAI(
    base_url="https://api.goodputai.cn/v1",
    api_key="GOODPUT_API_KEY",
)

resp = client.chat.completions.create(
    model="deepseek/deepseek-v4-pro",  # 换成任意模型
    messages=[{"role": "user", "content": "你好"}],
)

为 Agent 工具深度优化

Claude Code、Codex、Cline / Roo Code 等主流 Agent 开箱即用——协议差异完整清洗,长程工具调用、流式与提示词缓存表现一致。

bash
# ~/.zshrc 或 ~/.bashrc
export ANTHROPIC_BASE_URL="https://api.goodputai.cn"
export ANTHROPIC_AUTH_TOKEN="你的 GoodPut API Key"

claude   # 重开终端后启动即接入

自有部署,才有定价灵活

开源旗舰权重跑在自营国产卡上,成本自主可控——所以我们能把定价做「活」,而不是照搬一口价:分时错峰更省,并随集群优化持续下调。

查看模型定价
分时峰谷价错峰时段更低价,高峰按需,成本再省一档
自建成本可控定价透明、随集群优化下调,不吃中间差价

数据不出境

自营集群境内推理、国产渠道全链路境内,数据不出境;企业级鉴权与额度隔离,安全合规可控。

99.95%

供给确定,自动兜底

可用性与延迟由自营集群直接兑现;国产官方渠道并行兜底,限流或故障自动切换,应用零停机。

For Teams

企业与团队,安全开箱

企业登录、组织与团队分级、双层额度管控、多维用量统计——把先进的国产模型安全地交到每个成员手里,成本与权限由管理员统一说了算。

企业登录

钉钉、飞书、企业微信单点登录,成员用现有企业账号直接接入,无需注册。

组织 · 多团队

一个组织下建多个团队,成员按团队归属,资源与权限天然隔离。

双层额度管控

团队级治理上限 + 成员个人额度,谁能用多少由管理员统一分配。

多维用量统计

按团队 / 成员 / 模型 / 按天,用量与成本全维度可查、可复盘。

统一账单结算

组织预付费余额,按账期出账,一份账单管全员。

即将上线

一键开票

用量账单一键申请发票,财务省心。

Models & Pricing

热门模型

查看全部模型
MiniMax H3MiniMax

MiniMax H3 视频生成模型:支持文生视频、图生视频(首帧 / 首尾帧)与参考生视频,可输入文本、图片、音频、视频作为参考。输出 768P,默认连同声音一起生成。按成功生成的视频时长计费,正式价 0.50 元/秒,推广期特惠中(实际价格以页面标价为准)。生成失败不计费;参考图、参考音频、参考视频等输入素材限时免费。

¥0.01 /秒限时 98% 折扣自营算力
MiniMax H3 FastMiniMax

MiniMax H3 视频生成模型:支持文生视频、图生视频(首帧 / 首尾帧)与参考生视频,可输入文本、图片、音频、视频作为参考。输出 768P,默认连同声音一起生成。按成功生成的视频时长计费,正式价 0.50 元/秒,推广期特惠中(实际价格以页面标价为准)。生成失败不计费;参考图、参考音频、参考视频等输入素材限时免费。 H3 Fast 由拉模式任务队列调度:提交即返回任务 id,按秒计费。画布只支持 1344x768(16:9,默认)与 768x1344(9:16);时长 5–14 秒(默认 5 秒),成片会按帧网格略长于请求时长(至多约 0.7 秒),按请求秒数计费。其余参数与 MiniMax H3 相同。

¥0.01 /秒限时 98% 折扣自营算力
Z.AI: GLM 5.3Z.ai

GLM-5.3 是 Z.AI GLM 系列的新一代模型,支持最长 1M 上下文与 128K 输出,原生支持深度思考、工具调用与结构化输出,适合长文档理解、代码生成与复杂推理场景。由自营算力提供服务,兼容 OpenAI 与 Anthropic 两种调用协议。

1M¥4 / ¥14限时 50% 折扣自营算力
Case Notes

来自生产环境

Agent 编码降本
把 Claude Code 的默认模型切到自营算力上的 Kimi K2.7 之后,团队的月度模型开销降了一个数量级,任务完成率几乎没有差别。
某 AI 编程工具团队 · 技术负责人
双协议一套框架
我们同一套 Agent 框架同时跑 DeepSeek 和 GLM,只改模型名,不改一行业务代码。双协议兼容是真的省心。
某跨境电商 SaaS · 平台架构师
大促零停机
fallback 模型列表救过我们一次大促——主渠道限流时自动切到备用模型,用户完全无感。
某内容社区 · 基础设施工程师
Get Started

现在注册,开始调用

改一个 base URL 的事,让团队用上先进的国产模型。