智谱 GLM API 上手指南:模型怎么选、免费额度怎么用(2026实测)

过去几个月我一直用中转站调各家模型,上个月开始直接注册了智谱的 BigModel 平台,把 GLM 系列当成主力之一。用下来发现不少人对它印象还停在"免费 chatglm.cn 网页版",其实它的开放平台已经相当完整了。这篇把我踩过的点和查到的资料整理一下。

先纠正一个常见误解

很多人以为 GLM 只有网页聊天。实际上智谱有面向开发者的开放平台,现在叫 BigModel,文档站在 docs.bigmodel.cn。API 兼容 OpenAI 格式,你在任何支持自定义 base_url 的客户端里填进去就能用,不用改代码结构。

现在模型线有哪些

按官方文档(2026年9月查证)的当前主线:

GLM-5.3:旗舰,官方定位是复杂软件工程、终端操作和 Agent 任务的进步显著,1M 上下文、128K 最大输出。这是他们现在最能打的一个。

GLM-5.3-Flash:原生多模态的普惠款,能理解图片视频,价格低一个量级。我日常批量处理任务基本都走 Flash,账单好看很多。

GLM-5.2 / GLM-5.1 / GLM-5:上一代梯队,5.1 官方标称可自主工作长达 8 小时,长程 Agent 任务可以考虑,价格通常比 5.3 便宜。

剩下的专用模型把平台配齐了:图像生成、OCR、语音识别(ASR)、语音合成(TTS)、视频生成(CogVideoX-3)、向量(Embedding-3),做应用需要的基本不用出平台。写代码为主的场景可以搭配 Claude Code 的工作流提示词一起用。

免费额度情况

新注册账号送体验额度,部分模型(历代 Flash 系列)有免费的档位,适合拿来测试和学习。这是智谱对个人开发者最友好的地方。

但是要说清楚:免费模型的速率限制比较紧,正式业务别指望白嫖。我的做法是开发调试用 Flash 免费档,正式跑任务切付费模型,一个月花不了多少钱。

具体价格和额度政策官方调整得比较频繁,价格页看最新的,我不在文章里写死数字,免得三个月后误导人。

我实际的接入方式

拿 Python 举例(以 OpenAI SDK 调用为例):

from openai import OpenAI

client = OpenAI(
    api_key="你的key",
    base_url="https://open.bigmodel.cn/api/paas/v4/"
)

resp = client.chat.completions.create(
    model="glm-5.3-flash",
    messages=[{"role": "user", "content": "用一句话解释什么是向量数据库"}]
)
print(resp.choices[0].message.content)

就这么多。其他 OpenAI SDK 的用法直接照搬,流式输出、function calling 这些都支持。

如果你不想写代码,图形客户端也行。之前写过 Cherry Studio 的实测,它支持自定义模型供应商,把智谱的 key 填进去就能在桌面端用 GLM 全家桶。

用下来的真实感受

好的地方:国内直连稳定,不用折腾网络;Flash 系列性价比高;文档是中文的,查起来快;中文语料训练充分,中文写作任务表现好于同价位海外模型。

不太好的地方:最旗舰模型的编码能力跟海外第一梯队比还有差距,尤其是复杂工程任务的长链条规划。官方文档自己也在拿 Claude 系列做对标,说明他们清楚这个差距。纯中文任务或性价比敏感的场景选它没毛病,重度编码可以再对比对比。

另外提醒一句,API key 管好,别提交到代码仓库里。我见过有人把 key 传 GitHub,一晚上被刷掉几百块额度的。

适合谁

想要国内稳定直连、预算敏感、主要做中文任务的个人开发者和学生,BigModel 平台是目前性价比第一梯队的选择。从免费 Flash 试起,够用再充值,试错成本几乎为零。

发表评论