2026 年 8 月 29 日——据 ZCode 官方公告,ZCode 自 8 月 29 日(周六)起至 8 月 31 日 9 时前开放 GLM-5.3-Flash 模型免费用量申领,免费用量为 3 亿 Token,新老用户均可申领,用量需在 ZCode 客户端中使用。
ZCode 是智谱旗下 AI 编程工具,定位"新一代氛围编程工具",支持多智能体协作完成复杂目标。官网下载页显示,客户端当前版本为 v3.10.1,覆盖 macOS、Windows、Linux 三大平台。
申领信息
据官方公告,本次免费用量活动的核心信息如下:
| 项目 | 内容 |
|---|---|
| 活动主体 | ZCode |
| 免费模型 | GLM-5.3-Flash |
| 免费用量 | 3 亿 Token |
| 申领时间 | 2026 年 8 月 29 日起至 8 月 31 日 9 时前 |
| 申领对象 | 新老用户均可申领 |
| 使用范围 | 需在 ZCode 客户端中使用 |
| 下载地址 | https://zcode.z.ai/cn#all-downloads |
免费用量需在 ZCode 客户端中使用。客户端可通过官网下载页获取,活动截止时间为 2026 年 8 月 31 日 9 时。
ZCode 与 GLM-5.3-Flash
官网信息显示,ZCode 围绕长程任务提供 Goal 管理能力,支持对复杂目标持续规划、执行与验证;支持通过微信、飞书或 Telegram 远程唤起任务的 Bot 控制;并针对推理、编码和多 Agent 协作对 GLM-5.3 系列模型进行深度集成,兼容 ZCode、Claude Code 等 20 余款编程工具。
GLM-5.3-Flash 已同步接入 ZCode,官方称截图理解、看图分析等多模态任务可开箱即用。此外,官网同时提供 GLM Coding 订阅套餐,Lite、Pro、Max 三档价格分别为每月 94.4 元、430.4 元、862.4 元。
客户端各平台下载形态如下(版本 v3.10.1):
| 平台 | 安装包形态 |
|---|---|
| macOS | Apple 芯片 / Intel 芯片(.dmg) |
| Windows | 64 位 / ARM64(.exe) |
| Linux(Beta) | x64 / ARM64(.deb、.rpm、.AppImage) |
GLM-5.3-Flash 模型能力
据 BigModel 开放平台模型文档,GLM-5.3-Flash 是 GLM-5 系列首个原生多模态模型,模型代码为 glm-5.3-flash,主打低成本高智能。该模型采用稀疏注意力与线性注意力混合架构,总参数量 320B、激活参数量 18B,官方称其为首个采用该混合架构的开源前沿模型;相比 GLM-5.3,注意力计算量降低 3.01 倍,KV 缓存降低 4.44 倍。
第三方评测方面,据 Artificial Analysis 综合智能指数,GLM-5.3-Flash 取得 57 分,官方称与 Claude Opus 4.8 持平,并超越 GLM-5.2。主要规格如下:
| 项目 | 参数 |
|---|---|
| 模型代码 | glm-5.3-flash |
| 架构 | 稀疏注意力与线性注意力混合(MoE) |
| 总参数量 / 激活参数量 | 320B / 18B |
| 上下文窗口 | 1M |
| 最大输出 | 128K |
| 输入模态 | 文本、图片、视频、文件 |
| 输出模态 | 文本 |
| 思考模式 | 仅思考模式,不可关闭 |
| 功能支持 | Function Calling、流式输出、上下文缓存、结构化输出 |
据官方文档,GLM-5.3-Flash 定价为 GLM-5.3 的 1/10,限时折扣期间为 GLM-5.3 的 1/20;GLM Coding Plan 用户调用该模型的可用额度为 GLM-5.3 的 3 倍,非高峰时段(含周末)仅消耗标准积分的 50%。
与 DeepSeek V4 Flash 的对比
GLM-5.3-Flash 与 DeepSeek 主打的 deepseek-v4-flash 同属高性价比快速模型。据两家官方文档整理,主要参数对比如下:
| 对比维度 | GLM-5.3-Flash | deepseek-v4-flash |
|---|---|---|
| 模型版本 | glm-5.3-flash | DeepSeek-V4-Flash-0731 |
| 上下文长度 | 1M | 1M |
| 最大输出 | 128K | 384K |
| 输入模态 | 文本、图片、视频、文件 | 文本(官方文档未提及多模态输入) |
| 思考模式 | 仅思考模式,不可关闭 | 思考/非思考可切换(默认思考) |
| 工具调用 | 支持 Function Calling | 支持 Tool Calls 与 Responses API |
| 输出价格 | 官方称为 GLM-5.3 的 1/10,未公布绝对单价 | 2 元/百万 tokens(平时价) |
| 输入价格 | 未公布绝对单价 | 缓存命中 0.02 元、未命中 1 元/百万 tokens |
| 并发限制 | 未公布 | 2500 |
从官方公布的定位看,GLM-5.3-Flash 侧重原生多模态与编码场景,与 ZCode 深度集成;deepseek-v4-flash 侧重 Agent 工具链兼容,同时支持 OpenAI Responses API 与 Anthropic API 两种接入格式。
注:DeepSeek API 执行峰谷定价,高峰时段价格为平时价格的 2 倍;另据 2026 年 8 月媒体报道,DeepSeek 已预告近期整体上调 API 定价。GLM-5.3-Flash 实际价格以 BigModel 价格页为准。
BigModel 注册与 API 调用
本次活动的 3 亿 Token 免费用量需在 ZCode 客户端中使用,与开放平台 API 调用相互独立。开发者如需通过 API 调用 GLM 系列模型,可在智谱 BigModel 开放平台注册账号。据官方快速开始文档,流程如下:
- 访问智谱开放平台(open.bigmodel.cn),点击右上角「注册/登录」;
- 使用手机号完成注册,平台支持海外手机号,需选择对应国家区号并通过短信验证码验证;
- 企业用户可在实名认证页面完成企业实名认证,升级为企业账号;
- 登录后进入个人中心的 API Keys 页面创建 API Key,官方建议妥善保管 Key,避免泄露或硬编码在代码中。
验证码发送设有频率限制,短时间内频繁请求可能触发限制,需等待 5 分钟后重试。
API 调用兼容 OpenAI Chat Completions 格式,端点为 https://open.bigmodel.cn/api/paas/v4/chat/completions。Python 环境可安装新版 SDK(pip install zai-sdk)或旧版 SDK(pip install zhipuai),调用示例(cURL,据官方快速开始文档整理):
curl https://open.bigmodel.cn/api/paas/v4/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "glm-5.3-flash", "messages": [{"role": "user", "content": "你好"}]}'
举手提问