2026 年 8 月 29 日——据 ZCode 官方公告,ZCode 自 8 月 29 日(周六)起至 8 月 31 日 9 时前开放 GLM-5.3-Flash 模型免费用量申领,免费用量为 3 亿 Token,新老用户均可申领,用量需在 ZCode 客户端中使用。

ZCode 是智谱旗下 AI 编程工具,定位"新一代氛围编程工具",支持多智能体协作完成复杂目标。官网下载页显示,客户端当前版本为 v3.10.1,覆盖 macOS、Windows、Linux 三大平台。

申领信息

据官方公告,本次免费用量活动的核心信息如下:

项目 内容
活动主体 ZCode
免费模型 GLM-5.3-Flash
免费用量 3 亿 Token
申领时间 2026 年 8 月 29 日起至 8 月 31 日 9 时前
申领对象 新老用户均可申领
使用范围 需在 ZCode 客户端中使用
下载地址 https://zcode.z.ai/cn#all-downloads

免费用量需在 ZCode 客户端中使用。客户端可通过官网下载页获取,活动截止时间为 2026 年 8 月 31 日 9 时。

ZCode 与 GLM-5.3-Flash

官网信息显示,ZCode 围绕长程任务提供 Goal 管理能力,支持对复杂目标持续规划、执行与验证;支持通过微信、飞书或 Telegram 远程唤起任务的 Bot 控制;并针对推理、编码和多 Agent 协作对 GLM-5.3 系列模型进行深度集成,兼容 ZCode、Claude Code 等 20 余款编程工具。

GLM-5.3-Flash 已同步接入 ZCode,官方称截图理解、看图分析等多模态任务可开箱即用。此外,官网同时提供 GLM Coding 订阅套餐,Lite、Pro、Max 三档价格分别为每月 94.4 元、430.4 元、862.4 元。

客户端各平台下载形态如下(版本 v3.10.1):

平台 安装包形态
macOS Apple 芯片 / Intel 芯片(.dmg)
Windows 64 位 / ARM64(.exe)
Linux(Beta) x64 / ARM64(.deb、.rpm、.AppImage)

GLM-5.3-Flash 模型能力

据 BigModel 开放平台模型文档,GLM-5.3-Flash 是 GLM-5 系列首个原生多模态模型,模型代码为 glm-5.3-flash,主打低成本高智能。该模型采用稀疏注意力与线性注意力混合架构,总参数量 320B、激活参数量 18B,官方称其为首个采用该混合架构的开源前沿模型;相比 GLM-5.3,注意力计算量降低 3.01 倍,KV 缓存降低 4.44 倍。

第三方评测方面,据 Artificial Analysis 综合智能指数,GLM-5.3-Flash 取得 57 分,官方称与 Claude Opus 4.8 持平,并超越 GLM-5.2。主要规格如下:

项目 参数
模型代码 glm-5.3-flash
架构 稀疏注意力与线性注意力混合(MoE)
总参数量 / 激活参数量 320B / 18B
上下文窗口 1M
最大输出 128K
输入模态 文本、图片、视频、文件
输出模态 文本
思考模式 仅思考模式,不可关闭
功能支持 Function Calling、流式输出、上下文缓存、结构化输出

据官方文档,GLM-5.3-Flash 定价为 GLM-5.3 的 1/10,限时折扣期间为 GLM-5.3 的 1/20;GLM Coding Plan 用户调用该模型的可用额度为 GLM-5.3 的 3 倍,非高峰时段(含周末)仅消耗标准积分的 50%。

与 DeepSeek V4 Flash 的对比

GLM-5.3-Flash 与 DeepSeek 主打的 deepseek-v4-flash 同属高性价比快速模型。据两家官方文档整理,主要参数对比如下:

对比维度 GLM-5.3-Flash deepseek-v4-flash
模型版本 glm-5.3-flash DeepSeek-V4-Flash-0731
上下文长度 1M 1M
最大输出 128K 384K
输入模态 文本、图片、视频、文件 文本(官方文档未提及多模态输入)
思考模式 仅思考模式,不可关闭 思考/非思考可切换(默认思考)
工具调用 支持 Function Calling 支持 Tool Calls 与 Responses API
输出价格 官方称为 GLM-5.3 的 1/10,未公布绝对单价 2 元/百万 tokens(平时价)
输入价格 未公布绝对单价 缓存命中 0.02 元、未命中 1 元/百万 tokens
并发限制 未公布 2500

从官方公布的定位看,GLM-5.3-Flash 侧重原生多模态与编码场景,与 ZCode 深度集成;deepseek-v4-flash 侧重 Agent 工具链兼容,同时支持 OpenAI Responses API 与 Anthropic API 两种接入格式。

注:DeepSeek API 执行峰谷定价,高峰时段价格为平时价格的 2 倍;另据 2026 年 8 月媒体报道,DeepSeek 已预告近期整体上调 API 定价。GLM-5.3-Flash 实际价格以 BigModel 价格页为准。

BigModel 注册与 API 调用

本次活动的 3 亿 Token 免费用量需在 ZCode 客户端中使用,与开放平台 API 调用相互独立。开发者如需通过 API 调用 GLM 系列模型,可在智谱 BigModel 开放平台注册账号。据官方快速开始文档,流程如下:

  1. 访问智谱开放平台(open.bigmodel.cn),点击右上角「注册/登录」;
  2. 使用手机号完成注册,平台支持海外手机号,需选择对应国家区号并通过短信验证码验证;
  3. 企业用户可在实名认证页面完成企业实名认证,升级为企业账号;
  4. 登录后进入个人中心的 API Keys 页面创建 API Key,官方建议妥善保管 Key,避免泄露或硬编码在代码中。

验证码发送设有频率限制,短时间内频繁请求可能触发限制,需等待 5 分钟后重试。

API 调用兼容 OpenAI Chat Completions 格式,端点为 https://open.bigmodel.cn/api/paas/v4/chat/completions。Python 环境可安装新版 SDK(pip install zai-sdk)或旧版 SDK(pip install zhipuai),调用示例(cURL,据官方快速开始文档整理):

curl https://open.bigmodel.cn/api/paas/v4/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "glm-5.3-flash", "messages": [{"role": "user", "content": "你好"}]}'