GLM-5.3-Flash 免费使用:320B 多模态模型,每晚 10 小时无限畅用
一句话速览:智谱 GLM-5.3-Flash(320B-A18B)——GLM-5 系列首个原生多模态模型,AA 智能指数 57 分与 Claude Opus 4.8 持平,定价仅为 GLM-5.3 的 1/10。9 月 3 日至 10 月 7 日,每晚 23:00 至次日 09:00 在 ZCode 中无限免费畅用,其他 Agent 额度翻倍,双节期间全天按非高峰 50% 抵扣。
📚 目录
- 背景:GLM-5.3-Flash 是什么?
- 一、四大核心亮点
- 二、跑分对比:开源 SOTA vs 国际旗舰
- 三、免费使用指南:从订阅到畅用
- 3.1 夜间畅用活动(每晚 23:00~09:00 无限免费)
- 3.2 非高峰时段 50% 抵扣(白天也能省)
- 3.3 双节全天优惠(9.25-10.7)
- 3.4 体验卡免费试用
- 四、套餐额度与定价
- 五、接入工具:支持 20+ 编程工具
- 六、局限性(需要知道的真相)
- 总结:前沿智能,第一次不需要省着用
- 参考链接
背景:GLM-5.3-Flash 是什么?
GLM-5.3-Flash是智谱 AI 于2026 年 8 月 26 日正式发布并开源的 GLM-5 系列首个原生多模态模型,总参数 320B、激活参数仅 18B,在 AA 综合智能指数中取得 57 分,与 Anthropic Claude Opus 4.8 持平。
| 项目 | 详情 |
|---|---|
| 发布方 | 智谱 AI(Z.ai / BigModel) |
| 发布时间 | 2026 年 8 月 26 日 |
| 模型规格 | 320B 总参数 / 18B 激活(320B-A18B) |
| 模型品类 | GLM-5 系列首个原生多模态模型 |
| 上下文窗口 | 1M tokens |
| 输入模态 | 文本 + 图片 |
| 架构创新 | 稀疏注意力 + 线性注意力混合架构、mHC 超连接 |
| AA 综合智能指数 | 57 分(与 Claude Opus 4.8 持平) |
| 定价 | GLM-5.3 的 1/10,限时折扣 1/20 |
| 开源状态 | Apache 2.0,HuggingFace 开源权重 |
| 内测代号 | OX Alpha(匿名测试时创双平台调用量新高) |
| 算力支撑 | 国产芯片集群提供大规模推理服务 |
发布前以匿名模型 OX Alpha 在 OpenCode 和 OpenRouter 上大规模测试,迅速成为当周最受欢迎的模型,创下双平台调用量新高。
一、四大核心亮点
| 亮点 | 说明 |
|---|---|
| AA 57 分开源前沿 | 与 Claude Opus 4.8 持平,进入全球前沿模型能力区间 |
| 1/10 极致低价 | 定价为 GLM-5.3 的 1/10,限时折扣 1/20,Opus 4.8 的 1/40 |
| 原生多模态 | GLM-5 系列首个原生多模态,训练阶段即面向文本+图片联合输入 |
| 夜间无限免费 | 9.3-10.7 每晚 23:00~09:00 在 ZCode 无限畅用 |
二、跑分对比:开源 SOTA vs 国际旗舰
| 基准 | GLM-5.3-Flash | GLM-5.2 | Claude Opus 4.8 | GPT-5.6 Terra | Gemini 3.7 Flash |
|---|---|---|---|---|---|
| AA 综合智能指数 | 57 | — | 57 | — | — |
| Terminal-Bench 2.1 | 84.3 | 81.0 | 85.0 | 87.4 | 85.8 |
| DeepSWE v1.1 | 63.4 | 46.2 | — | — | — |
| Terminal-Bench 3.0 | 28.3 | 4.6 | — | — | — |
注:AA 指数由 Artificial Analysis 独立评测;Terminal-Bench/DeepSWE 由智谱自报。
架构效率优势:
| 指标 | GLM-5.3-Flash vs GLM-5.3 |
|---|---|
| 注意力计算量 | 降低 3.01 倍 |
| KV 缓存大小 | 降低 4.44 倍 |
| 激活参数 | 18B vs 32B(几乎减半) |
| 层数 | 45 层 vs 92 层(几乎减半) |
在所有基线模型中,GLM-5.3-Flash 的注意力计算量最低。
三、免费使用指南:从订阅到畅用
3.1 夜间畅用活动(每晚 23:00~09:00 无限免费)
| 项目 | 详情 |
|---|---|
| 活动时间 | 2026 年 9 月 3 日至 10 月 7 日 |
| 每日免费时段 | 23:00 至次日 09:00(共 10 小时) |
| ZCode 中 | GLM-5.3-Flash 额度消耗为 0,完全免费畅用 |
| 其他 Agent 中 | GLM-5.3-Flash 额度翻倍 |
| 生效方式 | 自动生效,无需手动开启 |
操作步骤:
- 访问
bigmodel.cn/glm-coding订阅任意套餐(Lite 起步 ¥118/月) - 下载 ZCode(
zcode.z.ai/cn)并登录 - 选择 GLM-5.3-Flash 模型
- 每晚 23:00 后自动免费无限使用
ZCode 是智谱官方编程工具,深度适配 GLM 模型,订阅用户专享 150% 额度。
3.2 非高峰时段 50% 抵扣(白天也能省)
| 时段 | 抵扣系数 | 说明 |
|---|---|---|
| 非高峰时段 | 0.5 倍(50% 抵扣) | 所有非高峰时段积分消耗减半 |
| 高峰时段 | 1.0 倍(正常抵扣) | 周一至周五 14:00~18:00 |
高峰时段仅为每周工作日下午 2-6 点,其余全部 50% 抵扣。相当于每周 120 小时中仅 20 小时全价,其余 100 小时半价。
3.3 双节全天优惠(9.25-10.7)
| 活动期间 | 抵扣规则 | 说明 |
|---|---|---|
| 9 月 25 日至 10 月 7 日 | 全天按非高峰时段规则 | 全天 50% 抵扣 |
双节期间全天半价,叠加夜间免费时段,等于每天 14 小时免费 + 10 小时半价。
3.4 体验卡免费试用
| 项目 | 详情 |
|---|---|
| 体验卡额度 | 2,000 积分 |
| 每日限量 | 10,000 张/天 |
| 可用模型 | GLM-5.3、GLM-5.3-Flash |
| 获取方式 | GLM Coding Plan 页面领取 |
体验卡积分用完即止,适合免费体验模型能力后再决定是否订阅。
免费方式汇总:
| 方式 | 免费内容 | 适合人群 |
|---|---|---|
| 夜间畅用 | 每晚 10 小时无限免费 | 夜猫子开发者 |
| 非高峰 50% 抵扣 | 全天大部分时段半价 | 日常开发 |
| 双节全天优惠 | 9.25-10.7 全天半价 | 假期加班 |
| 体验卡 | 2,000 积分免费试用 | 新手体验 |
四、套餐额度与定价
| 套餐 | 连续包月 | 5h 积分 | 每周积分 | GLM-5.3-Flash 周额度(95% 缓存) |
|---|---|---|---|---|
| Lite | ¥118/月 | 2,000 | 10,000 | 1.46~2.92 亿 tokens |
| Pro | ¥538/月 | 12,000 | 60,000 | 8.77~17.55 亿 tokens |
| Max | ¥1,078/月 | 28,000 | 140,000 | 20.47~40.95 亿 tokens |
充分利用非高峰时段,相较按量调用 GLM-5.3 标准 API,最高可节省 92% 成本。
积分抵扣系数:
| 模型 | Input 系数 | Cached Input 系数 | Output 系数 |
|---|---|---|---|
| GLM-5.3 | 6.9 | 1.7 | 24 |
| GLM-5.3-Flash | 2.3 | 0.56 | 8 |
| 联网搜索 MCP | — | — | 1.2 |
| 网页读取 MCP | — | — | 1.2 |
| 开源仓库 MCP | — | — | 1.2 |
积分消耗 = (输入 Token × Input 系数 + 缓存命中 × Cached 系数 + 输出 Token × Output 系数) / 10000。非高峰时段全部 × 0.5。
五、接入工具:支持 20+ 编程工具
GLM Coding Plan 支持以下编程工具,所有工具均可使用套餐额度:
| 工具 | Base URL 配置 |
|---|---|
| ZCode | 官方编程工具,深度适配,专享 150% 额度 |
| AutoClaw | 官方办公助手,深度适配 |
| Claude Code | https://open.bigmodel.cn/api/anthropic |
| Cherry Studio | https://open.bigmodel.cn/api/coding/paas/v4/ |
| 其他工具 | https://open.bigmodel.cn/api/coding/paas/v4 |
其他支持工具:Codex、TraeCode、TraeWork、WorkBuddy、CodeBuddy、Cursor、OpenCode、OpenClaw、Kilo Code、Cline、Crush、Factory 等 20+。
对话式无脑接入(最简单):
在 WorkBuddy、Trae、Cursor 等支持对话配置的工具中,直接告诉 AI:“帮我添加一个模型,API 地址是
https://open.bigmodel.cn/api/coding/paas/v4,API Key 是你的智谱 Key,模型名选 glm-5.3-flash”,AI 自动完成配置。
六、局限性(需要知道的真相)
| 局限 | 说明 |
|---|---|
| 需订阅付费套餐 | 夜间免费活动需至少订阅 Lite 套餐(¥118/月) |
| 仅限 ZCode 无限免费 | 其他 Agent 夜间为额度翻倍而非无限 |
| 活动有截止日期 | 9 月 3 日至 10 月 7 日,结束后可能调整 |
| 套餐仅限指定工具 | 在非官方工具中调用 API 不可享用套餐额度 |
| 体验卡每日限量 | 每天 10,000 张,抢完即止 |
| 国产芯片算力有限 | 大规模流量可能触发限流 |
| 跑分多为自测 | Terminal-Bench/DeepSWE 为智谱自报数据 |
| 不支持退款 | 订阅一经购买不支持退款 |
总结:前沿智能,第一次不需要省着用
| 维度 | 详情 |
|---|---|
| 模型 | GLM-5.3-Flash(320B-A18B) |
| 能力 | AA 57 分,与 Claude Opus 4.8 持平 |
| 免费时段 | 每晚 23:00~09:00 在 ZCode 无限免费 |
| 免费截止 | 2026 年 10 月 7 日 |
| 双节优惠 | 9.25-10.7 全天 50% 抵扣 |
| 非高峰优惠 | 每天大部分时段 50% 抵扣 |
| 支持工具 | ZCode + 20+ 编程工具 |
| 订阅起步 | Lite ¥118/月 |
GLM-5.3-Flash 的核心价值:AA 57 分前沿智能 + 1/10 极致低价 + 每晚 10 小时无限免费 + 双节全天半价。对于想零成本体验前沿多模态编码模型的开发者来说,10 月 7 日前是最佳窗口。
参考链接
- 智谱 GLM-5.3-Flash 发布博客:https://www.zhipuai.cn/zh/research/163
- GLM Coding Plan 官网:https://bigmodel.cn/glm-coding
- 套餐概览文档:https://docs.bigmodel.cn/cn/coding-plan/overview
- GLM-5.3-Flash 模型文档:https://docs.bigmodel.cn/cn/guide/models/vlm/glm-5.3-flash
- HuggingFace 开源权重:https://huggingface.co/zai-org/GLM-5.3-Flash
觉得有用?点赞 + 收藏 + 关注,并留你最关心的内容,后续考虑持续跟进更多相关内容。
声明:资源可能存在第三方来源,若有侵权请联系删除!