声明:文档由AI生成,仅作参考,最终功能和计费标准以官方为准。
Z.AI 是北京智谱华章科技有限公司研发的人工智能平台,提供基于 GLM 系列大模型的对话、编程、智能体及多模态任务处理服务。
![]()
原生多模态能力:GLM-5.3-Flash 是 GLM-5 系列首个原生多模态模型,支持视频、图像、文本、文件输入,视觉能力原生融入 Coding 循环,模型能主动观察界面、渲染结果与交互反馈并持续改进。
高效混合架构:总参数量 320B,激活参数量 18B,是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型。相较于 GLM-5.3,注意力计算量与 KV 缓存大小分别降低 3.01 倍和 4.44 倍。
超长上下文支持:支持 1M 上下文窗口,最大输出 128K,满足长文档处理与复杂任务需求。
Computer Use 闭环能力:能够视觉理解软件界面,执行点击、文本输入、决策和持续操作,在无结构化 API 时仍可测试游戏和网站,形成“观察→实现→使用→改进”的闭环。
多场景专业交付:支持 Office 文档、金融研究和专业文档场景,可自主拆解目标、调用工具并交付 PPTX、PDF、DOCX、XLSX 等格式成品。
多工具集成:GLM Coding Plan 兼容 Claude Code、Cline、OpenCode 等编码工具,覆盖自然语言编程、代码补全、调试修复、代码库问答、自动化任务处理等开发场景。
性能表现:在 Artificial Analysis Intelligence Index 中取得 57 分,编程表现在自研 Z.ai Code Bench 中与 Claude Opus 4.8 相当,在 DeepSWE v1.1(63.4 vs. 46.2)和 AutomationBench(48.8 vs. 26.2)等基准测试中超越 GLM-5.2。
| 套餐类型 | 5小时积分 | 周积分 |
|---|---|---|
| Lite | 2,000 | 10,000 |
| Pro | 12,000 | 60,000 |
| Max | 28,000 | 140,000 |
起始价格:18 美元/月。
| 席位类型 | 5小时积分 | 周积分 |
|---|---|---|
| Standard Seat | 15,000 | 66,000 |
| Premium Seat | 35,000 | 155,000 |
模型积分消耗 = (输入 tokens × 输入倍率 + 缓存输入 tokens × 缓存输入倍率 + 输出 tokens × 输出倍率) / 10,000。
MCP 工具积分消耗 = 调用次数 × 输出倍率。
| 产品类型 | 产品 | 输入倍率 | 缓存输入倍率 | 输出倍率 |
|---|---|---|---|---|
| 模型 | GLM-5.3 | 6.9 | 1.7 | 24 |
| 模型 | GLM-5.3-Flash(含视觉理解 MCP) | 2.3 | 0.56 | 8 |
| MCP 服务器 | Web Search | — | — | 1.2 |
| MCP 服务器 | Web Reader | — | — | 1.2 |
| MCP 服务器 | Zread | — | — | 1.2 |
时段折扣:非高峰时段模型消耗按标准积分的 50% 计费。高峰时段为周一至周五 14:00–18:00(新加坡标准时间 UTC+8)。
额度重置规则:5 小时积分为动态刷新,消耗后 5 小时重置;周积分自订阅激活起每 7 天重置。
超额使用:团队套餐支持开启按需超额,超额部分按模型 API 标价 10% 折扣计费(限时优惠)。
A:所有套餐均支持 GLM-5.3 和 GLM-5.3-Flash。对 GLM-5.2/GLM-5.1 的请求将自动路由至 GLM-5.3,对 GLM-4.7 的请求将自动路由至 GLM-5.3-Flash。
A:不会。在支持的工具中调用 GLM 仅使用 Coding Plan 额度,额度耗尽后需等待下一个 5 小时周期刷新,系统不会从账户余额扣款。
A:严格限定于官方支持的工具和产品,包括 Claude Code、Cline、OpenCode 等。用户不得在未支持的工具或场景中使用订阅权益。
A:订阅购买后不可退款。即使未使用完整套餐,费用亦无法退还。
A:同层级升级(如月付转年付)不会立即生效,将在当前套餐到期后激活,有效期累加。跨层级升级立即生效,原套餐剩余价值按比例转换为账户余额用于抵扣差价。
A:GLM 模型的缓存机制目前处于公开测试阶段。缓存内容存储免费,触发缓存命中时按约原价的 1/5 计费。缓存命中触发逻辑和保留时长尚未公布。