ZCode:GLM-5.3 的官方 harness,把自己定义成 ADE 而不是编辑器
zcode
Z.ai 为 GLM-5.3 做的官方 harness,自我定位既不是 AI 编辑器也不是 CLI,而是 ADE(Agentic Development Environment,智能体开发环境):把 GLM-5.3 的 1M 上下文与长程任务能力落成稳定可用的桌面体验,覆盖复杂开发任务中的规划、编码、审查与迭代,并把目标、文件、终端结果、浏览器上下文、执行模式与 Git 状态保持在同一个任务里,让任务从规划一路推进到实现与验证收口而不丢连续性;围绕 GLM-5.3 做过模型能力、工具调用与执行链路的多轮联调与专项优化。最有辨识度的是 /goal 目标模式:设定目标后每一轮结束自动校验是否达成,没达成就自己接着下一轮,确认完成才收尾(官方实例是连续跑了二十多轮的研究任务,右侧摘要面板逐轮显示做了什么、推进到哪一步);一个会话同一时间只有一个目标,/goal 查看、/goal 设定(已有目标时替换)、/goal replace 显式替换、/goal pause 暂停。官方对适用场景的判断也诚实:适合「一句话说得清、但要多轮才能做完」的活。卡片指标取可核验的价格事实层:GLM-5.3 API 每百万 token 输入 $1.4、输出 $4.4。边界:客户端不开源、深度联调只针对 GLM-5.3 系列;「1M 上下文稳定」是厂商口径,长上下文中段召回是行业通病,整仓塞入不能替代检索;闲时任务面向订阅用户逐步开放,不等于随时可用;免费额度是 5 天窗口而非长期福利。置信度 C(厂商宣称)。
- 置信度
- 厂商宣称
- 只有官方模型卡/发布会,无独立复测
- 关键指标
- GLM-5.3 API 单价(输入/输出,每百万 token)
- 厂商宣称 · 2026-09
- 成熟度
- 产品
- 研究 → 演示 → 产品 → 生产
我们的判断我们给它 C 档(厂商宣称)。可核对的部分不少:GLM-5.3 的 API 单价($1.4 输入 / $4.4 输出,每百万 token,另有 GLM-5.3-Flash $0.15 / $0.50、FlashX $0.37 / $1.25)直接写在
docs.z.ai的定价页上,可逐条复核;客户端版本线(我们查到时为 3.14.3,提供 macOS Apple Silicon / macOS Intel / Windows / Linux 四个安装包)、文档侧栏列出的完整功能面、新用户 5 天免费额度(GLM-5.3 300 万 token/天 + GLM-5-turbo 200 万 token/天,每日合计 500 万,仅这 5 天)、订阅用户闲时任务「执行费用免费、套餐额度消耗 0」,都是官方公开写明的事实。但我们采信为指标的那条——GLM-5.3 的价格/能力比——本质是定价事实而不是能力证据:ZCode 没有公开任何 harness 侧的基准读数(SWE-bench、Terminal-Bench 一类都没有),「稳定的 1M 上下文」「针对 Long Horizon Task 做专项优化、长链路稳定性与上下文保持显著提升」都是厂商表述,客户端闭源、无从复测。按契约 §13.5 落 vendor-claim,不因「模型便宜」或「模型开源」升档。水位判断:ZCode 的战略位置是「把一个开放权重旗舰模型的全部余量,压进一个官方壳里」。它与 Kimi Code 是同一条路线的两个样本:模型侧开源、harness 侧闭源,靠深度联调把模型能力在自己的工具面上兑现。区别在于 ZCode 把这件事做得更极端——它不试图兼容多模型,而是只围绕 GLM-5.3 系列做专项优化,赌的是「一家厂商同时控制模型与工具面时,能把长程任务的稳定性调到通用壳调不到的水位」。
产品层有两项设计值得单独说。第一是
/goal目标模式:每轮结束自动校验目标是否达成,没达成就自己进下一轮,确认完成才收尾,并且文档诚实地给出方法论——目标描述越具体、越可校验,每轮判定越准,「把 pnpm test 跑通且首屏加载控制在 2 秒内」明显好过「优化一下性能」。这与 Qoder 的 Goal 模式是同一个判断:长程 agent 的主要失败模式不是不会做,而是不知道什么时候算做完,把「完成」变成一个每轮都要判定的显式谓词,比让模型自己感觉差不多了可靠得多。第二是闲时任务:订阅用户把不着急的工作丢进队列,ZCode 在算力富余时段完成,执行费用与套餐额度消耗都为 0——这是把推理侧的闲置产能直接变成用户侧的免费吞吐,在定价设计上很少见,也侧面说明它自建推理产能。商业侧的定位很清楚:Z.ai 编码套餐起价 $18/月,同时官方把用壳范围写成 Claude Code、Kilo Code、Cline、OpenCode、Clawdbot/OpenClaw 等——GLM-5.3 既能在自家 ZCode 里跑,也主动装进别人的 harness。这与 Kimi 开放
/coding端点的打法一致,是 2026 年中国模型厂商在编码赛道上的共同选择:底座可得性已经商品化,分发靠的是「能被别人的壳直接装进去」。要如实说清的边界:客户端闭源,深度联调只针对 GLM-5.3 系列,换模型即失去这层优化;「稳定的 1M 上下文」是厂商口径,长上下文中段召回是行业通病,整仓塞入不能替代检索;闲时任务面向订阅用户逐步开放,不等于随时可用,把它算进容量规划会落空;免费额度是 5 天窗口而非长期福利;全部能力表述无第三方复测。
它是什么:GLM-5.3 的官方 harness,自称 Agentic Development Environment
ZCode 是 Z.ai 为 GLM-5.3 做的官方 harness,官方定位不是「AI 编辑器」也不是「CLI」,而是 ADE(Agentic Development Environment,智能体开发环境)——把 GLM-5.3 的长上下文、长程任务与 agentic 编程能力,转化为稳定可用的桌面体验,覆盖复杂开发任务中的规划、编码、审查与迭代。首页标语是「GLM-5.3 官方 Harness,多智能体开发更进一步」,下载页给 macOS(Apple Silicon)客户端并列出全部平台。
它的立足点写得很直白:依托 GLM-5.3 稳定的 1M 上下文与长程任务能力,ZCode Agent 把目标、文件、终端结果、浏览器上下文、执行模式与 Git 状态保持在同一个任务里,让复杂任务从规划一路推进到实现与验证收口而不丢连续性。围绕 GLM-5.3 做了深度联调与专项优化:模型能力、工具调用、执行链路多轮打磨,让 agent 更适合连续、多步骤的真实开发任务。
/goal 目标模式:把「盯着 agent 说继续」换成「设一个目标,等结果」
这是 ZCode 最有辨识度的一项设计。用 /goal 给当前会话设一个目标之后,agent 会围绕这个目标持续推进:每一轮结束都自动校验目标是否达成,没达成就自己接着下一轮,确认完成才收尾。官方文档给的实例是一个连续跑了二十多轮的研究任务,右侧摘要面板显示每一轮做了什么、当前推进到哪一步。
命令面很干净:一个会话同一时间只有一个目标;/goal 查看当前目标,/goal <描述> 设定(已有目标时替换),/goal replace <目标> 显式替换,/goal pause 暂停。文档对适用场景的判断也诚实:适合「一句话说得清、但要多轮才能做完」的活,例如重构整个模块并保持测试通过、修复所有 TypeScript 编译错误、把某个页面的 Lighthouse 性能分提到 90 以上。并且明确给出方法论——目标描述越具体、越可校验,每轮判断越准:「把 pnpm test 跑通,且首屏加载控制在 2 秒内」明显好过「优化一下性能」。
这背后是一个通用原理:长程 agent 的失败模式往往不是不会做,而是不知道什么时候算做完。把「完成」变成一个每轮都要判定的显式谓词,比让模型自己感觉差不多了要可靠得多。
能力面:从 Wiki、Memory 到闲时任务与 Bot Channel
官方文档侧栏列出的功能面(逐项可查)相当宽:ZCode Agent、目标模式、浏览器自动化、任务与文件管理、Wiki(仓库知识)、Memory、自动化、闲时任务、编辑历史对话、远程开发、Remote Control、Bot Channel、子智能体、Plugin、Skill、MCP、Command、Hooks、使用统计、安全操作确认、智能体开发环境工具(ADE tools),外加安装、连接模型、快捷键表与 Q&A。
其中几项值得单独说:
- 闲时任务:订阅用户可以把不着急的工作丢进队列,ZCode 在算力富余时段完成,执行费用为 0、套餐额度消耗为 0。这是把「闲置算力」直接变成用户侧的免费吞吐,是一种很少见的定价设计。
- 多端持续跟进:桌面端工作区、手机端 Remote、飞书 / 微信 Bot Channel 可以共同推进同一个工作区任务,长任务执行中随时查看进度并补充指令。
- 安全操作确认:关键命令、文件修改与高权限操作在执行前进入确认流程。
- 远程开发:面向 SSH 远端机器的开发形态,不局限于本地仓库。
- 子智能体 / Skill / MCP / Hooks / Command / Plugin:扩展面覆盖了当前主流 agent 生态的四种标准接口。
首页的任务流也透露了产品气质:任务列表带真实耗时(2m / 9m / 27m / 51m / 1h / 2h / 6h / 1d / 3d),支持分支执行,执行轨迹逐条展开(已探索、已搜索、已运行 pwd、git status、已写入 index.html / app.js / styles.css 共 +733 行、已运行 node --check 无输出)。它展示的是过程,不只是结果。
商业面
新用户 5 天免费体验,期间每日发放 GLM-5.3 300 万 token(文档明确写清:额度仅在这 5 天内每日发放,5 天后失效,并非长期每天都有)。Z.ai 侧的编码套餐起价 $18/月,官方把用壳范围写为 Claude Code、Kilo Code、Cline、OpenCode、Clawdbot/OpenClaw 等——也就是说 GLM-5.3 既能在自家 ZCode 里跑,也能装进别人的 harness。
边界
ZCode 客户端本身不开源,深度联调只针对 GLM-5.3 系列;1M 上下文的「稳定」是厂商口径,长上下文中段召回是行业通病,整仓塞入不能替代检索;闲时任务面向订阅用户逐步开放,不等于随时可用;免费额度是 5 天窗口而非长期福利,按它做容量规划会算错。