智谱 ZCode 升级四大功能:国产 Coding Harness 进入「自主交付」阶段

> AI HOT 收录(公众号:智谱 GLM,2026-08-11) > 二次源:北京日报、weibo @智谱...

> AI HOT 收录(公众号:智谱 GLM,2026-08-11) > 二次源:北京日报、weibo @智谱、mtrt.cn、dtm.com.cn、ITBear

一、四个功能各自的边界

8 月 11 日智谱把 ZCode 一次升级了四个功能——Goal、Subagents、Remote Control、闲时任务——同时把用户数推过百万。这是国产 Coding Harness 第一次把「自主交付」作为产品形态交付出来,而不只是宣传话术。

功能解决的问题关键约束
Goal 模式Agent 自主跑完复杂任务而非每步等人工推动目标必须明确且可验收(如「首屏 ≤2s 且所有测试通过」)
Subagents长任务对主对话上下文的过度占用内置 General-purpose + Explore 两类,用户可自建
Remote Control长任务时人想离开电脑的痛点手机仅作控制,代码执行始终在桌面端
闲时任务耗时但非紧急任务的成本问题低峰时段执行,不消耗 GLM Coding Plan 积分

Goal 是核心。它把开发者从「监工」位置推到「甲方」位置——给一个验收标准,剩下的全部由 Agent 自主拆解、改代码、跑命令、看测试、不达标就继续下一轮。

二、性能账:+2.39% 通过率不是偶然

智谱这次没回避基准对比,自研的 Z.ai Code Bench 给出了硬数字:

GLM-5.2 + ZCode vs GLM + Claude Code:整体任务通过率高 2.39%复杂任务上优势更明显:跨文件、跨环节、需要最终验收的任务是主战场 – 检查项通过率反低 1.22%:单点细节上 Claude Code 略胜,但整体闭环 GLM 反而更稳 – 缓存命中率 98%+:让有效 Token 量增加约 30%

叠加 8 月 11 日到 31 日的 1.5× 限时额度加成,用户实际可用资源接近常规的 1.8 倍

这个数字账的真正含义是:同一基座模型放在不同 Harness 里实际表现可能差很多。智谱团队的判断——「模型决定能力上限,Harness 负责上下文管理、工具调用、任务调度、缓存和结果校验,决定模型能力最终能发挥出多少」——被自家基准验证了。

三、用户数过百万是个分水岭

「ZCode 用户突破 100 万」这句话比升级本身更值得划重点。

国产 Coding 工具过去一直卡在「能不能跑通单任务」的门槛上,能跑≠能用,能用≠有人用。百万用户意味着:

1. 订阅模式跑通了:GLM Coding Plan 是订阅制不是按量计费,跟 Cursor / Claude Code / Codex 同档商业模式 2. 生态正循环启动:用户越多,数据越多,反过来训练 Harness 调度策略越准 3. 国产 AI 编程从模型竞赛转向工具链竞赛:DeepSeek / Qwen / GLM 都有强基座,差异化战场在 Harness

智谱这次给行业的真正信号不是功能列表,是「基础模型 + Coding Harness + 订阅服务」三件套生态正式成型。

四、Subagents 的隐藏价值

Subagents 不只是把任务并行化,它解决了一个 Harness Engineering 里被忽视的问题——长任务对主对话上下文的污染

Goal 模式下「自动拆解任务 + 跨文件重构」跑几十分钟是常态。主对话如果一直承载这种任务,token 消耗会线性涨,注意力会分散到一半以上已经无关的旧 context。Subagents 让 Explore 类只读子代理负责探查、General-purpose 子代理负责写、主对话只守住目标与终止条件。

这把 Harness 设计的复杂度又推上一层:主-子代理之间的「上下文共享什么、隔离什么、什么时候回收」是新一类工程问题。Claude Code 的 worktree 隔离、Codex 的 session ID 寻址,都是不同解法。智谱这次走的是「主对话 + 内置两类 + 用户可自建」的中间路线,看 8 月底能不能跑出 1.5× 加成期的真实数据。

五、闲时任务:成本结构的差异化

闲时任务看起来是个小功能,其实是商业模式的差异化卡位。

GLM Coding Plan 是积分制——积分用完就停。闲时任务在服务器低峰时段跑、不消耗积分,这意味着对长耗时但非紧急的工作(代码审查、性能优化、大规模测试),用户实际使用成本接近零。这把 Cursor / Claude Code 这种「全任务都按量计费」的成本结构撕开了一个口子。

对个人开发者:等效积分等于扩容了 1.5-1.8 倍 对企业团队:把夜间闲置算力变成实际产能,且不挤占生产时段额度

智谱用「额度回满 + 限时加成 + 闲时任务」三件套同时打,配合百万用户节点,把国产 Coding Harness 的价格-功能曲线压到了一个新的临界点。

六、跟 Cursor / Claude Code 的真正差距

不吹不黑地说,差距还剩三层:

1. 模型生态厚度:Claude Code 跑的是 Claude 全系(Haiku/Sonnet/Opus 4.6),ZCode 跑的是 GLM,模型多样性和全球部署能力有差距 2. 国际生态接入:Claude Code / Codex 接 GitHub Issue、PR Review、Slack 是原生能力,ZCode 这块需要时间 3. 企业级合规:金融/政企客户对私有化部署、数据合规要求高,国产 Harness 反而是优势

但反过来,ZCode 在国产化、本地化、订阅价格三件事上的领先是真实的。如果百万用户节点后能保持 30%+ 留存,国产 AI 编程工具的格局就不是「一家两家做大」,而是「智谱 + 阿里 Qwen + DeepSeek + Kimi」四家分庭。

核心数据:100 万用户、4 大功能、+2.39% 任务通过率、98%+ 缓存命中率、30% 有效 Token 提升、1.5× 限时加成至 1.8× 实际可用、-1.22% 检查项通过率 时间线:2025 立项 → 2026.8.11 升级 + 用户破百万 → 2026.8.31 加成期截止 来源:智谱 GLM 公众号(2026-08-11)、北京日报、ITBear、mtrt.cn

发表回复

人生梦想 - 关注前沿的计算机技术 acejoy.com 🐾 步子哥の博客 🐾 背多分论坛 🐾 借一步网 🐾 智柴网 沪ICP备2024052574号-1