用大模型写工程代码最大的痛感就是:高级模型的额度金贵,但放手让它自己跑又容易写出灾难代码。
前段时间 GLM-5.3-Flash 发布,速度快且极具性价比,突然给了我灵感:既然粗活脏活不用牛刀,为什么不把流程拆开垫刀?于是顺手搓了 zcode-executor ( https://github.com/KyoMio/zcode-executor ),有以下几个特点:
1.成本节省:大任务拆解后按层级分配。粗活、跑测试、证据收集先扔给 GLM-5.3-Flash 等平价模型垫刀,核心逻辑再换主力模型。加上 ZCode 调用 Coding Plan 有 6.7 折优惠,夜间闲时还有免费额度,双重叠加下来,原本 5x 配额硬生生拉扯出了 20x 的生产力。
2.自动审批:参考 claude code 的 auto 模式逻辑,常规操作灵活放行,确保 zcode 干活能够完全放手。遇到敏感文件读写、不可逆 shell 动作自动阻断进 Gate ,支持人工放行,告别“盲盒式”提交。
3.任务流水线化:任务支持排队、异步执行和 follow 追踪,不占死交互终端。


代码已开源,纯 Node.js CLI ,无多余依赖。claude code 和 codex 可作为插件直接安装。
欢迎交流日常使用 Agent 编码时的避坑与调教经验!
前段时间 GLM-5.3-Flash 发布,速度快且极具性价比,突然给了我灵感:既然粗活脏活不用牛刀,为什么不把流程拆开垫刀?于是顺手搓了 zcode-executor ( https://github.com/KyoMio/zcode-executor ),有以下几个特点:
1.成本节省:大任务拆解后按层级分配。粗活、跑测试、证据收集先扔给 GLM-5.3-Flash 等平价模型垫刀,核心逻辑再换主力模型。加上 ZCode 调用 Coding Plan 有 6.7 折优惠,夜间闲时还有免费额度,双重叠加下来,原本 5x 配额硬生生拉扯出了 20x 的生产力。
2.自动审批:参考 claude code 的 auto 模式逻辑,常规操作灵活放行,确保 zcode 干活能够完全放手。遇到敏感文件读写、不可逆 shell 动作自动阻断进 Gate ,支持人工放行,告别“盲盒式”提交。
3.任务流水线化:任务支持排队、异步执行和 follow 追踪,不占死交互终端。


代码已开源,纯 Node.js CLI ,无多余依赖。claude code 和 codex 可作为插件直接安装。
欢迎交流日常使用 Agent 编码时的避坑与调教经验!