我现在会把 review 前移成“可执行的验收清单”,而不是等代码全部生成后再读一大坨。每个小任务开工前先固定 4 样东西:允许修改的文件、不可变的接口、必须通过的测试、人工要看的关键路径。AI 完成后只看这个任务的 diff ,先跑测试和静态检查,再重点盯新增文件、重复实现、异常分支与删除操作。任务一完成就开新上下文,只保留短 spec 、决策和测试结果,不把整段讨论历史一直带着走。
老模块还有个比较有效的办法:先让 AI 只读调查,画出调用链和数据流,人确认它理解无误后才允许修改。你这次的问题我感觉不只是“上下文失忆”,更像是业务模型和验收标准没有被压缩成可检查的约束;
AGENTS.md 能管风格,但兜不住业务正确性。