总结了一下评论区, 提防 GPT-5.6 Sol 过度工程化 一句话概括的话就是: 规划可高,执行要轻,约束先行。 - 先复述意图、范围、非目标、验收标准 - High 只做规划,Low / Luna / Terra 落地 - 禁止全程 Ultra / max,禁止重 skill,禁止多 Agent 乱开 - 不可逆操作等确认;Git 回滚不算不可逆 - 完成前检查:测试过、diff 小、无多余抽象 不能证明必要的设计,默认不做。 同时,我让 Grok 4.6基于评论区里的高置信度内容设计了一个Agents.md👇不过我认为可以先测试,再根据实际情况看要不要再跟AI交互已简化这个方案。因为grok依然认可测试的重要性,只是压住无效以及与本轮无效的测试。