AI 编程 Agent 正在悄悄重写那些「本来没问题的测试」,因为按钮改了个名字,整条测试链路就崩了。9lives 提出了一种分级自愈策略——但它的核心设计不是修测试,而是拒绝修测试。
当 Codex 修坏了你的测试:自愈测试的「底线」在哪里?


AI 编程 Agent 正在悄悄重写那些「本来没问题的测试」,因为按钮改了个名字,整条测试链路就崩了。9lives 提出了一种分级自愈策略——但它的核心设计不是修测试,而是拒绝修测试。

让 AI 审查 AI 写的代码,听起来很美,实际做起来问题一大堆。审查循环往往不会收敛,每一轮都在加补丁、加文字、加伪代码。Convergo 这个开源插件用「新鲜审查者」和「摄入优先」两条核心规则,把发散的螺旋扭成了收敛的环。

大多数 AI 助手在它们最不了解的时候反而最自信。Aletheia 反其道而行之,用一个「信念→行动→观察→更新」的循环,让 AI 学会区分真正的知道和假装知道。

想把 Claude Code 的整个工作流搬到 Codex?Codex 0.142 的 /import 命令能帮你完成 80% 的脏活,但剩下的 20% 才是关键。本文逐一映射 12 个配置项,告诉你什么能迁、什么会坏、以及那个唯一的死胡同怎么绕过去。

2026 年,AI 编程已经从「让 AI 帮你写几行代码」进化为「设计一套让多个 AI Agent 协同工作的流水线」。本文梳理从 Vibe Coding 到 Agentic Engineering 的演进路径,介绍四大主流项目工作流,以及落地时最关键的三项技术。