一个 PR 烧掉 270 美元:实测 OpenAI Codex 的真实账单

一个 PR 烧掉 270 美元:实测 OpenAI Codex 的真实账单

说到 AI 编程烧钱,大家首先想到的是 Claude Code,那 Codex 是不是更省钱?作者用真金白银做了测试:一个再普通不过的 CLI 重构 PR,24 小时内烧光 270 美元的溢出额度。拆开账单才发现,真正的开销大头不是模型输出,而是并行子代理和反复读取的缓存,外加一个不小心踩中的 fast mode 溢价。

[阅读更多]

「我发布了我没读过的代码」:当 AI 负责写,验证成了新的实现

「我发布了我没读过的代码」:当 AI 负责写,验证成了新的实现

一年前,编辑器里的代码几乎每一行都是自己敲的;今天,大部分代码是模型已经写好的 diff,你只负责读、判断、保留。真正的瓶颈从写得快不快,挪到了验证得准不准。这篇文章拆解这个位移,并给出结论:当 AI 写代码,验证就是新的实现,而判断力是我们手里最后一块不会被拿走的地盘。

[阅读更多]

写了 1.7 万行代码,只复现 36% 的功能:编码代理为什么提前收工

写了 1.7 万行代码,只复现 36% 的功能:编码代理为什么提前收工

把一个大任务交给编码代理,它没超时也没超预算,却只完成了三分之一就宣布收工。Factory 团队用重建 gdal 的实验拆开了这个现象:代理缺的从来不是能力,而是一份「完成的标准」。动手之前先定义验收,同一个模型的复现率能从 36% 翻到 90%。

[阅读更多]