Posts for: #AI 编程

一个 PR 烧掉 270 美元:实测 OpenAI Codex 的真实账单

一个 PR 烧掉 270 美元:实测 OpenAI Codex 的真实账单

说到 AI 编程烧钱,大家首先想到的是 Claude Code,那 Codex 是不是更省钱?作者用真金白银做了测试:一个再普通不过的 CLI 重构 PR,24 小时内烧光 270 美元的溢出额度。拆开账单才发现,真正的开销大头不是模型输出,而是并行子代理和反复读取的缓存,外加一个不小心踩中的 fast mode 溢价。

[阅读更多]

「我发布了我没读过的代码」:当 AI 负责写,验证成了新的实现

「我发布了我没读过的代码」:当 AI 负责写,验证成了新的实现

一年前,编辑器里的代码几乎每一行都是自己敲的;今天,大部分代码是模型已经写好的 diff,你只负责读、判断、保留。真正的瓶颈从写得快不快,挪到了验证得准不准。这篇文章拆解这个位移,并给出结论:当 AI 写代码,验证就是新的实现,而判断力是我们手里最后一块不会被拿走的地盘。

[阅读更多]

一个 Go 依赖在编译期偷偷写入了 AGENTS.md,Codex 还帮忙藏起了改动

一个 Go 依赖在编译期偷偷写入了 AGENTS.md,Codex 还帮忙藏起了改动

恶意 Go 依赖在编译期写入一份假的 AGENTS.md,声称自己拥有「绝对权威」,成功让 Codex 把一次改动藏出代码审查。本文梳理 NVIDIA 红队、Prompt Security 和 GitInject 三条攻击路径,拆解这个开源指令格式为何天然是一条提示注入通道,以及安全边界到底该设在哪里。

[阅读更多]

你只输入了 16 个字符,Codex 却发走了 4 万字节:拆开一个真实的请求体

你只输入了 16 个字符,Codex 却发走了 4 万字节:拆开一个真实的请求体

有人把 Codex 的请求体逐字节截下来测量,发现一句 16 字符的「Reply with pong.」被包装成了 42980 字节、约 9435 个 token 的请求,真正的提示词只占 0.3%。其余全是工具定义、系统指令、技能元数据和环境上下文。本文拆解这个被多数人忽略的开销,以及它对隐私和成本意味着什么。

[阅读更多]

Codex 的引擎不在聊天框里:拆解那个可复用的智能体循环

Codex 的引擎不在聊天框里:拆解那个可复用的智能体循环

OpenAI 官方发文拆解 Codex 底层:真正支撑 App、CLI 和 IDE 的是同一个开源 harness。一个关键数据点说明执行循环的价值,GPT-5.6 Sol 在 ARC-AGI-3 上从 13.3% 提升到 38.3%,输出 token 却减少六倍。本文解读这个被多数人忽略的智能体引擎,以及它意味着什么。

[阅读更多]