Posts for: #上下文管理

两个 Agent,一个夜晚,1.58 亿 Token:读了两百本《战争与和平》,只为写出不到一本

两个 Agent,一个夜晚,1.58 亿 Token:读了两百本《战争与和平》,只为写出不到一本

一次设计评审留下 12 个待修项,父 agent 带着 16 个廉价 worker 用一个夜晚全部修完:13 小时、118 个文件、16369 行新增、158137319 个 token。但真正值得读的不是交付成绩,而是账单结构:95.4% 的 token 是重复读取已经缓存的上下文,模型真正新写出来的文字只有 0.42%;66 次「还没好」的空轮询烧掉 6.5% 的总量。这篇文章拆解父 worker 编排里的两个成本杠杆、一个最贵的等待习惯,以及 Codex 上那个至今无解的「父 agent 叫不醒」问题。

[阅读更多]

六百个工程师,零个共识:Codex 多智能体的瓶颈不在模型,在工作台

六百个工程师,零个共识:Codex 多智能体的瓶颈不在模型,在工作台

有人问:你们用什么 IDE 管理多个 coding agent?六百个工程师回答,没有一个人给出相同答案。这个「零共识」本身就是最有价值的信号。行业已经把 agent 造出来了,却没把工作台造出来。这篇文章拆解 Codex CLI 已经内置但极少被配置的三块拼图(codex queue、auto_recap、Guardian history),为什么「哪个刚跑完就看哪个」是错误的调度信号,以及把并发压到六条以内背后的管理逻辑。

[阅读更多]