codexer
  • Menu ▾
    • 关于
    • 文章
  • 关于
  • 文章

Codex 主动缩减上下文窗口:当 AI 学会「少即是多」

2026-07-14William Yi
#Codex  #GPT-5.6  #Context Window  #OpenAI  #Agent  Codex 主动缩减上下文窗口:当 AI 学会「少即是多」

GPT-5.6 Sol 的上下文窗口从 400K 缩到了 258K。在「窗口越大越强」的军备竞赛中,OpenAI 为什么反其道而行之?本文深度分析背后的技术逻辑和实际影响。

[阅读更多]

当 Codex 修坏了你的测试:自愈测试的「底线」在哪里?

2026-07-13William Yi
#Codex  #Testing  #Agent  #Quality  #Playwright  #Claude Code  #OpenAI  当 Codex 修坏了你的测试:自愈测试的「底线」在哪里?

AI 编程 Agent 正在悄悄重写那些「本来没问题的测试」,因为按钮改了个名字,整条测试链路就崩了。9lives 提出了一种分级自愈策略——但它的核心设计不是修测试,而是拒绝修测试。

[阅读更多]

多 Agent 加密的意外代价:当 Codex 的子智能体变成「黑箱」

2026-07-12William Yi
#Codex  #Multi-Agent  #Security  #Encryption  #Audit  #GPT-5.5  #OpenAI  多 Agent 加密的意外代价:当 Codex 的子智能体变成「黑箱」

Codex 在 6 月合并了多智能体通信加密功能,却意外抹掉了子 Agent 任务的可读审计记录。GPT-5.5 用户被强制使用加密路径,开发者正在失去对自己 AI 系统的「视力」。

[阅读更多]

编程 Agent 的「体检报告」:Databricks 如何在百万行代码中给 AI 打分

2026-07-11William Yi
#Codex  #Agent  #Benchmark  #Databricks  #AI Coding  #OpenAI  编程 Agent 的「体检报告」:Databricks 如何在百万行代码中给 AI 打分

Databricks 用真实 PR 构建了一套编程 Agent 基准测试体系,覆盖千万行代码。结果出人意料:开源模型 GLM 5.2 已能匹敌 Opus 4.8,而 Harness 选择对成本的影响比模型本身还大。

[阅读更多]

Codex 并入 ChatGPT:从独立 CLI 工具到超级平台的进化之路

2026-07-10William Yi
#Codex  #ChatGPT  #OpenAI  #GPT-5.6  #Agent  Codex 并入 ChatGPT:从独立 CLI 工具到超级平台的进化之路

OpenAI 正式将 Codex 并入 ChatGPT 桌面应用,同时发布 ChatGPT Work 和 Sites。这对 Codex 用户意味着什么?从独立 CLI 到超级平台,本文深度分析这次合并背后的战略逻辑。

[阅读更多]
< [Newer posts] :: [Older posts] >
© 2026 Powered by Hugo :: Theme made by panr
🔗 友链:Curvesoft