<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>GPU 内核 on Codexer</title><link>https://codexer.com/tags/gpu-%E5%86%85%E6%A0%B8/</link><description>Recent content in GPU 内核 on Codexer</description><generator>Hugo</generator><language>zh-cn</language><lastBuildDate>Sun, 16 Aug 2026 09:00:00 +0800</lastBuildDate><atom:link href="https://codexer.com/tags/gpu-%E5%86%85%E6%A0%B8/index.xml" rel="self" type="application/rss+xml"/><item><title>让 Codex 自主跑 14 天，内核提速 232 倍：一次「自动研究」实战复盘</title><link>https://codexer.com/posts/2026-08-16-codex-auto-research-loop-engineering/</link><pubDate>Sun, 16 Aug 2026 09:00:00 +0800</pubDate><guid>https://codexer.com/posts/2026-08-16-codex-auto-research-loop-engineering/</guid><description>&lt;p&gt;想象这样一个场景：你给 Codex 下达一个目标，把一段 GPU 上的矩阵分解代码优化到比基线快一百倍，然后合上电脑去睡觉。第二天早上醒来，它已经自己提交了几百个版本、跑完了上千次性能测试，还留了一份日志，告诉你哪些思路走通了、哪些是死路。这听上去像科幻，但真的有人这么干过，并且在 183 人的比赛里拿到了第 12 名，最终把基线速度提升了 232 倍。&lt;/p&gt;
&lt;p&gt;这位开发者叫 Sankalp，参加的是 GPU Mode 联合 Core Automation 举办的「自动研究」主题比赛，题目是优化一个批量 Householder QR 分解的 CUDA 内核。内核优化听起来很硬核，但他写下的复盘里，最有价值的并不是 GPU 那部分数学，而是一套「把 Codex 当自动驾驶用」的方法论。我把其中最通用、也最能迁移到日常任务里的几块拆出来，讲给你听。&lt;/p&gt;
&lt;h2 id="什么样的任务才值得放手让-ai-自主跑"&gt;什么样的任务，才值得放手让 AI 自主跑&lt;/h2&gt;
&lt;p&gt;不是所有任务都适合交给 Codex 连跑十几个小时。Sankalp 能这么干，有一个前提：比赛提供了 popcorn CLI，让 agent 可以自己提交、跑基准、看排行榜，而且反馈是逐 shape 给出的，外加一个总的几何平均耗时。换句话说，存在一个客观、快速、可自动化的「打分器」。&lt;/p&gt;
&lt;p&gt;有了打分器，agent 就拥有了一个紧凑的反馈闭环。每一次尝试都能立刻知道「这次变快还是变慢」，于是可以像爬山一样，沿着分数一路往上爬。十四天里，他提交了超过一千五百次。&lt;/p&gt;
&lt;p&gt;我自己用 Codex 的体会也印证了这一点：判断一个任务能不能「放养」，先问一句，有没有一个机器能自动判断好坏的「裁判」。有裁判，闭环才成立；没裁判，就得人盯人。&lt;/p&gt;
&lt;h2 id="先学到能问出好问题再让它跑"&gt;先学到「能问出好问题」，再让它跑&lt;/h2&gt;
&lt;p&gt;一个容易被忽略的细节是，Sankalp 在让 Codex 干活之前，自己先把 QR 分解的基础补了一遍，跟 Claude 反复讨论、看视频建立直觉。他的原话我特别喜欢：你对一个东西了解得越深，就越能给模型下好指令，因为你把「未知的未知」变成了「已知的未知」。&lt;/p&gt;
&lt;p&gt;这句话点破了一个常见误解。很多人以为让 AI 自主干活，人就可以彻底撒手不管。恰恰相反，你对问题域的理解越深，能喂给模型的方向就越值钱。Sankalp 自嘲是「不被看好的那一个」，他排行榜上面一位是 NVIDIA 的主任工程师，但这不妨碍他靠补课加问对问题，一路追到第 12 名。&lt;/p&gt;
&lt;p&gt;领域知识没有因为 AI 而贬值，它只是换了个去处，从「亲手写代码」挪到了「指引方向」。&lt;/p&gt;
&lt;h2 id="把-codex-用满的三个技巧"&gt;把 Codex 用满的三个技巧&lt;/h2&gt;
&lt;p&gt;真正让 Codex 长时间自主运转的，是三个具体技巧。&lt;/p&gt;</description></item></channel></rss>