这技能是什么,一句话
一个叫 andrej-karpathy-skills 的仓库,本体就是一份 2357 字节的 CLAUDE.md,四条原则,专门治 AI 写代码的四种老毛病——瞎做假设、过度复杂、乱改不该改的代码、没有验收标准就闷头跑。
我为什么试它
我平时让 AI 改代码,最烦三件事:它不问就替我做决定;让它修一个小 bug,它顺手“优化”了半个仓库;说“加个校验”,它给你整出一套可配置可扩展的抽象框架。这些毛病 Karpathy 在推特上点过名,这个仓库的作者(multica-ai,README 里作者自己说 derived from Karpathy 的观察)把这些吐槽变成了一份可以贴进 Claude Code 的行为守则。
星数 218225★,Trending 今日第一。MIT 协议。我更在意的是:它宣称零 Key 零依赖——一个纯 Markdown 文件就是全部内容,没有需要付费 API 的环节。这种技能我测得起,也推荐得起。
我实际怎么装怎么跑
安装就一行 curl:
curl -o CLAUDE.md https://raw.githubusercontent.com/multica-ai/andrej-karpathy-skills/main/CLAUDE.md
一个脚注先说清楚:仓库 README 里的安装命令写的是 forrestchang/andrej-karpathy-skills 这个旧路径。两条都实测过,当前都能下载成功(HTTP 200),是同一作者的新旧名字。这里统一用 multica-ai 路径(与仓库归属一致),照抄旧路径的读者也不会 404。
下载后核了文件指纹:sha256 694a2d721e41c385f3db492838c23299826df5ba9809e3b0721aac70021e196a。全文 65 行,四个原则各占一节,外加一段“怎么判断它生效了”的自检标准,没有任何外部依赖。
然后是实测。因为这是提示词类技能,测法是把同一需求写两遍,一遍带着 CLAUDE.md 的四原则约束执行,一遍不带,然后逐条 diff 对比。同一任务,结果差得很具体:
混入 README 越界修改、漏更新测试
假设显式列出 · pytest 3 passed · 零违规
四条原则实际说了什么
- 先想后写(Think Before Coding):假设要摆到桌面上说,歧义有几个解就摆几个,不许闷头挑一个;有更简单的方案要说出来。
- 简单优先(Simplicity First):只写解决问题的最少代码。它给了个自测问句——“一个资深工程师会不会觉得这是过度设计?”
- 外科手术式修改(Surgical Changes):只动必须动的行。不顺手“改进”邻接代码,不顺手删别人的死代码——发现了提一嘴就行。验收标准很硬:每一行改动都能追溯到用户请求。
- 目标驱动执行(Goal-Driven Execution):把“修这个 bug”翻译成“先写一个能复现它的测试,然后让它通过”。Karpathy 原话是“给它成功标准,看它自己跑起来”。
适合谁,不适合谁
适合:经常让 AI agent 改中大型存量代码的人。这四条原则治的正是 diff 越界和过度抽象——这次实测里 34 行变 13 行的差距,就是它们的作用面。
不适合:改一行错别字这种琐事。文件开头自己就写了(原文):"These guidelines bias toward caution over speed. For trivial tasks, use judgment."——它偏谨慎、牺牲速度,琐碎任务不必全套执行。这份“自己承认的限制”原样搬过来,因为它本来就是这份技能可信的一部分。
仓库地址(纯文本,不可点击):github.com/multica-ai/andrej-karpathy-skills
最后用它自带的生效自检收尾:这份守则在起作用,意味着 diff 里不必要的改动变少了、因为过度复杂而返工的次数变少了、澄清问题发生在动手之前而不是搞砸之后。本期实测读数支持前两条。