讨论与批判
vibe coding 长大了是什么样?以及——它还缺什么?这一页是把"掌声"和"冷水"都摆出来的地方。读完本页约 10 分钟。
从 vibe coding 到 agentic engineering
2025 年 2 月,Karpathy 给"全交给 AI、不管代码"的玩法起了个名字:vibe coding——"give in to the vibes, embrace exponentials, and forget that the code even exists." 那是玩具:接受所有更改、没有测试、坏了就重来。
Claw Code 是同一个光谱的另一端:它没有 forget the code,而是把代码钉死在一整套验证上。这种"让 agent 干活,但用流程约束它"的形态,正是 2025–2026 年业界所说的 agentic engineering(智能体工程)。理解这两个端点之间的光谱,比记住任何一个词都重要。
march of nines:为什么验证贵得离谱
AI 写的代码"九成对"是常态。但 90% 正确是 demo,99% 勉强能用,99.9% 才谈得上生产,99.99% 才算可靠。每多一个九,成本不是线性涨,是指数涨。这个仓库的所有"仪式"——verification-map、quality gate、doctor、双输出测试——本质上都是在为那多出来的几个九付费。它买到哪一档?诚实地说,它买到了"演示可信",还没买到"生产可靠"。
上下文窗口:最被低估的稀缺资源
agent 一次能"记住"的 token 是有限的。这个项目的 clawhip 设计(把通知路由移出上下文)提醒我们:在 agent 系统里,省上下文就是省钱、省时间、省错误。这一条工程直觉可以直接迁移到你自己写的任何 agent 应用上。
批判性审视
自我循环的博物馆
一个由 agent 维护、给 agent 看的仓库,容易变成 self-licking ice cream:为流程而流程、为 board 而 board。732 个 board 条目里 285 个 open——有多少是 agent 给自己造的工作?文件里无法判断。
六个九,不是九个九
"不是生产项目,是展品"是清醒的自我定位,也是退路。演示与生产之间的鸿沟,恰恰是这个项目最想回避、也最该被追问的地方。
决定权仍在人
代码是 agent 写的,但"为什么做这个项目、以什么姿态做"是人定的。这恰好证明:执行层可以自动化,判断层不能。
对照 ccleaks:三个值得课堂讨论的点
把 claw-code 与 ccleaks.com/leaks(Claude Code 泄露源码分析)放在一起,能引出三个有张力的讨论:
隐藏 vs 公开
Claude Code 的 26 个未文档化命令、32 个构建标志、120+ 环境变量要靠逆向才看清;claw-code 把同类能力写进文档。开源让能力变成公共知识,也意味着"能力面"不再是竞争壁垒——壁垒上移到数据和生态。
自治 vs 透明
泄露源码里藏着"undercover 模式"(自动抹掉 AI 痕迹)和反蒸馏假工具;claw-code 则把 agent 痕迹(账本、进度、政策)当作展品主动公开。透明度不是技术问题,是产品立场问题。
伦理边界
泄露源码分析本身是"逆向解读闭源产物",存在法律与伦理争议。课堂讨论时应区分:研究公开的源码与文档是正当的;未授权传播内部材料则不是。这个区分本身就是很好的思辨练习。
外部引用 · "Vibe Coding" 原推(2025-02)@karpathy · X▶
哲学原文 · 这个项目想证明什么PHILOSOPHY.md▶
思考题
Q1 · 如果你是维护者,你会把哪一道 gate 永远留给人类?理由是什么?
提示:merge 权?需求定义?对外承诺?还是验收标准?
Q2 · "self-licking ice cream"——你能从自己的项目或团队里找出一个"为流程而流程"的例子吗?怎么检测它?
提示:问"如果删除这个环节,用户/目标会受损吗"。