
有个开源项目,把AI变成了"最懒的那个资深同事"
你公司肯定有这么一个人。
格子衫,带眼镜,你拿五十行代码给他看,他看一眼,不说话,给你改成两行。然后潇洒地走了。
你用AI写代码的时候,最缺的就是这个人。
AI太勤快了。你让它做个日期选择器,它给你装个flatpickr,写个wrapper组件,加个样式表,然后开始跟你讨论时区。
八月份GitHub上有个项目,专门把这个"懒同事"塞进了AI里。叫ponytail(马尾)。6月12号建的仓,到8月12号,10万星。日均涨1657颗。增速算得上是本月最快。
项目地址: https://github.com/DietrichGebert/ponytail
这是我让他对已经有的代码做的一次审查:

它不是又一个Agent
先说清楚,ponytail不是一个新的AI agent。它不替代Claude Code,不替代Codex,不替代Cursor。
它是一个跨agent的plugin——把"最懒的资深dev"这个角色,打包成 skill(人格+规则)+ 生命周期hook + 跨harness适配器 三层,装进你已经在用的任何agent里。
Claude Code、Codex、GitHub Copilot、Pi、OpenCode、Gemini CLI、Qoder……七个harness,一个plugin,到处能装。
它装上去之后干的事只有一件:在AI写代码之前,逼它先问自己一道"能不写就不写"的阶梯。而且不是被动等你调用——靠那两个hook在每个prompt前主动注入规则,所以AI不会写着写着又过度构建。
给AI定的规矩
ponytail给AI定了个规矩,写代码前,从第一级开始问,哪一级能过就停在哪一级:
- 这东西需要存在吗? → 不需要?跳过(YAGNI)
- 代码库里已经有了? → 复用,别重写
- 标准库能做? → 用标准库
- 平台原生特性能做? → 用原生
- 已经装的依赖能解决? → 用它,别装新的
- 能一行写完? → 一行
- 都不行才:写能工作的最少代码
比如你让AI做个日期选择器。
普通AI:装flatpickr → 写wrapper → 加stylesheet → 讨论时区。404行。
装了ponytail插件的AI:爬到第4级——"平台原生特性能做?"——能用。浏览器自带一个。1行。
但它不是"少写代码"那么简单
很多人会想到一个反驳:那我直接跟AI说"用YAGNI,写一行"不就行了?
作者也想到了。所以他做了个对照实验,这是这个项目最值钱的地方,benchmark做的非常好。
他让同一个Claude Code(Haiku 4.5),在同一个真实仓库(tiangolo的FastAPI+React模板)上,做12个真实任务,分三组:
| 组别 | 代码量 | token | 成本 | 耗时 | 安全 |
|---|---|---|---|---|---|
| 不装任何plugin | 基线 | 基线 | 基线 | 基线 | 100% |
| 写prompt | -33% | -14% | -21% | -30% | 95% |
| 装ponytail | -54% | -22% | -20% | -27% | 100% |
光喊"少写代码"的AI,会把安全检查也一起砍了——safe掉到95%。
ponytail是唯一一个所有指标都降、且安全不掉的组。
为什么?因为它有一道明确的"不砍清单":信任边界的输入校验、防数据丢失的错误处理、安全、可访问性——这四样永远不在砍刀下。
懒,但不粗心。它让"懒"变成可审计的——别人能看见你为了简化牺牲了什么。
它凭什么涨这么猛?
痛点很普遍
但凡用过AI写代码的人,都被AI的"过度构建"折磨过。装库、写wrapper、加配置、讨论时区——这是所有人的共同体验。ponytail给的是直接解药,不是理论。
benchmark很诚实
8月大家对"我又做了个agent skill"的耐心已经见底了,都在喊"拿证据来"。
ponytail的README里直接挂了一个issue #126——有人公开质疑它早期报的"80-94%减码"数字注水。作者没删,把批评收进README,给了修正后更保守的数字(54%),还附了可复现脚本。
承认局限,反而换来信任。这在这个赛道太稀缺了。
七大harness通吃
它不绑死任何一家。同一个plugin,Claude/Codex/Copilot/Pi/OpenCode/Gemini/Qoder全装。靠的是最低公约数——AGENTS.md,任何会读这个文件的agent自动遵守规则;hook负责每轮主动注入,适配器负责对接各家plugin API。
零成本跨平台,传播起来就快。

京ICP备2024094994号-17
评论 (0)
还没有评论,来发第一条吧