Se agrega desde dentro de Claude Code con dos comandos, enviados como dos mensajes separados: primero se añade el catálogo del repo DietrichGebert/ponytail y después se instala ponytail@ponytail. A partir de ahí, antes de escribir código el agente comprueba si eso ya viene incluido.
Claude Code tiende a escribir de más. No porque el modelo sea malo, sino porque optimiza por resolver la tarea, no por escribir poco: escribir desde cero siempre funciona, mientras que reutilizar exige saber qué existe ya.
ponytail es un repo abierto (licencia MIT, de un desarrollador independiente; no lo publica Anthropic) que le añade una regla previa: antes de teclear, comprobar si lo que le pides ya viene incluido.
Esta es la guía para ponerlo y, sobre todo, para medir si te sirve a ti.
Paso 1. Agregarlo, en dos líneas
Se hace desde dentro de Claude Code, no en la terminal. Y van como dos mensajes separados: escribes el primero, esperas la respuesta y entonces mandas el segundo. El propio repo advierte que juntarlos no funciona.
El primero añade el catálogo del repo. El segundo instala la pieza.
Paso 2. Comprobar que quedó puesto
No hay que fiarse de un mensaje de confirmación. La señal es de comportamiento:
Pide algo que se sobre-construya con facilidad: un calendario, un selector de color, una zona para arrastrar archivos.
Mira si antes de escribir te avisa de que eso ya venía incluido.
Compara las líneas que añade con las que añadía antes en una tarea parecida.
Paso 3. Medir tu ahorro real en diez minutos
El benchmark de su creador da un 54 % de media sobre 12 funciones con Haiku 4.5. Es un dato honesto, pero es el suyo. El único que te sirve es el tuyo:
1. Abre un proyecto real y pídele una función que se sobre-construya, por ejemplo un calendario.
2. Cuenta las líneas que añadió con `git diff --stat` sobre ese cambio.
3. Descarta el cambio, agrega ponytail con las dos líneas de arriba y pide exactamente lo mismo.
4. Vuelve a contar. La diferencia entre esos dos números es tu ahorro real.
Dos avisos para que la prueba valga algo:
Pídelo con las mismas palabras las dos veces. Si cambias el enunciado, estás midiendo otra cosa.
Hazlo sobre un proyecto que ya tenga dependencias instaladas. En uno vacío no hay nada que reutilizar y el resultado no dice nada.
Cuándo NO te va a servir
Cuatro situaciones en las que instalarlo no cambia nada. Mejor saberlo antes:
Tu código ya era mínimo. En el propio benchmark, una de las 12 funciones salió igual: 44 líneas antes y 44 después.
No usas Claude Code. La regla se instala dentro de esa herramienta.
Trabajas con otro modelo. La medición publicada es solo con Haiku 4.5.
Te importa el rendimiento, no el tamaño. Esto recorta líneas; no optimiza velocidad.
La parte honesta
El 54 % es una media, no una promesa. Donde más recorta es donde el agente se estaba sobre-construyendo solo; donde el código ya era mínimo, el ahorro es prácticamente cero.
Su creador llegó a ese número corrigiendo a la baja su propio benchmark anterior después de una crítica metodológica, y dejó publicada la fila donde su herramienta no mejoró nada.
Un repo que publica su caso malo es mejor señal que uno donde todo sale bien.
Preguntas frecuentes
¿Los dos comandos se pueden mandar juntos?
No. Van como dos mensajes separados: primero el que añade el catálogo, y cuando responda, el que instala. El repo advierte que juntarlos no funciona.
¿Dónde se escriben esos comandos?
Dentro de la propia conversación de Claude Code, no en la terminal del sistema ni en una página web. Se escriben como si le hablaras al asistente: primero el comando que añade el catálogo del repo, esperas a que responda, y después el que instala la pieza. Si los pegas en la terminal de tu sistema operativo no van a hacer nada, porque son comandos de la propia herramienta.
¿Cómo sé si de verdad me está ahorrando código?
Midiéndolo: pide la misma función con las mismas palabras antes y después de instalarlo, y compara las líneas añadidas con git diff --stat. Hazlo sobre un proyecto con dependencias ya instaladas.
¿Cuánto código ahorra de verdad?
En el benchmark de su creador, la media de 12 funciones fue un 54 % menos, medido con Haiku 4.5 sobre cuatro corridas. Pero hay tareas donde no ahorra nada, y están publicadas en el mismo archivo.