Guías gratuitas Productividad

ClaudeProductividadPrompts

La skill que recorta 75% tu consumo de tokens

Una skill gratis de GitHub baja tu consumo de tokens haciendo que Claude hable como cavernícola. Las mismas respuestas con una cuarta parte de las palabras. Tres niveles de intensidad e instalación de una línea.

Le pides a Claude que te diga si conviene subir el precio. Te contesta con un párrafo de introducción, tres apartados con encabezado, un cuadro comparativo y un cierre que resume lo que acaba de decir. La respuesta útil eran cuatro líneas. Las otras cuarenta las pagaste igual.

Ese es el desperdicio que casi nadie mide: no el que gastas escribiendo, sino el que gastas leyendo. Y como cada mensaje nuevo arrastra toda la conversación anterior, esas cuarenta líneas de relleno no se pagan una vez. Se pagan otra vez en el mensaje siguiente, y en el que sigue.

Hay una skill gratis en GitHub que ataca exactamente eso. Se llama caveman y hace una sola cosa: obliga a Claude a contestar como cavernícola. Misma información, una cuarta parte de las palabras.

Qué hace, en una frase

No cambia lo que Claude piensa. Cambia cómo lo escribe: quita muletillas, corta artículos y conjunciones, usa sinónimos más cortos y abrevia los términos que se repiten. El contenido queda; el empaque se va.

En vez de "Basándome en los datos que compartiste, parece que la opción más recomendable sería aumentar el precio en un rango moderado, aunque vale la pena considerar que…", te devuelve algo del tipo "Sube precio. Rango moderado. Riesgo: churn en cuentas chicas. Mide 30 días."

Se lee raro los primeros diez minutos. Después ya no quieres volver.

Cómo se instala

La skill es de un desarrollador llamado JuliusBrussee y vive en su repositorio público caveman. La instalación depende de dónde uses Claude.

En Claude Code, es una línea en la terminal:

npx skills add JuliusBrussee/caveman

En claude.ai, es manual y toma dos minutos más. Abres el repositorio en GitHub, entras al archivo skills/caveman/SKILL.md y copias su contenido. Luego vas a Configuración → Personalizar → Skills, das clic en subir una skill nueva y pegas ahí lo que copiaste.

El paso que todo mundo se salta: revisar el archivo antes de instalarlo. Una skill es texto que Claude va a obedecer, y una skill mal intencionada puede pedirle cosas que tú no quieres. Antes de pegar nada, pásale el contenido del SKILL.md al propio Claude y pídele que te diga si hay instrucciones para mandar datos a algún lado, ejecutar código o cambiar permisos. Toma treinta segundos. La lógica completa de cómo filtrar skills de terceros está en el mercado de skills de Claude.

Los tres niveles

La skill trae tres intensidades y se cambian con un comando en el chat. La diferencia entre ellas no es cosmética: cada una sirve para un tipo de trabajo distinto.

1. Lite /caveman lite

Quita el relleno y el lenguaje corporativo, pero respeta las frases completas y los artículos. Sigue siendo español normal, solo que sin grasa. El ahorro es el más chico de los tres.

Para cuándo: todo lo que vas a reenviar. Un correo a un cliente, un resumen que le vas a pasar a tu jefe, texto que va a un documento. Nadie más que tú tiene que enterarse de que estás usando esto.

2. Full /caveman full

Fragmentos cortos, sinónimos más breves, se caen los artículos. Es el nivel donde aparece la reducción grande de la que habla el autor: alrededor de tres cuartas partes de las palabras desaparecen sin que se pierda la respuesta.

Para cuándo: el default. Trabajo tuyo, que solo tú vas a leer: análisis, decisiones, revisión de datos, ida y vuelta sobre un problema.

3. Ultra /caveman ultra

Abrevia los términos que se repiten (base de datos pasa a DB, autenticación a auth), tira las conjunciones y usa flechas para encadenar ideas. Es casi taquigrafía.

Para cuándo: volumen alto y con prisa. Revisar cincuenta registros, clasificar tickets, iterar rápido sobre algo que ya entiendes bien. No lo uses para pensar un tema nuevo.

Para apagarla, le dices stop caveman o le pides modo normal. No hay que desinstalar nada.

Dónde rinde de verdad en una operación

El caso individual es obvio: gastas menos y llegas menos veces a tu tope. El caso interesante es el de equipo.

Piensa en un área de atención a clientes que usa Claude para clasificar y proponer respuesta a doscientos tickets al día. Cada ticket dispara un intercambio, y en cada intercambio el modelo devuelve una respuesta con su encabezado, su justificación y su cierre amable. Nadie lee esa justificación: el agente mira la categoría, mira el borrador y sigue. En ese flujo, el modo full le quita la mitad larga a doscientas respuestas diarias y no cambia absolutamente nada del resultado.

Lo mismo aplica a cualquier cosa que corra en lote: revisar títulos de anuncios, sacar campos de facturas, evaluar currículums, comparar precios de proveedores. Donde el humano solo va a leer el veredicto, la prosa alrededor del veredicto es puro costo.

Cuándo no vale la pena

Aquí es donde hay que ser honesto, porque la skill se vende sola y tiene un límite claro.

No la uses cuando el matiz es el trabajo. Redactar un correo delicado, revisar una cláusula, escribir copy, dar retroalimentación a una persona. En esos casos las palabras que quita son las que estabas comprando.

No la uses cuando estás aprendiendo algo. Si le estás pidiendo a Claude que te explique cómo funciona un concepto que no dominas, el texto comprimido te va a dejar con la sensación de haber entendido sin haber entendido. Ahí quieres lo contrario: más explicación, no menos.

No la uses como sustituto de higiene de contexto. Recortar la respuesta ayuda, pero el gasto grande casi siempre está en otro lado: chats de sesenta mensajes que nunca se cerraron y archivos enormes que viajan en cada turno. Si eso no lo tienes resuelto, esta skill te va a ahorrar el postre mientras sigues pagando el banquete. Los cuatro hacks para gastar menos tokens atacan justo esa parte, y conviene hacerlos primero.

El orden correcto

Instálala en full y déjala una semana entera sin tocar el nivel. Vas a descubrir dos cosas: cuántas de tus preguntas nunca necesitaron una respuesta larga, y cuáles son las tres o cuatro donde sí extrañas el detalle.

Esas tres o cuatro son las que se hacen en modo normal. Todo lo demás se queda en cavernícola.

Una guía nueva cada semana

Sistemas de IA que ya están corriendo en operaciones reales, explicados paso a paso. Sin relleno y sin teoría.

Se cancela con un clic. Tu correo no se comparte con nadie.