Una nueva tendencia se está extendiendo por la comunidad de inteligencia artificial: reducir las instrucciones y respuestas a lo más esencial para recortar el uso de tokens.
Uno de los ejemplos más populares es el plugin Caveman de GitHub, que hace que modelos como Codex, Claude y Gemini se comuniquen en frases ultramínimas como: «Claude piensa. Claude escribe. Claude listo».
¿El resultado? El uso de tokens puede reducirse entre un 65 y 75%, disminuyendo los costos mientras se mantiene la misma tarea en curso.
Su lema lo dice todo: «Ahorra token. Ahorra dinero».
