Dos noticias de la misma semana, sobre el mismo tema desde ángulos distintos: cuánto texto de instrucciones necesita de verdad Claude para rendir bien. La respuesta, confirmada oficialmente, es «bastante menos de lo que parece».
El recorte real: de 800 tokens a 164
Anthropic anunció el 2 de julio de 2026, a través de su ingeniero Thariq Shihipar en el AI Engineer World’s Fair, que redujo el system prompt de Claude Code en un 80% — de 800 tokens a 164 — sin pérdida de rendimiento medible en sus evaluaciones internas de codificación. Un matiz que vale la pena señalar: la cifra exacta es en tokens, no en palabras (una fuente lo simplificaba a «800 palabras a 160»), pero la magnitud del recorte es correcta. La razón de fondo: los modelos más recientes razonan mejor por sí mismos y necesitan menos reglas exhaustivas para comportarse bien — el exceso de instrucciones puede limitar en vez de ayudar.
La aplicación práctica que se deriva de esto para cualquiera que use Claude Code a diario: separar en tu propio CLAUDE.md las reglas que siempre aplican de las que solo aplican «a veces», y mover estas últimas a skills independientes que Claude carga bajo demanda en vez de mantenerlas siempre en el contexto. No es una recomendación oficial de Anthropic — es una extrapolación razonable del propio sistema de Skills, que sí es una función real del producto.
La filtración que confirma cuánto pesa un system prompt de verdad
Por otro lado, unos días antes se filtró públicamente el system prompt completo de Claude Fable 5 (el modelo de gama alta de Anthropic): más de 120.000 caracteres, 1.585 líneas, más de 27.000 tokens, subido a un repositorio de terceros dentro de las 24 horas posteriores al lanzamiento del modelo. La filtración está ampliamente confirmada por prensa especializada con cifras casi idénticas entre varias fuentes independientes — aunque el contenido exacto proviene de un repositorio no oficial, sin confirmación directa de Anthropic sobre su autenticidad línea por línea.
Circula la idea de copiar ese prompt filtrado como base para modelos más baratos u open source (GLM, Kimi) y así «acercar» su comportamiento al de un modelo premium. Es técnicamente posible — un system prompt es solo texto, portable a cualquier modelo — pero no es una garantía: el rendimiento real depende también de las capacidades base del modelo que lo recibe, no solo de las instrucciones que se le den. Un modelo más débil no iguala a Claude solo por heredar su prompt.
La contradicción aparente que en realidad no lo es
A primera vista, «Claude Code funciona mejor con 164 tokens de instrucciones» y «el prompt filtrado de Fable 5 tiene 27.000 tokens» parecen decir cosas opuestas. No lo son: son dos productos distintos con necesidades distintas. El system prompt corto de Claude Code cubre el comportamiento base de una herramienta de codificación de propósito general; el prompt largo de un modelo conversacional de gama alta cubre un espacio de casos de uso mucho más amplio. La lección que aplica a ambos casos es la misma: cada instrucción que mantienes en el contexto tiene un coste, y ese coste solo se justifica si esa instrucción se necesita casi siempre — lo que se necesita «a veces» debería vivir en otro sitio, cargado solo cuando toca.
Cómo lo aplicamos nosotros
Cuando revisamos la configuración de Claude Code de un cliente, una de las primeras cosas que miramos es cuánto CLAUDE.md tiene acumulado con reglas que en realidad solo aplican a una tarea concreta. Recortar eso no es perder contexto — es dejar de pagar por contexto que no se usa la mayor parte del tiempo.
Si tu equipo lleva meses acumulando instrucciones en Claude Code sin revisarlas, podemos ayudarte a auditarlo. Escríbenos desde el formulario de contacto.