Cómo exprimir el plan de 20 dólares de Claude
· 6 min de lectura
El plan de 20 dólares de Claude se agota casi siempre por tres hábitos, no por el plan: chats eternos que reenvían todo el historial en cada turno, archivos crudos resubidos en vez de cargados una vez en un Proyecto, y ajustes como el pensamiento extendido o los conectores encendidos sin necesitarlos. Corregir los tres estira mucho el límite diario.
Grabé este video para la gente que ve el mensaje de límite alcanzado todos los días y cree que la solución es subir de plan. Casi nunca lo es. Esta es la versión leíble, con las fuentes enlazadas al final y el video completo aquí abajo.
Por qué se te acaba el plan
El modelo no recuerda nada entre mensajes. En cada turno se reenvía la conversación entera: instrucciones, archivos, respuestas anteriores y tu mensaje nuevo. Está descrito en la propia documentación de Anthropic cuando explica el caché de prompts: sin caché, la API reprocesa todo el historial en cada turno. La consecuencia práctica es que un chat de cien mensajes cuesta muchísimo más por respuesta que un chat nuevo con la misma pregunta. No porque el modelo sea más lento, sino porque le estás mandando cien mensajes cada vez. La regla que uso: un tema, un chat. Cuando cambio de tarea, abro conversación nueva. Y si necesito el contexto anterior, le pido un resumen de tres líneas y lo pego en el chat nuevo. Ese hábito solo ya devuelve una parte enorme del límite diario.
Este sistema es el que enseño dentro de la comunidad MÁQUINA IA: las estaciones, los gates y el código que lo sostiene.
Los archivos crudos son el segundo agujero
Subir un PDF a pelo en cada conversación es caro y no lo parece. La documentación oficial de soporte de PDF mide el consumo: un PDF de tres páginas procesado como texto e imagen gasta alrededor de 7.000 tokens. Eso son más de 2.000 tokens por página, antes de tu primera pregunta. La solución dentro de Claude se llama Proyectos. Subes los documentos una sola vez a la base de conocimiento del proyecto y todos los chats de ese proyecto comparten ese conocimiento sin resubir nada. Es la diferencia entre pagar el documento una vez y pagarlo en cada conversación.
Los interruptores que nadie revisa
Tres ajustes que gastan sin que los mires:
- Pensamiento extendido. Gasta límite extra en cada respuesta. Para tareas simples no aporta nada; apágalo.
- Búsqueda web y conectores. Consumen cuando están activos. Si no los necesitas para esa tarea, desactívalos.
- Mensajes sueltos. Cinco mensajes con cinco preguntas cuestan mucho más que un mensaje con las cinco preguntas, porque cada mensaje reenvía todo lo anterior.
Ninguno de los tres es un truco de internet: son consecuencias directas de cómo se factura el contexto.
Lo que el video no sabía todavía
Este es el añadido que no estaba cuando grabé. Desde la versión 2.1.242 de Claude Code, el TTL del caché es configurable. Importa aquí porque cuando pasas del uso incluido de tu plan y empiezas a consumir créditos de uso, la conversación principal baja de una hora a cinco minutos de caché. Cada pausa de café por encima de esos cinco minutos hace que tu siguiente mensaje reprocese el contexto completo. Dicho de otro modo: los tres errores de arriba se pagan el doble justo cuando ya estás apretado de límite. Escribí la guía del ajuste aparte, en maquina-ia.com, porque es un tutorial y aquí toca el caso.
El dato honesto
Si corres agentes o proyectos de código todo el día, ningún ajuste te salva. Los planes grandes existen por algo y no voy a fingir que veinte dólares dan para eso. Esto sirve para el perfil mayoritario: el que usa Claude para trabajar, crear y aprender. Y una corrección al propio video: el bonus que menciono al final, con Fable 5 incluido hasta el 19 de julio, ya caducó. Lo dejo escrito aquí en vez de borrarlo del video, porque una fecha límite vencida que nadie corrige es peor que un video con una nota encima.
Preguntas frecuentes
- ¿Por qué un chat largo de Claude gasta más que uno nuevo?
- Porque el modelo no guarda memoria entre mensajes. En cada turno se reenvía la conversación completa (las instrucciones, los archivos, todas las respuestas anteriores) más tu mensaje nuevo. Cuanto más largo el chat, más grande es ese envío y más caro sale cada respuesta, aunque la pregunta sea idéntica.
- ¿Cuántos tokens gasta un PDF en Claude?
- Depende de cómo se procese. La documentación oficial de soporte de PDF indica alrededor de 1.000 tokens para un PDF de tres páginas cuando solo se extrae el texto, y unos 7.000 para el mismo PDF cuando cada página se procesa además como imagen. Son más de 2.000 tokens por página antes de que hagas la primera pregunta.
- ¿Los Proyectos de Claude ahorran límite de verdad?
- Sí, cuando el problema es resubir los mismos documentos una y otra vez. En un Proyecto subes los archivos una sola vez a la base de conocimiento y todos los chats de ese proyecto la comparten, así que dejas de pagar el documento entero en cada conversación nueva. No ayuda si tu gasto viene de generar mucho texto.
- ¿Cuándo sí conviene subir de plan?
- Cuando corres agentes o proyectos de código durante horas todos los días. Ahí el consumo no viene de malos hábitos sino del volumen real de trabajo, y ningún ajuste de los de esta guía lo compensa. Para el uso de trabajar, crear y aprender, el plan de veinte dólares suele alcanzar si corriges los tres errores.