El precio de Claude bajó y tu factura casi no
· 6 min de lectura
Claude Sonnet 5 se queda en dos dólares por millón de tokens de entrada y diez de salida: la subida del 1 de septiembre de 2026 fue cancelada. Pero los modelos 4.7 en adelante usan un tokenizador nuevo que produce cerca de un 30 % más de tokens para el mismo texto, así que el ahorro real frente a Sonnet 4.6 ronda el 13 %, no el 33 % de la tabla.
Anthropic hizo dos anuncios sobre el precio de Claude y casi todo el mundo leyó solo uno. El primero es el que circuló: el precio de Claude Sonnet 5 se queda en dos dólares por millón de tokens de entrada y diez de salida. Ese precio se había anunciado como introductorio hasta el 31 de agosto de 2026, y la subida a tres y quince que estaba programada para el 1 de septiembre no va a ocurrir. Está escrito así, en la página oficial de precios. El segundo anuncio está en la misma página, unas líneas más abajo, y no lo compartió nadie: los modelos de la generación 4.7 en adelante usan un tokenizador nuevo, y ese tokenizador produce aproximadamente un 30 % más de tokens para el mismo texto. Sonnet 4.6 y anteriores usan el tokenizador viejo. Los dos son ciertos. Juntos cuentan una historia distinta a la del titular.
Qué es un tokenizador y por qué te acaba de cambiar la factura
Un modelo no cobra por palabras: cobra por tokens, que son los pedazos en que parte el texto antes de leerlo. El tokenizador es la regla que decide dónde se corta. Cambiar esa regla cambia cuántos tokens salen del mismo párrafo. No cambia el texto, no cambia lo que pides, no cambia lo que recibes. Cambia el contador. Y como la factura se calcula multiplicando tokens por precio, mover el contador es exactamente igual de real que mover el precio. Solo que el precio va en el titular y el contador va en una nota.
Este sistema es el que enseño dentro de la comunidad MÁQUINA IA: las estaciones, los gates y el código que lo sostiene.
La cuenta que nadie hizo en voz alta
Toma el mismo texto y pásalo por los dos modelos. Con Sonnet 4.6 pagas tres dólares por millón de tokens de entrada. Llámale mil tokens a ese texto: son tres milésimas de dólar. Con Sonnet 5 pagas dos dólares por millón, que es un 33 % menos por token. Pero ese mismo texto ya no son mil tokens: con el tokenizador nuevo son alrededor de mil trescientos. Dos dólares por millón, por mil trescientos tokens, son dos milésimas y media. De tres a dos y medio. El ahorro real ronda el 13 %, no el 33 % que sugiere la tabla de precios. En salida sale casi igual: quince dólares contra diez multiplicados por 1,3, o sea trece. Sigue siendo más barato. Es una rebaja de verdad. Pero es la mitad de la mitad de lo que parece, y si presupuestaste con el 33 % te vas a quedar corto. Este cálculo es mío, derivado del 30 % que publica Anthropic. Ellos no publican el porcentaje de ahorro final, y con razón: el aumento exacto depende del contenido y de la forma de tu carga de trabajo. En texto en español con muchas tildes no da lo mismo que en código.
La consecuencia que sí duele: tu ventana de un millón encoge
Aquí está el efecto que no aparece en ninguna factura. La ventana de contexto de Sonnet 5 es de un millón de tokens. La de Sonnet 4.6 también era de un millón. El número no cambió. Pero si el mismo texto ahora ocupa un 30 % más de tokens, en esa ventana de un millón te cabe alrededor de un 23 % menos de texto. Divide uno entre uno coma tres y te sale 0,77. O sea: el documento que antes entraba entero, quizá ya no entra. La conversación que llegaba al final del día sin compactarse, quizá se compacta antes. Y el síntoma no se parece en nada a la causa — vas a pensar que el modelo "se olvida más", cuando lo que pasó es que tu texto engordó en tokens.
Qué hacer con esto el lunes
Tres cosas, en orden. Primero: vuelve a medir. No arrastres los conteos de tokens que mediste con Sonnet 4.6, porque están medidos con la regla vieja. El endpoint de conteo de Anthropic acepta el modelo como parámetro justamente por esto. Segundo: no uses tiktoken. Es el tokenizador de OpenAI y para Claude subestima; con el tokenizador nuevo la diferencia es todavía mayor. Cualquier estimador que no sea el oficial te va a dar un número que no es tu factura. Tercero: revisa los topes que pusiste en tokens, no en palabras. Los límites de salida, los umbrales de compactación, las alertas de gasto: todos están calibrados contra la regla vieja y todos se van a comportar distinto.
El dato honesto
Nada de esto es una trampa. Anthropic publicó las dos cosas en la misma página, con todas las letras, incluido el "aproximadamente" y la advertencia de que depende del contenido. No escondieron nada. Lo que pasó es que una de las dos frases es un titular y la otra es una nota técnica, y el internet solo reparte titulares. La lección no es sobre Anthropic. Es que en cualquier servicio que cobre por unidad, hay dos números que te pueden mover la factura: el precio de la unidad y el tamaño de la unidad. Casi siempre miras solo el primero.
Preguntas frecuentes
- ¿Cuánto cuesta Claude Sonnet 5 por millón de tokens?
- Dos dólares por millón de tokens de entrada y diez dólares por millón de tokens de salida. Ese precio se anunció al lanzamiento como introductorio hasta el 31 de agosto de 2026 y ahora es el precio estándar: la subida a tres y quince dólares que estaba programada para el 1 de septiembre de 2026 fue cancelada oficialmente.
- ¿Qué modelos de Claude usan el tokenizador nuevo?
- Los modelos de la generación 4.7 en adelante, incluido Claude Sonnet 5. Anthropic indica que ese tokenizador produce aproximadamente un 30 % más de tokens para el mismo texto, y que el aumento exacto depende del contenido y de la forma de la carga de trabajo. Claude Sonnet 4.6 y los modelos anteriores siguen usando el tokenizador previo.
- ¿Cuánto ahorro real hay al pasar de Sonnet 4.6 a Sonnet 5?
- El precio por token baja un 33 %, de tres a dos dólares por millón en entrada, pero el mismo texto produce alrededor de un 30 % más de tokens. Haciendo la cuenta, el costo del mismo trabajo baja cerca de un 13 %. Es un ahorro real, pero bastante menor al que sugiere comparar solo las dos tablas de precios.
- ¿Por qué no debo usar tiktoken para contar tokens de Claude?
- Porque tiktoken es el tokenizador de OpenAI y no corresponde al de Anthropic: subestima el conteo real para Claude, y con el tokenizador nuevo la diferencia crece. La forma correcta es el endpoint oficial de conteo de tokens de Anthropic, que recibe el identificador del modelo como parámetro porque el conteo es distinto para cada uno.
- ¿Cabe menos texto en la ventana de contexto de Sonnet 5?
- La ventana sigue siendo de un millón de tokens, igual que en Sonnet 4.6, pero como el mismo texto ocupa alrededor de un 30 % más de tokens, en la práctica cabe cerca de un 23 % menos de texto. Es una división simple: uno entre uno coma tres da cero coma setenta y siete. El síntoma se parece a que el modelo olvida más, y la causa es solo el conteo.