Septiembre ha traído modelos nuevos casi cada semana. Si usas inteligencia artificial dentro de tus automatizaciones, lo que te interesa no son los titulares de rendimiento: es qué le pasa a la factura. Y ahí ha habido dos movimientos que merecen un minuto.
La caché se ha abaratado, y eso importa más de lo que parece
En la nueva versión de Claude Fable 5.1, publicada el 1 de septiembre, el precio de entrada y de salida se queda igual. Lo que cambia es la lectura desde caché: baja de 1,00 a 0,25 dólares por millón de tokens, cuatro veces menos.
Parece un detalle técnico y no lo es. Un agente que trabaja durante un rato relee una y otra vez el mismo contexto: las instrucciones, el historial, los documentos. Esa relectura es justo lo que se sirve desde caché. Si tienes agentes largos, ahí es donde estaba yéndose el dinero.
Y un precio de introducción con fecha de caducidad
Gemini 3.8 Flash, del 2 de septiembre, sale a 0,75 dólares por millón de tokens de entrada y 3,75 de salida. Es un precio de introducción: el 1 de enero de 2027 las tarifas se duplican.
Hay un segundo matiz que casi nadie cuenta. Ese modelo gasta alrededor de un 30 % más de tokens de salida que la versión anterior para resolver lo mismo. Así que el precio por millón baja, pero el precio por tarea no baja en la misma proporción.
La lección, que vale para cualquier modelo
No compares proveedores por el precio del millón de tokens. Compara por lo que te cuesta una tarea completa, de principio a fin, con tus propios datos. Es la única cifra que aparece luego en el recibo.
Y si automatizas con n8n, monta la prueba en tu propio servidor y mide durante una semana antes de cambiar nada: n8n en un servidor VPS.
Fuentes: Ficha de Claude Fable 5.1 · Actualizaciones de modelos