Claude Fable 5: el modelo más potente, y el más incómodo — Cesar Ayala
← Todos los artículos

Claude Fable 5: el modelo más potente, y el más incómodo

Sí, Claude Fable 5 es el Claude público más potente hasta hoy, líder en SWE-Bench Pro con 80.3%. Pero a $10/$50 por millón de tokens, con retención obligatoria de 30 días que pisa hasta los contratos de cero retención, lo reservo para el trabajo ambicioso de largo plazo y mando todo lo demás a modelos más baratos. La capacidad no está en duda; el paquete sí.

Actualización — 30 de junio de 2026: Claude Fable 5 (claude-fable-5) regresa. Tras levantarse el 30 de junio la directiva de control de exportaciones del 12 de junio que había dejado ambos modelos fuera de línea, Anthropic redespliega Fable 5 a nivel global el 1 de julio de 2026 en Claude Platform, Claude.ai, Claude Code y Claude Cowork (los proveedores de nube en cuanto puedan). Vuelve con nuevos clasificadores de seguridad que bloquean ciertas tareas dañinas de ciberseguridad; en las plataformas de Anthropic las solicitudes bloqueadas caen a Opus 4.8, y Anthropic advirtió más falsos positivos en tareas rutinarias de código y depuración que seguirá afinando. Consulta qué cambia en el redespliegue y cómo manejar el fallback del clasificador como desarrollador. El análisis de abajo describe a Fable 5 tal como se lanzó; considera su disponibilidad y precios vigentes de nuevo.

¿Vale la pena Claude Fable 5? Sí. ¿Me deja tranquilo? No.

Empiezo por lo que más me incomoda, porque es lo que nadie debería pasar por alto. Anthropic pidió “un freno coordinado al desarrollo de IA de frontera” y, días después, lanzó al público su modelo más potente. Esa contradicción no es un detalle: es la postura de la empresa puesta a prueba contra su propio producto.

Dicho eso, seré justo. Claude Fable 5 es el Claude público más potente que se ha lanzado, y la capacidad es real y verificable. Salió el 9 de junio de 2026, disponible en general, con el model ID claude-fable-5. Es la versión con salvaguardas de un nivel nuevo —los modelos clase Mythos— que, según Anthropic, se ubica por encima de la clase Opus. Mythos 5, la pieza sin frenos de ese nivel, no se hizo general.

Mi veredicto, separando hecho de opinión: la capacidad no está en duda. El paquete sí. Hay tres cosas que, como desarrollador que mete IA en producción todos los días, me hacen pensarlo dos veces antes de mandar tráfico: la contradicción de advertir y luego lanzar, una retención de datos obligatoria que pisa hasta los contratos de cero retención, y una economía en la que pagas precio Fable y, en temas marcados, recibes Opus. Esto no es panfleto. Es la lista que yo revisaría antes de firmar.

La capacidad es real: no finjamos lo contrario

Le doy su crédito al modelo primero, porque sin eso la crítica no pesa.

Fable 5 debutó #1 en el Artificial Analysis Intelligence Index. En SWE-Bench Pro marcó 80.3%, contra 58.6% de GPT-5.5 —21.7 puntos arriba— y alrededor de 11 puntos por encima de Opus 4.8. No es un retoque incremental. En ingeniería de software es otro escalón.

Y el dato que de verdad pega no es un benchmark, es un cliente: Anthropic reporta que Stripe usó Fable 5 para migrar un codebase de Ruby de 50 millones de líneas en un solo día —algo que a mano habría tomado más de dos meses. Quien ha vivido una migración grande sabe lo que eso significa.

El resto del panorama lo acompaña: razonamiento espacial 38.6% vs 14.5% de Opus 4.8 (casi 3x), razonamiento legal a la cabeza con 13.3% (GPT-5.5 2.1%, Gemini 0.0%), y visión state-of-the-art.

Lo que Fable 5 sí puso sobre la mesa

Fable 5

  • SWE-Bench Pro: 80.3%
  • Razonamiento espacial: 38.6%
  • Razonamiento legal: 13.3%
  • #1 del Artificial Analysis Intelligence Index

Referencia (Opus 4.8 / rivales)

  • SWE-Bench Pro: GPT-5.5 58.6% (Fable +21.7 pts)
  • Razonamiento espacial: Opus 4.8 14.5% (~3x)
  • Razonamiento legal: GPT-5.5 2.1% / Gemini 0.0%
  • Visión state-of-the-art
Números verificados al lanzamiento. Ojo: Anthropic señala que algunas de las filas más altas reflejan puntajes de Mythos 5, no de Fable 5.

Una advertencia que la propia Anthropic señala, y que tú debes tener presente: algunas de las filas más altas reflejan puntajes de Mythos 5, no de Fable 5. No leas cada número como si fuera lo que recibirás en la API.

Tres cosas que incomodan

Aquí está la columna vertebral. Las tres, sin rodeos y con justicia.

Uno: advirtieron y luego lanzaron. Días antes del lanzamiento, Anthropic urgió a los grandes laboratorios a adoptar un “freno coordinado” al desarrollo de IA de frontera, advirtiendo que los sistemas podrían acercarse a la auto-mejora recursiva. Y luego soltó al público su modelo más potente. La cautela declarada apunta en una dirección; la comercialización, en la opuesta. No hay forma de leerlo distinto.

Dos: retención obligatoria de 30 días. Aplica a todo el tráfico de Fable/Mythos —incluso a clientes con contrato de cero retención— y se presenta como defensa contra “ataques novedosos”. Lo que más me preocupa no es la regla: es el precedente. Que el acceso a los modelos más poderosos venga amarrado a recolección obligatoria de datos, etiquetada como “seguridad”. Esa puerta, una vez abierta, no se cierra sola, y la abre quien hoy lidera.

Tres: pagas precio Fable, recibes Opus en temas marcados. El diseño de seguridad enruta las consultas de ciberseguridad, biología/química y destilación de modelos a Opus 4.8, y te avisa. Como salvaguarda, razonable. Como economía, no: pagas tarifa de Fable y, en esos temas, el desempeño real es el de Opus 4.8. Estás pagando el doble por una respuesta que un modelo a mitad de precio te daría igual.

Las tres incomodidades, en una vista

Advirtieron y luego lanzaronAnthropic pidió un 'freno coordinado' a la IA de frontera y, días después, lanzó su modelo público más potente
Retención obligatoria30 días para TODO el tráfico Fable/Mythos, incluso clientes con cero retención, justificada como defensa ante 'ataques novedosos'
Precio Fable, respuesta OpusEn cyber/bio/destilación el fallback te da Opus 4.8 — pagando tarifa de Fable
Capacidad aparte, esto es lo que yo sopesaría antes de mandar tráfico de producción.

El crédito que Anthropic sí merece

Para que esto sea crítica creíble y no una cacería, hay esfuerzo de seguridad genuino que reconocer.

Anthropic dice que más del 95% de las sesiones de Fable nunca hacen fallback: para la enorme mayoría de los casos de uso, ni te topas con el ruteo a Opus. En el bug bounty externo reportan cero jailbreaks universales en más de 1,000 horas de pruebas, y —esto lo respeto— reconocen abiertamente que “aún podría haber ataques novedosos”. No venden infalibilidad.

Y un punto que defiendo: Mythos 5 no se hizo general. Quedó limitado a los socios de Project Glasswing y a investigadores selectos de biología, y es Mythos el que tiene las guardas de ciberseguridad levantadas para usuarios autorizados. Esa contención es real. No lanzaron lo más filoso al público; lanzaron la versión con salvaguardas. Eso cuenta, y mucho.

El precio: ¿pagas el doble por las razones correctas?

A los números, que es donde un desarrollador decide. Fable 5 cuesta $10 por millón de tokens de entrada y $50 por millón de salida: aproximadamente 2x Opus 4.8 ($5 / $25). Anthropic apunta que es “menos de la mitad del precio de Claude Mythos Preview”, pero contra Opus es el doble. Punto.

Hay una palanca que lo suaviza: el descuento de 90% por prompt-caching baja la entrada cacheada a ~$1/M. Si estructuras bien tus prompts —lo estático primero, lo variable al final, como expliqué en llevar un LLM a producción— el caching te quita una buena mordida.

Sobre acceso: en claude.ai y suscripciones (Pro, Max, Team, Enterprise por asiento) Fable 5 fue gratis hasta el 22 de junio de 2026; a partir del 23 de junio requiere créditos de uso “hasta que la capacidad permita incluirlo de forma estándar”. En la API y en Enterprise por consumo es pay-as-you-go. Está en Claude API, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry y claude.ai.

Mi postura: el sobreprecio de 2x se justifica solo cuando la tarea de verdad necesita ese horizonte extra. Para todo lo demás, estás quemando presupuesto. Si quieres la matemática fina de los tokens de frontera, la desglosé en cuánto cuesta integrar IA en tu app.

Precio por millón de tokens: Fable 5 vs Opus 4.8

Fable 5 — salida$50/M
Opus 4.8 — salida$25/M
Fable 5 — entrada$10/M
Opus 4.8 — entrada$5/M
Fable 5 — entrada cacheada~$1/M
Fable 5 cuesta ~2x Opus 4.8. El caching agresivo baja la entrada cacheada a ~$1/M.

Cómo decidiría yo si usarlo

La parte práctica, la que sirve. Así enruto yo.

Úsalo para trabajo ambicioso de largo plazo. Migraciones autónomas grandes, tareas de millones de tokens donde “se mantiene enfocado” —puede trabajar de forma autónoma más tiempo que cualquier Claude previo. El caso de Stripe es exactamente esto. Si tu tarea tiene ese horizonte, el sobreprecio se gana su lugar.

Manda el trabajo diario y los temas marcados a modelos más baratos. Clasificación, extracción, chat de soporte, resúmenes: ahí no necesitas un modelo clase Mythos, y en cyber/bio/destilación caerías en el fallback a Opus 4.8 de todos modos. Antes de asumir que necesitas lo más potente, lee agentes de IA vs automatización: muchas veces ni de agente necesitas.

Si tu cero retención importa, decídelo antes de mandar tráfico sensible. La retención obligatoria de 30 días no es opcional. Para datos regulados o de cliente, eso es parte de la decisión, no una nota al pie.

Cachea agresivo. Es la forma más directa de suavizar el costo de 2x. La estructura de prompt, los guardarraíles, los fallbacks y los topes de gasto los detallé en LLM en producción; aplican igual aquí.

¿Deberías adoptar Fable 5? Un flujo rápido

  1. ¿La tarea es de largo plazo / autónoma?Migración grande, tarea de millones de tokens. Si no, enruta a un modelo más barato.
  2. ¿El tema está marcado? (cyber / bio / destilación)Si sí, recibirás fallback a Opus 4.8 — pagar precio Fable no tiene sentido ahí.
  3. ¿La retención de 30 días choca con tu política de datos?Aplica aun con cero retención. Para datos sensibles, decídelo aquí.
  4. ¿Puedes cachear para bajar el costo?Lo estático primero; entrada cacheada ~$1/M. Si todo se cumple, usa Fable; si no, modelo más barato.
Cuatro preguntas antes de mandarle tráfico. Si la primera es 'no', casi siempre hay un modelo más barato que basta.

Preguntas frecuentes

¿Fable 5 es lo mismo que Mythos 5? No. Mythos 5 no es general: está limitado a los socios de Project Glasswing y a investigadores selectos de biología, con las guardas de ciberseguridad levantadas para usuarios autorizados. Fable 5 es la versión con salvaguardas, hecha segura para uso general.

¿Cuánto cuesta? $10 por millón de tokens de entrada y $50 por millón de salida. Con el descuento de 90% por caching, la entrada cacheada queda en ~$1/M.

¿Sigue siendo gratis en mi plan? Fue gratis en Pro, Max, Team y Enterprise por asiento hasta el 22 de junio de 2026. A partir del 23 de junio requiere créditos de uso, hasta que la capacidad permita incluirlo de forma estándar.

¿Cuál es la ventana de contexto? 1,000,000 de tokens. Acepta texto, imagen y archivo de entrada; la salida es texto, con soporte para razonamiento / extended thinking.

¿Dónde puedo usarlo? Claude API, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry y claude.ai.

¿Cuál es el detalle de la retención? Una retención obligatoria de 30 días aplica a todo el tráfico de Fable/Mythos, incluso a clientes con acuerdos de cero retención.

Mi conclusión

Fable 5 es brillante y la capacidad es real. Eso no está a discusión. Lo que sí merece escrutinio —y no que nos encojamos de hombros— es advertir y luego lanzar, y una retención obligatoria de 30 días que pisa hasta los contratos de cero retención. Las dos cosas pueden ser ciertas a la vez: el mejor modelo público y el paquete más incómodo.

Mi posición, en una línea: úsalo para el trabajo ambicioso de largo plazo; para todo lo demás, enruta a modelos más baratos y cachea agresivo. Y lo que voy a vigilar de cerca no es el siguiente benchmark —es el precedente de la “retención como seguridad”. Esa es la parte que, si se normaliza, nos toca a todos los que construimos. Más guías para aterrizar esto en producción, en agentes de IA.