
Claude Fable 5 vuelve el 1 de julio: qué cambió
Claude Fable 5 vuelve a nivel global el 1 de julio de 2026 en todas las superficies de Anthropic; los proveedores cloud lo reactivan cuanto antes. Los planes de pago lo incluyen hasta el 50% de los límites semanales hasta el 7 de julio. Anthropic lo redesplegó con nuevos clasificadores que bloquean una técnica reportada en más del 99% de los casos, enrutando lo bloqueado a Opus 4.8.
Qué pasó y cuándo: Claude Fable 5 vuelve el 1 de julio de 2026
Claude Fable 5 vuelve a nivel global el 1 de julio de 2026 en todas las superficies de Anthropic: Claude Platform, Claude.ai, Claude Code y Claude Cowork. Anthropic lo redesplegó con nuevos clasificadores de seguridad que bloquean una técnica reportada en más del 99% de los casos y enrutan lo bloqueado a Opus 4.8 en sus propias superficies. En los planes de pago, Fable 5 queda incluido hasta el 50% de los límites de uso semanales hasta el 7 de julio de 2026; después requiere créditos de uso.
Si solo necesitas el titular: el modelo (claude-fable-5, con $10 / $50 por MTok de entrada/salida, contexto de 1M de tokens, salida máxima de 128k y pensamiento adaptativo siempre activo) sigue siendo el modelo más capaz de amplia disponibilidad de Anthropic, GA desde el 9 de junio de 2026. Lo que cambió no es el modelo, sino la capa de seguridad alrededor de él. Los proveedores cloud (AWS, Google Cloud y Microsoft) lo reactivan “cuanto antes”.
La cronología: del lanzamiento del 9 de junio al redespliegue del 1 de julio
La secuencia de eventos ayuda a entender por qué el modelo estuvo restringido y qué motivó el redespliegue. Fue un proceso de tres semanas que combinó lanzamiento de producto, control de exportaciones y coordinación con el gobierno.
- 9 de junioSe lanzan Claude Fable 5 y Mythos 5 (GA).
- 12 de junioSe aplica una directiva de control de exportaciones de EE. UU.
- 26 de junioAprobación del gobierno de EE. UU. para ampliar el acceso a Mythos 5.
- 30 de junioSe levantan los controles de exportación.
- 1 de julioRedespliegue global de Fable 5.
- 7 de julioTermina la inclusión en planes de pago (50% de límites).
La clave del calendario para ti como usuario es doble: el 1 de julio recuperas acceso, y el 7 de julio termina la ventana en la que Fable 5 viene incluido hasta el 50% de tus límites semanales. Después de esa fecha, el uso de Fable 5 consume créditos.
Qué hay de nuevo: clasificadores de seguridad que bloquean tareas dañinas de ciberseguridad
El cambio central del redespliegue es un nuevo conjunto de clasificadores de seguridad. Estos clasificadores detectan cuándo se le pide al modelo realizar una tarea de ciberseguridad potencialmente dañina, o cuándo el modelo produce salidas potencialmente dañinas, y bloquean esa solicitud. Según Anthropic, el clasificador bloquea la técnica específica reportada en más del 99% de los casos.
Por responsabilidad editorial, aquí no describimos ni especulamos sobre la técnica bloqueada ni sobre cómo funcionaría cualquier uso indebido. Lo relevante desde el punto de vista de ingeniería es el comportamiento observable: ciertas solicitudes que antes pasaban ahora se bloquean, y ese bloqueo se maneja de forma distinta según la superficie que uses.
Vale la pena leer esto junto con el contexto del modelo en sí. Si aún no tienes claro qué es Fable 5 y para qué destaca, empieza por Claude Fable 5 explicado y por la pregunta práctica de si vale la pena Claude Fable 5.
El respaldo a Opus 4.8 y la advertencia de falsos positivos para quienes programan
En las superficies propias de Anthropic (Claude.ai, Claude Code y Cowork), el comportamiento es cómodo: si una solicitud a Fable 5 se bloquea, se te notifica y la solicitud se envía en su lugar a Opus 4.8 (claude-opus-4-8; $5 / $25 por MTok; contexto de 1M; salida de 128k; el nivel Opus más capaz para razonamiento y programación agéntica). No pierdes la respuesta: cambias de modelo.
La parte honesta del anuncio es que el nuevo clasificador genera más falsos positivos en tareas rutinarias de programación y depuración. Anthropic afirma que refinará los clasificadores “durante las próximas semanas para reducir los falsos positivos y distinguir mejor el uso indebido genuino de las solicitudes legítimas”. Traducido a la práctica: si depuras mucho, puedes toparte con bloqueos que no tienen nada que ver con seguridad ofensiva, y esos se redirigen a Opus.
En la API cruda de Claude el comportamiento es diferente y esto es importante. Una solicitud bloqueada aparece como un rechazo: un stop_reason con valor "refusal". No asumas que la API hace fallback automático como las superficies de consumo; ese enrutamiento lo construyes tú. Un manejador mínimo se ve así:
import anthropic
client = anthropic.Anthropic()
def call_with_fallback(messages):
resp = client.messages.create(
model="claude-fable-5",
max_tokens=4096,
messages=messages,
)
if resp.stop_reason == "refusal":
# el clasificador bloqueó la solicitud: enruta a Opus 4.8
resp = client.messages.create(
model="claude-opus-4-8",
max_tokens=4096,
messages=messages,
)
return resp
Para más detalle sobre cómo manejar rechazos y valores de stop_reason en producción, revisa Sonnet 5 en producción: streaming, reintentos y errores y la guía de manejar rechazos del clasificador con fallback a Opus. Si estás empezando con la API, parte de cómo usar la API de Claude.
El marco de consenso Glasswing: cuatro criterios para la gravedad de un jailbreak
Junto con Amazon, Microsoft, Google y otros socios de Glasswing, Anthropic está redactando un marco compartido para evaluar la gravedad de los jailbreaks de IA. La idea es dejar de discutir caso por caso y tener criterios comunes que la industria pueda aplicar. El marco propone cuatro criterios.
Los cuatro criterios son: (1) la ganancia de capacidad respecto a las herramientas ya existentes; (2) la amplitud de esa ganancia a través de tareas ofensivas distintas; (3) la facilidad para convertir la técnica en un arma, es decir, el esfuerzo requerido; y (4) la descubribilidad de la técnica. La invitación es abierta a otros proveedores y desarrolladores de modelos.
Que exista un marco de industria importa por una razón concreta: hoy cada laboratorio evalúa la severidad con su propio criterio, lo que hace difícil comparar incidentes o coordinar respuestas. Un vocabulario común permite priorizar según el riesgo real y no según quién grita más fuerte.
Colaboración ampliada con el gobierno de EE. UU.: los cuatro compromisos
El redespliegue vino acompañado de una colaboración ampliada con el gobierno de EE. UU., estructurada en cuatro compromisos. En conjunto, apuntan a que la evaluación de seguridad no dependa solo del laboratorio que construye el modelo.
Compromisos con el gobierno de EE. UU.
- Acceso previo al lanzamiento: modelos y salvaguardas para evaluación independiente
- Compartir información: investigar, priorizar y notificar jailbreaks o uso indebido
- Investigación conjunta: recursos dedicados de Anthropic en prioridades compartidas
- Estándares comunes: un estándar voluntario y compartido de seguridad y evaluación
Marco de consenso Glasswing
- Ganancia de capacidad relativa
- Amplitud entre tareas ofensivas
- Facilidad para convertirla en arma
- Descubribilidad de la técnica
Los cuatro compromisos son: acceso previo al lanzamiento (acceso temprano ampliado tanto a los modelos como a las salvaguardas para evaluación independiente); intercambio de información (investigar, priorizar y notificar rápidamente a las contrapartes del gobierno sobre jailbreaks o uso indebido); investigación conjunta (recursos dedicados de Anthropic en prioridades gubernamentales compartidas); y estándares comunes (un estándar voluntario y compartido de seguridad y evaluación). La señal para la gobernanza de IA es clara: la evaluación de seguridad se está moviendo hacia un modelo con revisión externa, no puramente interno.
Qué significa esto para ti: usuarios frente a desarrolladores
Para el uso normal, la respuesta es simple: desde el 1 de julio, Fable 5 vuelve, incluido hasta el 50% de tus límites semanales hasta el 7 de julio. Si una solicitud se bloquea en las superficies de Anthropic, se te notifica y se atiende con Opus 4.8. No tienes que hacer nada especial. Espera algún falso positivo ocasional en tareas comunes mientras Anthropic refina los clasificadores durante las próximas semanas.
Para quienes construyen sobre la API, la recomendación práctica es más matizada. Ahora mismo, para programación y depuración rutinarias, Opus 4.8 es la opción pragmática por defecto: menos falsos positivos del clasificador y la mitad del precio ($5/$25 frente a $10/$50 de Fable 5). Reserva Fable 5 para el trabajo de razonamiento más exigente y las tareas agénticas de horizonte largo, donde su capacidad extra sí paga. Y recuerda: en la API cruda no hay fallback automático, así que maneja el stop_reason de "refusal" por tu cuenta.
# API cruda: un bloqueo llega como stop_reason "refusal", no como fallback automático
# tu código decide si reintentar con claude-opus-4-8
Para decidir el enrutamiento y afinar costo contra calidad, ayudan ajustar Sonnet 5: costo, calidad, effort y batch y la guía práctica de cómo usar Claude Fable 5. El resto del ecosistema de agentes está en el hub de agentes de IA.
En resumen: el modelo no cambió, cambió la capa de seguridad alrededor de él. Fable 5 vuelve el 1 de julio con clasificadores más estrictos, un respaldo claro a Opus 4.8 en las superficies de consumo, un marco de industria para medir la gravedad de los jailbreaks y una colaboración gubernamental más formal. Es una historia de disponibilidad y gobernanza, no de una nueva capacidad del modelo.
Fuentes: Redeploying Fable 5 (Anthropic) y la vista general de modelos en la Claude Platform.