Costos de Claude Fable 5 tras el 7 de julio: API vs plan — Cesar Ayala
← Todos los artículos

Costos de Claude Fable 5 tras el 7 de julio: API vs plan

Fable 5 no desaparece tras el 7 de julio; solo cambia el cobro. La inclusión "hasta el 7 de julio" aplica a planes Pro, Max, Team y ciertos Enterprise (hasta 50% de los límites semanales). En la API de Claude no hay semana gratis: Fable 5 se cobra a $10/$50 por MTok siempre. Tras el 7 de julio, el uso en planes se cobra con créditos a tarifas API estándar.

Costos de Claude Fable 5 tras el 7 de julio: la respuesta corta

Fable 5 no desaparece tras el 7 de julio; solo cambia el cobro. La inclusión “hasta el 7 de julio” aplica a planes Pro, Max, Team y ciertos Enterprise, hasta el 50% de tus límites semanales de uso. En la API de Claude no hay semana gratis: Fable 5 se cobra a $10 / $50 por MTok (entrada/salida) siempre, sin importar la fecha. Tras el 7 de julio, el uso en planes de suscripción se cobra con usage credits a tarifas API estándar.

La única distinción que cambia tu factura: API de Claude vs plan de suscripción

Antes de calcular un solo peso, tienes que saber por cuál de los dos caminos estás pagando, porque el precio se comporta distinto en cada uno.

En un plan de suscripción (Claude.ai, Claude Code) pagas una mensualidad y consumes contra límites semanales de uso: una ventana rodante de 5 horas más un tope semanal. Ahí “incluido” significa que tu uso de Fable 5 cuenta contra ese tope sin cargo extra, hasta el límite del plan.

En la API de Claude no hay mensualidad ni límite semanal incluido: pagas por token consumido. Fable 5 se mide a $10 por millón de tokens de entrada y $50 por millón de salida, y eso no cambia el 1 ni el 7 de julio. La “primera semana incluida” es un beneficio del plan de suscripción, no un descuento de API.

Plan de suscripción (Claude.ai / Code)

  • Mensualidad fija más límites semanales de uso
  • Fable 5 incluido hasta el 50% del tope semanal, del 1 al 7 de julio
  • Tras el 7 de julio: usage credits a tarifas API estándar
  • Ventana rodante de 5 h más tope semanal

API de Claude

  • Pago por token, sin mensualidad
  • Fable 5 a $10 / $50 por MTok siempre
  • No hay semana gratis en la API
  • La fecha (1 o 7 de julio) no cambia nada

Si no tienes clara esta separación, cualquier estimación de costo va a salir mal. Si vas a construir sobre la API, arranca por cómo usar la API de Claude.

Qué significa realmente “incluido hasta el 7 de julio” (y qué no)

Cito la frase de facturación exacta del anuncio de Anthropic, porque hay una confusión que conviene matar de raíz:

“For Pro, Max, Team, and select Enterprise plans, Fable 5 will be included for up to 50% of weekly usage limits through July 7, after which it will be available via usage credits.”

Léelo con calma. Lo único que termina el 7 de julio es la palabra “included”. Del 1 al 7 de julio, tu uso de Fable 5 en esos planes puede consumir hasta la mitad de tu tope semanal sin cargo adicional. Después del 7 de julio, ese mismo uso pasa a cobrarse con usage credits, es decir, pago por consumo.

Aquí está la corrección importante: Fable 5 NO deja de estar disponible el 7 de julio. No es un modelo que “solo dure 7 días”. Sigue vivo y usable después; lo que cambia es de dónde sale el dinero, no si puedes llamarlo. Cualquiera que te diga que “Fable 5 se va tras la primera semana” está confundiendo disponibilidad con facturación.

Tras el 7 de julio: usage credits = tarifas API estándar (actívalos y ponles tope)

A partir del 7 de julio, si quieres seguir usando Fable 5 en tu plan después de agotar el uso incluido, entran los usage credits. Según el Centro de Ayuda de Claude, los usage credits dejan que suscriptores Pro, Max y Team sigan usando Claude tras alcanzar sus límites de uso incluidos, facturados a tarifas de precio API estándar. Es prepago y tú controlas el gasto.

Cómo activarlos, sin sorpresas en la factura:

  1. Abre Settings > UsageBusca la sección 'Usage credits' en la configuración de tu cuenta.
  2. Haz clic en EnableHabilitas el pago por consumo tras agotar el uso incluido, en lugar de bloquearte.
  3. Pon un tope mensual con Adjust limitLimita el costo, o déjalo unlimited si aceptas gasto abierto.
  4. Prepaga y monitoreaEl crédito es prepago; vigila el panel de Usage para que el gasto de Fable 5 siga visible.

Mi recomendación práctica: activa el límite mensual con “Adjust limit” y un número que puedas justificar. Dejarlo en unlimited es cómodo hasta que un job de volumen se come el presupuesto del mes en una tarde. Como el crédito se factura a tarifas API estándar, cada millón de tokens de Fable 5 que consumas ahí cuesta lo mismo que en la API pura: $10 de entrada y $50 de salida. Desarrollo esta ruta a fondo en Fable 5 después del 7 de julio: usage credits y costos de API; y el complemento sobre la ventana incluida está en Fable 5 incluido hasta el 7 de julio.

En la API pura no hay semana gratis: Fable 5 cuesta $10/$50 por MTok, punto

Repito esto porque es donde más gente se equivoca al presupuestar: si tu producto llama a Fable 5 por la API, nunca tuviste una semana gratis y no la vas a tener. El model ID es claude-fable-5, el precio es $10 por MTok de entrada y $50 por MTok de salida, el contexto es de 1M de tokens y la salida llega hasta 128k, con adaptive thinking siempre encendido.

Model IDclaude-fable-5
Precio$10 / $50 por MTok (entrada/salida)
Contexto y salida1M de tokens de contexto; salida hasta 128k
Semana gratis en la APINo existe — la API se cobra todos los días.

La “primera semana incluida” del 1 al 7 de julio existe solo en Claude.ai y Claude Code (los planes de suscripción). En la API es pago por consumo desde el primer request. Si estás modelando el costo de una integración, usa $10/$50 desde el token cero y no restes ninguna semana.

# Fable 5 on the API is metered per token, always — no "free week".
# Input:  $10 / 1M tokens
# Output: $50 / 1M tokens
# A request with 40k input + 6k output tokens:
#   input  = 40000  / 1_000_000 * 10 = $0.40
#   output =  6000  / 1_000_000 * 50 = $0.30
#   total  = $0.70 per call

Mantén la factura bajo control: Opus 4.8 por defecto para código rutinario ($5/$25)

Aquí es donde se gana o se pierde el presupuesto real. No todo el trabajo necesita el modelo más caro. Para código rutinario y depuración, el default sensato es Opus 4.8 (claude-opus-4-8), a $5 / $25 por MTok: la mitad del precio de Fable 5, tanto en entrada como en salida.

Hay un bono nada menor: con el redespliegue, Anthropic añadió nuevos clasificadores de seguridad, y en las superficies de Anthropic una solicitud de Fable 5 bloqueada cae automáticamente a Opus 4.8. Opus 4.8 también da menos falsos positivos en tareas rutinarias de código y depuración, así que para ese trabajo no solo es más barato: suele estorbarte menos. Reserva Fable 5 para el razonamiento y el trabajo agéntico más duros, donde su capacidad extra sí se paga sola. Si te topas con rechazos, mira cómo manejar los rechazos del clasificador con fallback a Opus.

# Route by task difficulty, not by habit. Default cheap; escalate deliberately.
def pick_model(task: str) -> str:
    hard = {"multi_file_refactor", "deep_agentic", "novel_architecture"}
    # Opus 4.8: $5 / $25 per MTok — half the price, fewer false positives.
    # Fable 5:  $10 / $50 per MTok — reserve for the hardest work.
    return "claude-fable-5" if task in hard else "claude-opus-4-8"

Batch API (-50%) y prompt caching (~0.1x en lecturas) para trabajo de volumen

Cuando el trabajo es de volumen y no urgente, hay dos palancas que bajan la factura más que cualquier truco de prompt:

  • Batch API: procesa asíncrono y te cuesta -50% frente al mismo trabajo en línea. Ideal para clasificación masiva, evals, backfills o cualquier lote que puedas esperar.
  • Prompt caching: las lecturas de caché cuestan cerca de 0.1x del precio normal de entrada. Si tu prefijo (system más tools más contexto estable) se repite entre llamadas, cachéalo y paga casi nada por releerlo. El desglose fino está en prompt caching para bajar costos de tokens.
Fable 5, sin optimizar100
Opus 4.8 por defecto50
Batch API (-50%)50
Lecturas de caché (~0.1x)10

Estas palancas se combinan: Opus 4.8 a mitad de precio, enviado en batch a la mitad otra vez, leyendo un prefijo cacheado a un décimo — la misma carga puede caer a una fracción del costo ingenuo con Fable 5.

Un ejemplo de costo real: la misma tarea en Opus 4.8 vs Fable 5

Pongamos números en una tarea concreta de código: 50,000 tokens de entrada (los archivos relevantes más las instrucciones) y 8,000 tokens de salida (un parche y su explicación). Esto es lo que cuesta esa llamada en cada modelo.

{
  "task": "one code change: 50k input tokens, 8k output tokens",
  "opus_4_8": {
    "input_usd": 0.25,
    "output_usd": 0.20,
    "total_usd": 0.45
  },
  "fable_5": {
    "input_usd": 0.50,
    "output_usd": 0.40,
    "total_usd": 0.90
  },
  "note": "Fable 5 costs exactly 2x here. On the API this holds every day; on a subscription after July 7 the same ratio applies via usage credits."
}

Fable 5 cuesta exactamente 2x lo de Opus 4.8 con los mismos conteos de tokens, porque sus tarifas por token son justo el doble. Corre esa tarea mil veces al mes y la brecha es $450 contra $900. Si Opus 4.8 saca el trabajo rutinario — y para código rutinario casi siempre lo hace, con menos falsos positivos — son $450 ahorrados sin perder nada. Por eso el default a Opus 4.8 para lo rutinario no es tacañería: es aritmética.

Cuándo la capacidad extra de Fable 5 sí justifica los $10/$50

Nada de esto significa “nunca uses Fable 5”. Significa reservarlo para donde su capacidad de frontera cambia el resultado, no solo el gasto. Vale los $10 / $50 cuando la tarea es genuinamente frontier: trabajo agéntico profundo de varios pasos, arquitectura y razonamiento novedosos, problemas de gran contexto que necesitan sostener 1M tokens de forma coherente, o casos donde un resultado un poco mejor vale dinero real — una migración correcta, un bug que a Opus 4.8 se le sigue escapando, un plan que ahorra días.

La regla de decisión es simple. Si Opus 4.8 lo resuelve bien, Opus 4.8 es la llamada correcta a mitad de precio. Si no, o si la apuesta claramente justifica el modelo de frontera, ve por Fable 5 de forma deliberada — y que su costo sea una decisión, no un default.

Cierro con una calculadora autocontenida que puedes copiar a un script para comparar cualquier carga en ambos modelos — más el descuento de batch — antes de disparar el request.

PRICES = {  # USD per 1M tokens (input, output)
    "claude-opus-4-8": (5, 25),
    "claude-fable-5": (10, 50),
}

def cost(model: str, in_tok: int, out_tok: int, batch: bool = False) -> float:
    pin, pout = PRICES[model]
    total = in_tok / 1_000_000 * pin + out_tok / 1_000_000 * pout
    return total * 0.5 if batch else total  # Batch API is roughly -50%

# Default routine work to Opus 4.8; only escalate deliberately.
DEFAULT_MODEL = "claude-opus-4-8"

for m in PRICES:
    print(m, round(cost(m, 50_000, 8_000), 2),
          "batch:", round(cost(m, 50_000, 8_000, batch=True), 2))
# claude-opus-4-8 0.45 batch: 0.23
# claude-fable-5  0.90 batch: 0.45

Resumen para que no te sorprenda la factura: Fable 5 sigue disponible tras el 7 de julio; lo que cambia en los planes es que el uso pasa de incluido a usage credits a tarifas API estándar. En la API pura siempre pagas $10/$50, sin semana gratis. Enruta lo rutinario a Opus 4.8 ($5/$25), usa Batch (-50%) y prompt caching (~0.1x) en volumen, activa y topa tus usage credits en Settings > Usage, y guarda Fable 5 para el trabajo más duro. Para profundizar, ahí está el hub de agentes de IA.

Fuentes: Anthropic — Redeploying Fable 5 · Centro de Ayuda de Claude — Usage credits