← Artículos

Claude Opus 5: precio real por millón de tokens

· 5 min de lectura

Claude Opus 5 cuesta $5 por millón de tokens de entrada y $25 por millón de tokens de salida en la API de Anthropic. Es el mismo precio que Claude Opus 4.8 y la mitad de lo que cobra Claude Fable 5. Con la Batch API el costo baja a $2.50 y $12.50 por millón.

Anthropic lanzó Claude Opus 5 y lo dejó al mismo precio que su antecesor: no subió ni un dólar por token. Esta es la versión con los números al lado, tomados de la documentación oficial de precios y no de la nota de prensa.

Cuánto cuesta Claude Opus 5

En la API de Anthropic, la tarifa base por millón de tokens es:

La ventana de contexto de 1 millón de tokens entra en esa misma tarifa. Una petición de 900.000 tokens se cobra al mismo precio por token que una de 9.000: no hay recargo por contexto largo, y los descuentos de caché y batch aplican en toda la ventana.

Para que el número aterrice: una sesión que consume 50.000 tokens de entrada y 15.000 de salida te cuesta $0.25 más $0.375. Menos de un dólar por una hora de trabajo del modelo.

Cómo se compara con el resto de la familia

Precio por millón de tokens, entrada y salida:

De ahí salen las dos únicas conclusiones que importan. Opus 5 cuesta exactamente la mitad que Fable 5, el modelo más capaz que Anthropic tiene disponible. Y cuesta lo mismo que Opus 4.8, así que si ya venías pagando esa tarifa, cambiar de modelo no te mueve la factura por token.

Cómo pagar menos por el mismo modelo

  1. Usa la Batch API. 50% de descuento en entrada y salida: $2.50 y $12.50 por millón. Es asíncrona, así que sirve para lo que no necesitas ya mismo.
  2. Activa la caché de prompt. Escribir la caché cuesta 1.25 veces la entrada; leerla cuesta el 10%. Con una sola lectura ya recuperas la escritura de 5 minutos.
  3. Baja el nivel de esfuerzo. El parámetro `effort` controla cuántos tokens gasta el modelo en toda la respuesta, incluidas las llamadas a herramientas. En niveles bajos hace menos llamadas y responde más corto.
  4. No uses Opus para todo. Sonnet 5 cuesta $2 y $10 por millón, y Haiku 4.5 baja a $1 y $5. Para clasificar, resumir o etiquetar, Opus es dinero quemado.

Los descuentos se apilan: un batch con caché activa paga el 50% sobre una tarifa que ya venía rebajada.

Qué puede salir mal con la factura

El dato honesto

Opus 5 no es el modelo más capaz del catálogo de Anthropic. La propia documentación recomienda empezar por Opus 5 para código agéntico y trabajo de empresa, y pasar a Claude Fable 5 cuando necesitas la capacidad más alta disponible. Pagar la mitad tiene ese costo.

Y el control de esfuerzo no son tres niveles: son cinco, de `low` a `max`, pasando por `medium`, `high` y `xhigh`. Por defecto la API corre en `high`, así que si nunca tocas ese parámetro estás pagando un nivel alto sin haberlo decidido. Un detalle más que no está en el titular: en Claude Opus 5 no puedes apagar el razonamiento en `xhigh` ni en `max`; esa combinación devuelve un error 400.

Preguntas frecuentes

¿Cuánto cuesta Claude Opus 5 por millón de tokens?
Claude Opus 5 cuesta $5 por millón de tokens de entrada y $25 por millón de tokens de salida en la API de Anthropic. Esa tarifa cubre toda la ventana de contexto de 1 millón de tokens, sin recargo por contexto largo. Con la Batch API los mismos tokens cuestan $2.50 y $12.50 por millón.
¿Claude Opus 5 es más caro que Claude Opus 4.8?
No, cuesta exactamente lo mismo. Claude Opus 4.8 también se cobra a $5 por millón de tokens de entrada y $25 por millón de salida. Anthropic mantuvo la tarifa en el cambio de modelo, así que migrar de Opus 4.8 a Opus 5 no te cambia el precio por token.
¿Por qué Claude Opus 5 cuesta la mitad que Claude Fable 5?
Porque son modelos para trabajos distintos. Claude Fable 5 se cobra a $10 y $50 por millón de tokens y es el modelo más capaz que Anthropic tiene disponible al público. Opus 5 está pensado para código agéntico y trabajo de empresa del día a día, y por eso sale a la mitad de precio.
¿Cómo bajo el costo de Claude Opus 5 sin cambiar de modelo?
Hay tres palancas y se pueden combinar. La Batch API descuenta 50% en entrada y salida, la caché de prompt cobra la lectura al 10% del precio de entrada, y bajar el parámetro effort reduce los tokens que gasta el modelo en toda la respuesta. Lo que no baja el costo es cambiar el prompt para pedir respuestas cortas.

Fuentes

MÁQUINA IA

La comunidad donde dejas de usar IA y empiezas a dirigirla.

Entrar a la comunidad →