Cómo elegir un modelo Claude de Anthropic: Fable 5.1, Opus 5.5, Sonnet 5 y Haiku 4.5

Compara los modelos Claude actuales de Anthropic por función, API ID, contexto, límite de salida y precio estándar, y descubre cómo distribuir el trabajo entre Opus, Sonnet y Haiku.

Si no sabes por dónde empezar, usa Claude Opus 5.5 para establecer una referencia de calidad. Evalúa Fable 5.1 para razonamiento exigente y agentes de larga duración; compara Sonnet 5 para el desarrollo y la escritura cotidianos; y prueba primero Haiku 4.5 para tareas de baja latencia y gran volumen. Elige según la tasa de aceptación, la latencia y el coste total de tus tareas, no como si los nombres de los modelos formaran una clasificación universal.

Esta guía trata los modelos generales de Claude API de Anthropic. Las suscripciones de Claude, los planes de Claude Code y la facturación a través de AWS, Google Cloud u otras plataformas pueden diferir. Los modelos y precios cambian; la información se verificó con la documentación oficial de Anthropic el 25 de septiembre de 2026.

Modelos principales actuales: capacidades, contexto y precios estándar

Modelo API ID Enfoque oficial Contexto / salida máxima Precio de entrada / salida (USD por millón de tokens)
Claude Fable 5.1 claude-fable-5-1 Razonamiento exigente y agentes de larga duración 1M / 128K $10 / $50
Claude Opus 5.5 claude-opus-5-5 Programación agéntica prolongada y trabajo de conocimiento; Anthropic lo recomienda como punto de partida para la mayoría de las tareas 1M / 128K $4 / $20
Claude Sonnet 5 claude-sonnet-5 Equilibrio entre velocidad e inteligencia 1M / 128K $2 / $10
Claude Haiku 4.5 claude-haiku-4-5 El más rápido, con capacidad cercana a la frontera 200K / 64K $1 / $5

Estos son los precios base por token de la API propia de Anthropic. El prompt caching, la Batch API, el modo rápido, la residencia de datos y las plataformas en la nube pueden modificar la factura real. Consulta las tarifas vigentes de tu canal antes de preparar un presupuesto. Resumen de modelos · Precios de la API

Fable 5.1, Opus 5.5, Sonnet 5 y Haiku 4.5 admiten entrada de texto e imágenes, salida de texto, capacidades multilingües, visión y uso de herramientas. Sus diferencias principales están en el límite de capacidad, la velocidad, el coste y el tamaño del contexto, no en una simple lista de funciones disponibles o ausentes.

Cómo repartir el trabajo entre Opus, Sonnet y Haiku

Opus 5.5: establece una referencia de calidad útil

Anthropic recomienda empezar con Opus 5.5 si no tienes claro qué modelo elegir. Está orientado a programación agéntica prolongada y trabajo de conocimiento. Su precio estándar de API es de 4 USD por millón de tokens de entrada y 20 USD por millón de tokens de salida. El contexto de 1M y el límite de salida de 128K encajan con tareas que continúan a través de varios archivos y pasos.

Puedes evaluarlo primero en cambios complejos de repositorios, investigaciones con varias herramientas, síntesis de documentos extensos y flujos de trabajo empresariales con varios pasos. No tiene por qué ser tu opción predeterminada más barata: si una tarea tiene límites claros y es fácil de validar, compara Sonnet o Haiku con las mismas entradas.

Fable 5.1: sube de nivel solo cuando una tarea difícil lo requiera

Fable 5.1 está pensado para razonamiento exigente y agentes de larga duración. Sus tarifas de entrada y salida son 2,5 veces las de Opus 5.5. Inclúyelo en una evaluación si Opus 5.5, incluso con un nivel de esfuerzo mayor, no alcanza de forma consistente los criterios de aceptación, o si el valor de la tarea justifica el coste adicional.

No deduzcas solo por el nombre que sea automáticamente mejor para toda tarea de programación, investigación o contexto largo. Registra qué fallos, retrabajos o comprobaciones manuales reduce realmente y compara ese beneficio con el gasto adicional.

Sonnet 5: compáralo con Opus en el trabajo cotidiano

Sonnet 5 cuesta 2 USD por millón de tokens de entrada y 10 USD por millón de tokens de salida. Anthropic lo presenta como una combinación de velocidad e inteligencia. Es un candidato para cambios rutinarios de código, documentos, análisis, llamadas habituales a herramientas y tareas sensibles a la latencia.

Su precio unitario es la mitad del de Opus 5.5, pero eso no significa que el coste total de cada tarea sea exactamente la mitad. Los modelos pueden generar distintas cantidades de tokens de razonamiento, realizar un número diferente de llamadas a herramientas y reintentos, y requerir más o menos correcciones manuales. Compáralos con cargas de trabajo reales.

Haiku 4.5: úsalo en solicitudes acotadas y de gran volumen

Haiku 4.5 cuesta 1 USD por millón de tokens de entrada y 5 USD por millón de tokens de salida. Anthropic lo posiciona como su modelo actual más rápido. Su contexto es de 200K y su salida máxima es de 64K, ambos inferiores a los de los otros tres modelos generales principales.

La clasificación, extracción de campos, resúmenes breves, conversión de formato, preguntas sencillas y distribución por lotes son buenos puntos de partida. Define un esquema de salida y reglas de validación claros. Si la solicitud requiere planificación prolongada, juicio complejo o coordinación de herramientas en varios turnos, establece una ruta de escalado a Sonnet u Opus.

Costes que no aparecen en la tabla de precios

Prompt caching

El prompt caching de Anthropic reduce el coste de volver a leer contexto repetido. Las reglas estándar incluyen una escritura de caché de 5 minutos a 1,25 veces el precio base de entrada, una escritura de 1 hora a 2 veces ese precio y lecturas de caché que suelen costar 0,1 veces la tarifa base de entrada. Las lecturas son más baratas en Fable 5.1 y Opus 5.5: 0,025 y 0,05 veces sus tarifas base, respectivamente. El ahorro depende del coste de escritura y de las consultas posteriores que aprovechen la caché; calcúlalo para cada modelo. Detalles de caché y precios

Batch API

La Batch API está pensada para grandes volúmenes de solicitudes que pueden procesarse de forma asíncrona. Ofrece un descuento del 50% tanto en los tokens de entrada como en los de salida. No sirve si una interacción debe responder de inmediato, pero puede reducir el coste de clasificación, archivo, extracción y evaluación sin conexión.

Modo rápido de Opus

En la fecha de consulta, el modo rápido está disponible para Opus 5.5, Opus 5 y Opus 4.8 con tarifas superiores. El modo rápido de Opus 5.5 cuesta 8 USD por millón de tokens de entrada y 40 USD por millón de salida. Opus 5 y Opus 4.8 cuestan 10 / 50 USD. Solo está disponible en la API propia de Claude; no des por hecho que lo ofrecen Claude Platform on AWS u otras plataformas en la nube. Detalles del modo rápido

Qué hacer con modelos antiguos y de acceso restringido

Modelos antiguos como Opus 4.8, Opus 4.7 y Sonnet 4.6 pueden seguir apareciendo en configuraciones y flujos de migración existentes. Antes de migrar, comprueba el API ID exacto, la fecha de retirada, los límites de contexto, el prompt caching y el comportamiento del tokenizer. No sustituyas solo el nombre del modelo y cambies todo el tráfico de producción de inmediato. Evalúa las versiones antigua y nueva con el mismo conjunto de ejemplos anonimizados.

Mythos y otros modelos de vista previa restringida no se incluyen en la comparación de modelos de disponibilidad general. Evalúalos solo si tu cuenta y plataforma tienen acceso autorizado. Que aparezca un nombre de modelo en una noticia o interfaz de terceros no significa que tu proyecto de API pueda invocarlo.

Decide el modelo predeterminado con tus propias tareas

Prepara un conjunto anonimizado que represente el trabajo diario e incluya solicitudes exitosas, entradas límite, fallos anteriores, errores de herramientas y tareas con contexto extenso. Mantén fijos los prompts, las definiciones de herramientas, los límites de salida y los criterios de aceptación. Compara primero Opus 5.5 y Sonnet 5; añade Fable 5.1 solo si los ejemplos más difíciles siguen sin aprobar. Prueba Haiku 4.5 por separado en solicitudes sencillas y de gran volumen.

Registra estas medidas:

Medida Qué registrar
Calidad de la tarea Si supera los mismos criterios de aceptación y qué tipos de errores aparecen
Coste real Entrada, salida, caché, reintentos y cargos adicionales de herramientas
Tiempo de finalización Tiempo hasta el primer token y tiempo total de extremo a extremo
Retrabajo manual Tiempo dedicado a revisar, editar y volver a ejecutar
Fiabilidad de las herramientas Si las llamadas son correctas y los fallos se recuperan bien

Fija primero el nivel mínimo de calidad y después compara el coste total de las tareas aprobadas. Una política de enrutamiento práctica podría usar Haiku para clasificar, Sonnet para el trabajo cotidiano, Opus para los casos difíciles y Fable solo para unas pocas tareas largas y de gran valor. Un producto no necesita usar un único modelo para todas las solicitudes.

Comparaciones anteriores de Claude en este sitio

La guía anterior para elegir entre Claude Fable, Opus, Sonnet y Haiku, junto con el borrador sobre Opus 4.7, Sonnet 4.6 y Haiku 4.5, se ha consolidado aquí. Esta guía actualiza los modelos principales, los precios y el contexto. Las URL anteriores ahora redirigen directamente a este artículo, que pasa a ser la referencia vigente para elegir modelo.

Fuentes oficiales