Si no sabes por dónde empezar, usa Claude Opus 5.5 para establecer una referencia de calidad. Evalúa Fable 5.1 para razonamiento exigente y agentes de larga duración; compara Sonnet 5 para el desarrollo y la escritura cotidianos; y prueba primero Haiku 4.5 para tareas de baja latencia y gran volumen. Elige según la tasa de aceptación, la latencia y el coste total de tus tareas, no como si los nombres de los modelos formaran una clasificación universal.
Esta guía trata los modelos generales de Claude API de Anthropic. Las suscripciones de Claude, los planes de Claude Code y la facturación a través de AWS, Google Cloud u otras plataformas pueden diferir. Los modelos y precios cambian; la información se verificó con la documentación oficial de Anthropic el 25 de septiembre de 2026.
Modelos principales actuales: capacidades, contexto y precios estándar
| Modelo | API ID | Enfoque oficial | Contexto / salida máxima | Precio de entrada / salida (USD por millón de tokens) |
|---|---|---|---|---|
| Claude Fable 5.1 | claude-fable-5-1 |
Razonamiento exigente y agentes de larga duración | 1M / 128K | $10 / $50 |
| Claude Opus 5.5 | claude-opus-5-5 |
Programación agéntica prolongada y trabajo de conocimiento; Anthropic lo recomienda como punto de partida para la mayoría de las tareas | 1M / 128K | $4 / $20 |
| Claude Sonnet 5 | claude-sonnet-5 |
Equilibrio entre velocidad e inteligencia | 1M / 128K | $2 / $10 |
| Claude Haiku 4.5 | claude-haiku-4-5 |
El más rápido, con capacidad cercana a la frontera | 200K / 64K | $1 / $5 |
Estos son los precios base por token de la API propia de Anthropic. El prompt caching, la Batch API, el modo rápido, la residencia de datos y las plataformas en la nube pueden modificar la factura real. Consulta las tarifas vigentes de tu canal antes de preparar un presupuesto. Resumen de modelos · Precios de la API
Fable 5.1, Opus 5.5, Sonnet 5 y Haiku 4.5 admiten entrada de texto e imágenes, salida de texto, capacidades multilingües, visión y uso de herramientas. Sus diferencias principales están en el límite de capacidad, la velocidad, el coste y el tamaño del contexto, no en una simple lista de funciones disponibles o ausentes.
Cómo repartir el trabajo entre Opus, Sonnet y Haiku
Opus 5.5: establece una referencia de calidad útil
Anthropic recomienda empezar con Opus 5.5 si no tienes claro qué modelo elegir. Está orientado a programación agéntica prolongada y trabajo de conocimiento. Su precio estándar de API es de 4 USD por millón de tokens de entrada y 20 USD por millón de tokens de salida. El contexto de 1M y el límite de salida de 128K encajan con tareas que continúan a través de varios archivos y pasos.
Puedes evaluarlo primero en cambios complejos de repositorios, investigaciones con varias herramientas, síntesis de documentos extensos y flujos de trabajo empresariales con varios pasos. No tiene por qué ser tu opción predeterminada más barata: si una tarea tiene límites claros y es fácil de validar, compara Sonnet o Haiku con las mismas entradas.
Fable 5.1: sube de nivel solo cuando una tarea difícil lo requiera
Fable 5.1 está pensado para razonamiento exigente y agentes de larga duración. Sus tarifas de entrada y salida son 2,5 veces las de Opus 5.5. Inclúyelo en una evaluación si Opus 5.5, incluso con un nivel de esfuerzo mayor, no alcanza de forma consistente los criterios de aceptación, o si el valor de la tarea justifica el coste adicional.
No deduzcas solo por el nombre que sea automáticamente mejor para toda tarea de programación, investigación o contexto largo. Registra qué fallos, retrabajos o comprobaciones manuales reduce realmente y compara ese beneficio con el gasto adicional.
Sonnet 5: compáralo con Opus en el trabajo cotidiano
Sonnet 5 cuesta 2 USD por millón de tokens de entrada y 10 USD por millón de tokens de salida. Anthropic lo presenta como una combinación de velocidad e inteligencia. Es un candidato para cambios rutinarios de código, documentos, análisis, llamadas habituales a herramientas y tareas sensibles a la latencia.
Su precio unitario es la mitad del de Opus 5.5, pero eso no significa que el coste total de cada tarea sea exactamente la mitad. Los modelos pueden generar distintas cantidades de tokens de razonamiento, realizar un número diferente de llamadas a herramientas y reintentos, y requerir más o menos correcciones manuales. Compáralos con cargas de trabajo reales.
Haiku 4.5: úsalo en solicitudes acotadas y de gran volumen
Haiku 4.5 cuesta 1 USD por millón de tokens de entrada y 5 USD por millón de tokens de salida. Anthropic lo posiciona como su modelo actual más rápido. Su contexto es de 200K y su salida máxima es de 64K, ambos inferiores a los de los otros tres modelos generales principales.
La clasificación, extracción de campos, resúmenes breves, conversión de formato, preguntas sencillas y distribución por lotes son buenos puntos de partida. Define un esquema de salida y reglas de validación claros. Si la solicitud requiere planificación prolongada, juicio complejo o coordinación de herramientas en varios turnos, establece una ruta de escalado a Sonnet u Opus.
Costes que no aparecen en la tabla de precios
Prompt caching
El prompt caching de Anthropic reduce el coste de volver a leer contexto repetido. Las reglas estándar incluyen una escritura de caché de 5 minutos a 1,25 veces el precio base de entrada, una escritura de 1 hora a 2 veces ese precio y lecturas de caché que suelen costar 0,1 veces la tarifa base de entrada. Las lecturas son más baratas en Fable 5.1 y Opus 5.5: 0,025 y 0,05 veces sus tarifas base, respectivamente. El ahorro depende del coste de escritura y de las consultas posteriores que aprovechen la caché; calcúlalo para cada modelo. Detalles de caché y precios
Batch API
La Batch API está pensada para grandes volúmenes de solicitudes que pueden procesarse de forma asíncrona. Ofrece un descuento del 50% tanto en los tokens de entrada como en los de salida. No sirve si una interacción debe responder de inmediato, pero puede reducir el coste de clasificación, archivo, extracción y evaluación sin conexión.
Modo rápido de Opus
En la fecha de consulta, el modo rápido está disponible para Opus 5.5, Opus 5 y Opus 4.8 con tarifas superiores. El modo rápido de Opus 5.5 cuesta 8 USD por millón de tokens de entrada y 40 USD por millón de salida. Opus 5 y Opus 4.8 cuestan 10 / 50 USD. Solo está disponible en la API propia de Claude; no des por hecho que lo ofrecen Claude Platform on AWS u otras plataformas en la nube. Detalles del modo rápido
Qué hacer con modelos antiguos y de acceso restringido
Modelos antiguos como Opus 4.8, Opus 4.7 y Sonnet 4.6 pueden seguir apareciendo en configuraciones y flujos de migración existentes. Antes de migrar, comprueba el API ID exacto, la fecha de retirada, los límites de contexto, el prompt caching y el comportamiento del tokenizer. No sustituyas solo el nombre del modelo y cambies todo el tráfico de producción de inmediato. Evalúa las versiones antigua y nueva con el mismo conjunto de ejemplos anonimizados.
Mythos y otros modelos de vista previa restringida no se incluyen en la comparación de modelos de disponibilidad general. Evalúalos solo si tu cuenta y plataforma tienen acceso autorizado. Que aparezca un nombre de modelo en una noticia o interfaz de terceros no significa que tu proyecto de API pueda invocarlo.
Decide el modelo predeterminado con tus propias tareas
Prepara un conjunto anonimizado que represente el trabajo diario e incluya solicitudes exitosas, entradas límite, fallos anteriores, errores de herramientas y tareas con contexto extenso. Mantén fijos los prompts, las definiciones de herramientas, los límites de salida y los criterios de aceptación. Compara primero Opus 5.5 y Sonnet 5; añade Fable 5.1 solo si los ejemplos más difíciles siguen sin aprobar. Prueba Haiku 4.5 por separado en solicitudes sencillas y de gran volumen.
Registra estas medidas:
| Medida | Qué registrar |
|---|---|
| Calidad de la tarea | Si supera los mismos criterios de aceptación y qué tipos de errores aparecen |
| Coste real | Entrada, salida, caché, reintentos y cargos adicionales de herramientas |
| Tiempo de finalización | Tiempo hasta el primer token y tiempo total de extremo a extremo |
| Retrabajo manual | Tiempo dedicado a revisar, editar y volver a ejecutar |
| Fiabilidad de las herramientas | Si las llamadas son correctas y los fallos se recuperan bien |
Fija primero el nivel mínimo de calidad y después compara el coste total de las tareas aprobadas. Una política de enrutamiento práctica podría usar Haiku para clasificar, Sonnet para el trabajo cotidiano, Opus para los casos difíciles y Fable solo para unas pocas tareas largas y de gran valor. Un producto no necesita usar un único modelo para todas las solicitudes.
Comparaciones anteriores de Claude en este sitio
La guía anterior para elegir entre Claude Fable, Opus, Sonnet y Haiku, junto con el borrador sobre Opus 4.7, Sonnet 4.6 y Haiku 4.5, se ha consolidado aquí. Esta guía actualiza los modelos principales, los precios y el contexto. Las URL anteriores ahora redirigen directamente a este artículo, que pasa a ser la referencia vigente para elegir modelo.
Fuentes oficiales
- Claude Models Overview: recomendaciones actuales, API ID, contexto y límites de salida.
- Claude API Pricing: precios base, prompt caching, Batch API, residencia de datos y modo rápido.