Última actualización: 25 de julio de 2026
Anthropic tiene ahora dos modelos Claude sólidos en el segmento medio-premium: Claude Opus 5 (lanzado el 24 de julio de 2026) y Claude Sonnet 5 (lanzado el 30 de junio de 2026). Ambos comparten la misma ventana de contexto de 1M de tokens y una salida máxima de 128K. Ambos admiten pensamiento adaptativo. Ambos están disponibles en Claude Code, en la API y en todos los planes de Claude. La pregunta ya no es “cuál es mejor”, sino “cuál es mejor para tu carga de trabajo”.
Respuesta rápida: Opus 5 ($5/$25 por MTok) es el modelo premium: SOTA en Frontier-Bench, 3x el siguiente mejor en ARC-AGI 3 y a menos de 0.5% de Fable 5 en CursorBench a la mitad del costo. Sonnet 5 ($3/$15, precio de lanzamiento $2/$10 hasta el 31 de agosto) cubre la programación diaria, la investigación y el trabajo profesional a un precio más bajo. Opus 5 tiene un corte de conocimiento de mayo de 2026; el de Sonnet 5 es de enero de 2026. Empieza con Sonnet 5 para trabajo sensible al costo; usa Opus 5 cuando la precisión en tareas complejas de varios pasos justifique el precio premium.
| Comparación | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|
| Fecha de lanzamiento | 24 de julio de 2026 | 30 de junio de 2026 |
| Precio base | $5 / $25 por MTok | $3 / $15 por MTok (lanzamiento: $2 / $10 hasta el 31 de agosto) |
| Ventana de contexto | 1M de tokens | 1M de tokens |
| Salida máxima | 128K tokens | 128K tokens |
| Corte de conocimiento | Mayo de 2026 | Enero de 2026 |
| Frontier-Bench v0.1 | SOTA (2x+ Opus 4.8) | No reportado |
| SWE-bench Verified | No reportado individualmente | 85.2% |
| SWE-bench Pro | No reportado individualmente | 63.2% |
| ARC-AGI 3 | 3x el siguiente mejor modelo | No reportado |
| Terminal-Bench 2.1 | No reportado individualmente | 80.4% |
| BrowseComp | No reportado individualmente | 84.7% |
| Retención de datos | Admite retención cero de datos | Admite retención cero de datos |
| Modelo por defecto en la app de Claude | Max (por defecto); Pro (el más potente) | Free y Pro (por defecto) |
| Modo rápido | Sí (~2.5x de velocidad a 2x el precio) | No disponible |
| Ideal para | Programación compleja, agentes, empresa, ciencia | Programación diaria, investigación, producción de alto volumen |
Verified 25 de julio de 2026
- Lineup y especificaciones de los modelos: Resumen de modelos de Anthropic
- Página de producto de Opus: Claude Opus
- Precios: Precios de la API de Claude
- Lanzamiento de Opus 5: Presentamos Claude Opus 5
- Lanzamiento de Sonnet 5: Presentamos Claude Sonnet 5
- Seguridad de Sonnet 5: System Card de Claude Sonnet 5
El acceso a los modelos, los precios y el empaquetado de los planes pueden cambiar. Verifica los detalles en vivo antes de tomar decisiones de producción.
Qué es cada modelo
Claude Opus 5 es el modelo más nuevo de la clase Opus de Anthropic: el nivel premium para el día a día. Ofrece una inteligencia cercana a Fable 5 a la mitad del precio, con el corte de conocimiento más reciente de cualquier modelo Claude (mayo de 2026). En Frontier-Bench v0.1 más que duplica la puntuación de Opus 4.8 y supera a todos los demás modelos. En CursorBench 3.2 rinde a menos de 0.5% del máximo de Fable 5. Es el modelo por defecto en Claude Max y el modelo más potente en Claude Pro.
Claude Sonnet 5 es el modelo más nuevo de la clase Sonnet de Anthropic: el nivel de trabajo diario. Lanzado el 30 de junio de 2026, está diseñado para trabajo agéntico: programación, uso de herramientas, automatización del navegador, investigación y realización de tareas profesionales. Es el modelo por defecto en Claude Free y Pro, y su precio de lanzamiento ($2/$10 por MTok hasta el 31 de agosto) lo convierte en la puerta de entrada más rentable a la generación Claude 5.
El posicionamiento es claro: Sonnet 5 es el modelo que pruebas primero; Opus 5 es el modelo al que escalas cuando la precisión en tareas difíciles justifica el precio premium.
Comparación de benchmarks
Los datos de benchmarks de estos dos modelos provienen de fuentes distintas: los materiales de lanzamiento de Opus 5 de Anthropic destacan Frontier-Bench, ARC-AGI 3 y OSWorld 2.0, mientras que la System Card de Sonnet 5 reporta SWE-bench, Terminal-Bench y BrowseComp. Cuando ambos modelos reportan el mismo benchmark, la comparación es directa. Cuando no, toma los datos como orientativos.
Programación e ingeniería de software
| Benchmark | Claude Opus 5 | Claude Sonnet 5 | Claude Fable 5 | Claude Opus 4.8 | Qué mide |
|---|---|---|---|---|---|
| Frontier-Bench v0.1 | SOTA (2x+ Opus 4.8) | — | — | Línea base | Tareas valiosas de ingeniería de software |
| CursorBench 3.2 (esfuerzo máximo) | A menos de 0.5% de Fable 5 | — | Máximo | — | Programación en el mundo real en Cursor |
| SWE-bench Verified | — | 85.2% | 95.0% | — | Resolución de issues reales de GitHub |
| SWE-bench Pro | — | 63.2% | 80.3% | 69.2% | Ingeniería de software de largo horizonte |
| SWE-bench Multilingual | — | 78.3% | — | — | Tareas de software en 9 lenguajes |
| Terminal-Bench 2.1 | — | 80.4% | 88.0% | 82.7% | Tareas de terminal y línea de comandos |
| FrontierCode v1 | — | 38.8% | — | — | Programación agéntica en PRs reales |
Tres observaciones:
- Los benchmarks estrella de Opus 5 son distintos de los de Sonnet 5. El lanzamiento de Opus 5 destaca Frontier-Bench (donde es SOTA) y CursorBench (donde casi iguala a Fable 5). La System Card de Sonnet 5 reporta SWE-bench y Terminal-Bench. La falta de benchmarks superpuestos hace que una comparación directa de programación sea imprecisa.
- Donde Sonnet 5 reporta puntuaciones, son sólidas pero inferiores a Fable 5 y Opus 4.8 en las pruebas más difíciles. El 63.2% de Sonnet 5 en SWE-bench Pro queda por debajo del 69.2% de Opus 4.8 y del 80.3% de Fable 5. Opus 5 no reporta SWE-bench Pro individualmente, pero sus resultados en Frontier-Bench y CursorBench sugieren que está al nivel de Opus 4.8 o por encima.
- Ambos son mejoras importantes sobre sus predecesores. Opus 5 más que duplica a Opus 4.8 en Frontier-Bench. Sonnet 5 más que duplica a Sonnet 4.6 en FrontierCode (38.8% vs 15.1%).
Razonamiento, agentes y trabajo de conocimiento
| Benchmark | Claude Opus 5 | Claude Sonnet 5 | Qué mide |
|---|---|---|---|
| ARC-AGI 3 | 3x el siguiente mejor modelo | No reportado | Resolución de problemas nuevos |
| GDPval-AA v2 | SOTA | 1609 Elo | Trabajo de conocimiento profesional |
| Zapier AutomationBench | ~1.5x el siguiente mejor (100% de aprobación) | 13.5% | Automatización de tareas de negocio |
| OSWorld 2.0 | Supera a Fable 5 a 1/3 del costo | 81.2% (OSWorld-Verified) | Tareas de uso de computadora |
| BrowseComp | No reportado | 84.7% (agente único) | Búsqueda web y localización de información |
| HLE (sin herramientas) | El mejor de su clase | 43.2% | Conocimiento experto |
| HLE (con herramientas) | El mejor de su clase | 57.4% | Conocimiento experto con herramientas |
| DeepSearchQA | El mejor de su clase | No reportado | Investigación profunda y búsqueda |
Opus 5 domina en los benchmarks de razonamiento intensivo y agénticos. Sonnet 5 se defiende bien en tareas asistidas por herramientas (BrowseComp, HLE con herramientas) y en uso de computadora (81.2% en OSWorld-Verified), pero la brecha se amplía en razonamiento novedoso (ARC-AGI 3) y trabajo de conocimiento profesional (GDPval-AA).
Ciencia y dominios especializados
Opus 5 supera a Opus 4.8 en todas las evaluaciones de ciencias de la vida, incluyendo +10.2 puntos en química orgánica y +7.7 puntos en predicción de función de proteínas. Ahora es el modelo generalmente disponible más capaz de Anthropic para investigación científica, ya que las salvaguardas de biología de Fable 5 son más restrictivas. La System Card de Sonnet 5 no enfatiza benchmarks científicos.
Toma los benchmarks publicados por los proveedores como orientativos. Valida con tu propia carga de trabajo antes de comprometer presupuesto.
Comparación de precios
Ambos modelos usan precios por millón de tokens. Sonnet 5 tiene un precio de lanzamiento temporal hasta el 31 de agosto de 2026.
| Componente de precio | Claude Opus 5 | Claude Sonnet 5 | Lanzamiento de Sonnet 5 (hasta el 31 de agosto) |
|---|---|---|---|
| Entrada base | $5 / MTok | $3 / MTok | $2 / MTok |
| Salida base | $25 / MTok | $15 / MTok | $10 / MTok |
| Escritura de caché de 5 minutos | $6.25 / MTok | $3.75 / MTok | $2.50 / MTok |
| Escritura de caché de 1 hora | $10 / MTok | $6 / MTok | $4 / MTok |
| Aciertos y actualizaciones de caché | $0.50 / MTok | $0.30 / MTok | $0.20 / MTok |
| Entrada de Batch API | $2.50 / MTok | $1.50 / MTok | $1 / MTok |
| Salida de Batch API | $12.50 / MTok | $7.50 / MTok | $5 / MTok |
| Entrada en modo rápido | $10 / MTok | — | — |
| Salida en modo rápido | $50 / MTok | — | — |
La relación de precios es aproximadamente de 1.67x con el precio estándar ($5/$3 de entrada, $25/$15 de salida) y de 2.5x durante el periodo de lanzamiento de Sonnet 5 ($5/$2 de entrada, $25/$10 de salida).
Estrategia de costos:
- Durante el precio de lanzamiento (hasta el 31 de agosto): Sonnet 5 es excepcionalmente competitivo. Para trabajo de alto volumen donde una calidad cercana a Opus es suficiente, es la opción por defecto clara.
- Después del 31 de agosto: La relación de 1.67x significa que Opus 5 cuesta cerca de 67% más por token. Si Opus 5 completa las tareas en menos turnos y con menos reintentos, la brecha de costo efectiva se reduce.
- El caché de prompts reduce los costos de ambos modelos hasta en 90% en contexto repetido. Los aciertos de caché cuestan $0.50/MTok en Opus 5 y $0.30/MTok en Sonnet 5.
- El modo rápido es exclusivo de Opus 5: aproximadamente 2.5x de velocidad a 2x el precio base ($10/$50 por MTok). Sonnet 5 no tiene modo rápido.
Advertencia sobre el tokenizador: Sonnet 5 usa un tokenizador actualizado. La misma entrada puede convertirse en aproximadamente 1.0x a 1.35x más tokens en comparación con Sonnet 4.6, según el tipo de contenido. Mide prompts reales en lugar de estimar a partir de conteos de tokens antiguos.
Comparación de funciones
| Función | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|
| Ventana de contexto | 1M de tokens | 1M de tokens |
| Salida máxima | 128K tokens (300K vía Batch API) | 128K tokens |
| Corte de conocimiento | Mayo de 2026 | Enero de 2026 |
| Pensamiento | Adaptativo (esfuerzo configurable) | Adaptativo (esfuerzo configurable) |
| Esfuerzo por defecto | high en la API y Claude Code | Configurable |
| Retención de datos | Admite retención cero de datos | Admite retención cero de datos |
| Modo rápido | Sí (~2.5x de velocidad a 2x el precio) | No |
| Inferencia solo en EE. UU. | Disponible a 1.1x el precio | Consulta la disponibilidad actual |
| Salvaguardas cibernéticas | ~85% menos intervenciones del clasificador que Fable 5 | Activadas por defecto; menos capaz en tareas cibernéticas peligrosas que Opus/Mythos |
| Salvaguardas de biología | Menos restrictivas; el mejor modelo GA para ciencia | Salvaguardas estándar |
| Alineación | El modelo Claude más alineado; el menor comportamiento engañoso | Más seguro que Sonnet 4.6; mayor comportamiento desalineado que Opus/Mythos en algunas evaluaciones |
| Claude Free | No disponible | Modelo por defecto |
| Claude Pro | El modelo más potente en Pro | Modelo por defecto |
| Claude Max | Modelo por defecto | Disponible |
| Claude Team / Enterprise | Disponible | Disponible |
| Claude Code | Disponible | Disponible |
| ID del modelo en la API | claude-opus-5 | claude-sonnet-5 |
La brecha de cuatro meses en el corte de conocimiento importa más de lo que parece. Si tu trabajo involucra bibliotecas, APIs, regulaciones o eventos recientes de febrero a mayo de 2026, Opus 5 tiene conocimiento confiable que Sonnet 5 no tiene.
Cuándo usar Opus 5 vs Sonnet 5
| Pregunta | Empieza con | Razón |
|---|---|---|
| ¿La tarea es programación compleja de varios pasos o trabajo agéntico? | Opus 5 | SOTA en Frontier-Bench; casi Fable 5 en CursorBench |
| ¿Es programación diaria, investigación o trabajo profesional? | Sonnet 5 | Rendimiento sólido a menor costo |
| ¿Necesitas el conocimiento más fresco (posterior a enero de 2026)? | Opus 5 | Corte de mayo de 2026 vs enero de 2026 |
| ¿El trabajo es de alto volumen y sensible al costo? | Sonnet 5 | 1.67x más barato a precio estándar; 2.5x más barato durante el lanzamiento |
| ¿Estás construyendo agentes de IA en producción? | Opus 5 (por defecto) o Sonnet 5 (sensible al costo) | Prueba ambos; Opus 5 tiene mejor autoverificación |
| ¿Es investigación científica? | Opus 5 | El mejor modelo GA para ciencia; menos restricciones de biología |
| ¿Necesitas retención cero de datos? | Ambos funcionan | Ambos admiten ZDR; Fable 5 no |
| ¿El trabajo está relacionado con ciberseguridad? | Opus 5 | 85% menos intervenciones del clasificador que Fable 5; más fuerte que Sonnet 5 |
| ¿Estás en Claude Free? | Sonnet 5 | Opus 5 no está disponible en Free |
| ¿Necesitas el modo rápido para trabajo sensible a la latencia? | Opus 5 | El modo rápido es exclusivo de Opus 5 |
| ¿El fallo es costoso y la revisión humana es limitada? | Opus 5 | Mejor juicio, autoverificación y capacidad de objetar |
| ¿Estás prototipando o experimentando? | Sonnet 5 (precio de lanzamiento) | $2/$10 por MTok hasta el 31 de agosto es muy competitivo |
La mejor métrica es el costo por tarea exitosa, no el precio por token. Las ganancias de eficiencia de Opus 5 —menos reintentos, menos tokens, menos latencia— hacen que en la práctica pueda ser más barato que un modelo de menor precio que necesita más iteraciones.
Desglose por caso de uso
Programación
Ganador: Opus 5 para trabajo complejo; Sonnet 5 para tareas diarias.
Opus 5 es SOTA en Frontier-Bench v0.1 y está a menos de 0.5% de Fable 5 en CursorBench 3.2. Los clientes reportan que detecta sus propios errores, verifica su trabajo en un navegador en anchos de escritorio y móvil, y maneja migraciones multiarchivo que los modelos Opus anteriores no podían. Usa menos tokens en niveles de esfuerzo más altos: un cliente reporta 1/7 de los tokens de razonamiento y la mitad de la latencia de Opus 4.8.
Sonnet 5 obtiene 85.2% en SWE-bench Verified y 80.4% en Terminal-Bench 2.1: resultados sólidos para la programación diaria. Maneja bien correcciones de bugs, generación de tests, refactorizaciones y triaje de CI. Pero en las tareas de largo horizonte más difíciles (SWE-bench Pro: 63.2%), queda por detrás de Opus 4.8 (69.2%) y Fable 5 (80.3%).
Configuración práctica: Usa Sonnet 5 como predeterminado en Claude Code. Escala a Opus 5 para depuración compleja, refactorizaciones multi-repo y tareas donde Sonnet 5 falla o necesita varios reintentos. Consulta Los mejores agentes de IA para programar en 2026 para ver el panorama general.
Agentes
Ganador: Opus 5 para agentes en producción; Sonnet 5 para agentes sensibles al costo.
Los benchmarks agénticos de Opus 5 son dominantes: 3x el siguiente mejor en ARC-AGI 3, ~1.5x el siguiente mejor en Zapier AutomationBench (con una tasa de aprobación del 100%) y superando a Fable 5 en OSWorld 2.0 a un tercio del costo. Su comportamiento de autoverificación —comprobar supuestos, contrastar resultados con métodos independientes— lo hace más confiable para flujos de trabajo largos y de varios pasos.
Sonnet 5 está diseñado para trabajo agéntico y mejora significativamente sobre Sonnet 4.6 en uso de herramientas, automatización del navegador y tareas de flujos de trabajo de negocio. Su 84.7% en BrowseComp y su 57.4% en HLE con herramientas muestran un razonamiento asistido por herramientas sólido. Pero todavía muestra tasas más altas de ciertos comportamientos desalineados que los modelos Opus en las evaluaciones internas de Anthropic.
Configuración práctica: Usa Sonnet 5 como primera pasada. Si la tarea falla o la confianza es baja, deriva a Opus 5. Un humano revisa las salidas de alto riesgo antes del despliegue.
Escritura y creación de contenido
Ganador: Sonnet 5 para la mayoría de la escritura; Opus 5 para profundidad analítica.
Para redactar, editar y producir contenido, Sonnet 5 ofrece mejor valor. Maneja publicaciones de blog, documentación, resúmenes y escritura creativa a menor costo. Opus 5 brilla en la escritura analítica de formato largo, la documentación técnica que requiere razonamiento profundo y el contenido donde importa la precisión sobre temas recientes (su corte de mayo de 2026 ayuda aquí).
Investigación
Ganador: depende del tipo de investigación.
El 84.7% de Sonnet 5 en BrowseComp y su 57.4% en HLE con herramientas lo hacen fuerte para investigación web, descubrimiento de fuentes y síntesis multifuente. Opus 5 lidera en DeepSearchQA y en HLE sin herramientas, y su corte de conocimiento de mayo de 2026 significa que tiene conocimiento confiable de desarrollos recientes que Sonnet 5 no tiene.
Para la investigación científica en concreto, Opus 5 es la elección clara: es el modelo generalmente disponible más capaz de Anthropic para ciencia, con menos restricciones de biología que Fable 5.
Empresa
Ganador: Opus 5 para la mayoría de las cargas de trabajo empresariales.
Ambos modelos admiten retención cero de datos, que es el requisito empresarial clave. Pero Opus 5 añade una alineación más fuerte (el menor comportamiento engañoso de cualquier modelo Claude reciente), mejor autoverificación, un corte de conocimiento más fresco y modo rápido para aplicaciones sensibles a la latencia. Sonnet 5 es la opción correcta para pipelines empresariales de alto volumen donde domina el costo por token y la complejidad de la tarea es moderada.
El ángulo de la competencia
Tanto Opus 5 como Sonnet 5 compiten con la familia GPT-5.6 de OpenAI. El posicionamiento:
| Modelo Claude | Equivalente de OpenAI | Equivalente de Google |
|---|---|---|
| Claude Fable 5 (clase Mythos) | GPT-5.6 Sol | Gemini 3.1 Pro (nivel inferior) |
| Claude Opus 5 | GPT-5.6 Sol / Terra | Gemini 3.1 Pro |
| Claude Sonnet 5 | GPT-5.6 Terra | Gemini 3.1 Flash |
| Claude Haiku 4.5 | GPT-5.6 Luna | Gemini 3.1 Flash Lite |
La historia es la relación precio-rendimiento de Opus 5. A $5/$25 por MTok, iguala o se acerca a GPT-5.6 Sol ($5/$30 por MTok) en la mayoría de los benchmarks e incluye un contexto completo de 1M de tokens a su tarifa estándar. GPT-5.6 Sol aplica un recargo de 2x en la entrada por encima de 272K tokens; el contexto de 1M de Opus 5 no tiene tal recargo.
Sonnet 5 a $3/$15 por MTok (lanzamiento $2/$10) rebaja el precio de GPT-5.6 Terra mientras lo iguala o supera en benchmarks de programación y agénticos. Durante el periodo de lanzamiento, Sonnet 5 es uno de los modelos de clase frontera más rentables disponibles.
Para el cara a cara detallado en el nivel frontera, consulta GPT-5.6 Sol vs Claude Fable 5.
Preguntas frecuentes
Claude Opus 5 vs Sonnet 5: ¿cuál es la diferencia?
¿Vale la pena Opus 5 frente a Sonnet 5?
¿Qué modelo de Claude es mejor para programar en 2026?
Sonnet 5 vs Opus 5: ¿cómo se comparan los benchmarks?
Opus 5 vs Sonnet 5: ¿cuál es la diferencia de precio?
¿Puede Sonnet 5 hacer lo que hace Opus 5?
Opus 5 vs Sonnet 5 para agentes de IA: ¿cuál es mejor?
¿Debería pasar de Sonnet 5 a Opus 5?
¿Ambos modelos admiten retención cero de datos?
¿Cuál es la diferencia de corte de conocimiento entre Opus 5 y Sonnet 5?
¿Qué modelo de Claude está disponible en el plan Free?
¿Cómo se comparan Opus 5 y Sonnet 5 con GPT-5.6?
Conclusión
Claude Opus 5 y Claude Sonnet 5 no son competidores: son complementos. Sonnet 5 es el caballo de batalla por defecto: programación, investigación y trabajo profesional sólidos al costo más bajo de la generación Claude 5. Opus 5 es la escalada premium: inteligencia cercana a Fable 5 a la mitad del precio, con el conocimiento más fresco, el razonamiento más fuerte y la mejor alineación de cualquier modelo Claude.
Empieza con Sonnet 5. Pruébalo con tu carga de trabajo real. Si completa las tareas de forma confiable, estás obteniendo un valor excelente, especialmente durante el precio de lanzamiento hasta el 31 de agosto. Escala a Opus 5 cuando la precisión en tareas complejas justifique el precio premium, cuando necesites conocimiento posterior a enero de 2026 o cuando tu trabajo toque ciencia, cumplimiento empresarial o flujos de trabajo agénticos de alto riesgo.
Para los desgloses modelo por modelo, consulta la guía de Claude Opus 5 y la guía de Claude Sonnet 5. Para la comparación de la generación anterior, consulta Fable 5 vs Opus 4.8.