Modelos · Septiembre 2026

Claude Opus 5.5: más capacidad, menos costo, nuevas reglas

Anthropic lanzó Claude Opus 5.5 el 22 de septiembre de 2026. Promete el nivel de Fable 5.1 en la mayoría de los trabajos por un precio menor que Opus 5. Esto es lo que cambia para un equipo que lo pone en producción.

USD 4 / 20 por millón de tokens1M tokens de contexto22 sept. 2026 lanzamiento
En resumen

Claude Opus 5.5 cuesta USD 4 por millón de tokens de entrada y USD 20 de salida (Opus 5: 5 y 25), mantiene 1 millón de tokens de contexto y, según Anthropic, rinde como Claude Fable 5.1 en la mayoría de los trabajos, genera más de un 30 % más rápido que Opus 5 y cuesta un 40 % menos de operar en cargas típicas.

Para los equipos técnicos trae cambios que rompen código existente: el razonamiento ya no se puede apagar, el esfuerzo por defecto baja a medium y el uso forzado de herramientas desaparece. Nuestra lectura: es el nuevo punto de partida para agentes y trabajo de conocimiento, siempre que se valide con tus propios prompts.

Qué es Claude Opus 5.5 y qué promete

Claude Opus 5.5 es el nuevo modelo de la línea Opus de Anthropic, publicado el martes 22 de septiembre de 2026, dos meses después de Opus 5 (24 de julio). Anthropic lo describe como un modelo para trabajo agéntico de larga duración en código y trabajo de conocimiento, y su documentación ya recomienda empezar por Opus 5.5 para la mayoría de las cargas.

Las promesas principales, todas de Anthropic: rendimiento al nivel de Claude Fable 5.1 (su modelo más capaz de uso general) en la mayor parte del trabajo, un costo de operación un 40 % menor que Opus 5 en cargas típicas y una generación más de un 30 % más rápida. Está disponible en la API de Claude, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry y Claude Platform on AWS, y en los planes Pro, Max, Team y Enterprise de Claude.

Es también el primer modelo que Anthropic lanza desde que su CEO, Dario Amodei, publicó en septiembre de 2026 el ensayo We Must Pace the Frontier, en el que pide frenar el ritmo al que mejoran las capacidades de los modelos para dar tiempo a la alineación y a la evaluación externa. El mismo día, OpenAI lanzó GPT-6 Sol y GPT-6 Luna, y Anthropic anunció que Claude Sonnet 5.5 y Claude Haiku 5.5 llegarán en las próximas semanas.

Dónde encaja en la familia Claude

Cuatro modelos actuales, cuatro puntos de precio.

Datos de la documentación de Anthropic (models overview), consultada el 26 de septiembre de 2026. Precios en USD por millón de tokens.
ModeloEntrada / salidaContextoSalida máx.Esfuerzo por defectoConocimiento hasta
Claude Fable 5.110 / 501M128Khighjunio 2026
Claude Opus 5.54 / 201M128Kmediumjunio 2026
Claude Sonnet 52 / 101M128Khighenero 2026
Claude Haiku 4.51 / 5200K64Kno aplicafebrero 2025

La lectura práctica: Opus 5.5 ocupa el lugar que antes exigía pagar el nivel Fable. Fable 5.1 queda para el razonamiento más exigente y los agentes de horizonte muy largo, o para cuando tus evaluaciones con Opus 5.5 a esfuerzo alto todavía se quedan cortas. Sonnet 5 y Haiku 4.5 siguen siendo las opciones para volumen y latencia.

Dos detalles de precio que importan en producción: la lectura de caché de prompts de Opus 5.5 cuesta USD 0,20 por millón (el 5 % del precio de entrada, frente a USD 0,50 en Opus 5) y la API de lotes aplica un 50 % de descuento. En lotes, Opus 5.5 admite hasta 300.000 tokens de salida con una cabecera beta.

Los benchmarks, leídos con cuidado

Lo que publica Anthropic y lo que dicen las clasificaciones independientes.

Resultados reportados por Anthropic el 22 de septiembre de 2026, con esfuerzo máximo. Cuando un clasificador de seguridad intervino, la tarea corrió en Opus 4.8 u Opus 5. GPT-6 Astra es el modelo de OpenAI de su comparación.
BenchmarkOpus 5.5Fable 5.1Opus 5GPT-6 Astra
Terminal-Bench 4.066,4 %55,8 %52,3 %57,9 %
FrontierCode v1.154,4 %50,3 %48,0 %53,3 %
CursorBench 4.057,8 %51,8 %46,6 %sin dato
OSWorld 2.0 (uso de computador, puntaje parcial)81,8 %80,7 %74,0 %sin dato
Humanity's Last Exam (con herramientas)67,7 %65,6 %63,6 %57,2 %
AutomationBench40,0 %31,4 %26,9 %41,4 %
Terminal-Bench-Science 0.158,7 %52,6 %sin dato64,6 %

Tres cautelas antes de decidir con esta tabla. Primero, son pruebas corridas o elegidas por el propio fabricante, varias en versiones nuevas (Terminal-Bench 4.0, OSWorld 2.0) con poco historial de comparación. Segundo, no gana en todo: en su misma tabla, GPT-6 Astra queda por delante en AutomationBench y en Terminal-Bench-Science. Tercero, ninguna prueba está en español o francés de empresa, que es donde más vemos romperse a los modelos.

Las clasificaciones independientes apuntan en la misma dirección, con matices. El 25 y 26 de septiembre, Opus 5.5 encabezaba la clasificación de texto de Arena (1.509 puntos) y el índice de inteligencia de Artificial Analysis (58 puntos, versión 4.3.2). En cambio, todavía no figuraba en la tabla oficial de Terminal-Bench 4.0, que lideraba GPT-6 Astra con 58,2 %, y en ARC-AGI-2 GPT-6 Astra marcaba 95,0 % frente a 93,3 % de Opus 5.5, aunque a un costo por tarea casi tres veces mayor.

Anthropic también cita casos de clientes: una migración de 680.000 líneas de código en menos de un día o la auditoría de un código de 200.000 líneas en menos de tres horas. Son anécdotas de su comunicación: una señal útil de hacia dónde apunta el modelo, no una promesa para tu proyecto.

Qué cambia para los equipos técnicos

Cuatro cambios rompen código escrito para Opus 5.

El razonamiento está siempre activo. Opus 5.5 piensa de forma adaptativa y no se puede desactivar; la única perilla es el parámetro effort (low, medium, high, xhigh, max). El valor por defecto baja a medium, un nivel por debajo de Opus 5. Anthropic afirma que Opus 5.5 en medium supera a Opus 5 en high en sus evaluaciones de código y trabajo de conocimiento, y que en varias de código low se le acerca a un costo mucho menor. Lo explicamos a fondo en cuándo pagar por pensar.

  • Enviar thinking: disabled o un presupuesto fijo de tokens de razonamiento devuelve un error 400.
  • El uso forzado de herramientas (tool_choice con any o una herramienta concreta) ya no se admite: se usa auto con herramientas estrictas o salidas estructuradas.
  • Los bloques de razonamiento quedan ligados al modelo y a la conversación: si tu código edita turnos anteriores, las cuentas creadas desde el 31 de agosto de 2026 reciben un error. El historial debe ser de solo anexar.
  • El uso de computador solo funciona con el nuevo computer_toolset_20260801; la herramienta anterior se rechaza.

Hay un cambio más que no rompe nada pero sorprende: los textos cortos que el modelo escribe entre llamadas a herramientas llegan ahora como bloques de razonamiento vacíos por defecto. Si tu interfaz muestra ese progreso al usuario, se quedará en silencio hasta que actives el modo de visualización de actualizaciones. Por último, el modo rápido (vista previa, solo en la API de Claude) promete hasta 2,5 veces más velocidad a USD 8 / 40 por millón de tokens.

Regla práctica

Fija effort de forma explícita en cada ruta de tu aplicación y vuelve a correr tu batería de evaluación. Copiar la configuración de Opus 5 da turnos más largos y más tokens de salida, porque a igual nivel Opus 5.5 tiende a pensar más.

Cuánto cuesta de verdad: un ejemplo con números

El precio por token baja un 20 %; el costo por tarea puede bajar mucho más.

Tomemos un paso típico de un agente: 12.000 tokens de entrada, de los cuales 10.000 son un prefijo estable (instrucciones, herramientas, documentos de referencia) que se puede cachear, y 2.000 tokens de salida, contando el razonamiento, que se factura como salida. Son supuestos ilustrativos, no mediciones de un proyecto.

Cálculo ilustrativo con precios de lista de Anthropic. No incluye el costo de escritura inicial de la caché (USD 5 por millón en Opus 5.5 para 5 minutos), que se amortiza entre peticiones.
EscenarioCosto por pasoPor 100.000 pasos
Opus 5, sin cachéUSD 0,110USD 11.000
Opus 5.5, sin cachéUSD 0,088USD 8.800
Opus 5, con caché del prefijoUSD 0,065USD 6.500
Opus 5.5, con caché del prefijoUSD 0,050USD 5.000

El ahorro grande no está en el precio de lista sino en la combinación: caché barata, un esfuerzo por defecto más bajo y, según Anthropic, menos tokens por tarea resuelta. El número que hay que mirar es el costo por tarea completada: un paso más barato que necesita dos reintentos no es más barato. Si el trabajo no es interactivo, la API de lotes divide la factura por dos. Más palancas en el costo real de la IA.

Seguridad y rechazos: lo que debe saber tu equipo

Opus 5.5 aplica clasificadores de seguridad en ciberseguridad y en biología, parecidos a los de Fable 5.1; el de biología es nuevo frente a Opus 5. Según la documentación, buscar vulnerabilidades en código fuente está permitido, mientras que las peticiones de investigación biológica de doble uso se rechazan salvo para participantes en el programa de verificación de Anthropic. Una categoría nueva, reasoning_extraction, rechaza los intentos de hacer que el modelo copie su razonamiento interno en la respuesta.

Para un equipo de producto esto tiene una consecuencia concreta: un rechazo llega como una respuesta normal con stop_reason: refusal, no como un error. Hay que tratarlo en el código, registrarlo y, si procede, reenviar la petición a otro modelo; la API permite configurar ese reenvío en el servidor. En equipos de pentest y seguridad ofensiva, conviene probar los flujos reales antes de migrar.

Sobre robustez, Anthropic afirma que Opus 5.5 iguala o supera a Opus 5 frente a inyección de prompts en todos los escenarios que probó y que intenta saltarse los límites de contención un 85 % menos que Opus 5. Son buenas noticias, pero ningún modelo resuelve solo la inyección de prompts: el diseño del agente sigue siendo la defensa principal, como explicamos en prompt injection y seguridad de agentes.

Qué modelo usar para cada trabajo

Nuestro punto de partida antes de evaluar; no reemplaza la evaluación.

Recomendación de Slash AI Lab a septiembre de 2026, para arrancar las pruebas. La decisión final sale de tus prompts.
TrabajoModelo inicialEsfuerzo inicialPor qué
Agentes de código, migraciones, refactorizaciones largasOpus 5.5medium, subir a high si fallaEs el caso para el que Anthropic lo diseñó
Análisis de documentos largos, finanzas, legalOpus 5.5medium1M de contexto y caché barata
Razonamiento muy difícil, agentes de horizonte muy largoFable 5.1 u Opus 5.5 en xhighhigh o superiorComparar ambos en tu evaluación
Atención al cliente y chat de alto volumenSonnet 5 o Haiku 4.5low o mediumLatencia y costo por conversación
Clasificación y extracción masivasHaiku 4.5 en lotesno aplicaEl costo manda; la calidad suele sobrar
Respuesta en tiempo real con OpusOpus 5.5 en modo rápidolow o mediumSolo si la latencia justifica pagar el doble
Ojo con Haiku 4.5

Anthropic solo garantiza Haiku 4.5 hasta el 15 de octubre de 2026 como mínimo y ya anunció Haiku 5.5. Si hoy arrancas una ruta nueva de alto volumen, prevé esa migración desde el diseño. En el mismo segmento compiten GPT-6 Sol (USD 2 / 10) y los Gemini Flash.

Esta tabla es un punto de partida. El método que usamos para decidir, con 30 prompts reales por cliente y en tres idiomas, está en cómo elegimos un modelo, y el panorama completo de proveedores en el mapa de modelos de septiembre de 2026.

Checklist para migrar desde Opus 5

  1. Fija effort por ruta y corre tu evaluación en low, medium y high antes de elegir.
  2. Elimina cualquier thinking: disabled o presupuesto fijo de razonamiento.
  3. Sustituye el uso forzado de herramientas por auto con herramientas estrictas o salidas estructuradas.
  4. Revisa que tu historial de conversación sea de solo anexar: nada de editar turnos anteriores.
  5. Si usas uso de computador, migra a computer_toolset_20260801 y pruébalo antes en Opus 5, que acepta ambas versiones.
  6. Muestra las actualizaciones de progreso entre herramientas si tu interfaz depende de ellas.
  7. Maneja stop_reason: refusal con registro y reenvío a otro modelo.
  8. Revisa los límites de uso de tu nivel para Opus 5.5 antes de mover volumen.
  9. Compara costo por tarea completada, no precio por token, durante al menos una semana de tráfico real.

Qué significa para empresas en Colombia y en Europa

Compras y contratos. Opus 5.5 está en los tres grandes clouds (AWS, Google Cloud y Microsoft). Para muchas empresas colombianas y europeas eso permite usarlo dentro de contratos y compromisos de gasto que ya existen, sin abrir un proveedor nuevo. Ojo con el costo de la residencia: la inferencia solo en EE. UU. cuesta 1,1 veces el precio base y los endpoints regionales de Bedrock y Google Cloud llevan un 10 % de recargo.

Riesgo de acceso. El 12 de junio de 2026, una directiva de control de exportaciones de EE. UU. obligó a Anthropic a retirar Fable 5 y Mythos 5 a todos sus usuarios; Fable 5 volvió el 1 de julio. Cualquier empresa fuera de EE. UU. debería tener un modelo de respaldo de otro proveedor, probado y listo para activar.

Datos personales. En Colombia, enviar datos personales a un modelo alojado fuera del país es una transferencia internacional bajo la Ley 1581 de 2012: hay que revisar la autorización de los titulares y las garantías del proveedor. En la Unión Europea aplican el RGPD y, desde el 2 de agosto de 2026, las obligaciones de transparencia del AI Act para quien despliega un chatbot. Las obligaciones de modelo de propósito general recaen en Anthropic; las tuyas, en cómo lo usas. Lo detallamos en el mapa regulatorio de 2026.

Idiomas. Ningún benchmark publicado mide el español de una aseguradora colombiana o el francés de un despacho parisino. Esa prueba te toca a ti. En Slash AI Lab corremos Opus 5.5 con la misma batería de 30 prompts por cliente que usamos con cualquier modelo nuevo; no publicaremos cifras hasta tener resultados reproducibles.

Nuestra recomendación

Si hoy usas Opus 5 o Fable 5.1 en producción, abre una prueba controlada de Opus 5.5 esta semana, con esfuerzo fijado y tu evaluación en español y francés. Si usas Sonnet para volumen, espera a Sonnet 5.5, anunciado para las próximas semanas, antes de mover esa ruta.

Lo esencial

  • Opus 5.5 (22 de septiembre de 2026) cuesta USD 4 / 20 por millón de tokens, un 20 % menos que Opus 5, con 1M de contexto.
  • Anthropic lo sitúa al nivel de Fable 5.1 en la mayoría del trabajo; los benchmarks son del fabricante y GPT-6 Astra gana en dos.
  • El razonamiento no se puede apagar: el esfuerzo es la palanca y su valor por defecto baja a medium.
  • Cuatro cambios rompen código escrito para Opus 5; la migración necesita una checklist y una evaluación nueva.
  • Mide el costo por tarea completada: la caché a USD 0,20 y los lotes cambian más la factura que el precio de lista.

Fuentes

  1. Introducing Claude Opus 5.5 · Anthropic, 2026-09-22
  2. Claude Opus 5.5: model page · Anthropic documentation, 2026-09-22
  3. What's new in Claude Opus 5.5 · Anthropic documentation, 2026-09-22
  4. Migrating to Claude Opus 5.5 · Anthropic documentation, 2026-09-22
  5. Models overview · Anthropic documentation, 2026-09
  6. Pricing · Anthropic documentation, 2026-09
  7. Claude Opus 5.5 system card · Anthropic, 2026-09-22
  8. Anthropic releases Opus 5.5 with lower prices and Fable-level performance · TechCrunch, 2026-09-22
  9. Anthropic Releases Claude Opus 5.5 · MarkTechPost, 2026-09-22
  10. We Must Pace the Frontier · Dario Amodei, 2026-09
  11. Update on access to Claude Fable 5 and Claude Mythos 5 · Anthropic, 2026-06-12
  12. GPT-6 Astra · OpenAI, 2026-09-03
  13. Text leaderboard · Arena, 2026-09-25
  14. AI model leaderboards (Intelligence Index) · Artificial Analysis, 2026-09-26
  15. Terminal-Bench leaderboard · Terminal-Bench, 2026-09-26
  16. ARC-AGI leaderboard · ARC Prize, 2026-09-26

Nota editorial: este análisis refleja la información pública disponible en la fecha de revisión. Modelos, precios y normas cambian rápido; cada dato de terceros enlaza a su fuente y nuestras opiniones se presentan como tales. ¿Ves un error? Escríbenos a contact@slash-digital.io.

Preguntas frecuentes

Las preguntas que escuchamos a menudo

¿Cuándo salió Claude Opus 5.5?

El 22 de septiembre de 2026. Anthropic compromete su disponibilidad al menos hasta el 22 de septiembre de 2027.

¿Cuánto cuesta Claude Opus 5.5?

USD 4 por millón de tokens de entrada y USD 20 de salida; la lectura de caché cuesta USD 0,20 por millón y la API de lotes tiene un 50 % de descuento.

¿Es mejor que Claude Fable 5.1?

Según Anthropic rinde a su nivel en la mayoría del trabajo por menos de la mitad del precio. Fable 5.1 sigue recomendado para el razonamiento más exigente. Solo tu evaluación lo confirma para tu caso.

¿Puedo desactivar el razonamiento para ahorrar?

No. El razonamiento siempre está activo; para ahorrar se baja el parámetro effort a low o medium.

¿Está disponible desde Colombia y la Unión Europea?

Sí, por la API de Claude y por AWS, Google Cloud y Microsoft. Revisa las regiones disponibles y tus obligaciones de protección de datos antes de enviar datos personales.

Hablar con Slash

Pongámoslo en producción

Cuéntanos tu reto. Respondemos en menos de 24 horas laborales con una primera lectura honesta: si podemos ayudarte, te diremos cómo; si no, te diremos quién puede.

Contesto personalmente. Sin formularios eternos ni respuestas automáticas.

Escribirle a Esteban