Anthropic ha presentado Claude Opus 5, un nuevo modelo de inteligencia artificial que, según la compañía, ofrece inteligencia cercana a la frontera a aproximadamente la mitad del precio de su modelo Fable 5 de primer nivel. Lanzado el 24 de julio de 2026, Opus 5 es ahora el modelo predeterminado en Claude Max y el modelo más potente disponible en Claude Pro, lo que lo posiciona como el caballo de batalla diario de Anthropic para codificación, agentes autónomos y trabajo de conocimiento profesional.

El lanzamiento llega en un momento en el que las empresas están analizando el gasto en IA. Según CNBC, el nuevo modelo "rivaliza con Fable 5 y es más barato ya que las empresas se preocupan por los costos", mientras que Bloomberg lo caracterizó como un "modelo más rentable para las tareas cotidianas". Para los equipos que siguen los últimos desarrollos de IA, Opus 5 representa una apuesta deliberada de que el próximo campo de batalla competitivo es el valor, no la pura supremacía de los puntos de referencia.

Rendimiento de referencia: nueva tecnología de punta en codificación y trabajo del conocimiento

Anthropic informa que Opus 5 publica resultados de última generación en codificación y evaluaciones de trabajo de conocimiento, incluidos Frontier-Bench y GDPval-AA. En Frontier-Bench v0.1, la compañía dice que Opus 5 supera a todos los demás modelos y duplica con creces el rendimiento de su predecesor, Opus 4.8, a un menor costo por tarea.

En CursorBench 3.2, Opus 5 se sitúa a un 0,5% de la puntuación máxima de Fable 5 y cuesta la mitad por tarea, según los propios puntos de referencia de Anthropic. Decrypt señaló que el modelo "supera a Fable 5 en la mayoría de los puntos de referencia, a la mitad de precio".

Los beneficios se extienden a las evaluaciones agentes y de resolución de problemas:

  • ARC-AGI 3: Opus 5 obtiene una puntuación aproximadamente tres veces mayor que el siguiente mejor modelo en esta novedosa prueba de resolución de problemas.
  • Zapier AutomationBench: Una tasa de aprobación de aproximadamente 1,5 veces el siguiente mejor modelo por el mismo costo, midiendo la finalización de las tareas comerciales de un extremo a otro.
  • OSWorld 2.0 (uso de computadora): Opus 5 supera el mejor resultado de Fable 5 por poco más de un tercio del costo.

En particular, Anthropic reconoce que Opus 5 "permanece detrás de Mythos 5 en tareas de ciberseguridad", un área donde un modelo de frontera rival conserva el liderazgo.

Agencia más fuerte y autoverificación

Un tema recurrente en el anuncio es la capacidad mejorada de Opus 5 para verificar su propio trabajo e iterar hasta tener éxito. Anthropic describió varios ejemplos de pruebas de acceso temprano que resaltan esta autonomía.

En una tarea de Frontier-Bench, al modelo se le dio un dibujo de una pieza de máquina y se le pidió que escribiera código para reconstruirlo como un modelo 3D FreeCAD, pero deliberadamente no se le dio ninguna forma de ver el dibujo directamente. Según se informa, Opus 5 escribió su propio proceso de visión por computadora para extraer geometría de píxeles sin procesar, luego reconstruyó la pieza completa, teniendo éxito repetidamente donde ningún modelo de la competencia pudo resolver la tarea después de cinco intentos.

Ante un error real en un popular administrador de paquetes de código abierto, Opus 5 encontró la causa raíz y solucionó un caso extremo que el propio parche de la comunidad había omitido, mientras que un modelo de la competencia solucionó solo el síntoma superficial y declaró que el error estaba resuelto. Según se informa, un ingeniero de una empresa comercial utilizó Opus 5 para crear una fuente de datos de mercado para un nuevo intercambio en una sola sesión (una tarea que los modelos anteriores no podían completar en absoluto) y, al no encontrar ninguna fuente en vivo con la que validar, el modelo construyó su propio arnés de prueba.

Recepción de clientes

Los socios de acceso temprano ofrecieron evaluaciones en gran medida positivas. Scott Wu, director ejecutivo de Cognition (fabricante del agente de codificación Devin), dijo que Opus 5 "se acerca al rendimiento de nivel Fable a la mitad del costo" y muestra "particular fortaleza en tareas difíciles de depuración y análisis de causa raíz". Sualeh Asif, cofundador de Cursor, dijo que el modelo ofrece "inteligencia cercana a Fable 5 a la velocidad y costo de Opus".

Wade Foster, director ejecutivo de Zapier, informó que Opus 5 "encabezó la clasificación de AutomationBench de Zapier sin gastar más tokens que los modelos Claude anteriores", completando un flujo de trabajo completo de prevención de abandono de principio a fin: señalando cuentas en riesgo, alertando al propietario adecuado y resumiendo para los equipos de retención. Los modelos anteriores no aprobaron; Opus 5 alcanzó el 100%.

Ganancias en la investigación científica

Anthropic también destacó las mejoras del Opus 5 para el trabajo científico. El modelo supera al Opus 4.8 en todas las evaluaciones de ciencias biológicas de Anthropic, que abarcan biología estructural, química orgánica y bioinformática. La compañía señaló una mejora de 10,2 puntos porcentuales en un punto de referencia interno de química orgánica (inferir estructuras moleculares a partir de datos de espectroscopia) y una ganancia de 7,7 puntos en tareas de predicción de funciones de proteínas. Un cliente de genómica describió el modelo como si se comportara "más como un científico cuidadoso", buscando las pruebas estadísticas correctas y verificando sus propios resultados.

La estrategia de precios

Al fijar el precio de Opus 5 al mismo nivel que Opus 4.8 y al mismo tiempo acercarse a la inteligencia de Fable 5, Anthropic está reduciendo efectivamente la brecha entre sus ofertas de nivel medio y emblemáticas. VentureBeat enmarcó el lanzamiento como "un modelo de IA más económico para codificación, agentes y flujos de trabajo empresariales", y Buscando Alpha observó que Opus 5 está "más cerca y más barato del modelo fronterizo Fable 5". La compañía ofrece una configuración de "esfuerzo" ajustable que permite a los clientes intercambiar inteligencia por velocidad y costos de token más bajos, ajustando la relación costo-rendimiento por tarea.

Qué significa para la carrera de la IA

Opus 5 subraya la rapidez con la que está cayendo el coste de la IA cercana a la frontera. Un modelo que se acerca a los sistemas más capaces disponibles (a la mitad del precio simbólico) presiona a los competidores a justificar precios superiores por ganancias marginales. Con Anthropic, OpenAI, Google y otros compitiendo para hacer modelos capaces lo suficientemente asequibles para la implementación diaria a gran escala, la pregunta para las empresas está pasando de "¿qué modelo es más inteligente?" a "¿qué modelo ofrece más inteligencia por dólar?"

Para Anthropic, el mensaje es claro: el razonamiento de alto nivel ya no es un producto de lujo. Opus 5 ofrece capacidad adyacente a la frontera a un precio que hace realista el despliegue diario y sostenido, y ese puede llegar a ser el detalle más importante de todos.

Manténgase a la vanguardia de la IA

Claude Opus 5 está disponible a partir de hoy en Claude Pro, Claude Max y a través de la API de Anthropic. Para obtener más información sobre esta historia y el panorama más amplio de la inteligencia artificial, manténgase al día con las noticias de última hora sobre IA a medida que suceden.

Leer más noticias sobre IA →