Opus 5 duplica el rendimiento en programación al mismo coste que su antecesor

24/07/2026

Anthropic presenta su nuevo modelo de la gama Opus, que se acerca a la inteligencia de Fable 5 en tareas de programación y trabajo de conocimiento con la mitad de coste, aunque queda por detrás en ciberseguridad.

Opus 5 duplica el rendimiento en programación al mismo coste que su antecesor

Anthropic ha lanzado Opus 5, la nueva versión de su modelo de gama alta, disponible desde hoy en todas sus plataformas al mismo precio que su predecesor: 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida.

En evaluaciones de programación y trabajo de conocimiento como Frontier-Bench y GDPval-AA, Opus 5 se convierte en el nuevo referente del sector. En Frontier-Bench v0.1 alcanza un 43,3% de acierto, frente al 21,1% de Opus 4.8, más del doble. En CursorBench se sitúa a menos de medio punto porcentual de Fable 5, pero a la mitad de coste por tarea. En razonamiento sobre problemas novedosos (ARC-AGI-3) obtiene un 30,2%, muy por encima del 7,8% del siguiente modelo mejor situado. En tareas de uso de ordenador (OSWorld 2.0) llega al 70,6%, superando el mejor resultado de Fable 5 (66,1%) con menos de un tercio de su coste por tarea, según la compañía.

El modelo también mejora en investigación científica: sube 10,2 puntos porcentuales respecto a Opus 4.8 en química orgánica, como inferir estructuras moleculares a partir de espectroscopia, y 7,7 puntos en tareas relacionadas con proteínas.

En seguridad, Anthropic afirma que Opus 5 es su modelo más alineado hasta la fecha, con la tasa más baja de comportamiento engañoso de sus auditorías internas. No obstante, precisa que no amplía la frontera en capacidades de doble uso: sigue por detrás de Mythos 5 en investigación biológica y ciberseguridad ofensiva. Se acerca a Mythos 5 al identificar vulnerabilidades de software, pero queda por detrás en el desarrollo de exploits para aprovecharlas.

Los clasificadores de seguridad de Opus 5 son menos restrictivos que los de Fable 5 en el ámbito de la ciberseguridad, y Anthropic estima que intervendrán alrededor de un 85% menos. El modelo pasa a ser el predeterminado en Claude Max y el más potente disponible en Claude Pro, y también se ofrece en modo rápido, con una velocidad 2,5 veces superior al modo estándar.

Puntos clave

  • Anthropic lanza Opus 5, disponible hoy al mismo precio que Opus 4.8.
  • Duplica el rendimiento de Opus 4.8 en programación (Frontier-Bench).
  • Se acerca a Fable 5 en CursorBench a mitad de coste.
  • Triplica al siguiente mejor modelo en problemas novedosos (ARC-AGI-3).
  • Supera a Fable 5 en uso de ordenador con un tercio de su coste.
  • Mejora en química orgánica y tareas con proteínas.
  • Es el modelo más alineado de Anthropic hasta la fecha.
  • Sigue por detrás de Mythos 5 en biología y ciberseguridad ofensiva.
  • Sus clasificadores de seguridad intervienen un 85% menos que los de Fable 5.
  • Es el modelo predeterminado en Claude Max y el más potente en Claude Pro.

Vídeos

IA relacionada

Anthropic

Sistemas de IA en los que confiar

Anthropic desarrolla sistemas de inteligencia artificial fiables e interpretables desde un enfoque científico de seguridad. La compañía integra investigación avanzada y colaboración ...

Claude

Crea con Claude

Claude es un sistema de IA conversacional de Anthropic diseñado para procesar lenguaje natural e imágenes, proporcionando análisis, razonamiento lógico, generación de código y comunicación ...

Últimas noticias

★★★★★
Valóranos en Google
Esta web utiliza cookies técnicas, de personalización y análisis, propias y de terceros, para facilitarle la navegación de forma anónima y analizar estadísticas del uso de la web. Consideramos que si continúa navegando, acepta su uso.