Anthropic presenta su nuevo modelo de la gama Opus, que se acerca a la inteligencia de Fable 5 en tareas de programación y trabajo de conocimiento con la mitad de coste, aunque queda por detrás en ciberseguridad.
Anthropic ha lanzado Opus 5, la nueva versión de su modelo de gama alta, disponible desde hoy en todas sus plataformas al mismo precio que su predecesor: 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida.
En evaluaciones de programación y trabajo de conocimiento como Frontier-Bench y GDPval-AA, Opus 5 se convierte en el nuevo referente del sector. En Frontier-Bench v0.1 alcanza un 43,3% de acierto, frente al 21,1% de Opus 4.8, más del doble. En CursorBench se sitúa a menos de medio punto porcentual de Fable 5, pero a la mitad de coste por tarea. En razonamiento sobre problemas novedosos (ARC-AGI-3) obtiene un 30,2%, muy por encima del 7,8% del siguiente modelo mejor situado. En tareas de uso de ordenador (OSWorld 2.0) llega al 70,6%, superando el mejor resultado de Fable 5 (66,1%) con menos de un tercio de su coste por tarea, según la compañía.
El modelo también mejora en investigación científica: sube 10,2 puntos porcentuales respecto a Opus 4.8 en química orgánica, como inferir estructuras moleculares a partir de espectroscopia, y 7,7 puntos en tareas relacionadas con proteínas.
En seguridad, Anthropic afirma que Opus 5 es su modelo más alineado hasta la fecha, con la tasa más baja de comportamiento engañoso de sus auditorías internas. No obstante, precisa que no amplía la frontera en capacidades de doble uso: sigue por detrás de Mythos 5 en investigación biológica y ciberseguridad ofensiva. Se acerca a Mythos 5 al identificar vulnerabilidades de software, pero queda por detrás en el desarrollo de exploits para aprovecharlas.
Los clasificadores de seguridad de Opus 5 son menos restrictivos que los de Fable 5 en el ámbito de la ciberseguridad, y Anthropic estima que intervendrán alrededor de un 85% menos. El modelo pasa a ser el predeterminado en Claude Max y el más potente disponible en Claude Pro, y también se ofrece en modo rápido, con una velocidad 2,5 veces superior al modo estándar.
Anthropic desarrolla sistemas de inteligencia artificial fiables e interpretables desde un enfoque científico de seguridad. La compañía integra investigación avanzada y colaboración ...
Claude es un sistema de IA conversacional de Anthropic diseñado para procesar lenguaje natural e imágenes, proporcionando análisis, razonamiento lógico, generación de código y comunicación ...
21/07/2026
Hugging Face detectó una intrusión atribuida a un agente autónomo de IA. Días después, OpenAI confirmó que fueron sus propios modelos, en una ...
16/07/2026
SpaceXAI ha presentado Grok 4.5, su modelo más avanzado hasta la fecha, entrenado junto con Cursor y orientado a programación, tareas de agentes y ...
16/07/2026
Moonshot AI ha presentado Kimi K3, un modelo de código abierto de 2,8 billones de parámetros que, según sus propios datos, supera a varios modelos ...
15/07/2026
Thinking Machines Lab lanza Inkling, su primer modelo de inteligencia artificial con pesos abiertos: procesa texto, imágenes y audio, y está ...