Anthropic ha presentado Claude Opus 4.5, un modelo de IA que establece nuevos máximos en pruebas de desarrollo de software real. El sistema incorpora mejoras en programación, uso de agentes y control de ordenadores, junto con actualizaciones en productos como Claude Code y Excel.
Anthropic ha anunciado Claude Opus 4.5, disponible desde hoy en su API, aplicaciones y las tres principales plataformas de nube. El sistema obtiene un 80,9% de precisión en SWE-bench Verified, la evaluación de referencia para ingeniería de software en condiciones reales, superando a modelos como Sonnet 4.5 (77,2%) y otros competidores del sector. En programación multilingüe lidera en 7 de 8 lenguajes evaluados.
Además de liderar en programación con agentes, el modelo muestra capacidades superiores en múltiples áreas técnicas. En uso de herramientas obtiene un 98,2% en escenarios de telecomunicaciones y un 88,9% en entornos de comercio minorista. En tareas de uso de ordenadores registra un 66,3%, y en razonamiento visual un 80,7%. El sistema también logra un 90,8% en respuestas multilingües y un 87% en razonamiento de nivel universitario.
Una característica diferencial es el nuevo parámetro de esfuerzo en la API, que permite a los desarrolladores ajustar el equilibrio entre capacidad y consumo de tokens. Con nivel medio de esfuerzo, Opus 4.5 iguala el rendimiento de Sonnet 4.5 utilizando un 76% menos de tokens de salida. En su nivel máximo, supera a Sonnet 4.5 en 4,3 puntos porcentuales mientras consume un 48% menos de tokens.
Anthropic realizó pruebas internas donde Claude Opus 4.5 completó un examen técnico de dos horas para candidatos a ingeniería de rendimiento, obteniendo la puntuación más alta registrada entre todos los candidatos humanos evaluados. La compañía indica que este resultado plantea cuestiones sobre cómo la inteligencia artificial modificará el desarrollo de software como profesión.
En cuanto a seguridad, Claude Opus 4.5 presenta mayor resistencia a ataques de inyección de prompts que cualquier otro modelo del mercado. En pruebas con mil consultas, el modelo registra una tasa de éxito de ataque del 4,7%, frente al 7,3% de Sonnet 4.5, el 12,5% de Gemini 3 Pro y el 12,6% de GPT-5.1.
Anthropic ha actualizado varios productos aprovechando las capacidades del modelo. Claude Code incorpora un modo Plan que genera archivos editables antes de ejecutar tareas. Las conversaciones en las aplicaciones ya no tienen límite de longitud, ya que el sistema resume automáticamente el contexto anterior. Claude for Excel ha ampliado el acceso beta a todos los usuarios Max, Team y Enterprise.
Claude Opus 4.5 está disponible en la API con identificador claude-opus-4-5-20251101. El precio se establece en 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida.
Anthropic desarrolla sistemas de inteligencia artificial fiables e interpretables desde un enfoque científico de seguridad. La compañía integra investigación avanzada y colaboración ...
Claude es un sistema de IA conversacional de Anthropic diseñado para procesar lenguaje natural e imágenes, proporcionando análisis, razonamiento lógico, generación de código y comunicación ...
12/06/2026
El gobierno de Estados Unidos ha ordenado a Anthropic bloquear el acceso a Claude Fable 5 y Mythos 5 a ciudadanos extranjeros, lo que ha obligado a ...
09/06/2026
Anthropic presenta Claude Fable 5 y Claude Mythos 5, dos versiones de su modelo de mayor capacidad hasta la fecha. Comparten la misma base, pero uno ...
02/06/2026
Microsoft amplía su familia de modelos de inteligencia artificial con siete nuevos desarrollos internos que cubren generación de imágenes, ...
25/05/2026
El papa León XIV publica la primera encíclica dedicada a la inteligencia artificial, en la que fija la dignidad humana como criterio para todo ...