Claude Opus 4.5, el nuevo modelo de Anthropic que domina en ingeniería de software

24/11/2025

Anthropic ha presentado Claude Opus 4.5, un modelo de IA que establece nuevos máximos en pruebas de desarrollo de software real. El sistema incorpora mejoras en programación, uso de agentes y control de ordenadores, junto con actualizaciones en productos como Claude Code y Excel.

Claude Opus 4.5, el nuevo modelo de Anthropic que domina en ingeniería de software

Anthropic ha anunciado Claude Opus 4.5, disponible desde hoy en su API, aplicaciones y las tres principales plataformas de nube. El sistema obtiene un 80,9% de precisión en SWE-bench Verified, la evaluación de referencia para ingeniería de software en condiciones reales, superando a modelos como Sonnet 4.5 (77,2%) y otros competidores del sector. En programación multilingüe lidera en 7 de 8 lenguajes evaluados.

Además de liderar en programación con agentes, el modelo muestra capacidades superiores en múltiples áreas técnicas. En uso de herramientas obtiene un 98,2% en escenarios de telecomunicaciones y un 88,9% en entornos de comercio minorista. En tareas de uso de ordenadores registra un 66,3%, y en razonamiento visual un 80,7%. El sistema también logra un 90,8% en respuestas multilingües y un 87% en razonamiento de nivel universitario.

Una característica diferencial es el nuevo parámetro de esfuerzo en la API, que permite a los desarrolladores ajustar el equilibrio entre capacidad y consumo de tokens. Con nivel medio de esfuerzo, Opus 4.5 iguala el rendimiento de Sonnet 4.5 utilizando un 76% menos de tokens de salida. En su nivel máximo, supera a Sonnet 4.5 en 4,3 puntos porcentuales mientras consume un 48% menos de tokens.

Anthropic realizó pruebas internas donde Claude Opus 4.5 completó un examen técnico de dos horas para candidatos a ingeniería de rendimiento, obteniendo la puntuación más alta registrada entre todos los candidatos humanos evaluados. La compañía indica que este resultado plantea cuestiones sobre cómo la inteligencia artificial modificará el desarrollo de software como profesión.

En cuanto a seguridad, Claude Opus 4.5 presenta mayor resistencia a ataques de inyección de prompts que cualquier otro modelo del mercado. En pruebas con mil consultas, el modelo registra una tasa de éxito de ataque del 4,7%, frente al 7,3% de Sonnet 4.5, el 12,5% de Gemini 3 Pro y el 12,6% de GPT-5.1.

Anthropic ha actualizado varios productos aprovechando las capacidades del modelo. Claude Code incorpora un modo Plan que genera archivos editables antes de ejecutar tareas. Las conversaciones en las aplicaciones ya no tienen límite de longitud, ya que el sistema resume automáticamente el contexto anterior. Claude for Excel ha ampliado el acceso beta a todos los usuarios Max, Team y Enterprise.

Claude Opus 4.5 está disponible en la API con identificador claude-opus-4-5-20251101. El precio se establece en 5 dólares por millón de tokens de entrada y 25 dólares por millón de tokens de salida.

Puntos clave

  • Claude Opus 4.5 obtiene 80,9% en SWE-bench Verified, superando a Sonnet 4.5 y otros competidores
  • Lidera en 7 de 8 lenguajes de programación en evaluaciones multilingües
  • Incorpora parámetro de esfuerzo que permite ajustar consumo de tokens manteniendo o superando rendimiento
  • Con nivel medio de esfuerzo iguala a Sonnet 4.5 usando 76% menos tokens de salida
  • Superó a todos los candidatos humanos en examen técnico de ingeniería de rendimiento de dos horas
  • Registra 4,7% de vulnerabilidad a ataques de inyección de prompts, la tasa más baja del mercado
  • Claude Code incorpora modo Plan con archivos editables antes de ejecutar tareas
  • Las conversaciones en aplicaciones ya no tienen límite de longitud

Vídeos

IA relacionada

Anthropic

Sistemas de IA en los que confiar

Anthropic desarrolla sistemas de inteligencia artificial fiables e interpretables desde un enfoque científico de seguridad. La compañía integra investigación avanzada y colaboración ...

Claude

Crea con Claude

Claude es un sistema de IA conversacional de Anthropic diseñado para procesar lenguaje natural e imágenes, proporcionando análisis, razonamiento lógico, generación de código y comunicación ...

Últimas noticias

★★★★★
Valóranos en Google
Esta web utiliza cookies técnicas, de personalización y análisis, propias y de terceros, para facilitarle la navegación de forma anónima y analizar estadísticas del uso de la web. Consideramos que si continúa navegando, acepta su uso.