Anthropic presenta Claude Opus 4.6, con mejoras en razonamiento, programación y manejo de contextos largos. El modelo lidera varios benchmarks frente a GPT-5.2 y Gemini 3 Pro.
Claude Opus 4.6 es la nueva versión del modelo de mayor capacidad de Anthropic, disponible en claude.ai, la API y las principales plataformas en la nube, con el mismo precio que su predecesor: 5 y 25 dólares por millón de tokens de entrada y salida respectivamente.
La novedad más relevante en términos técnicos es la ventana de contexto de un millón de tokens en fase beta, que llega por primera vez a los modelos de gama Opus y permite procesar bases de código completas, contratos extensos o grandes volúmenes de documentos en una sola consulta. En la prueba MRCR v2, que evalúa la localización de información en textos muy largos, Opus 4.6 alcanza un 76% frente al 18,5% de Sonnet 4.5.
Los benchmarks comparativos con otros modelos muestran resultados destacados en varias categorías. En programación terminal agéntica (Terminal-Bench 2.0) obtiene un 65,4%, frente al 64,7% de GPT-5.2 y el 56,2% de Gemini 3 Pro. En búsqueda agéntica (BrowseComp) alcanza el 84%, frente al 77,9% de GPT-5.2 y el 59,2% de Gemini 3 Pro. En tareas de oficina con valor económico (GDPVal-AA), logra 1.606 puntos Elo frente a los 1.462 de GPT-5.2 y los 1.195 de Gemini 3 Pro, lo que equivale a superar al segundo mejor modelo del mercado aproximadamente el 70% de las veces en esta evaluación.
En programación, Opus 4.6 alcanza un 80,8% en SWE-bench Verified y planifica con mayor cuidado, mantiene tareas agénticas durante más tiempo y detecta errores propios con más fiabilidad. En Claude Code se ha introducido la posibilidad de configurar equipos de agentes que trabajan en paralelo sobre diferentes partes de un mismo proyecto.
En seguridad, el modelo mantiene una tasa baja de comportamientos no deseados comparable a la de Opus 4.5, hasta ahora el modelo mejor alineado de la compañía, y registra la tasa más baja de rechazos incorrectos ante consultas legítimas entre los modelos recientes de Claude.
Opus 4.6 también amplía la capacidad de salida hasta 128.000 tokens y llega acompañado de mejoras en Claude en Excel y del lanzamiento en fase de prueba de Claude en PowerPoint, disponible para los planes Max, Team y Enterprise.
Entre las novedades para desarrolladores, la API incorpora controles de esfuerzo en cuatro niveles, pensamiento adaptativo y compactación de contexto en fase beta.
Anthropic desarrolla sistemas de inteligencia artificial fiables e interpretables desde un enfoque científico de seguridad. La compañía integra investigación avanzada y colaboración ...
Claude es un sistema de IA conversacional de Anthropic diseñado para procesar lenguaje natural e imágenes, proporcionando análisis, razonamiento lógico, generación de código y comunicación ...
24/07/2026
Anthropic presenta su nuevo modelo de la gama Opus, que se acerca a la inteligencia de Fable 5 en tareas de programación y trabajo de conocimiento ...
21/07/2026
Hugging Face detectó una intrusión atribuida a un agente autónomo de IA. Días después, OpenAI confirmó que fueron sus propios modelos, en una ...
16/07/2026
SpaceXAI ha presentado Grok 4.5, su modelo más avanzado hasta la fecha, entrenado junto con Cursor y orientado a programación, tareas de agentes y ...
16/07/2026
Moonshot AI ha presentado Kimi K3, un modelo de código abierto de 2,8 billones de parámetros que, según sus propios datos, supera a varios modelos ...