Anthropic dévoile son nouveau modèle Opus, qui approche l'intelligence de Fable 5 en programmation et travail de connaissance pour moitié moins cher, tout en restant en retrait en cybersécurité.
## Corps (1983 caracteres)
Anthropic a lancé Opus 5, disponible dès aujourd'hui sur toutes ses plateformes au même prix que son prédécesseur : 5 dollars par million de jetons en entrée et 25 dollars par million de jetons en sortie.
Sur les évaluations de programmation et de travail de connaissance comme Frontier-Bench et GDPval-AA, Opus 5 devient la nouvelle référence du secteur. Sur Frontier-Bench v0.1, il atteint 43,3% de réussite, contre 21,1% pour Opus 4.8, soit plus du double. Sur CursorBench, il se situe à moins d'un demi-point de Fable 5, pour moitié moins cher par tâche. Sur le raisonnement face à des problèmes inédits (ARC-AGI-3), il obtient 30,2%, largement devant les 7,8% du modèle suivant. Sur les tâches d'utilisation d'ordinateur (OSWorld 2.0), il atteint 70,6%, dépassant le meilleur résultat de Fable 5 (66,1%) pour moins d'un tiers de son coût par tâche, selon l'entreprise.
Le modèle progresse aussi en recherche scientifique : il gagne 10,2 points de pourcentage par rapport à Opus 4.8 en chimie organique, comme déduire des structures moléculaires à partir de données de spectroscopie, et 7,7 points sur les tâches liées aux protéines.
Côté sécurité, Anthropic affirme qu'Opus 5 est son modèle le plus aligné à ce jour, avec le taux de comportement trompeur le plus bas de ses audits internes. Toutefois, l'entreprise précise que le modèle ne repousse pas la frontière des capacités à double usage : il reste derrière Mythos 5 en recherche biologique comme en cybersécurité offensive. Il se rapproche de Mythos 5 pour identifier des vulnérabilités logicielles, mais reste largement en retrait pour développer des exploits.
Les classificateurs de sécurité d'Opus 5 sont moins restrictifs que ceux de Fable 5 en cybersécurité, et Anthropic estime qu'ils interviendront environ 85% moins souvent. Le modèle devient le modèle par défaut sur Claude Max et le plus puissant disponible sur Claude Pro, et il est aussi proposé en mode rapide, 2,5 fois plus rapide que le mode standard.
Anthropic développe des systèmes d'intelligence artificielle fiables et interprétables selon une approche scientifique de la sécurité. L'entreprise intègre recherche avancée et collaboration ...
Claude est un système d'IA conversationnelle d'Anthropic conçu pour traiter le langage naturel et les images, fournissant analyse, raisonnement logique, génération de code et communication ...
08/09/2026
Meta présente Muse, un agent d'intelligence artificielle qui ne se contente pas de répondre aux questions : il exécute des tâches et des projets ...
04/09/2026
OpenAI présente GPT-6 Astra, un modèle qui améliore l'utilisation de l'ordinateur, le travail professionnel, la programmation et la ...
03/09/2026
xAI étend Grok Bot, ses agents d'intelligence artificielle capables de travailler de façon autonome dans les applications et outils, aux ...
27/08/2026
Cent cinquante organisations technologiques, banques et entreprises de cybersécurité signent une lettre publiée par OpenAI qui alerte sur la ...