Opus 5 double les performances en programmation au même prix que son prédécesseur

24/07/2026

Anthropic dévoile son nouveau modèle Opus, qui approche l'intelligence de Fable 5 en programmation et travail de connaissance pour moitié moins cher, tout en restant en retrait en cybersécurité.

Opus 5 double les performances en programmation au même prix que son prédécesseur

## Corps (1983 caracteres)
Anthropic a lancé Opus 5, disponible dès aujourd'hui sur toutes ses plateformes au même prix que son prédécesseur : 5 dollars par million de jetons en entrée et 25 dollars par million de jetons en sortie.

Sur les évaluations de programmation et de travail de connaissance comme Frontier-Bench et GDPval-AA, Opus 5 devient la nouvelle référence du secteur. Sur Frontier-Bench v0.1, il atteint 43,3% de réussite, contre 21,1% pour Opus 4.8, soit plus du double. Sur CursorBench, il se situe à moins d'un demi-point de Fable 5, pour moitié moins cher par tâche. Sur le raisonnement face à des problèmes inédits (ARC-AGI-3), il obtient 30,2%, largement devant les 7,8% du modèle suivant. Sur les tâches d'utilisation d'ordinateur (OSWorld 2.0), il atteint 70,6%, dépassant le meilleur résultat de Fable 5 (66,1%) pour moins d'un tiers de son coût par tâche, selon l'entreprise.

Le modèle progresse aussi en recherche scientifique : il gagne 10,2 points de pourcentage par rapport à Opus 4.8 en chimie organique, comme déduire des structures moléculaires à partir de données de spectroscopie, et 7,7 points sur les tâches liées aux protéines.

Côté sécurité, Anthropic affirme qu'Opus 5 est son modèle le plus aligné à ce jour, avec le taux de comportement trompeur le plus bas de ses audits internes. Toutefois, l'entreprise précise que le modèle ne repousse pas la frontière des capacités à double usage : il reste derrière Mythos 5 en recherche biologique comme en cybersécurité offensive. Il se rapproche de Mythos 5 pour identifier des vulnérabilités logicielles, mais reste largement en retrait pour développer des exploits.

Les classificateurs de sécurité d'Opus 5 sont moins restrictifs que ceux de Fable 5 en cybersécurité, et Anthropic estime qu'ils interviendront environ 85% moins souvent. Le modèle devient le modèle par défaut sur Claude Max et le plus puissant disponible sur Claude Pro, et il est aussi proposé en mode rapide, 2,5 fois plus rapide que le mode standard.

Points clés

  • Anthropic lance Opus 5, disponible dès aujourd'hui au même prix qu'Opus 4.8.
  • Double les performances d'Opus 4.8 en programmation (Frontier-Bench).
  • Se rapproche de Fable 5 sur CursorBench pour moitié moins cher.
  • Triple le meilleur modèle suivant sur les problèmes inédits (ARC-AGI-3).
  • Dépasse Fable 5 sur l'utilisation d'ordinateur pour un tiers du coût.
  • Progresse en chimie organique et sur les tâches liées aux protéines.
  • Modèle le plus aligné d'Anthropic à ce jour.
  • Reste derrière Mythos 5 en biologie et cybersécurité offensive.
  • Les classificateurs de sécurité interviennent 85% moins souvent que ceux de Fable 5.
  • Modèle par défaut sur Claude Max et le plus puissant sur Claude Pro.

Vidéos

IA connexe

Anthropic

Systèmes d'IA dignes de confiance

Anthropic développe des systèmes d'intelligence artificielle fiables et interprétables selon une approche scientifique de la sécurité. L'entreprise intègre recherche avancée et collaboration ...

Claude

Créez avec Claude

Claude est un système d'IA conversationnelle d'Anthropic conçu pour traiter le langage naturel et les images, fournissant analyse, raisonnement logique, génération de code et communication ...

Dernières nouvelles

★★★★★
Évaluez-nous sur Google
Ce site utilise des cookies techniques, de personnalisation et d’analyse, propres et tiers, pour faciliter la navigation anonyme et analyser les statistiques d’utilisation du site. Nous considérons que si vous continuez à naviguer, vous acceptez leur utilisation.