Opus 5 duplica el rendiment en programació al mateix cost que el seu antecessor

24/07/2026

Anthropic presenta el seu nou model Opus, que s'acosta a la intel·ligència de Fable 5 en programació i treball de coneixement a meitat de cost, tot i que continua per darrere en ciberseguretat.

Opus 5 duplica el rendiment en programació al mateix cost que el seu antecessor

Anthropic ha llançat Opus 5, disponible des d'avui a totes les seves plataformes al mateix preu que el seu antecessor: 5 dòlars per milió de tokens d'entrada i 25 dòlars per milió de tokens de sortida.

En avaluacions de programació i treball de coneixement com Frontier-Bench i GDPval-AA, Opus 5 esdevé el nou referent del sector. A Frontier-Bench v0.1 assoleix un 43,3% d'encert, davant el 21,1% d'Opus 4.8, més del doble. A CursorBench se situa a menys de mig punt percentual de Fable 5, però a meitat de cost per tasca. En raonament sobre problemes nous (ARC-AGI-3) obté un 30,2%, molt per sobre del 7,8% del següent model millor situat. En tasques d'ús d'ordinador (OSWorld 2.0) arriba al 70,6%, superant el millor resultat de Fable 5 (66,1%) amb menys d'un terç del seu cost per tasca, segons la companyia.

El model també millora en recerca científica: puja 10,2 punts percentuals respecte a Opus 4.8 en química orgànica, com inferir estructures moleculars a partir d'espectroscòpia, i 7,7 punts en tasques relacionades amb proteïnes.

Pel que fa a la seguretat, Anthropic afirma que Opus 5 és el seu model més alineat fins ara, amb la taxa més baixa de comportament enganyós de les seves auditories internes. Tanmateix, precisa que no amplia la frontera en capacitats de doble ús: continua per darrere de Mythos 5 en recerca biològica i ciberseguretat ofensiva. S'acosta a Mythos 5 a l'hora d'identificar vulnerabilitats de programari, però queda per darrere en el desenvolupament d'exploits per aprofitar-les.

Els classificadors de seguretat d'Opus 5 són menys restrictius que els de Fable 5 en l'àmbit de la ciberseguretat, i Anthropic estima que intervindran al voltant d'un 85% menys. El model passa a ser el predeterminat a Claude Max i el més potent disponible a Claude Pro, i també s'ofereix en mode ràpid, amb una velocitat 2,5 vegades superior a l'estàndard.

Punts clau

  • Anthropic llança Opus 5, disponible avui al mateix preu que Opus 4.8.
  • Duplica el rendiment d'Opus 4.8 en programació (Frontier-Bench).
  • S'acosta a Fable 5 a CursorBench a meitat de cost.
  • Triplica el següent millor model en problemes nous (ARC-AGI-3).
  • Supera Fable 5 en ús d'ordinador amb un terç del cost.
  • Millora en química orgànica i tasques amb proteïnes.
  • És el model més alineat d'Anthropic fins ara.
  • Continua per darrere de Mythos 5 en biologia i ciberseguretat ofensiva.
  • Els classificadors de seguretat intervenen un 85% menys que els de Fable 5.
  • És el model predeterminat a Claude Max i el més potent a Claude Pro.

Vídeos

IA relacionada

Anthropic

Sistemes d'IA en els quals confiar

Anthropic desenvolupa sistemes d'intel·ligència artificial fiables i interpretables des d'un enfocament científic de seguretat. La companyia integra recerca avançada i col·laboració ...

Claude

Crea amb Claude

Claude és un sistema d'IA conversacional d'Anthropic dissenyat per processar llenguatge natural i imatges, proporcionant anàlisi, raonament lògic, generació de codi i comunicació multilingüe ...

Últimes noticies

★★★★★
Valora'ns a Google
Aquest lloc web utilitza cookies tècniques, de personalització i anàlisi, pròpies i de tercers, per facilitar la navegació anònima i analitzar estadístiques d’ús del web. Considerem que si continueu navegant, n’accepteu l’ús.