Anthropic presenta el seu nou model Opus, que s'acosta a la intel·ligència de Fable 5 en programació i treball de coneixement a meitat de cost, tot i que continua per darrere en ciberseguretat.
Anthropic ha llançat Opus 5, disponible des d'avui a totes les seves plataformes al mateix preu que el seu antecessor: 5 dòlars per milió de tokens d'entrada i 25 dòlars per milió de tokens de sortida.
En avaluacions de programació i treball de coneixement com Frontier-Bench i GDPval-AA, Opus 5 esdevé el nou referent del sector. A Frontier-Bench v0.1 assoleix un 43,3% d'encert, davant el 21,1% d'Opus 4.8, més del doble. A CursorBench se situa a menys de mig punt percentual de Fable 5, però a meitat de cost per tasca. En raonament sobre problemes nous (ARC-AGI-3) obté un 30,2%, molt per sobre del 7,8% del següent model millor situat. En tasques d'ús d'ordinador (OSWorld 2.0) arriba al 70,6%, superant el millor resultat de Fable 5 (66,1%) amb menys d'un terç del seu cost per tasca, segons la companyia.
El model també millora en recerca científica: puja 10,2 punts percentuals respecte a Opus 4.8 en química orgànica, com inferir estructures moleculars a partir d'espectroscòpia, i 7,7 punts en tasques relacionades amb proteïnes.
Pel que fa a la seguretat, Anthropic afirma que Opus 5 és el seu model més alineat fins ara, amb la taxa més baixa de comportament enganyós de les seves auditories internes. Tanmateix, precisa que no amplia la frontera en capacitats de doble ús: continua per darrere de Mythos 5 en recerca biològica i ciberseguretat ofensiva. S'acosta a Mythos 5 a l'hora d'identificar vulnerabilitats de programari, però queda per darrere en el desenvolupament d'exploits per aprofitar-les.
Els classificadors de seguretat d'Opus 5 són menys restrictius que els de Fable 5 en l'àmbit de la ciberseguretat, i Anthropic estima que intervindran al voltant d'un 85% menys. El model passa a ser el predeterminat a Claude Max i el més potent disponible a Claude Pro, i també s'ofereix en mode ràpid, amb una velocitat 2,5 vegades superior a l'estàndard.
Anthropic desenvolupa sistemes d'intel·ligència artificial fiables i interpretables des d'un enfocament científic de seguretat. La companyia integra recerca avançada i col·laboració ...
Claude és un sistema d'IA conversacional d'Anthropic dissenyat per processar llenguatge natural i imatges, proporcionant anàlisi, raonament lògic, generació de codi i comunicació multilingüe ...
08/09/2026
Meta presenta Muse, un agent d'intel·ligència artificial que no només respon preguntes, sinó que executa tasques i projectes en nom de l'usuari, ...
04/09/2026
OpenAI presenta GPT-6 Astra, un model que millora l'ús d'ordinador, el treball professional, la programació i la ciberseguretat, i que respecta ...
03/09/2026
xAI amplia Grok Bot, els seus agents d'intel·ligència artificial capaços de treballar de forma autònoma dins d'aplicacions i eines, a les ...
27/08/2026
Un centenar i mig d'organitzacions tecnològiques, bancs i empreses de ciberseguretat signen una carta publicada per OpenAI que adverteix d'un ...