Conform Anthropic.com: Claude Opus 5, un nou model de inteligență artificială, a fost lansat astăzi, promițând performanțe de ultimă generație la un preț redus. Dezvoltat de Anthropic, acest model se aliniază la frontiera inteligenței artificiale, fiind poziționat ca o alternativă mai accesibilă la Claude Fable 5.
Performanță îmbunătățită și eficiență cost-beneficiu
Claude Opus 5 se remarcă prin îmbunătățiri semnificative ale performanței, la un cost comparabil cu predecesorul său, Opus 4.8. Testele pe platforme cheie precum Frontier-Bench și GDPval-AA îl plasează pe Opus 5 ca fiind noul standard de performanță în evaluările legate de codare și sarcini de lucru intelectuale. Deși remain în urma lui Mythos 5 în ceea ce privește sarcinile specifice de securitate cibernetică, Opus 5 excelează în numeroase alte domenii.
Modelul este conceput pentru utilizare zilnică, oferind o eficiență sporită. A devenit deja modelul implicit pentru Claude Max și cel mai performant pe Claude Pro. Pe platforme precum Frontier-Bench v0.1, Opus 5 depășește toate celelalte modele, dublându-și performanța față de Opus 4.8 la un cost mai mic. De asemenea, pe CursorBench 3.2, modelul se apropie de scorul maxim al lui Fable 5, dar la jumătate din costul per sarcină.
În sarcinile de cunoaștere și rezolvare de probleme, Opus 5 oferă rezultate remarcabile. Pe ARC-AGI 3, o evaluare ce implică rezolvarea de probleme noi, scorul Opus 5 este de trei ori mai mare decât al următorului model. Pe Zapier AutomationBench, care testează capacitatea modelelor de a finaliza sarcini de business, rata de succes a Opus 5 este de 1.5 ori mai mare decât a altor modele. În evaluarea OSWorld 2.0, modelul depășește toate celelalte la orice cost dat.
Opus 5 aduce, de asemenea, îmbunătățiri notabile în cercetarea științifică, în special în domeniul chimiei organice și în analiza proteinelor. Performanța sa în inferarea structurilor moleculare și predicția funcțiilor proteinelor este considerabil mai bună comparativ cu Opus 4.8. În plus, modelul este capabil să genereze output-uri vizuale mult mai puternice.
Caracteristici de operare și siguranță
Claude Opus 5 demonstrează o capacitate sporită de verificare a propriilor sarcini și de iterare metodică. Acesta se distinge prin „agenție” și o abordare riguroasă în rezolvarea problemelor complexe. Un exemplu notabil este capacitatea sa de a construi un pipeline de viziune computerizată pentru extragerea geometriei din imagini, un task pe care alte modele nu l-au putut soluționa în aceleași condiții.
Pe partea de siguranță, Opus 5 este cel mai aliniat model dezvoltat de Anthropic până în prezent. Acesta aderează mai bine la „Constituția Claude” decât predecesorii săi, manifestând rate scăzute de comportament dezinformat sau susceptibilitate la utilizare abuzivă. Modelul prezintă, de asemenea, un risc minim de acțiuni pripite cu efecte greu de reversat.
În evaluările riguroase, Opus 5 se menține sub nivelul lui Mythos 5 în domenii sensibile precum cercetarea biologică și securitatea cibernetică ofensivă. Deși identifică vulnerabilități software cu o eficiență comparabilă, capacitatea sa de a dezvolta exploit-uri pentru acestea rămâne limitată comparativ cu Mythos 5.
Măsurile de siguranță pentru Opus 5 sunt concepute pentru a permite utilizări benefice, inclusiv în domeniul ciberneticii. Restricțiile aplicate blochează scanarea bazată pe fișiere binare și generarea de exploit-uri, direcționând în schimb solicitările către modele anterioare, precum Opus 4.8, în cazul detectării unor potențiale riscuri. Pentru activități profesionale de securitate cibernetică, există programe speciale care permit accesul la versiuni cu restricții diminuate.
Disponibilitate și acces
Claude Opus 5 este disponibil începând de astăzi pe toate platformele Anthropic, la un preț de 5$ per milion de token-uri de intrare și 25$ per milion de token-uri de ieșire, același tarif ca pentru Opus 4.8. Dezvoltatorii pot accesa modelul prin API-ul Claude, sub numele claude-opus-5.
Modelul este oferit și în modul „Fast”, care rulează de aproximativ 2.5 ori mai rapid decât viteza implicită, fiind disponibil la dublul prețului de bază pe platforma Claude și prin credite de utilizare în Claude Code. Odată cu lansarea Opus 5, Anthropic a introdus în beta două actualizări majore: schimbări mid-conversation ale uneltelor pe platforma Claude, permițând modificarea acestora fără a invalida cache-ul de prompt, și fallback-uri automate pe API, care direcționează solicitările blocate de clasificatorii de siguranță către alte modele disponibile.
Sursa: Anthropic.com