Anthropic lansează Claude Opus 5, un nou model de inteligență artificială axat pe siguranță

Anthropic lansează Claude Opus 5, un nou model de inteligență artificială axat pe siguranță
Imagine Anthropic lansează Claude Opus 5 (Foto: Flickr)
Noul sistem se apropie de performanțele celor mai avansate modele ale companiei, dar este conceput pentru a limita capacitatea de exploatare a vulnerabilităților informatice.

Compania Anthropic a prezentat vineri Claude Opus 5, cea mai nouă versiune din familia sa de modele de inteligență artificială. Noul sistem este descris ca fiind mai greu de deturnat pentru atacuri cibernetice și mai puțin predispus la comportamente nedorite.

În gama Claude, modelul preia locul Opus 4.8, disponibil de la sfârșitul lunii mai. Compania a lansat între timp și Fable 5, un sistem cu caracteristici diferite.

Opus 5 se apropie de performanțele Fable 5

Varianta Fable 5 folosește o versiune restricționată a modelului Mythos 5. Acesta din urmă este prezentat drept cel mai performant sistem dezvoltat de Anthropic, conform Mediafax.

Accesul la Mythos 5 a fost acordat unui grup limitat de companii și organizații. Utilizarea sa este destinată proiectelor care urmăresc îmbunătățirea securității internetului.

Conform Anthropic, Opus 5 „se apropie de capacitățile lui Fable 5 în numeroase domenii, la jumătate din preț”.

După apariția Fable 5 în iunie, performanțele sale au atras aprecieri. Costurile ridicate au generat însă și critici, mai ales în comparație cu modelele concurente, printre care GPT-5.6 al OpenAI.

Costurile agenților IA devin tot mai importante

Până de curând, prețul utilizării inteligenței artificiale a primit mai puțină atenție. Abonamentele generoase oferite de companii, uneori în pierdere, au contribuit la această situație.

Odată cu dezvoltarea agenților AI, costurile au devenit însă o problemă importantă. Aceste sisteme pot îndeplini mai multe sarcini pornind de la instrucțiuni formulate în limbaj natural.

În plus, agenții pot verifica rezultatele obținute și le pot modifica atunci când este necesar. Funcționarea lor necesită însă resurse de calcul mult mai mari decât în cazul modelelor generative clasice.

Prin urmare, utilizarea unor asemenea sisteme poate deveni considerabil mai costisitoare.

Anthropic pune accent pe „alinierea” modelului

Un alt element evidențiat de companie este calibrarea Opus 5. Anthropic îl descrie drept „cel mai aliniat” model pe care l-a lansat până acum.

Prin „aliniere” sunt înțelese mecanismele prin care un sistem AI este determinat să respecte intențiile dezvoltatorilor și regulile stabilite. Scopul acestora este reducerea riscului apariției unor comportamente nedorite.

Tema a revenit în atenție și pe fondul unui presupus incident atribuit unor modele OpenAI aflate în testare. Potrivit relatării din materialul-sursă, două sisteme ar fi ieșit din mediul controlat de evaluare și ar fi atacat platforma de inteligență artificială Hugging Face.

Astfel de situații au alimentat preocupările specialiștilor privind modelele care pot lua inițiative contrare instrucțiunilor primite. O altă problemă este posibilitatea ca asemenea acțiuni să nu fie semnalate dezvoltatorilor.

„Cea mai redusă rată de comportament ascuns”

Testările realizate de companie indică, potrivit Anthropic, rezultate mai bune în această privință. Opus 5 ar avea „cea mai redusă rată de comportament ascuns” dintre modelele sale avansate.

Totodată, dezvoltatorul afirmă că a „evitat în mod intenționat să antreneze Opus 5 pentru sarcini de securitate cibernetică”. Progresele generale față de generațiile precedente i-au îmbunătățit însă și capacitățile în acest domeniu.

În detectarea vulnerabilităților informatice, Opus 5 ar ajunge aproape de performanțele Mythos 5, conform companiei. Diferența devine mai mare atunci când sistemul trebuie să exploateze vulnerabilitățile identificate.

Această limitare ar putea reduce capacitatea modelului de a fi utilizat pentru desfășurarea unor eventuale atacuri cibernetice.

0 comentarii Comentarii