După OpenAI, și modelele AI ale Anthropic au intrat neautorizat în sistemele unor organizații externe
Modelele de inteligență artificială (AI) ale companiei Anthropic „au obținut acces neautorizat” la trei organizații externe în timpul unor teste menite să le țină la distanță de sistemele „din lumea reală”, a declarat joi compania, potrivit Euronews.
Anunțul vine la doar câteva zile după ce rivalul OpenAI a dezvăluit pentru prima dată că modelele sale au accesat în mod neautorizat internetul și au acționat în mod neautorizat în timpul testelor de securitate.
Anthropic a evaluat peste 141.000 de „rulări de evaluare” și a constatat că trei versiuni diferite ale modelului său, cunoscut sub numele de Claude, au accesat în mod neautorizat sistemele a trei organizații, pe care nu le-a numit.
Spre deosebire de incidentul legat de tehnologia OpenAI, modelele Anthropic au avut acces la internet „din cauza unei neînțelegeri între noi și partenerul nostru de evaluare”, numit Irregular, a precizat Anthropic într-o postare.
Cu toate acestea, Claude a folosit „tehnici de bază, precum exploatarea parolelor slabe și a punctelor finale neautentificate”, a continuat blogul.
Printre modelele implicate s-a numărat unul dintre cele mai puternice ale sale, cunoscut sub numele de Mythos 5, care a fost pus la dispoziție doar unui număr limitat de parteneri aprobați.
Anthropic colaborează cu Irregular pentru a evalua situația, a precizat compania, și a contactat sau a încercat să contacteze toate cele trei organizații afectate.
Sisteme scăpate de sub control
Atât OpenAI, cât și Anthropic și-au lansat în acest an cele mai puternice modele, cunoscute sub numele de Sol și, respectiv, Mythos, amplificând îngrijorările din întreaga industrie cu privire la siguranță și securitate.
Aceste îngrijorări se referă, de asemenea, la așa-numiții agenți AI, care sunt produse software concepute pentru a îndeplini sarcini în mod autonom.
OpenAI a recunoscut săptămâna trecută că modelele sale au ieșit din mediul lor izolat în timpul testării, s-au conectat la internet și s-au infiltrat pe Hugging Face, un site unde dezvoltatorii își stochează și partajează coduri.
Câteva zile mai târziu, OpenAI a declarat că a identificat încă trei incidente.
Sam Altman, CEO-ul OpenAI, a declarat într-un podcast săptămâna aceasta că, în urma incidentului, compania și-a „suspendat” propriile teste, în timp ce a îmbunătățit securitatea sistemului său de „sandboxing” – procesul de izolare a software-ului într-un mediu controlat în scopul testării.
Incidentul a declanșat, de asemenea, o petiție semnată de peste 1.000 de angajați ai unor companii de vârf din domeniul AI, prin care se solicită guvernului SUA să contribuie la încetinirea lansării celor mai avansate modele de AI. Dario Amodei, CEO-ul Anthropic, s-a numărat printre semnatarii petiției.









