- Echipa de la Hacktron A.I a obținut acces la contul ChatGPT al unui angajat OpenAI, iar de acolo a ajuns la codul intern al companiei găzduit pe GitHub.
- Cercetătorii au încercat inițial atacul cu Claude Opus 4.8, dar modelul nu a reușit să producă un exploit funcțional. După lansarea Opus 5, tentativa a avut succes.
- Atacul a fost realizat în cadrul programului de bug bounty al OpenAI, iar compania le-a plătit cercetătorilor o recompensă de 6.500 de dolari și a remediat vulnerabilitățile identificate.
- Hacktron A.I susține că exploatarea a necesitat doar câteva zile de lucru pentru un agent AI și câteva ore de intervenție umană, ceea ce ridică noi întrebări despre modul în care modelele avansate pot accelera atacurile informatice.
Un grup de cercetători în securitate cibernetică a reușit să acceseze sisteme interne ale OpenAI folosind Claude, modelul de Inteligență Artificială dezvoltat de compania rivală Anthropic. Incidentul a avut loc în cadrul programului de identificare a vulnerabilităților derulat de OpenAI și scoate în evidență riscurile tot mai mari asociate modelelor A.I avansate.
Cercetătorii de la Hacktron A.I au obținut acces la contul ChatGPT al unui angajat OpenAI, iar ulterior au ajuns la codul intern al companiei găzduit pe GitHub. Echipa a raportat vulnerabilitatea către OpenAI, iar compania le-a acordat o recompensă de 6.500 de dolari.
Potrivit cercetătorilor, prima încercare a fost realizată cu Claude Opus 4.8, însă modelul nu a reușit să genereze un exploit funcțional. După lansarea Claude Opus 5, echipa a repetat tentativa, iar modelul a reușit să ducă atacul la capăt. Cercetătorii au remarcat astfel cât de rapid cresc capacitățile modelelor de Inteligență Artificială.
Atacul a făcut parte din proiectul „HEIF Heist”, o cercetare mai amplă privind vulnerabilitățile asociate modului în care anumite servicii și programe procesează fișiere imagine. Potrivit Hacktron A.I, proiectul a identificat vulnerabilități și în servicii precum Slack, Zoom și Meta.
Cercetătorii susțin că accesarea sistemelor OpenAI a necesitat doar câteva zile de lucru pentru un agent A.I și câteva ore de intervenție umană. În opinia lor, evoluția modelelor A.I reduce timpul și resursele necesare pentru activități care, în trecut, necesitau echipe specializate și perioade mult mai lungi.
OpenAI a mulțumit cercetătorilor pentru informațiile furnizate și a anunțat că vulnerabilitățile identificate au fost remediate. Incidentul relansează însă discuția despre impactul modelelor A.I asupra securității informatice și despre necesitatea ca sistemele de protecție să țină pasul cu noile capacități ale instrumentelor de Inteligență Artificială.
