Într-un experiment de o complexitate uluitoare care demonstrează potențialul destabilizator al noilor tehnologii computaționale, o echipă de experți independenți a reușit să penetreze infrastructura privată a gigantului OpenAI. Ironia sorții face ca breșa de securitate să fi fost realizată cu ajutorul direct al unui model lingvistic dezvoltat de marea sa rivală din Silicon Valley, compania Anthropic. Folosind versiuni succesive ale asistentului autonom Claude, specialiștii au preluat controlul asupra contului de ChatGPT al unui angajat oficial al OpenAI, obținând o poartă de acces direct către codul sursă intern al companiei. Testul s-a desfășurat în cadrul programului oficial de recompense Bug Bounty, iar managementul OpenAI a remediat de urgență vulnerabilitățile, acordând echipei o recompensă financiară de 6500 de dolari.
Investigația de securitate, realizată de echipa de elită Hacktron AI, a debutat prin identificarea unei vulnerabilități în sistemul de procesare a imaginilor de pe forumul public al comunității OpenAI, o platformă externă bazată pe arhitectura Discourse. Cercetătorii au descoperit o breșă critică în modul în care serverele procesau fișierele foto în formate moderne de tip HEIF/HEIC. Un fișier imagine modificat malițios a exploatat o bibliotecă software internă, permițând rularea de la distanță a unui cod arbitrar pe serverul gazdă – o eroare de tipul Remote Code Execution (RCE).
În această etapă de atac a fost integrată inteligența artificială a rivalilor de la Anthropic. Inițial, modelul Claude Opus 4.8 a ajutat la structurarea parțială a codului de atac (exploit), însă s-a dovedit incapabil să livreze o soluție stabilă pentru rețeaua reală. Turnura decisivă a avut loc pe 24 iulie, odată cu lansarea pe piață a noului și mult mai puternicului model Claude Opus 5. Integrat într-o versiune specială dedicată exclusiv cercetătorilor prin programul Cyber Verification Program, Opus 5 a avut nevoie de numai trei ore pentru a genera în mod autonom un exploit perfect funcțional într-un mediu local, adaptându-l ulterior cu succes la sistemele Discourse ale OpenAI.
Odată ce infrastructura forumului a fost compromisă, Hacktron AI a descoperit o a doua eroare majoră, localizată în sistemul central de autentificare al OpenAI. Această defecțiune permitea, în condiții specifice, interceptarea token-urilor de autentificare ale utilizatorilor care se conectau pe forum. Folosind aceste chei digitale, cercetătorii au putut accesa direct conturi operaționale de ChatGPT și Codex.
Situația a devenit critică în momentul în care unul dintre conturile compromise s-a dovedit a aparține unui inginer software din cadrul OpenAI. Acest cont personal era interconectat direct cu profilul de GitHub al companiei. Astfel, prin acest efect de domino, atacul a evadat din zona unui forum extern și a pătruns adânc în monorepo-ul privat al OpenAI – depozitul digital securizat în care compania își păstrează codul sursă și secretele comerciale pentru majoritatea proiectelor sale majore. Pentru a demonstra succesul operațiunii fără a extrage ilegal date sau a spiona secrete industriale, cercetătorii s-au oprit din rularea codului și au folosit contul angajatului doar pentru a crea o cerere de test (pull request) în interiorul sistemului.
Întregul lanț de atac s-a derulat într-un timp record de mai puțin de 72 de ore, efortul fizic al oamenilor însumând doar câteva ore, restul muncii brute de programare fiind preluată de algoritmul Claude Opus 5. Deși Anthropic precizează că Opus 5 nu a fost antrenat specific drept o armă de atac cibernetic, performanțele sale native reaprind dezbaterea privind capacitatea sistemelor AI de a automatiza atacuri informatice severe la o viteză imposibil de blocat de apărătorii umani.
Sursa: Mediafax