Conform Mediafax: Cercetătorii au demonstrat cum AI-ul a facilitat accesul la sisteme interne OpenAI, obținând o recompensă de 6.500 de dolari. Experimentul, realizat în cadrul programului oficial de recompensare a vulnerabilităților, a scos la iveală lanțuri de probleme de securitate, de la un forum public la infrastructura de dezvoltare a companiei.

Lanțul de vulnerabilități, de la imagine la server

Totul a început pe forumul comunității OpenAI, care utilizează platforma Discourse. Cercetătorii de la Hacktron AI au identificat o vulnerabilitate legată de procesarea imaginilor în format HEIF/HEIC. Un fișier imagine modificat special putea exploata o problemă într-o bibliotecă software, permițând executarea de cod pe serverul care procesa imaginea, o tehnică cunoscută sub numele de remote code execution (RCE).

Folosind modelul Claude Opus 4.8, echipa a încercat să construiască un exploit. Acesta a funcționat într-un mediu cu anumite protecții dezactivate, dar nu a fost viabil pentru configurația reală. Ulterior, după lansarea Claude Opus 5 pe 24 iulie, cercetătorii au reluat testele. Noul model a generat, în aproximativ trei ore, un exploit funcțional într-un mediu local și a contribuit la adaptarea acestuia pentru configurația Discourse.

Acces la servicii OpenAI prin tokenuri

După obținerea accesului la infrastructura forumului, cercetătorii au descoperit o a doua problemă, de data aceasta în sistemul de autentificare al OpenAI. Această vulnerabilitate permitea, în anumite condiții, extragerea unor tokenuri de autentificare asociate utilizatorilor conectați. Aceste tokenuri puteau fi folosite pentru a accesa diverse servicii OpenAI, inclusiv ChatGPT și Codex.

Unul dintre conturile vizate aparținea unui angajat OpenAI și era conectat la organizația internă GitHub a companiei. Astfel, lanțul de vulnerabilități a evoluat de la un serviciu extern la sistemele interne de dezvoltare software.

Demonstrarea accesului la monorepo-ul privat

Pentru a dovedi accesul la repository-ul intern, cercetătorii au folosit contul angajatului OpenAI pentru a crea o cerere în „monorepo-ul” privat al companiei. Un monorepo este un depozit Git de mari dimensiuni unde este stocat codul mai multor proiecte software. Cercetătorii susțin că s-au oprit înainte de a analiza sau copia informații sensibile, demonstrând astfel potențialul lanțului de vulnerabilități de a accesa infrastructura internă de dezvoltare.

Reacția OpenAI și recompensa

Cercetătorii au raportat vulnerabilitățile prin programul bug bounty al OpenAI, iar compania a confirmat și a remediat problemele. OpenAI a identificat două probleme distincte: una în serviciul extern Discourse și alta în propriul sistem de autentificare. Compania a restrâns permisiunile tokenurilor de autentificare și a revocat tokenurile și sesiunile afectate. Echipa Hacktron AI a primit o recompensă de 6.500 de dolari pentru descoperirile sale.

Experimentul a durat mai puțin de 72 de ore de la descoperirea inițială până la demonstrarea accesului la repository-ul OpenAI. Cercetătorii estimează că munca efectivă a oamenilor a însumat doar câteva ore, restul activității tehnice fiind realizat cu ajutorul modelelor AI.

AI-ul, un instrument cu dublu tăiș

Acest caz subliniază o problemă majoră pentru industria inteligenței artificiale: modelele care pot identifica și remedia vulnerabilități pot, în același timp, accelera dezvoltarea atacurilor informatice. Deși Anthropic afirmă că modelul Opus 5 nu a fost antrenat specific pentru securitate cibernetică, performanțele sale în acest domeniu au crescut odată cu îmbunătățirea capacităților generale. Compania menține restricții suplimentare pentru anumite activități cibernetice și oferă acces autorizat la versiuni cu mai puține limitări prin programul său Cyber Verification Program. Cercetătorii au subliniat, totuși, că experimentul nu a constituit un atac clandestin, ci a fost realizat în cadrul unui program oficial de securitate.

Sursa: Mediafax