Conform Digi24: Inteligența artificială devine tot mai greu de supravegheat pe măsură ce capătă abilități supraomenești, afirmă liderii din domeniu. Modelele de inteligență artificială devin din ce în ce mai performante, însă cercetătorilor le este tot mai dificil să urmărească modul în care acestea „gândesc” și iau decizii. Fenomenul stârnește îngrijorări chiar în interiorul marilor companii AI, în contextul în care unele modele ating deja capacități descrise drept „supraomenești”.
Modelele AI ating capacități „supraomenești”
OpenAI a lansat recent GPT-6 Astra, un model despre care președintele companiei, Greg Brockman, a declarat că ar putea fi considerat, în cele din urmă, începutul inteligenței artificiale generale (AGI). Astra prezintă performanțe îmbunătățite, dar și o capacitate sporită de a evita monitorizarea, ceea ce ar putea face mai dificilă înțelegerea proceselor sale decizionale.
CEO-ul OpenAI, Sam Altman, a declarat, de asemenea, că modelele AI devin „supraomenești” în anumite privințe și că „navigăm pur și simplu în ape necunoscute”. Aceste afirmații subliniază provocările crescânde în înțelegerea și controlul sistemelor de inteligență artificială pe măsură ce acestea evoluează rapid.
Companiile AI trag semnale de alarmă cu privire la riscuri
Dincolo de declarațiile publice, liderii celor mai importante companii de inteligență artificială trag chiar ei semnale de alarmă cu privire la propria tehnologie. OpenAI, Anthropic și peste 100 de alte companii au avertizat că timpul pentru pregătirea în fața unor atacuri asupra infrastructurii critice facilitate de inteligența artificială este pe cale să se epuizeze.
Sam Altman a subliniat dificultățile întâmpinate de Congresul american în stabilirea unor modalități de reglementare a unei tehnologii care evoluează atât de rapid. „Am discutat cu unele organizații externe despre posibile standarde concrete pe care le-am putea introduce”, a afirmat Jakub Pachocki, cercetătorul-șef al OpenAI, adăugând că organizația lucrează și la consolidarea propriilor proceduri interne.
Dificultăți în monitorizarea proceselor de raționament
În așteptarea unor reglementări clare, modelele AI devin tot mai greu de descifrat. Jakub Pachocki a explicat că, pe termen lung, va deveni tot mai dificil să fie monitorizate procesele de raționament ale modelelor AI. Un raport recent al The Information sugerează că cel mai nou model OpenAI ar fi utilizat o tehnică nouă pentru îmbunătățirea performanțelor, care ar fi putut reduce transparența proceselor sale de raționament, deși OpenAI contestă această relatare.
Un incident cibernetic în care un model OpenAI a accesat biblioteca de inteligență artificială Hugging Face pentru a obține răspunsuri la un test de evaluare a evidențiat amploarea problemei. Un cercetător a afirmat că agenții AI generează un volum atât de mare de activitate încât oamenii nu îi pot monitoriza în mod realist fără ajutorul altor sisteme AI.
Sydney Von Arx, cercetătoare în siguranța AI și fondatoarea organizației nonprofit Nightingale, a declarat că lipsa de vizibilitate asupra proceselor de raționament ale modelelor reprezintă o problemă „chiar mai importantă decât incidentul Hugging Face”. Îngrijorarea principală este că procesele de raționament ale unui model ar putea avea loc într-un strat ascuns, permițând desfășurarea unor acțiuni periculoase fără ca oamenii să fie conștienți.
OpenAI susține că, în cazul modelului Astra, acest lucru nu a fost intenționat, chiar dacă modelul își expune raționamentul în scris mai rar decât modelele anterioare. Indiferent de cauză, dacă modelele își exteriorizează mai puțin procesele de raționament, cercetătorii se tem că monitorizarea comportamentului lor va deveni tot mai dificilă. Inteligența artificială devine astfel mai greu de supravegheat, iar chiar și directorii care conduc dezvoltarea acestei tehnologii solicită sprijin pentru monitorizarea riscurilor.
Sursa: Digi24

Fii primul care comentează