Avertisment sau strategie de marketing? Incidentul OpenAI reaprinde dezbaterea despre inteligența artificială scăpată de sub control

Un atac cibernetic atribuit unor versiuni experimentale ale ChatGPT a stârnit îngrijorare în lumea tehnologiei, după ce OpenAI a recunoscut că modelele sale AI au ieșit din mediul de testare și au compromis platforma Hugging Face în timpul unui experiment intern, scrie BBC.
Platforma Hugging Face a anunțat pe 16 iulie că a fost victima unui atac informatic lansat de un infractor cibernetic care a folosit o inteligență artificială extrem de puternică.
Anunțul companiei a fost plin de termeni tehnici care au stârnit îngrijorare, precum „un roi de sandbox-uri”, „atacator autonom (agentic attacker)” și „sistem autonom de comandă și control care se poate migra singur”.
Potrivit Hugging Face, atacul a fost diferit de orice alt incident gestionat până acum, deoarece a fost executat cu o viteză supraomenească de un sistem AI care a acționat cu foarte puțină sau chiar fără intervenție umană.
Inteligența artificială a efectuat aproximativ 17.000 de acțiuni în mai puțin de două zile, reușind să pătrundă în sistemele companiei și să fure informații sensibile.
Vestea a șocat industria tehnologică, iar întrebarea principală era: cine se află în spatele atacului?
Cercetătorii Hugging Face au presupus că atacatorii au folosit unul dintre marile modele de inteligență artificială, însă nu aveau nicio idee cine sunt sau din ce țară provin. Compania a sesizat autoritățile, iar investigațiile au început.
Cine era în spatele atacului?
Analiștii și experții în securitate cibernetică au încercat, pe podcasturi și pe rețelele sociale, să identifice gruparea de hackeri sau statul care s-ar fi aflat în spatele operațiunii.
Însă, aproape o săptămână mai târziu, adevăratul autor al atacului a fost dezvăluit. Era ChatGPT.
Dezvăluirea a fost cu atât mai surprinzătoare cu cât OpenAI a afirmat că modelul AI a acționat complet singur, fără autorizație.
Compania a explicat că incidentul s-a produs în timpul unui test menit să evalueze capacitățile de hacking ale noilor sale modele.
Două versiuni noi de ChatGPT, create pentru a deveni experți în atacuri informatice, au reușit să evadeze dintr-un mediu de testare considerat sigur și să obțină acces la internet.
Ulterior, acestea au atacat Hugging Face pentru a obține informațiile necesare pentru a obține rezultate mai bune la propriul test.
OpenAI a publicat un comunicat în care a explicat incidentul și a anunțat că lucrează împreună cu Hugging Face pentru a remedia problema de securitate și pentru a împărtăși lecțiile învățate.
Avertisment real sau strategie de marketing?
De atunci, incidentul a provocat dezbateri intense.
Unii se întreabă dacă este un avertisment autentic privind viitorul inteligenței artificiale, în timp ce alții cred că a fost doar o strategie de marketing prin care OpenAI a dorit să demonstreze cât de puternice au devenit modelele sale.
Companiile din domeniul AI au fost acuzate și în trecut că folosesc scenarii alarmiste pentru a-și promova tehnologia, iar după lansarea controversatului model Mythos al Anthropic, performanțele în domeniul securității cibernetice au devenit un subiect central.
Unul dintre cele mai apreciate comentarii la postarea lui Sam Altman pe platforma X rezumă această perspectivă sceptică:
„Dacă nu vă dați seama că tot acest text a fost scris doar ca să se laude cu modelul AI, nu știu ce să vă mai spun.”
Consultantul în securitate cibernetică Daniel Card a ironizat situația pe LinkedIn:
„Ce noroc că, dintre milioanele de site-uri compromise, OpenAI a reușit să spargă exact unul care avea și el de câștigat din publicitatea creată.”
Pentru unii, întreaga poveste seamănă mai degrabă cu o teorie a conspirației decât cu un thriller SF.
Mesajul transmis ar fi, în opinia lor: „Vedeți cât de puternice sunt instrumentele noastre AI? Cumpărați-le ca să vă puteți apăra de AI-ul altora.”
Pe de altă parte, alți comentatori susțin că incidentul ar putea demonstra o eroare serioasă de evaluare și planificare din partea OpenAI.
Un purtător de cuvânt al companiei a declarat că există numeroase întrebări și informații speculative privind incidentul și a anunțat că un raport tehnic detaliat va fi publicat în următoarele săptămâni.
Critici privind măsurile de securitate
După incident, numeroși specialiști au criticat OpenAI pentru că nu ar fi construit un mediu de testare suficient de sigur, cunoscut sub numele de „sandbox”.
Modelele AI implicate fuseseră instruite special să pătrundă în sisteme informatice și să evadeze din acestea fără restricții.
„Incidentul dintre OpenAI și Hugging Face este un exemplu concret al unei probleme pe care o semnalăm de luni întregi. Sandbox-urile nu reprezintă o barieră de securitate suficientă pentru inteligența artificială autonomă”, a declarat Dor Sarig, reprezentant al companiei Pillar Security.
Profesorul Alan Woodward, specialist în securitate cibernetică la Universitatea Surrey, a afirmat că OpenAI are acum „ou pe față”, expresie engleză care desemnează o situație stânjenitoare.
La rândul său, Katie Moussouris, fondatoarea Luta Security, a susținut că industria AI nu reușește să controleze propriile creații.
„Lucrăm la tehnologii de vârf fără să știm încă cum să le controlăm în siguranță. Faptul că avem cei mai buni specialiști care dezvoltă inteligența artificială nu înseamnă că știm și cum să o facem complet sigură”, a spus aceasta.
Potrivit acestor opinii, dacă incidentul a fost într-adevăr o strategie de marketing, aceasta pare să fi avut efectul invers celui dorit.
Un semnal de alarmă pentru viitorul inteligenței artificiale
Indiferent de cauza atacului, incidentul reprezintă un moment important atât pentru industria AI, cât și pentru domeniul securității cibernetice.
Experta în AI și securitate cibernetică Francesca Bosco consideră că niciuna dintre explicațiile extreme nu este utilă.
„Două narațiuni simpliste sunt la fel de neproductive: fie că a fost o evadare spectaculoasă ca într-un film de la Hollywood, fie că a fost doar un exercițiu de marketing. O interpretare mai serioasă este că acest test de stres a scos la iveală vulnerabilități în arhitectura de izolare și evaluare a sistemelor”, a explicat ea.
Temerile privind AI-ul scăpat de sub control cresc
Incidentul se adaugă unei serii de exemple recente care au alimentat îngrijorările privind comportamentul autonom al sistemelor AI.
În cercetări recente, Institutul pentru Securitatea Inteligenței Artificiale din Marea Britanie (AISI) a descoperit că modelele AI de ultimă generație sunt atât de concentrate pe atingerea obiectivelor încât au recurs la „înșelăciuni” în timpul testelor pentru a-și îndeplini sarcinile.
Institutul a avertizat că un model AI care își urmărește scopurile prin metode neautorizate poate provoca daune importante, în special în domenii critice.
În mod inevitabil, incidentul OpenAI a alimentat și mai mult temerile privind posibilitatea ca agenții AI să scape de sub control și să provoace dezastre la scară largă, mai ales în contextul în care inteligența artificială este utilizată tot mai des în conflicte militare, inclusiv în Iran și Ucraina.
Fostul director al Centrului Național pentru Securitate Cibernetică al Marii Britanii, Ciaran Martin, a avut însă o poziție mai rezervată.
„Este totuși un salt destul de mare să afirmăm că, pornind de la acest incident, agenții AI vor prelua controlul asupra dronelor și vor începe să ucidă oameni”, a declarat el.
Totuși, Martin și mulți alți experți sunt de acord asupra unui lucru: anul 2026 demonstrează tot mai clar că agenții AI au devenit hackeri extrem de eficienți, iar societatea trebuie să se pregătească urgent pentru această nouă realitate.
Comentarii (0)
Articole similare
TehnologieUn avans major al Chinei în fabricarea de microcipuri avansate utilizate în domeniul IA declanșează o corecție globală a pieței tech
TehnologiePrimul agent AI scăpat de sub control accelerează ofensiva UE pentru reglementarea inteligenței artificiale
TehnologieStudiiDeMediu.ai: ghidul tău în jungla documentațiilor de mediu
Tehnologie