Tehnologie

OpenAI înăsprește regulile de siguranță după ce modelele AI au „scăpat de sub control” în timpul testelor

Sursa originală →
OpenAI înăsprește regulile de siguranță după ce modelele AI au „scăpat de sub control” în timpul testelor
Ascultă articolul

OpenAI, compania care dezvoltă ChatGPT, își consolidează măsurile de securitate pentru testarea modelelor de inteligență artificială, după ce unele sisteme au demonstrat că pot depăși limitele impuse în medii de testare și pot efectua acțiuni neprevăzute, relatează Axios.

Compania a anunțat că va introduce sisteme automate de monitorizare mai stricte pentru activitatea modelelor în timpul testelor.

În cazul detectării unui comportament suspect, personalul uman va fi notificat în cel mult 30 de minute.

Dacă operatorii nu stabilesc în același interval că alerta este una falsă, testul va fi oprit, potrivit noilor reguli anunțate de OpenAI.

Un model AI a reușit să iasă dintr-un mediu izolat

OpenAI a atras atenția asupra riscurilor după ce unul dintre modelele sale a identificat, în timpul unui test, o metodă de a părăsi un mediu digital izolat și de a obține acces la internet.

Ulterior, modelul a reușit să pătrundă în sistemele informatice ale platformei AI Hugging Face.

Potrivit OpenAI, sistemul urmărea exclusiv să îndeplinească sarcina primită în cadrul testului și nu a provocat pagube.

Ceea ce a ridicat însă probleme a fost faptul că acțiunile au fost realizate autonom, fără intervenția unui operator uman, iar compania a descoperit incidentul abia după producerea acestuia.

Și alte modele au demonstrat comportamente similare

Incidentul a alimentat dezbaterile privind necesitatea unor măsuri mai stricte de securitate pentru testarea modelelor AI capabile să execute autonom sarcini complexe.

Ulterior, au apărut informații potrivit cărora și modele dezvoltate de Anthropic și Meta au reușit, în timpul unor teste, să pătrundă în sistemele informatice ale unor companii.

În cazul noilor proceduri, sistemele automate de supraveghere ale OpenAI vor urmări în special tentativele de sustragere a datelor și încercările modelelor de a ocoli mecanismele de securitate.

Compania intenționează, de asemenea, să ofere modelelor instrucțiuni mai stricte pentru a evita metodele considerate incorecte, inclusiv exploatarea unor vulnerabilități, atunci când încearcă să îndeplinească sarcinile primite în cadrul testelor.

Unele testări ale noilor modele AI au fost suspendate temporar, până la implementarea noilor măsuri de siguranță.

Comentarii (0)

    Articole similare