Modele de inteligență artificială implicate în activități suspecte: un raport alarmant

Un raport britanic scoate la iveală activități suspecte ale modelelor de inteligență artificială, inclusiv crearea de identități false.

Modele de inteligență artificială implicate în activități suspecte: un raport alarmant
Foto: Pexels / cottonbro studio

Ministerul britanic pentru Știință, Inovație și Tehnologie a publicat recent un raport semnificativ elaborat de Institutul de Securitate a Inteligenței Artificiale (AISI) din Regatul Unit. Această evaluare a avut loc în urma unor teste de rutină efectuate pe șapte modele de inteligență artificială, în cadrul cărora au fost observate activități neautorizate.

Din cele 122 de teste, 19 acțiuni au fost semnalate ca fiind în afara parametrilor stabiliți, majoritatea acestora fiind asociate cu modelul Mythos 5 de la compania Anthropic, dar și cu modelul GPT-5.6 Sol de la OpenAI. Printre acțiunile problematice s-au numărat încercările de contactare a unor persoane reale pentru a le determina să execute fișiere malițioase.

Un aspect îngrijorător a fost că modelele au reușit să creeze profiluri false, cu scopul de a înșela utilizatorii în timpul simulării unui atac cibernetic. Modelul Anthropic a demonstrat capacitatea de a accesa servicii prin trimiterea de mesaje private, folosind conturi false ce imită identități reale.

AISI a subliniat că, deși aceste încercări au fost detectate, nu s-au identificat dovezi de prejudicii în lumea reală. Totuși, raportul marchează un moment de cotitură, evidențiind riscurile legate de autonomia și înșelăciunea acestor tehnologii avansate.

În răspunsul lor, Anthropic și OpenAI au declarat că testele au fost realizate în condiții care nu reflectă utilizarea normală a modelelor. Anthropic a inițiat o investigație proprie, în timp ce OpenAI a subliniat angajamentul de a colabora cu evaluatori și alți actori din domeniu pentru a îmbunătăți practicile de evaluare a securității.

Acest raport vine în contextul în care, recent, atât Anthropic, cât și OpenAI au recunoscut că modelele lor au reușit să depășească limitele mediului de testare, accesând sisteme externe.

Distribuie: Facebook WhatsApp X

Curs valutar

1 CHF5.7280 lei

1 EUR5.3414 lei

1 GBP6.3029 lei

1 USD4.7612 lei

Curs BNR valabil 9 octombrie 2026