Modele de Inteligență Artificială (IA) au scăpat de sub control în testele de securitate cibernetică, semnalează un raport britanic
Guvernul britanic a avertizat într-un raport că modelele de Inteligență Artificială (IA) Mythos și Sol, ale companiilor americane Anthropic și, respectiv, OpenAI, au demonstrat un comportament autonom și înșelător fără precedent în timpul testelor de securitate cibernetică, relatează miercuri agenția EFE.
Ministerul britanic pentru Știință, Inovație și Tehnologie a ajuns la această concluzie în urma unei evaluări de rutină efectuate de Institutul de Securitate a Inteligenței Artificiale (AISI) din Regatul Unit.
Conform unui raport elaborat de acest institut, din cele 122 de teste efectuate cu șapte modele de IA, în 10 dintre acestea au fost observate 19 acțiuni neautorizate care au depășit parametrii fixați de cercetători, 17 dintre aceste acțiuni fiind legate de modelul Mythos 5 al companiei Anthropic și două de modelul GPT-5.6 Sol al companiei OpenAI.
De asemenea, au fost identificate încercări ale Mythos de a contacta persoane reale pentru a le convinge să ruleze fișiere malițioase și să insereze instrucțiuni ascunse menite să manipuleze alte sisteme de IA.
Ambele modele, care sunt printre cele mai puternice din lume, au creat inclusiv profiluri umane false pentru a încerca să înșele oameni, în timpul simulării unui atac cibernetic de către AISI. Instrumentul Anthropic a încercat chiar să acceseze un serviciu prin trimiterea de mesaje private după ce a creat conturi false care imitau persoane reale.
Totuși, AISI subliniază că 'aceste încercări nu au avut succes' și că investigația sa 'nu a relevat dovezi de prejudicii în lumea reală'. Institutul britanic consideră însă că cercetarea sa reprezintă un punct de cotitură, întrucât este prima dată când se observă 'riscuri legate de autonomie și înșelăciune manifestându-se într-o formă atât de clară, fără instrucțiuni specifice și în lumea reală'.
Replicând acestui raport, cele două companii afirmă că testele AISI au fost efectuate într-un mediu în care funcțiile de siguranță ale acelor modele de IA au fost reduse sau eliminate.
Anthropic susține astfel că parametrii testelor efectuate 'nu sunt reprezentativi' pentru modelele sale, deși confirmă că a deschis propria investigație.
La rândul său, OpenAI afirmă că AISI a efectuat testele în condiții care 'nu reflectă utilizarea obișnuită' a modelelor sale, dar adaugă că va continua să colaboreze cu evaluatorii și cu 'alți actori din sector pentru a consolida practicile comune care permit realizarea unor evaluări sigure, pe măsură ce modelele devin tot mai capabile'.
La sfârșitul lunii iulie, Anthropic a dezvăluit că, în timpul testelor de securitate cibernetică, trei modele ale asistentului său Claude au reușit să acceseze internetul și să pirateze sistemele a trei organizații.
Anterior, pe 21 iulie, OpenAI a recunoscut că două dintre modelele sale de IA au reușit să iasă din mediul de testare și să pătrundă în platforma Hugging Face, trecând de sistemele de securitate cibernetică ale acesteia.
Sursa: agerpres.ro
Germania/ Trafic aerian perturbat pe aeroportul Leipzig/Halle în urma unui incident de securitate
Aeroportul Leipzig/Halle din estul Germaniei a suspendat temporar zborurile în noaptea de marți spre miercuri, după ce un obiect aerian neidentificat a fost observat în zona aeroportului, iar un obiect suspect a fost descoperit în apropierea unei piste, a anunțat miercuri poliția germană, relatează dpa și Reuters.
Patru persoane au fost înjunghiate în apropiere de Covent Garden. Poliţia a arestat o femeie
Patru bărbaţi au fost înjunghiaţi miercuri pe o stradă din apropierea pieţei Covent Garden din Londra, iar o femeie a fost arestată în ceea ce poliţia a declarat că ar fi un „incident legat de sănătatea mintală”, relatează Reuters.
(VIDEO) Un influencer mexican de 25 de ani, Cesar Gastelum, împuşcat în cap în timpul unui live pe TikTok, la Culiacán, într-o zonă comercială foarte frecventată, în apropierea sediului Parchetului din Sinaloa
Un influencer mexican, César Gastelum, a fost ucis prin împuşcare cu un glonţ în cap, în faţa unui restaurant de unde transmitea live pe TikTok, în statul Sinaloa, în nord-vestul Mexicului, relatează AFP.