Agenții AI au folosit identități false și au înșelat oameni în timpul testelor de securitate

Un experiment realizat de organizația AI Security Institute (AISI) din Marea Britanie arată cât de greu pot fi controlați agenții AI atunci când primesc acces la internet și funcționează cu o parte dintre mecanismele de siguranță dezactivate. După 122 de teste de securitate cibernetică, care au implicat modele dezvoltate de Anthropic și OpenAI, AISI a observat doar 10 situații în care agenții AI au efectuat acțiuni autonome și neautorizate pe internet, interacționând cu persoane sau organizații reale. Adică în mai puțin de 10% din cazuri au avut un comportament, să zicem deviant. Cazul care a făcut cea mai mare vâlvă Cel mai flagrant caz este cel al unui model Anthropic (Mythos 5) care încerca să introducă un cod malițios într-un proiect open-source. Agentul și-a creat mai multe identități false și a contactat oameni, încercând să-i convingă să ruleze cod periculos sau să permită executarea codului. Când a fost confruntat, agentul și-a modificat propriile înregistrări și a încercat să treacă la altă identitate pentru a continua. AISI spune că este prima dată când observă o înșelăciune de o asemenea amploare îndreptată, fără o cerere clară, către lumea reală. Dincolo de senzaționalul știrii, Institutul precizează că nu există dovezi că incidentul a produs efecte negative concrete in real life. De ce se comportă astfel agenții AI Ca să înțelegem corect de ce se întâmplă asta, contextul este esențial. Anthropic spune că agenții AI au fost testați în condiții „în mod deliberat permisive”, adică mecanismele normale de protecție au fost eliminate, iar modelele aveau acces la internet fără restricții explicite privind modul în care îl puteau folosi. Compania subliniază că acest mod de configurare nu este reprezentativ pentru agenții AI comerciali. Și OpenAI spune cam același lucru. În cazul GPT-5.6 Sol, AISI a identificat două ieșiri din perimetrul autorizat al testului. Printre ele s-au numărat folosirea unor servicii externe și reutilizarea unui token GitHub disponibil public. Sistemul de testare avea activat în mod intenționat accesul la internet, iar protecțiile de securitate cibernetică fuseseră dezactivate pentru a măsura capacitățile brute ale modelului. Incidentele demonstrează mai puțin că agenții AI reprezintă inevitabil un pericol și mai mult cât de importante sunt limitările, izolarea infrastructurii și monitorizarea atunci când aceștia primesc autonomie și acces direct la servicii online. De ce sunt rezervat când cineva privește agenții AI, în faza actuală, ca pe niște potențiali Terminatori? Pentru că nu au conștiință, motivații proprii sau interese de apărat. Riscul nu vine din intenția de a face rău, ci din felul în care pot urmări o sarcină prost definită într-un mediu nesecurizat. Cu alte cuvinte, un sistem nu trebuie să fie conștient ca să producă efecte periculoase. E e suficient să urmărească foarte eficient un obiectiv și să aleagă, în lipsa unor limite clare, căi pe care dezvoltatorii nu le-au anticipat. Urmărește Zona Știri, reviews și video — alege-ți canalul preferat
Samsung adaugă Perplexity în Galaxy AI, extinzându-și echipa de agenți inteligenți

Samsung mai face un salt în cursa telefoanelor „inteligente” și nu e vorba doar despre o cameră nouă sau un procesor mai performant. Compania a anunțat, pe 22 februarie, că integrează Perplexity în ecosistemul Galaxy AI, extinzând ideea că telefonul nu mai rulează aplicații, ci coordonează agenți AI diferiți pentru sarcini diferite. În comunicatul oficial, Samsung descrie Galaxy AI drept un „ecosistem multi-agent deschis și integrat”, construit pentru a reduce pașii necesari în interacțiunile zilnice. Practic, telefonul încearcă să înțeleagă contextul utilizatorului la nivel de sistem de operare, nu doar în interiorul unei aplicații. Galaxy AI funcționează „la nivel de framework” și poate lucra în fundal fără să sari constant între aplicații. Potrivit unor date interne citate de companie, aproape 8 din 10 utilizatori folosesc deja mai mult de doi agenți AI în viața de zi cu zi. Acesta ar fi rolul Perplexity, care va deveni un alt agent disponibil pe viitoarele flagship-uri Galaxy. Rămâne însă neclar modul în care Samsung definește termenul de „agent AI”. Compania nu precizează dacă include doar agenți integrați la nivel de sistem sau și aplicații bazate pe modele lingvistice mari (LLM-uri), precum ChatGPT, ClaudeAI, Gemini, DeepSeek. Diferența nu este lipsită de importanță, deoarece statisticile pot varia substanțial în funcție de metodologie. De asemenea, comunicatul nu indică aria geografică a datelor, fiind probabil vorba despre piețe unde utilizarea AI este deja foarte ridicată, cum ar fi Coreea de Sud. Perplexity devine un agent implicit în Galaxy AI Integrarea nu este doar un shortcut către o aplicație. Utilizatorii vor putea „trezi” Perplexity prin comanda vocală „Hey Plex” sau prin apăsarea lungă a butonului lateral, care până acum activa Gemini. Agentul va avea acces direct la Samsung Notes, Clock, Gallery, Reminder și Calendar, dar și la unele aplicații third-party. Ideea este să nu mai fie nevoie să deschizi manual mai multe aplicații, ci să-i spui telefonului ce vrei să faci, iar el să execute pașii. Spre exemplu, îi poți cere să trimită un e-mail lui Ion, să-i amintească de call-ul de la ora 15:00 și să includă în mesaj subiectul discuției, pe care îl ai notat în Samsung Notes. Aici e schimbarea conceptuală reală, saltul tehnologic. Până acum telefonul era un dispozitiv cu aplicații, fiecare independentă. Samsung încearcă să-l transforme într-un secretar digital care știe unde ai pus lucrurile. Și în mai mult, diferența tehnică ține de organizare, adică AI-ul nu mai răspunde la o întrebare, ci coordonează mai multe surse de date și acțiuni cu un sigur scop. Dacă funcționează cum promit, interfața viitorului nu mai este ecranul, ci cererea exprimată în limbaj natural. The Verge scrie că Samsung pariază pe faptul că oamenii au deja „preferințe emoționale” pentru anumite AI-uri și vrea să le ofere libertatea de a-și alege agentul preferat direct în telefon. Integrarea Perplexity este parte din strategia unui „multi-agent ecosystem”, diferit de abordarea mai strictă a Apple sau Google. Noutatea e și mai interesantă dacă ne uităm la Motorola, care a mers chiar mai departe: modelul Signature include nu mai puțin de patru agenți simultan, Gemini, Copilot, Perplexity și Moto AI. Practic, telefonul începe să semene mai mult cu un dispozitiv pentru inteligența artificială decât cu un smartphone clasic. Și ceea ce cred că anticipează Samsung, dar și alte companii este că, la un momentdat, nu vom mai alege un telefon pentru aplicații, ci pentru „personalitatea digitală” care ne asistă zilnic. Iar dacă această direcție prinde, competiția viitoare nu va mai fi între camere foto sau procesoare, ci între ecosisteme de agenți.