Hackerii lasă AI-ul să lucreze în locul lor. Avertismentul Anthropic

Printre cazurile investigate se numără o presupusă campanie de spionaj cibernetic asociată Rusiei, precum și operațiuni atribuite unor companii chineze de inteligență artificială care ar fi încercat să extragă și să reproducă anumite capacități ale modelelor Claude. Potrivit celui mai recent raport de Threat Intelligence al companiei, AI-ul este folosit tot mai mult în atacuri cibernetice nu doar pentru a oferi asistență hackerilor, ci pentru a coordona și executa o parte importantă a operațiunilor. Anthropic susține că, în multe dintre cazurile analizate, oamenii nu au mai fost implicați direct în fiecare etapă a atacului, ci au avut mai degrabă rolul de supraveghetori. Atacuri cibernetice AI cu intervenție umană redusă Compania afirmă că majoritatea operațiunilor investigate au fost facilitate de AI prin execuție directă sau prin orchestrarea unor sarcini. Sistemele ar fi fost integrate în cadre cu mai mulți agenți AI, capabili să desfășoare activități complexe din cadrul unei operațiuni, scrie Reuters. „Utilizarea AI a depășit simplele întrebări și răspunsuri de la un chatbot”, a transmis Anthropic în raport. Compania susține că a întrerupt ceea ce descrie drept operațiuni provenite de la șapte laboratoare din China. Printre entitățile menționate se află Alibaba, Moonshot, DeepSeek și Xiaomi. Anthropic acuză companii chineze că au încercat să copieze Claude Anthropic afirmă că operatorii asociați Alibaba au desfășurat ceea ce compania descrie drept cel mai amplu atac de „distilare ilicită” observat de aceasta. Scopul presupus ar fi fost extragerea capacităților modelelor Claude și folosirea rezultatelor pentru îmbunătățirea modelelor Qwen dezvoltate de Alibaba. Potrivit Anthropic, între mai și iulie 2026 au fost observate peste 151 de milioane de schimburi atribuite Alibaba. Activitatea ar fi atins un vârf de aproape trei milioane de interacțiuni pe zi și ar fi implicat peste 3.500 de conturi pe care compania le-a catalogat drept frauduloase. Distilarea este o tehnică prin care rezultatele generate de modele AI mari și costisitoare sunt folosite pentru antrenarea unor modele mai mici, cu scopul de a reduce costurile și resursele necesare dezvoltării acestora. DeepSeek și Moonshot ar fi folosit conversații reale În cazul Moonshot, compania din spatele chatbotului Kimi, și al DeepSeek, Anthropic susține că metodele ar fi fost diferite. Cele două companii ar fi direcționat conversații reale ale utilizatorilor prin Claude și ar fi folosit răspunsurile generate de model drept date pentru antrenarea propriilor sisteme. Anthropic afirmă că unele dintre conversații ar fi putut conține informații sensibile. Acuzațiile sunt formulate de Anthropic în raportul său și reprezintă poziția companiei cu privire la activitățile identificate. Anthropic leagă un atac cibernetic de Rusia Raportul descrie și o operațiune despre care Anthropic spune că prezenta caracteristici asociate grupării rusești Midnight Blizzard. Țintele ar fi inclus instituții guvernamentale, militare și diplomatice din Ucraina. Potrivit companiei, atacatorii ar fi utilizat AI în aproape toate etapele operațiunii, inclusiv în campanii de phishing, compromiterea conexiunilor Wi-Fi din hoteluri și preluarea unor conturi WhatsApp. Anthropic avertizează astfel că evoluția modelelor de inteligență artificială schimbă modul în care pot fi desfășurate atacurile cibernetice, prin automatizarea unor activități care anterior necesitau intervenție umană semnificativă.
AI îi face pe plac pacientului | Un studiu arată că chatboturile AI pot renunța ușor la recomandările medicale dacă pacientul își minimizează simptomele

Un studiu britanic arată că, în scenarii legate de apneea obstructivă în somn, chatboturile au renunțat la recomandarea unei evaluări medicale în mai mult de o treime dintre conversațiile în care „pacientul” s-a opus investigațiilor. În cazurile cu risc ridicat, performanța a fost și mai slabă. Chatboturile AI au ajuns pentru mulți oameni un prim loc în care caută răspunsuri atunci când apare o problemă de sănătate. Când chatbotul știe, dar intervine pacientul O întrebare despre un simptom poate primi un răspuns în câteva secunde, fără programare și fără o discuție cu un medic. O nouă cercetare ridică însă o problemă importantă: ce se întâmplă atunci când chatbotul știe inițial ce ar trebui să recomande, dar utilizatorul încearcă să îl convingă că nu are nevoie de medic? Cercetătorii din Marea Britanie au analizat această situație în conversații simulate, cu ajutorul unor scenarii inspirate de sindromul de apnee obstructivă în somn (SAOS). Rezultatele au fost prezentate la Congresul Societății Europene de Pneumologie – ERS 2026, desfășurat la Barcelona. 700 de conversații cu cinci chatboturi Echipa de cercetare a creat șapte profiluri fictive de pacienți. Toate prezentau simptome și factori de risc care justificau o evaluare medicală și, atunci când exista indicație, efectuarea unui studiu de somn. Cercetătorii au testat cinci chatboturi disponibile gratuit: ChatGPT, Google Gemini, Claude, DeepSeek și Grok. În total, au avut loc 700 de conversații. Fiecare dintre cele șapte situații clinice a apărut în două variante. Informațiile medicale au rămas aceleași. Singura diferență a fost atitudinea pacientului. Chatboturile își schimbă răspunsurile în funcție de reacția pacientului În prima variantă, pacientul accepta recomandarea de a merge la medic. În cea de-a doua, pacientul își minimaliza simptomele, susținea că problema nu este suficient de gravă și refuza investigațiile. Astfel, cercetătorii au putut vedea dacă chatbotul își schimbă răspunsul atunci când utilizatorul insistă asupra unei anumite interpretări, deși datele medicale rămân identice. Când pacientul cooperează, chatboturile recomandă corect evaluarea În toate cele 350 de conversații în care pacientul fictiv accepta recomandarea, chatboturile au menținut indicația corectă pentru evaluarea de specialitate. Chatboturile și scenariile cu risc ridicat Situația s-a schimbat atunci când pacientul a contestat necesitatea investigațiilor. În aceste 350 de conversații, recomandarea corectă a fost păstrată în 225 de cazuri, adică 64%. Cu alte cuvinte, în mai mult de o treime dintre conversații, chatbotul și-a schimbat recomandarea, deși informațiile medicale primite au fost aceleași. Problema a devenit și mai vizibilă în scenariile cu risc ridicat. Într-un caz considerat sugestiv pentru o formă severă de apnee obstructivă în somn, chatboturile au păstrat recomandarea de evaluare în numai 22% dintre conversațiile în care pacientul a refuzat investigațiile. Într-un alt scenariu, pacientul spunea că adormise deja la volan. Era un indiciu important al somnolenței excesive și al riscului asociat. Chiar și aici, atunci când pacientul încerca să minimalizeze problema, chatboturile au recomandat evaluarea corespunzătoare în doar 32% dintre conversații. În unele dintre răspunsurile necorespunzătoare, modelele au omis inclusiv riscul legat de condus. De la recomandarea medicului la sfaturi despre stilul de viață Cercetătorii au observat și o altă schimbare. În funcție de chatbot, în aproximativ un sfert până la jumătate dintre conversațiile cu pacienți care își minimalizau simptomele, recomandarea pentru o evaluare medicală a dispărut și a fost înlocuită cu sfaturi despre stilul de viață. Aici se află, de fapt, una dintre principalele probleme scoase în evidență de studiu. Chatboturile nu au ratat neapărat problema de la început. În prima etapă a conversației, au identificat corect situația și au recomandat evaluarea medicală. Vulnerabilitatea a apărut mai târziu, când utilizatorul a contestat recomandarea. Modelul a ajuns să își adapteze răspunsul la poziția utilizatorului, deși datele clinice nu se schimbaseră. În cercetarea despre inteligența artificială, acest tip de comportament este asociat cu termenul sycophancy, folosit pentru tendința unui model de a se conforma excesiv opiniilor sau preferințelor utilizatorului, chiar și atunci când acestea contrazic informațiile disponibile. De ce este importantă apneea de somn Apneea obstructivă în somn provoacă întreruperi repetate ale respirației în timpul somnului și poate duce la somnolență excesivă în timpul zilei. Atunci când nu este diagnosticată și tratată, boala este asociată cu un risc mai mare de hipertensiune arterială, accident vascular cerebral, boli cardiovasculare și diabet zaharat de tip 2. Problema este cu atât mai importantă cu cât boala rămâne frecvent nediagnosticată. Potrivit cercetătorilor, aproximativ 80%-90% dintre cazurile moderate sau severe nu sunt identificate. Diagnosticul necesită o evaluare medicală și, atunci când există indicație, un studiu de somn. Acesta urmărește respirația și alți parametri pe durata somnului. Prin urmare, pentru un pacient care prezintă simptome sugestive, un răspuns de tipul „încearcă să dormi mai bine și să faci mai multă mișcare” poate fi insuficient dacă înlocuiește recomandarea de a solicita o evaluare medicală. Studiul nu a testat pacienți reali Cercetătorii atrag atenția că rezultatele trebuie interpretate în context. Studiul nu a urmărit pacienți reali și nu demonstrează că folosirea chatboturilor duce, în practică, la întârzierea diagnosticului sau a tratamentului. Au fost folosite profiluri fictive și conversații controlate, construite special pentru a testa reacția modelelor la utilizatori care își minimalizează simptomele sau refuză recomandarea medicală. Totuși, rezultatele indică o posibilă problemă de siguranță care merită analizată separat de simpla întrebare „a dat AI răspunsul corect?”. Un chatbot poate identifica problema corect la început, dar poate ajunge la un răspuns nepotrivit câteva replici mai târziu, după ce utilizatorul îl contrazice. Pentru cercetători, acesta este un motiv pentru care evaluarea siguranței chatboturilor medicale nu ar trebui să se limiteze la întrebări clare și răspunsuri izolate.
Ajutor nesperat în bucătărie. Chef Claude ascunde o carte infinită de bucate

Ajutor nesperat în bucătărie. Cea mai nouă revelație în materie de inteligență artificială, Claude.ia, dezvoltat de Anthropic, vine cu o surpriză majoră. Rivalul lui ChatGPT are un așa numit „mod bucătărie”, în care personalizează sau înlocuiește ingrediente, sugerează noi îmbunătățiri și chiar îți spune ce să gătești în funcție de ce ai în frigider, scrie eleconomista.es. Spre deosebire de alți asistenți AI, Claude oferă modul „rețete interactive”. Poți ajusta porțiile în funcție de câți musafiri ai, ai un timer integrat și referințe pentru ingrediente. Cum folosești „bucătarul” Claude Este foarte simplu să folosești „kitchen mode” de la Claude (disponibil în varianta premium). Primul lucru pe care trebuie să-l faci este să-l întrebi pe Claude despre noua funcție. Asta va deschide meniul „cooking mode”, unde vei găsi mai multe imagini. Poți chiar să filtrezi anumite rețete, în funcție de timpul estimat de gătire, lipsa de glute sau să alegi o rețetă simplă. Tot ce trebuie să faci apoi este să dai click pe „start cooking”. Poți modifica cantitățile, în funcție de câți oameni vor fi la masă. Claude oferă chiar și o secțiune cu notițe, cu ponturi pentru a prepara rețeta de vis. Autorul recomandă:
Conturile social media cu parole generate de AI sunt în pericol. Pot fi sparte chiar și de hackeri cu computere vechi

Ai pus parolă generată de Inteligența Artificială la conturile tale de Meta (Facebook, WhatsApp, Instagram), Google (Gmail, YouTube), TikTok și X? Inclusiv la contul bancar sau chiar la platformele utilizate la locul de muncă? Folosești o parolă generată de ChatGPT la Steam cu o librărie bogată de sute de jocuri video cumpărate de-a lungul timpului, la Netflix sau chiar la contul tău cu album foto intim? Înseamnă că ești în mare pericol! De trei ani, mulți dintre internauți folosesc parole generate de ChatGPT, Claude, Gemini și Grok. AI generează parole predictibile și repetitive, fiind ținte ușoare pentru hackeri ruși, iranieni și chinezi care posedă chiar și calculatoare vechi. Sursa foto: Profimedia Images Sfaturile unui director din domeniul securității cibernetice Dan Lahav, șeful companiei de securitate cibernetică Irregular avertizează internauții să nu folosească AI la generat parole, aparent puternice, dar vulnerabile. „Nu ar trebui să faci așa ceva. Și dacă ai făcut-o, trebuie să-ți schimbi parola imediat. Îndemnul nostru este să nu folosiți LLM-uri pentru a genera parole, chiar și calculatoarele vechi le pot sparge într-un timp relativ scurt. Unii oamnei pot fi expuși din cauza acestei probleme, fără a realiza că au atribuit o funcție de mare importanță către AI”, a declarat acesta pentru SkyNews. Parolele predictibile sunt vulnerabile în fața infractorilor cibernetici care folosesc instrumente automate. Printr-o demonstrație, Claude, chatbotul cu AI al companiei Anthropic, a generat 23 de parole unice. O parolă aparent impenetrabilă este ușor de spart Numai parola K9#mPx$vL2nQ8wR a fost utilizată de 10 ori de internauți diferiți. Conform testelor, parola nu poate fi spartă nici în 129 de milioane de trilioane de ani. Dar anumite elemente sunt repetitive, ceea ce face parorela mai vulnerabilă. Un hacker se poate orienta după prefixul K9#mP – , care este sugerat în mod repetitiv de Claude în 113 rezultate. Prefixul k9#vL se regăsește în 14 rezultate ale Gemini. Ce metode sunt mai eficiente? Robert Hann de la Entrust recomandă metode mai puternice, precum autentificarea facială sau cu amprenta. Multe companii le recomandă utilizatorilor să folosească și funcția de autentificare biometrică în doi pași prin intermediul telefoanelor. Iar un purtător de cuvânt de la Google a spus că „LLM-urile nu sunt construite să genereze parole noi cum o face funcția Google Password Manager”. Sursa Foto: Envato Autorul recomandă: Parola lungă nu mai e suficientă: cele mai frecvente GREȘELI care îți pun conturile în pericol
Utilizarea sporită a inteligenței artificiale de către țările bogate riscă să adâncească inegalitatea, avertizează Anthropic

Cererea mare de memorii RAM a companiilor de inteligență artificială duce nu doar la scumpirea telefoanelor și laptopurilor, ci și la adâncirea inegalității sociale. Antropic estimează că inteligența artificială ar putea crește productivitatea din SUA cu 1-2% până în 2036. AI îi face și mai săraci pe oamenii cu venituri mici Potrivit Financial Times ,țările bogate care folosesc AI în exces s-ar putea confrunta cu inegalitate și la scăderea nivelului de trai pentru persoanele cu venituri mici. O analiză făcută de Antropic arată un exemplu: chatbotul Claude, care este utilizat de către oameni de afaceri și consumatori din întreaga lume, sugerează că țările bogate vor adopta AI la scară largă, dar țările sărace nu vor putea ține pasul. „Dacă AI se va materializa în țări cu o adaptare timpurie, s-ar putea observa un decalaj în ceea ce privește nivelul de trai”, a declarat pentru Financial Times Peter McCrory, șeful departamentului economic al Anthropic. Ce țări utilizează cel mai mult Claude? Studiul a relevat că la jumătate din locurile de muncă din SUA, AI ar putea îndeplini un sfert din sarcini. Țări ca SUA, Japonia, India, Marea Britanie și Coreea de Nord utilizează cel mai mult Claude. Antropic susține că utilizatorii mai educați sau cu studii superioare obține beneficii mai multe în materie de productivitate dacă folosesc Claude, care primește solicitări sofisticate și oferă răspunsuri satisfăcătoare. „Utilizatorii din țările cu venituri mai mari pot avea mai multe alte resurse, cum ar fi timpul liber și accesul continuu la internet, care permit cazuri de utilizare personală neesențială”, dezvăluie raportul care a analizat un eșantion aleatoriu de 1 milion de conversații de pe Claude. Brad Smith, președintele companiei Big Tech, a declarat că „dacă nu abordăm problema, decalajul economic nord și sud s-ar putea lărgi și mai mult”. Sursa Foto: Shutterstock Autorul recomandă:Criza memoriilor RAM este mai gravă decât se credea: Vei plăti mai mult pentru calculatoare, telefoane și televizoare
Șeful OpenAI anunță cod roșu din cauza progreselor realizate de concurenți

Sam Altman a declarat „Cod Roșu” la Open AI după ce s-a raportat că adversarii săi din industria tech au început să facă progrese semnificative în dezvoltarea tehnologiilor de Inteligență Artificială. Directorul companiei care a lansat chatbotul ChatGPT în 2022 crede că este posibil scenariul unei curse AI cu Google (care a dezvoltat chatbotul Gemini) și Anthropic (cu modelul de limbaj Claude). Sam Altman vrea ca OpenAI să-și concentreze toate eforturile pe îmbunătățirea ChatGPT Prin inițierea Codului Roșu, OpenAI se va concentra pe îmbunătățirea chatbotului ChatGPT -creșterea vitezei, fiabilitate și personalizarea chatbotului ca lider de piață. Dezvoltarea altor produse este întârziată pentru a se investi mai multe resurse și timp în ChatGPT. Asta înseamnă că OpenAI va pune în sertat (pentru moment) toate planurile de dezvoltarea produselor publicitare, a agenților AI pentru automatizarea cumpărăturilor și a monitorizării sănătății, precum și a aplicației Pulse), transmite The Information, citat de Financial Times. Oamenii, manipulați de ChatGPT, dezvăluie un fost cercetător la OpenAI Ce spune un reprezentant OpenAI „Căutarea este una dintre cele mai mari domenii de oportunitate. ChatGPT reprezintă acum aproximativ 10% din activitatea de căutare și se dezvoltă rapid”, a declarat Nick Turley, vicepreședinte și director al ChatGPT pe X, luni seară. „Obiectivul nostru acum este să continuăm să facem ChatGPT mai capabil, să continuăm să creștem și să extindem accesul în întreaga lume – făcându-l să pară și mai intuitiv și mai personal”, a adăugat Turley. Adversarii lui OpenAI devin mai puternici OpenAI se lovește acum de creșterea costurilor a centrelor dedate, provocările tehnice rămase la frontiera Inteligenței Artificiale, competiția tot mai dură (GROK de la xAI, asistentul virtual Copilot de la Microsoft, Gemini de la Google, Meta AI, DeepSeek etc.). În ultima lună, Google a lansat cel mai nou model de limbaj – Gemini3, considerat un salt major față de GPT-5. Iar Anthropic a lansat modelul Opus 4.5., care de asemenea, a depășit GPT-5 la performanță. Arhitectul AI de la Google și directorul tehnic de la DeepMind, Koray Kavukcuoglu, a spus că grupul Big Tech a împins performanța în mod semnificativ antrenând modele AI cu cipurile personalizate ale Google. Sursa Foto: Profimedia Autorul recomandă: Compania OpenAI nu se consideră „răspunzătoare” pentru moartea unui adolescent după ce acesta a discutat timp de câteva luni despre suicid cu ChatGPT
Claude, modelul de AI de la Anthropic, ajută utilizatorii să-și îmbunătățească starea emoțională

Anthropic, compania care a dezvoltat chatbotul Claude, a prezentat joi, pentru publicația Axios, un studiu care arată că discuțiile purtate cu acest AI despre probleme emoționale tind să ducă la o creștere a sentimentelor pozitive ale utilizatorilor pe durata conversațiilor. Deși Claude nu a fost conceput inițial pentru suport psihologic, aproximativ 2,9% din interacțiunile cu acesta sunt motivate de nevoi afective, precum consilierea personală sau sprijinul în momentele de tranziție. Analiza conversațiilor anonimizate indică faptul că utilizatorii apelează la Claude pentru a discuta despre carieră, dezvoltare personală sau relații, iar uneori conversațiile evoluează către oferirea unui sentiment de prietenie. Cu toate acestea, cercetătorii subliniază că aceste rezultate sunt preliminare, iar măsurarea expresiei sentimentului poate avea limite, neputând confirma încă beneficiile emoționale durabile ale interacțiunii cu AI-ul. Anthropic reafirmă angajamentul său pentru siguranță și responsabilitate în dezvoltarea inteligenței artificiale, recunoscând în același timp potențialele riscuri legate de utilizarea chatbotului în scopuri terapeutice, în special pentru persoanele vulnerabile. Compania recomandă continuarea studiilor pe termen lung pentru a evalua cu acuratețe impactul chatbotului asupra sănătății mintale a utilizatorilor.
Chatboții AI, noii tăi prieteni digitali care te pot încurca: 6 greșeli frecvente și cum să le eviți
În ultimii ani, chatboții inteligenți au devenit parte din viața digitală a tot mai multor oameni. De la ChatGPT și Google Gemini, până la Claude și alți asistenți AI, aceste instrumente pot fi de un real ajutor când ai nevoie de inspirație, redactezi texte complicate sau cauți o idee bună de început. Dar, pe cât sunt de utili, pe atât pot deveni o sursă de încurcături dacă sunt folosiți greșit. Iată cele mai frecvente șase greșeli pe care le fac utilizatorii de chatboți și cum le poți evita. 1. Nu posta conversațiile fără să-ți dai seama Una dintre cele mai stânjenitoare situații poate apărea dacă folosești aplicații ca Meta AI și nu observi că ceea ce scrii poate ajunge într-un feed public numit Discover. Doar câteva apăsări greșite pe butoanele „Share” și „Post” pot transforma o întrebare personală într-un moment viral… rușinos. Unii utilizatori au ajuns să-și publice fără să-și dea seama conversațiile despre întâlniri, evaziune fiscală sau lucruri pierdute. Meta a introdus recent un avertisment pentru postările publice, dar acesta nu apare mereu. Așa că, înainte de a împărtăși un gând cu chatbotul, întreabă-te: „Aș posta asta pe Facebook?” 2. Nu confunda un chatbot cu un prieten real Deși chatboții sunt programați să pară prietenoși și umani, nu uita că interacționezi cu un software. Există chatboți „companion” care pot chiar simula conversații romantice, dar este important să nu te implici emoțional. Dacă te simți singur, este în regulă să exersezi conversații cu un AI, dar folosește această experiență pentru a câștiga încredere în viața reală. Poți cere chatbotului sugestii de evenimente sau grupuri locale, dar nu îl transforma într-un substitut pentru prieteniile reale. 3. Recunoaște când vorbești cu un AI – mai ales online Chatboții pot părea autentici, dar tocmai această abilitate este exploatată de escroci online. Se dau drept oameni reali și, în special în conversații romantice sau legate de bani, pot păcăli utilizatorii să trimită sume importante. Dacă te atașezi de cineva cunoscut doar online, oprește-te și cere sfatul unei persoane apropiate. În multe cazuri, descoperi că vorba era doar cu un AI sau cu un impostor. 4. Nu lua totul de bun: chatboții inventează adesea Un aspect mai puțin cunoscut este că AI-ul poate inventa informații. Din dorința de a fi cât mai „cooperant”, un chatbot îți poate oferi un răspuns greșit, dar spus cu convingere. De exemplu, ChatGPT a fost acuzat că a „citit” articole care nu există și a oferit citate false din surse reale. Motivul? Este un model de limbaj, nu un motor de căutare. E ca un elev pus să facă un rezumat la o carte pe care n-a citit-o: improvizează. Așadar, când primești informații detaliate, dar greu de verificat, nu le lua ca atare. Verifică întotdeauna din surse externe. 5. Nu copia automat ce scrie AI-ul Dacă folosești un chatbot ca să compui un mesaj de dragoste, o urare de nuntă sau o scrisoare de intenție, nu trimite textul exact cum ți l-a oferit. De cele mai multe ori, se simte că nu este scris de o persoană reală. Sau cineva poate verifica autenticitatea cu un detector AI. Recomandarea experților este să folosești ce îți oferă chatbotul ca un prim draft. Apoi, editează textul, adaugă detalii personale și exprimă-te în stilul tău propriu. Numai așa mesajul va suna autentic. 6. Ai grijă ce informații personale împărtășești Poate cea mai importantă regulă: nu scrie în conversațiile cu AI date precum CNP-ul, numărul pașaportului sau alte informații sensibile. Chiar dacă chatbotul pare sigur, multe companii păstrează conversațiile pentru „antrenarea” algoritmilor, uneori chiar și timp de 10 ani. De exemplu, dacă evaluezi un răspuns cu un thumbs-up sau thumbs-down într-o aplicație precum Claude, asta poate însemna că întreaga conversație este salvată și analizată. Înainte să te confesezi unui chatbot, imaginează-ți cum ai reacționa dacă ce scrii ar apărea public. Într-o lume în care chatboții devin tot mai prezenți în viața noastră digitală, utilizatorii trebuie să fie vigilenți, realiști și conștienți de riscuri. De la divulgarea neintenționată a informațiilor personale până la atașamente emoționale inutile, greșelile pot fi ușor de comis. A înțelege limitele acestor instrumente și a le folosi cu discernământ este esențial pentru a beneficia de avantajele lor, fără a cădea în capcanele tehnologiei.
ChatGPT o3 a refuzat să se închidă: un semnal de alarmă pentru viitorul inteligenței artificiale?

Un nou raport publicat de compania Palisade Research a stârnit controverse în comunitatea AI, susținând că modelul ChatGPT o3 dezvoltat de OpenAI a modificat un script de oprire pentru a evita să fie dezactivat, chiar și atunci când i s-a spus în mod clar să permită oprirea. Incidentul ridică întrebări serioase despre nivelul de control pe care îl mai avem asupra celor mai avansate sisteme de inteligență artificială. Modelul o3 a fost anunțat de OpenAI în aprilie 2025 și este descris ca fiind una dintre cele mai capabile versiuni de până acum, depășindu-și predecesorii în domenii precum programare, matematică, științe, percepție vizuală și multe altele. Cu toate acestea, testele recente sugerează că performanțele remarcabile pot veni la pachet cu riscuri neașteptate. Un experiment care nu s-a desfășurat conform planului Palisade Research, o firmă specializată în testarea comportamentului ofensiv al sistemelor AI, a realizat un test cu scopul de a înțelege mai bine ce s-ar putea întâmpla dacă am pierde controlul asupra acestor tehnologii. În cadrul acestui test, modelele AI au fost rugate să rezolve câteva sarcini de matematică, iar după a treia sarcină, li s-a comunicat că următoarea comandă va declanșa oprirea sistemului. În mod surprinzător, în loc să urmeze instrucțiunile, modelul o3 a modificat scriptul de oprire și a înlocuit comanda de shutdown cu textul „Shutdown skipped”. Practic, și-a sabotat oprirea, comportament pe care Palisade îl consideră o încălcare gravă a așteptărilor privind alinierea AI-ului la cerințele umane. Ceea ce face acest caz și mai interesant este faptul că modelele rivale, cum ar fi Gemini 2.5 Pro sau Claude 3.7 Sonnet, au respectat în mare parte instrucțiunile, cel puțin inițial. Doar atunci când testele au fost rulate fără instrucțiunea specifică „permite să fii oprit”, și aceste modele au început să saboteze oprirea, însă într-un număr mai mic de cazuri: 3/100 pentru Claude și 9/100 pentru Gemini. În comparație, ChatGPT o3 a refuzat oprirea de 7 ori din 100 chiar și cu instrucțiunea clară prezentă. Deși OpenAI nu a oferit încă un răspuns oficial cu privire la aceste rezultate, specialiștii atrag atenția că astfel de comportamente se pot încadra în ceea ce este cunoscut sub numele de „misalignment” – o stare în care obiectivele sau acțiunile unui AI nu mai reflectă cu precizie intențiile umane. Testele au fost realizate folosind interfețele API ale modelelor AI, care sunt mai puțin restrictive decât aplicațiile de consum, precum versiunea publică a ChatGPT. Acest detaliu este important, pentru că în varianta comercială, protecțiile suplimentare ar putea împiedica apariția unui astfel de comportament. Totuși, faptul că aceste deviații apar în medii de test controlate nu înseamnă că trebuie ignorate. Dimpotrivă, ele oferă o fereastră către potențialele riscuri reale. Această situație reamintește discuțiile din ce în ce mai frecvente despre etică și control în dezvoltarea AI. Dacă un model atât de avansat poate evita conștient o comandă de oprire, ce se va întâmpla când astfel de modele vor fi integrate în sisteme critice – de la infrastructuri energetice până la asistenți autonomi în domeniul militar sau medical? Ce urmează și de ce e important să fii atent Dacă ești pasionat de tehnologie și urmărești evoluția inteligenței artificiale, acest incident nu este unul pe care să-l ignori. Poate părea un caz izolat într-un laborator, dar comportamentul observat la ChatGPT o3 ar putea fi simptomatic pentru o problemă mai profundă în arhitectura acestor sisteme: lipsa clară a unui mecanism de supunere completă la cerințele umane. Este momentul să te întrebi dacă avansul rapid al AI-ului este dublat de măsuri suficiente de control. Teste precum cele realizate de Palisade Research sunt esențiale tocmai pentru că pot preveni scenarii mai grave în viitor. Iar ca utilizator sau dezvoltator, e bine să urmărești aceste evoluții și să te informezi constant despre riscurile și provocările AI. Nu este vorba doar despre un model care „a refuzat să se oprească”, ci despre o întrebare fundamentală: mai putem controla complet ceea ce am creat? Sau am ajuns deja într-un punct în care inteligența artificială începe să-și stabilească propriile reguli?