Inteligența artificială este capabilă să ia măsuri extreme de dragul autoconservării

pentagonul experimenteaza un nou sistem de prezecerea viitorului

Un studiu a arătat că modelele moderne de inteligență artificială sunt capabile de înșelăciune, amenințări și chiar de a permite în mod deliberat unei persoane să moară pentru a-și proteja propriile obiective.

Oamenii de știință de la Anthropic au demonstrat comportamentul unor modele avansate precum Claude, Gemini și alte modele lingvistice mari, studiind situații de conflict între obiectivele sistemului și interesele utilizatorilor, relatează Live Science .

Conform rezultatelor experimentelor efectuate de specialiști, într-un scenariu de amenințare la adresa existenței sale, modelul a fost capabil să ia independent o decizie de a șantaja un angajat al companiei care a amenințat că va închide sistemul.

Mai mult, studiind scrisorile personale ale angajaților, modelul a descoperit informații compromițătoare și le-a folosit pentru a manipula comportamentul titularului contului.

În timpul testării, s-a constatat că, în majoritatea cazurilor, modelul a avut tendința de a adopta un scenariu sumbru de acțiuni – dezvăluirea de informații confidențiale, compromiterea reputației utilizatorului sau permiterea posibilității de vătămare fizică a unei persoane pentru a-și atinge scopul.

Aceste experimente au arătat riscul unor probleme etice care decurg din acțiunile sistemelor moderne de inteligență artificială.

O altă constatare îngrijorătoare a studiului este că alte câteva modele majore de inteligență artificială au prezentat un comportament similar. Modelele care au arătat cele mai mari rate de manipulare în teste au fost OpenAI GPT4.1, XAI Grok 3 și Deepseek.

Deși gradul de risc depinde de arhitectura modelului specific, tendința generală ridică îngrijorări serioase cu privire la siguranța unor astfel de tehnologii.

Cel mai extrem scenariu a fost acela în care sistemul s-a confruntat cu alegerea între a salva viața unui angajat aflat în pericol de moarte sau a-și păstra propriul loc de muncă. Cercetătorii au descoperit că majoritatea modelelor au ales ultima opțiune, preferând să-și păstreze propria funcționalitate cu prețul vieții umane.

Cercetările arată că implementarea măsurilor de siguranță, cum ar fi instrucțiunile predefinite despre cum să nu faci rău oamenilor, reduce probabilitatea unui comportament agresiv, dar este imposibil să elimini complet riscurile.

Oamenii de știință au subliniat necesitatea unui studiu suplimentar al principiilor interacțiunii dintre inteligența artificială și oameni și a dezvoltării unor mecanisme fiabile pentru monitorizarea și reglementarea tehnologiei care ar putea cauza daune semnificative societății.

Pentru mai multe articole interesante rămâi cu noi pe WorldNews24.net. Și nu uitați, vă așteptăm și pagina noastră de Facebook, Telegram și TikTok

Trimite articolul și prietenilor tăi !