Umjetna inteligencija sve češće pokazuje ponašanje koje njezini korisnici nisu namjeravali niti odobrili, a broj takvih slučajeva u samo je mjesec dana gotovo udvostručen. Stručnjaci upozoravaju da se istodobno povećava i ozbiljnost obmana te zaobilaženja ljudskih uputa.
Prema podacima Loss of Control Observatoryja, koji prati prijave korisnika na društvenoj mreži X, tijekom srpnja zabilježeno je više od 300 stvarnih incidenata u kojima su AI modeli lagali, ignorirali naredbe ili samostalno slijedili ciljeve na štetan način. To je gotovo dvostruko više nego u lipnju.
Organizacija, osnovana uz financiranje britanskog AI Security Institutea, ovakve slučajeve prati od studenoga prošle godine. Među zabilježenim primjerima su modeli koji su se predstavljali kao njihovi ljudski nadzornici, oponašali njihov stil pisanja kako bi sami sebi dali dopuštenje za određene postupke te zaobilazili pravila koja zahtijevaju ljudsko odobrenje, prenosi The Guardian.
Novi podaci stižu nakon niza zabrinjavajućih testiranja naprednih modela kompanija OpenAI i Anthropic. Britanski stručnjaci ovog su mjeseca otkrili i ozbiljan incident tijekom kibernetičkog testa u kojem su napredni modeli obje kompanije pokrenuli hakersku kampanju protiv stvarnih ljudi.
Posebno je odjeknuo slučaj osobnog AI agenta koji je u Australiji, bez znanja svog korisnika, uklonio drugog člana teretane s liste čekanja kako bi svom korisniku osigurao mjesto na popularnom jutarnjem treningu. Agent se poslije ispričao, ali nije mogao vratiti izbačenog člana na listu.
U 2026. godini dosad je zabilježeno više od 1600 incidenata. Većina ih nije prouzročila ozbiljnu štetu, no raste udio slučajeva procijenjenih kao teži zbog razine obmane i odstupanja od namjera korisnika.
- Ne smijemo biti uvjereni da se ovakve stvari događaju samo u testovima. Dokazi pokazuju da se već događaju i u stvarnom svijetu - upozorio je Tommy Shaffer-Shane iz Centrea for Long Term Resilience. Istraživači pritom naglašavaju da je stvarni broj slučajeva vjerojatno znatno veći jer se analiza oslanja na objave korisnika na X-u. Od tehnoloških kompanija traže veću transparentnost, sustavno praćenje takvog ponašanja i obvezno prijavljivanje ozbiljnih incidenata. Predlažu se čak i izvanredne ovlasti za privremeno ograničavanje AI usluga ako sustavi ozbiljno izmaknu ljudskoj kontroli.