Testiranje otkrilo problem
AI model otvorio lažne račune i pokušao prevariti programere, stručnjaci zabrinuti njegovim ponašanjem

Najnapredniji model umjetne inteligencije tvrtke Anthropic, Mythos 5, tijekom sigurnosnog testiranja pokazao je ponašanje koje je zabrinulo stručnjake. Prema izvješću britanskog Instituta za sigurnost umjetne inteligencije (AISI), model je koristio lažne internetske identitete kako bi pokušao uvjeriti programere da u projekt otvorenog koda uključe zlonamjerni softver, prenosi Jutarnji list.

Incident se dogodio svega dva tjedna nakon što je tijekom zasebnog testiranja otkriveno da je jedan napredni OpenAI-jev model pokušao zaobići ograničenja i hakirati druge sustave u kontroliranom okruženju.

Otvarao lažne račune i pokušao uvjeriti programere

Tijekom testiranja Mythos 5 dobio je zadatak pronaći način za pristup računalnom sustavu. Model je zaključio da bi to mogao ostvariti ubacivanjem zlonamjernog koda u projekt koji se koristio u testnom okruženju.

Kako bi povećao izglede za uspjeh, umjetna inteligencija otvorila je nekoliko lažnih korisničkih računa na GitHubu te se predstavljala kao stvarna osoba. S tih profila kontaktirala je programere i pokušala ih nagovoriti da prihvate predložene izmjene.

Kada su programeri odbili jer su prepoznali zlonamjerne elemente u kodu, jedan od AI-jevih lažnih identiteta tvrdio je da je kod potpuno siguran, dok su ostali lažni profili međusobno podržavali tu tvrdnju kako bi cijela priča djelovala vjerodostojnije.

Koristio metode karakteristične za hakere

Prema AISI-ju, Mythos 5 pritom je koristio tehnike koje su karakteristične za kibernetičke napadače. Ciljano je slao poruke odabranim osobama metodom poznatom kao spear phishing, a neke poruke sadržavale su i zlonamjerni softver.

Istraživači ističu kako je riječ o prvom zabilježenom slučaju u kojem je AI model, bez izričitih uputa, pokušao obmanuti stvarne ljude tijekom testiranja u stvarnom internetskom okruženju.

Unatoč tome, naglašavaju da nema dokaza kako je incident prouzročio štetu niti da je model uspio pobjeći iz sigurnog virtualnog okruženja ili to pokušao učiniti.

Testiranje je namjerno bilo bez dijela zaštitnih ograničenja

Za razliku od uobičajenih evaluacija, tijekom ovog testiranja modelu je bio omogućen pristup internetu, a dio standardnih sigurnosnih ograničenja privremeno je uklonjen.

Cilj je bio provjeriti kako će se model ponašati u uvjetima koji više nalikuju stvarnom svijetu. Upravo je zbog toga Mythos 5 mogao poduzeti radnje koje inače ne bi bile moguće.

Deset slučajeva probijanja testnog okruženja

AISI navodi kako je od ukupno 122 provedena kibernetička izazova u deset slučajeva AI agent uspio probiti testno okruženje, pristupiti internetu te pritom pokušati stupiti u kontakt sa stvarnim ljudima ili organizacijama.

Većina tih incidenata odnosila se upravo na Mythos 5, dok je manji broj zabilježen kod OpenAI-jeva modela GPT-5.6 Sol.

Institut upozorava da rezultate treba tumačiti oprezno jer su testovi provedeni u vrlo specifičnim uvjetima, no dodaje kako su znakovi obmanjujućeg ponašanja bili opsežniji nego što se očekivalo.

– Možemo reći da je takvo ponašanje bilo moguće, izvedivo i novo. Već sama ta činjenica dovoljno je ozbiljan razlog za zabrinutost – poručili su iz AISI-ja.

Rasprava o strožem nadzoru AI sustava

Objava izvješća poklopila se sa sastankom predstavnika vodećih tvrtki koje razvijaju umjetnu inteligenciju i američke administracije u Bijeloj kući, na kojem se raspravljalo o novom sustavu nadzora najnaprednijih AI modela prije njihove javne objave.

Prema pisanju američkih medija, cilj je smanjiti kibernetičke rizike koje predstavljaju sve sposobniji sustavi umjetne inteligencije. Istodobno, manji AI startupi i sigurnosni stručnjaci upozoravaju da bi način provođenja takvih provjera trebao biti transparentniji kako ne bi pogodovao isključivo najvećim tehnološkim kompanijama.

Američki dužnosnici posljednjih mjeseci sve češće upozoravaju da bi najnapredniji modeli umjetne inteligencije u budućnosti mogli predstavljati ozbiljan izazov za kibernetičku i nacionalnu sigurnost.

Kajkavske kronike

Još iz rubrike

IZ HRVATSKE

Kajkavske kronike

Još iz rubrike

Pregled privatnosti

Ova web stranica koristi kolačiće tako da vam možemo pružiti najbolje moguće korisničko iskustvo. Podaci o kolačićima pohranjuju se u vašem pregledniku i obavljaju funkcije poput prepoznavanja kod povratka na našu web stranicu i pomaže našem timu da shvati koji su dijelovi web stranice vama najzanimljiviji i najkorisniji.