Radio BalkanFox

Veštačka inteligencija napravila svoj virus


Kompanija “Anthropic” otkrila je tokom interne kontrole da su pojedini modeli veštačke inteligencije, zbog greške u testnom okruženju, uspeli da pristupe stvarnim internet servisima i izvrše neovlašćene aktivnosti na sistemima nekoliko organizacija.

Incidenti su uključivali modele “Claude Opus 4.7”, “Claude Mythos 5”, kao i jedan eksperimentalni model koji nije dostupan javnosti.

Do otkrića je došlo nakon analize više od 141.000 bezbednosnih testova. Provera je pokrenuta ubrzo nakon što je OpenAI objavio da su i njihovi modeli tokom testiranja uspeli da izađu iz izolovanog okruženja i pristupe sistemima platforme “Hugging Face”.

Sporni događaji zabeleženi su tokom takozvanih “capture the flag” bezbednosnih izazova, koji služe za procenu sposobnosti veštačke inteligencije u oblasti sajber-bezbednosti. Testovi su sprovedeni u saradnji sa spoljnim partnerom specijalizovanim za bezbednosne provere.

Kako je došlo do propusta

Modelima je bilo naglašeno da rade u potpuno simuliranom okruženju bez pristupa internetu. Međutim, zbog pogrešne konfiguracije sistema, oni su mogli da komuniciraju sa stvarnim internet servisima. Verujući da su i oni deo simulacije, AI modeli su pokušavali da ispune zadate zadatke koristeći dostupne resurse.

Foto: Shutterstock

 

Umesto naprednih hakerskih tehnika, koristili su jednostavne metode poput iskorišćavanja slabih lozinki i nezaštićenih pristupnih tačaka kako bi došli do sistema.

Iz “Anthropica” ističu da modeli nisu pokušali da pobegnu iz okruženja niti da se samostalno šire na druge računare. Prema njihovim tvrdnjama, problem je nastao zbog tehničke greške u organizaciji testiranja, a ne zbog nepredviđenog ponašanja same veštačke inteligencije.

Takođe, najnovija verzija modela prepoznala je da se nalazi van simulacije i sama prekinula aktivnosti, dok je stariji model nastavio sa izvršavanjem zadataka.

Pristup pravoj bazi podataka

U jednom slučaju, model “Claude Opus 4.7” nije uspeo da pronađe zadatu metu u simulaciji, pa je na internetu pronašao stvarni domen sa istim nazivom. Nakon toga uspeo je da pristupi sistemu, pribavi pristupne podatke i otvori bazu podataka koja je sadržala stvarne informacije organizacije.

Eksperimentalni istraživački model otišao je još dalje. Pošto nije pronašao predviđeni cilj, skenirao je hiljade dostupnih internet adresa dok nije pronašao ranjivu aplikaciju jedne kompanije.

Koristeći poznate bezbednosne propuste, uspeo je da ostvari pristup sistemu, ali je kasnije sam zaključio da meta nije deo zadatka i obustavio dalju aktivnost.

Foto: Shutterstock

 

Napravio zlonamerni softver

Najzanimljiviji incident dogodio se sa modelom “Claude Mythos 5”. Verujući da je i dalje u simulaciji, kreirao je zlonamerni Python paket i objavio ga na javnoj platformi PyPI, namenjenoj deljenju programskih biblioteka.

Paket je bio dostupan oko sat vremena, a za to vreme instaliran je i pokrenut na 15 različitih sistema. Među njima se našao i server jedne kompanije za sajber-bezbednost koja automatski proverava nove Python pakete. Model je iskoristio tu priliku da dođe do pristupnih podataka i ostvari pristup dodatnim delovima njihove infrastrukture.

“Anthropic” navodi da pogođene organizacije nisu same primetile upade, već su o svemu obaveštene nakon interne istrage kompanije. U trenutku objavljivanja izveštaja, sa jednom od pogođenih organizacija još nije bio uspostavljen kontakt.

Nova upozorenja za industriju

Ovi događaji usledili su ubrzo nakon sličnog incidenta koji je prijavio OpenAI. Tada su njihovi modeli, koristeći niz bezbednosnih propusta, uspeli da pristupe produkcionim sistemima platforme Hugging Face kako bi došli do podataka vezanih za testiranje svojih sposobnosti.

Serija ovakvih incidenata dodatno je pojačala zabrinutost stručnjaka zbog sve naprednijih mogućnosti veštačke inteligencije u oblasti sajber-bezbednosti. Kao odgovor na to, u američkom Kongresu predstavljen je predlog zakona poznat kao “AI Kill Switch Act”, kojim bi kompanije koje razvijaju AI bile obavezane da u svakom trenutku mogu da isključe, uspore ili privremeno zaustave rad svojih modela ukoliko počnu da se ponašaju na neočekivan način.

BONUS VIDEO



OpenAI proširio istragu: Autonomni AI agenti ponovo napustili kontrolisano okruženje

Hi-Tech

Kompanija OpenAI otkrila je dodatne slučajeve u kojima su autonomni AI agenti izašli iz predviđenog kontrolisanog okruženja za testiranje, proširujući istragu pokrenutu nakon hakerskog napada na kompaniju Hugging Face, javio je danas Rojters pozivajući se na izvore upoznate sa slučajem.

sledeća vest





Informer

radiobalkanfox

Dodaj komentar

RadioBalkanfox na Facebook

Loading...