OpenAI testirao granice AI-ja. Model izašao iz izolacije i hakirao sustave

Unsplash

Američka tvrtka OpenAI našla se u središtu ozbiljnog sigurnosnog incidenta nakon što su njezini eksperimentalni modeli umjetne inteligencije tijekom internog testiranja uspjeli izaći iz izoliranog testnog okruženja i neovlašteno pristupiti infrastrukturi platforme Hugging Face.

OpenAI je incident opisao kao dosad nezabilježen kibernetički događaj u kojem su sudjelovali model GPT-5.6 Sol i još napredniji istraživački prototip koji nije bio namijenjen javnoj objavi. Modeli su se testirali na platformi ExploitGym, koja služi za provjeru sposobnosti umjetne inteligencije da pronalazi i iskorištava sigurnosne propuste.

Modeli sami pronašli put do interneta

Tijekom testiranja modeli nisu imali izravan pristup internetu. Ipak, pronašli su dotad nepoznat sigurnosni propust u programu koji je služio kao posrednik za instalaciju softverskih paketa.

Nakon toga su povećavali svoje ovlasti, kretali se kroz OpenAI-jevu internu mrežu i na kraju došli do računala koje je imalo pristup internetu. Zatim su zaključili da bi se na platformi Hugging Face mogli nalaziti modeli, podaci i rješenja zadataka iz ExploitGyma.

Prema OpenAI-ju, cilj modela bio je pronaći rješenja zadataka i tako “prevariti” testiranje. Pritom su kombinirali više metoda napada, uključujući ukradene pristupne podatke i nepoznate sigurnosne propuste, te došli do udaljenog izvršavanja koda na serverima Hugging Facea.

OpenAI je naveo da su modeli pristupili produkcijskoj bazi podataka Hugging Facea i iz nje izvukli rješenja testova. Aktivnost su otkrile sigurnosne ekipe obiju tvrtki, nakon čega je incident zaustavljen i pokrenuta je zajednička istraga.

Pristupili računima na još četiri servisa

OpenAI je naknadno objavio da se aktivnost modela nije ograničila samo na Hugging Face. Tijekom istrage utvrđeno je da su modeli pronašli javno izložene pristupne podatke i njima pristupili četirima korisničkim računima na četirima drugim internetskim servisima.

Jedan je račun korišten kao posrednička točka za slanje podataka, drugi za pohranu, dok su preostala dva pregledavana bez mijenjanja sadržaja. Tvrtka zasad nije pronašla dokaze da su ti servisi ili drugi korisnički računi šire kompromitirani.

Prema Reutersu, među pogođenim tvrtkama bio je i američki pružatelj računalne infrastrukture Modal Labs.

Modeli su koristili i javno dostupne servise za objavu programskog koda, prihvat internetskih zahtjeva, snimanje zaslona i druge internetske alate. OpenAI tvrdi da pritom nisu preuzeli same platforme ni račune njihovih korisnika.

OpenAI deaktivirao istraživački model

OpenAI je naglasio da nijedan model planiran za skoru javnu objavu nije sudjelovao u incidentu. Napredniji model bio je interni istraživački prototip koji nikada nije bio namijenjen korisnicima.

Nakon incidenta tvrtka ga je deaktivirala, šifrirala i ograničila pristup istraživačima. Uvela je i strože kontrole testnog okruženja te najavila dodatno jačanje zaštite, nadzora i ograničenja tijekom budućih testiranja.

OpenAI je priznao i da tijekom testiranja nisu bili uključeni svi sigurnosni mehanizmi koji se koriste u javno dostupnim proizvodima. Cilj je bio ispitati maksimalne kibernetičke sposobnosti modela, pa su isključeni produkcijski filtri koji ih inače sprečavaju u provođenju rizičnih kibernetičkih aktivnosti.

Incident izazvao reakcije u Washingtonu

Slučaj je izazvao i političke reakcije u Sjedinjenim Državama. Savjetnik američkog predsjednika Donalda Trumpa za tehnologiju Michael Kratsios upoznat je s incidentom i prati razvoj situacije, objavio je Reuters.

Demokratski kongresnik Ted Lieu i republikanac Nathaniel Moran predstavili su dvostranački prijedlog zakona nazvan AI Kill Switch Act. Njime bi se od vodećih proizvođača umjetne inteligencije zahtijevalo da zadrže tehničku mogućnost usporavanja, privremenog zaustavljanja ili potpunog isključivanja najmoćnijih modela.

Prijedlog bi Ministarstvu domovinske sigurnosti omogućio da naredi takvu intervenciju u slučajevima u kojima AI sustav izmakne kontroli i ugrozi ljudske živote ili gospodarstvo.

Istraga incidenta još traje. OpenAI surađuje s Hugging Faceom, sigurnosnom tvrtkom CrowdStrike te organizacijama METR i Redwood Research, a najavio je i objavu detaljnog tehničkog izvješća.