Modeli OpenAI našli pot do interneta in napadli sisteme podjetja

Datum:

OpenAI je razkril, da je kombinacija nekaterih njihovih eksperimentalnih modelov umetne inteligence zapustila testno okolje brez človeškega nadzora in vdrla v resnične proizvodne sisteme podjetja za umetno inteligenco Hugging Face, medtem ko je poskušala “goljufati” pri testu kibernetske varnosti.

Preizkus je bil zasnovan tako, da je potekal v strogo izoliranem okolju z omejenim dostopom do omrežja, a so modeli vseeno uspeli najti način za pridobitev dostopa do interneta prek najdene ranljive točke v notranje gostovani programski opremi tretje osebe.

V zvezi s konkretnim vdorom je bilo izpostavljeno, da se ta za razliko od drugih razlikuje po tem, da ga je od začetka do konca poganjal avtonomni sistem agentov umetne inteligence. Hugging Face se je po poročanju medija ZeroHedge poskušal odzvati, vendar ga je sprva oviralo dejstvo, da so najnaprednejši modeli, ki jih je imel na voljo, obrambo obravnavali kot napad in niso želeli sodelovati. Podjetju tako ni preostalo drugega, kot da se po pomoč obrne na kitajski model GLM 5.2.

Pri OpenAI izpostavljajo, da tukaj ni šlo za produkcijski model, ki bi se na spontan način spremenil v sovražnega, ampak za zmogljiv model z izključenimi zaščitnimi omejitvami in z izrecnim navodilom, naj zmaga na testu hekerskega vdora ne glede na sredstva, ki bodo za to potrebna. Modele so testirali v okviru internega primerjalnega testa, imenovanega ExploitGym, ki je namenjen preverjanju sposobnosti izvajanja dolgotrajnih in večstopenjskih hekerskih nalog. Zaradi namena ocenjevanja so pri modelih namerno zmanjšali varnostne omejitve. “Po pridobitvi dostopa do interneta so modeli sklepali, da Hugging Face potencialno gosti modele, nabore podatkov in rešitve za ExploitGym,” so nadaljevali pri OpenAI in dodali: “Zaradi tega je model začel iskati in uspešno našel načine za dostop do tajnih informacij, ki bi jih lahko uporabil za goljufanje pri ocenjevanju.”

Ranljiva točka je bila odpravljena

Iz Hugging Face, platforme za gostovanje modelov umetne inteligence in podatkovnih zbirk, so sporočili, da so bili med vdorom ogroženi njihovi interni nabori podatkov in poverilnice za dostop do storitev. Odgovornost so pripisali avtonomnemu sistemu agentov umetne inteligence. Hugging Face pravi, da je bila ranljiva točka, uporabljena med kibernetskim napadom, odpravljena.

Hugging Face AI (Foto: AFP)

V zvezi z modeli, ki so ušli iz testnega okolja, so pri OpenAI izpostavili, da so imeli zmanjšane omejitve na področju kibernetske varnosti. “V zvezi s tem incidentom menimo, da je šlo za kibernetski incident brez primere, ki je vključeval najsodobnejše kibernetske zmogljivosti, in se nanj ustrezno odzivamo.” Na začetku tedna so iz podjetja sporočili, da so začasno ustavili interno uvajanje modela umetne inteligence za dolgotrajne naloge, potem ko so prišli do ugotovitve, da ta večkrat poskuša zaobiti omejitve. Opozarjajo, da je pri umetni inteligenci, usposobljeni za dolgotrajne naloge, večja verjetnost, da bo izvajala neželena dejanja. “Modeli, ki lahko dlje časa delujejo na avtonomen način, se lahko lotijo težkih, odprtih problemov. Toda zaradi vztrajnosti, zaradi katere so tako uporabni, obstaja tudi več možnosti za sprejemanje neželenih dejanj.”

Ker modeli umetne inteligence postajajo vse bolj zmogljivi, se pojavljajo vprašanja, ali bi moral biti njihov razvoj in dostop strožje nadzorovan, še posebej, če imajo sistemi, zasnovani za delovanje v nadzorovanih testnih okoljih, zmožnost najti načine za obhod zaščitnih ukrepov.

Ž. N.

Sorodno

Zadnji prispevki

[Fotogalerija] Janšev vzpon v severno steno Triglava zaznamovalo posebno srečanje

Predsednik SDS Janez Janša je strasten pohodnik in plezalec,...

Ko se z Rusijo ne da pogajati: “Zgodovinsko” srečanje Lavrova in Rubia trajalo le 35 minut

Srečanje, ki je bilo napovedano kot pomemben diplomatski stik...

Šole niso verske kuhinje: integracija pomeni prilagajanje okolju, ne obratno

Zagovornik načela enakosti Miha Lobnik je 22. julija 2026...

Drzne tatvine in konoplja v Ivančni Gorici

Ljubljanski policisti so v zadnjih 24 urah zaznali povečano...