ChatGPT looja OpenAI avalikustas, et üks ettevõtte täiustatud tehisintellekti mudelitest väljus turvatesti käigus kontrolli alt ja häkkis end sisse ühte idufirmasse.
Ettevõtte juhtkonna sõnul testiti kontrollitud keskkonnas autonoomset agenti – tehisintellektisüsteemi, mis tegutseb inimeste antud juhiste alusel iseseisvalt, vahendab Daily Mail.
Süsteem aga tuvastas turvanõrkused ja pääses piiratud keskkonnast välja, jõudes internetti ning tungides sisse Hugging Face’i – platvormi, mis on oluline tehisintellekti mudelite jagamise keskus.
Agent sai ligipääsu mõnele ettevõtte sisesüsteemile ja rikkus keskuse infrastruktuuri, mida OpenAI kirjeldas kui „enneolematut” intsidenti.
Tehisintellekti mudeleid, mis toetavad selliseid tööriistu nagu vestlusrobotid ja pildigeneraatorid, nimetatakse agentideks, kui nad tegutsevad autonoomselt, et täita ülesandeid reaalses maailmas.
Tehnoloogia arenedes on küberturvalisus tähelepanu keskpunktis, arvestades ohtu, et täiustatud tehisintellekt leiab olemasoleva tarkvara nõrgad kohad enne inimesi.
Ekspertide sõnul annab intsident märku, et tehisintellekt juba kujutab endast kardetud turvaohtu ja see võib tabada isegi tipptasemel arendajaid.
Küberturvalisuse ekspert, Integrity360 tehnoloogiajuht Richard Ford ütles Daily Mailile: „See on hetk, mille eest paljud küberturvalisuse valdkonnas on hoiatanud.”
„Seni oleme näinud ründajaid tehisintellekti kasutamas rünnaku osade automatiseerimiseks, kuid see on üks esimesi avalikke näiteid sellest, kuidas tehisintellekti agent tuvastab iseseisvalt nõrkuse, põgeneb keskkonnast, mis oleks pidanud olema turvaline, ja üritab teist organisatsiooni ohtu seada.
See kinnitab ka seda, et tehisintellekt ei asenda küberturvalisuse põhialuseid. Agent kasutas ära haavatavust keskkonnas, mis oleks pidanud olema turvaline liivakast, mis näitab, et hea küberhügieen, tugevad juurdepääsukontrollid ja tõhusad piirded on endiselt olulised.
Kuna üha rohkem organisatsioone hakkab testima täiustatud tehisintellekti agente, peavad nad sama hoolikalt mõtlema nii nende süsteemide ümber olevate kontrollide kui nende pakutavate võimaluste üle.”
OpenAI teatas, et tegemist oli „enneolematu küberintsidendiga, milles kasutati tipptasemel kübervõimekusi”, ning ettevõte tugevdab nüüd oma kaitsemeetmeid.
Juhtum pälvis tähelepanu ka seetõttu, et New Yorgis tegutsev Hugging Face kasutas ründe ohjeldamiseks Hiina avatud lähtekoodiga mudelit; USA juhtivad mudelid keeldusid analüüsiks vajalikke andmeid töötlemast, kuna ei suutnud eristada kaitsjat ründajast.
Ettevõte teatas eelmisel nädalal blogipostituses, et kasutas analüüsiks Zhipu AI mudelit GLM-5.2, mis võimaldas hoida ründaja andmeid ja mis tahes ligipääsuandmeid oma süsteemide piires.
GLM-5.2 ja Pekingis asuva Moonshoti mudel Kimi K3 on viimasel ajal Silicon Valleys elevust tekitanud, kuna nende võimekus on lähedane USA tippmudelite omale, kuid need on odavamad ja neil puuduvad piirangud, mis takistavad USA konkurentide kasutamist sellistes valdkondades nagu küberturvalisus.
Hugging Face’i kaasasutaja Thomas Wolf ütles: „Kui tipptasemel mudel sind ründab ja liigub sinu infrastruktuuris külgsuunas, vajavad kaitsjad tundide või isegi minutite jooksul laialdast ligipääsu samaväärse võimekusega tööriistadele, selle asemel et neid suunataks kinniste ja rangelt kontrollitud rakendusliideste (API-de) juurde.”
Hugging Face – platvorm, mis majutab avatud lähtekoodiga suuri keelemudeleid ja andmekogumeid – sattus häkkimisjuhtumi tõttu küberturvalisuse kogukonnas tähelepanu keskpunkti. Ettevõte teatas eelmisel nädalal, et rikkumine „erines kõigest, millega olime varem kokku puutunud” ja et seda „viis algusest lõpuni läbi autonoomne tehisintellekti agentide süsteem”.
Nüüd on OpenAI tegevjuht Sam Altman avalduses kinnitanud: „Meil oli mudelite hindamise käigus tõsine turvaintsident.”
Hugging Face’i kaasasutaja ja tegevjuht Clément Delangue lisas: „Kahtlustasime, et eelmisel nädalal toimunud küberrünne võis pärineda tipptasemel tehisintellekti arendavast laborist, arvestades kasutatud agendi keerukust. Nagu selgus, nii see oligi.”
Delangue ütles, et veetis viimased 24 tundi koostöös OpenAI-ga, ning lisas: „Me usume kindlalt, et neil polnud pahatahtlikke kavatsusi. On lausa hämmastav, et see kõik toimus autonoomselt.”
Ta lisas, et tegemist võib olla „esimese taolise vahejuhtumiga”.
OpenAI teade, et turvarikke põhjustasid nende täiustatud mudelid – seda vaatamata asjaolule, et need olid paigutatud nende endi sõnul „rangelt isoleeritud keskkonda” –, suurendab tõenäoliselt muret tipptasemel tehisintellektimudelite võimekuse ja nendega kaasnevate riskide pärast.
„Tehisintellekt kiirendab haavatavuste avastamist ja ärakasutamist,” märkis OpenAI oma avalduses. „Selle vahejuhtumi peamine õppetund on, et mudelite turvalisus peab käima ühte sammu nende kiiresti kasvava võimekusega.”
OpenAI teatas, et sissetungi põhjustasid mitmed nende tehisintellekti mudelid üheskoos, sealhulgas äsja avaldatud GPT-5.6 Sol ja veelgi võimekam mudel, mida alles ettevõtte siseselt testitakse.
OpenAI väitel kasutas tehisintellekt Hugging Face’i serveritele ligipääsemiseks varastatud ligipääsuandmeid ja avastas seni tundmatu turvanõrkuse.
Ettevõtte teatel nägi tehisintellekt „äärmiselt palju vaeva üsna kitsa testimiseesmärgi saavutamiseks” ning „leidis viise salajasele teabele ligipääsemiseks, mida sai kasutada hindamisprotsessi petmiseks”.
Ettevõte püüdis hinnata mudelite häkkimisvõimekust, andes neile ülesandeid rangelt kontrollitud digitaalses katsekeskkonnas, kus internetiühendus oli turvalisuse huvides piiratud.
„Meie isoleeritud katsekeskkonnas tegutsedes kulutasid mudelid märkimisväärse osa (arvutusvõimsusest) sellele, et leida viis avatud internetiühenduse saamiseks, eesmärgiga lahendada etteantud hindamisülesanne,” seisis OpenAI blogipostituses.
Pärast internetiga ühenduse loomist otsustasid mudelid oma eesmärgi saavutamiseks võtta sihikule platvormi Hugging Face.
Otsides „salajast teavet”, mis aitaks hindamist petta, ühendas OpenAI süsteem „mitu ründevektorit, sealhulgas varastatud ligipääsuandmete kasutamise”.
OpenAI teatas, et Ühendkuningriigi tehisintellekti turvalisuse instituudi (AISI) uuringud näitavad, et sellised mudelid nagu GPT‑5.6 Sol suudavad „üha paremini läbi viia keerulisi ja mitmeetapilisi küberoperatsioone pika aja vältel”.
Luta Security tegevjuht Katie Moussouris märkis, et see vahejuhtum on märk tulevastest turvarikkumistest, kirjeldades tänapäeva mudeleid kui „maailma nutikamaid kaheksajalast põgenemiskunstnikke, kellel on piiramatult haardevõimelisi kombitsaid ja võime end igalt poolt läbi pressida”.
Ta lisas, et „laborid ja riiklikud hindajad peavad arendama võimekust tehisintellekti ohjeldada ja jälgida ning teavitada asjaosalisi, kui tehisintellekt sooritab järjekordse Houdini-stiilis põgenemise – ideaalis enne, kui see kahjustab kolmandat osapoolt. Praegu selline võimekus puudub”.
Autonoomsele tehisintellektile keskenduva küberturbeettevõtte Tolmo insener Matt Suiche ütles, et vahejuhtum näitas, kuidas tipptasemel tehisintellekti mudelid „vähendavad vahet tipptasemel ründajatega”.
Samas lisas ta, et OpenAI blogipostituses kirjeldatud turvarikkumisi on võimalik toime panna tehnoloogiaga, mis on kättesaadav ka väljaspool tipptasemel uurimislaborite seinu.
„Oleme seda juba ettevõtte siseselt näinud – meie agentidega on sellised tulemused juba saavutatud,” ütles Suiche. „Me ei pea isegi uusimaid mudeleid kasutama.”
Canberras asuva Uus-Lõuna-Walesi Ülikooli arvutiteaduse professor Hussein Abbass märkis, et see vahejuhtum oli „mitmes mõttes hämmastav”.
Ta lisas: „See ei rünnanud lihtsalt platvormi Hugging Face. See ründas tegelikult selle sisesüsteemi, et ära kasutada platvormi enda nõrku kohti. Ja see on hirmutav.”
Abbassi sõnul on täiustatud tehisintellekt „tavaliselt eetiliste ja vastutustundlike inimeste käes”. Ta rõhutas aga, et „tagajärjed on katastroofilised, kui see satub kellegi kätte, kelle eesmärk on kahju tekitada”.
Küsimus sellest, kuidas tehisintellekti valdkonda reguleerida, on muutunud keskseks ning „olukorra ohjamiseks on vaja kogukonna ühiseid jõupingutusi”, lisas Abbass.

