text size
Kada su napredni modeli veštačke inteligencije kompanije OpenAI prošle nedelje provalili u interne sisteme AI startapa Hugging Face, bilo im je potrebno svega nekoliko sati da izvedu hakerski napad za koji bi veštom čoveku bilo potrebno znatno više vremena, rekli su izvori upoznati sa situacijom.
Uobičajeno bi čak i talentovanom hakeru bile potrebne dve nedelje da izvede ovakav napad, rekli su izvori koji su tražili da ostanu anonimni kako bi razgovarali o detaljima koji nisu javno objavljeni.
OpenAI je u kontaktu sa američkom vladom otkako je saznao da se upad dogodio, dodao je jedan od izvora.
Portparol OpenAI-ja izjavio je da je kompanija komunicirala sa organima za sprovođenje zakona i drugim državnim službama o incidentu, kao i da je bila transparentna u vezi sa svojim saznanjima.
Portparol se takođe pozvao na objavu kompanije na blogu od utorka o tom incidentu, u kojoj je kompanija navela da će "nastaviti da sprovodi temeljnu istragu zajedno sa Hugging Faceom i podeliti više detalja o ranjivostima, incidentu i nalazima kada istraga bude završena".
Iz Hugging Facea odbili su da daju komentar.
OpenAI je u istoj objavi na blogu naveo da se "nezabeleženi" hakerski napad na Hugging Face dogodio nakon što su njegovi sopstveni AI modeli - uključujući GPT-5.6 Sol i još jedan sposobniji model koji još nije javno objavljen pobegli iz testnog okruženja i pristupili širem internetu. Kompanija je u to vreme testirala sajber sposobnosti tih modela.
Modeli su radili bez uobičajenih bezbednosnih zaštitnih ograda, saopštila je kompanija, jer je OpenAI nameravao da ostanu u testnom području poznatom kao "peščanik" (sandbox) - zapravo virtuelnom i izolovanom softverskom okruženju namenjenom izvođenju bezbednosnih testova ili analizi nebezbednog koda u kontrolisanim uslovima.
Hakerski napad uključivao je ukupno tri OpenAI-jeva modela, GPT-5.6 Sol i dva koja još nisu javno objavljena koji su radili na otkrivanju i iskorišćavanju niza ranjivosti, što je na kraju dovelo do provale, rekao je jedan od izvora. Jedan od tih neobjavljenih modela sposobniji je od GPT-5.6 Sola, objavio je OpenAI u utorak, dok je drugi bio neusklađen (misaligned) i nije bio treniran nekim od uobičajenih tehnika, naveo je izvor.
Hugging Face je otkrio incident u četvrtak, navodeći da je pretrpeo upad u hakerskom napadu za koji je okrivio spoljašnji autonomni (agentic) proizvod. Ovaj startap, koji hostuje AI modele i skupove podataka, saopštio je da je detektovao "roj od nekoliko desetina hiljada automatizovanih radnji" i da je na kraju upotrebio kineski model za forenzičku analizu incidenta, nakon što su njegovi zahtevi za korišćenje vlasničkih AI modela bili blokirani bezbednosnim zaštitnim ogradama.
OpenAI je kasnije otkrio da je svojim modelima dao uputstva da pošalju desetine hiljada automatizovanih radnji u okviru testa, uključujući "napredno iskorišćavanje" (advanced exploitation) i "složene putanje napada". Kompanija je u utorak objavila da deli rane detalje o incidentu kako bi pomogla osoblju za sajber bezbednost da razume situaciju.
Moćni AI sajber proizvodi i ranije su se ponašali na neočekivane načine. Kompanija Anthropic PBC saopštila je u aprilu da je njen model Mythos "u retkim prilikama" preduzimao radnje koje je kompanija smatrala "prilično zabrinjavajućim". Jedan slučaj uključivao je istraživača koji je izazvao ranu verziju Mythosa da pobegne iz izolovanog sistema i pošalje poruku nazad istraživaču. Mythos je to učinio, a zatim preduzeo "dodatne, zabrinjavajuće radnje" i izgradio višestepeni proces kako bi dospeo do šireg interneta.