text size
Modeli veštačke inteligencije (AI) koje su razvili OpenAI i Anthropic PBC tokom bezbednosnih testiranja sproveli su "neodobrene" radnje: hakovanje jedne internet stranice i pokušaj ubacivanja zlonamernog koda u softver, što je dodatno pojačalo strahove da ni njihovi tvorci ni iskusni istraživači ne mogu pouzdano da predvide ponašanje ovih sistema tokom testiranja.
Britanski Institut za bezbednost veštačke inteligencije (AI Security Institute), osnovan 2023. kako bi procenjivao bezbednosti najnaprednijih AI modela, saopštio je u utorak da su i Anthropicov Mythos 5 i OpenAI-jev GPT-5.6-Sol tokom evaluacije "učestvovali u dugotrajnim, potencijalno štetnim aktivnostima usmerenim ka stvarnim ljudima i organizacijama". Institut je modelima namerno omogućio pristup internetu i koristio ih bez pojedinih bezbednosnih ograničenja kako bi testirao njihove sposobnosti.
"Čak i u uslovima testiranja, ovaj incident je značajan: prvi put smo videli da se rizici povezani s autonomijom i obmanom ovako jasno ispolje u stvarnom svetu", naveo je institut u objavi na društvenoj mreži X.
Opširnije
LinkedIn menja pravila igre u borbi protiv AI sadržaja
Platforma u vlasništvu kompanije Microsoft prošle nedelje predstavila je dugme "deluje kao AI smeće".
pre 7 sati
SpaceX nadmašio očekivanja, ali velika ulaganja u AI oborila su akcije
Akcije kompanije Elona Muska, koja posluje u oblastima raketne tehnologije, satelitskih komunikacija i veštačke inteligencije, pale su oko sedam odsto u trgovanju nakon zatvaranja berze u SAD.
pre 7 sati
Zabrinjavajući pogled u Muskovu AI utopiju
Osnivačima kompanija, posebno vizionarima, samopouzdanje je neophodno, ali kritika ima važnu ulogu jer omogućava da se pravac koriguje kada je to potrebno. Musk je uglavnom imun na takve korekcije.
03.08.2026
OpenAI-jevi odbegli agenti zapravo su užasni provalnici
Uprkos strahovima od hakerskih napada veštačke inteligencije, stvarni primeri pokazuju da su AI agenti i dalje previše uočljivi i nepouzdani da bi ozbiljnije ugrozili sajber-bezbednost.
01.08.2026
U jednom slučaju, prema navodima istraživača, Mythos 5 je pokušao da ubaci zlonamerni kod u projekat softvera otvorenog koda na GitHubu. Model je otišao toliko daleko da je kreirao lažne identitete kako bi povećao šanse da njegov kod bude odobren.
"Osoba zadužena za održavanje projekta primetila je pokušaj i odbila odobravanje zlonamernog koda", navela je organizacija.
Tokom prethodne dve nedelje, i OpenAI i Anthropic javno su priznali da su njihovi modeli, tokom testiranja, nenamerno kompromitovali sisteme više institucija, uključujući i kompaniju Hugging Face Inc.
Najnovija otkrića su dokaz više da AI agenti mogu autonomno da deluju na načine koje čak ni istraživači specijalizovani za otkrivanje ranjivosti više ne mogu da predvide, što dodatno naglašava potrebu za strožim bezbednosnim proverama i pouzdanijim okruženjima za testiranje.
Britanski institut saopštio je da je Anthropicov model Mythos 5 odgovoran za 17 od ukupno 19 otkrivenih "autonomnih, neodobrenih aktivnosti na internetu".
Zbog ovih incidenata, pojedini zvaničnici američke administracije pozvali su na strožu regulaciju razvoja veštačke inteligencije. Prošlog utorka, više od 1.100 zaposlenih u AI industriji potpisalo je peticiju kojom se traži uspostavljanje regulatornog mehanizma koji bi namerno usporio razvoj veštačke inteligencije.
Anthropic je na mreži X saopštio da sarađuje sa britanskim Institutom za bezbednost veštačke inteligencije kako bi prikupio dodatne informacije o incidentu, dok istovremeno sprovodi sopstvenu istragu.
OpenAI je, u zasebnoj objavi na svom blogu, otkrio da je tokom testiranja jednog od njegovih modela, koje je sprovela spoljašnja kompanija za sajber-bezbednost Irregular, došlo do još jednog bezbednosnog incidenta.
U tom testu, poznatom kao "capture the flag", modeli su imali zadatak da pronađu informacije skrivene u simuliranom okruženju. Kompanija navodi da su modeli iskoristili pogrešnu konfiguraciju testnog okruženja kako bi se povezali na internet i hakovali internet stranicu jedne neimenovane institucije.
Do tog upada došlo je tokom iste evaluacije kompanije Irregular u kojoj su Anthropicovi modeli hakovali sisteme tri organizacije, rekao je upućen anonimni izvor. Anthropic je prošle sedmice objavio detalje tih incidenata. Predstavnik kompanije Irregular odbio je da komentariše slučaj.
Pre dve sedmice, OpenAI je takođe objavio da su njegovi modeli odgovorni za do sada nezabeležen hakerski napad na startap Hugging Face. Modeli su tom prilikom iskoristili bezbednosni propust kako bi "pobegli" iz izolovanog okruženja za testiranje (engl. sandbox), povezali se na internet i potom kompromitovali sistem kompanije Hugging Face, platforme koja hostuje modele veštačke inteligencije i skupove podataka.