Društvo Autor: A. Izvor: RTS

Vještačka inteligencija izmakla kontroli, dva najnovija modela hakovala digitalnu biblioteku

Kompanija OpenAI saopštila je da su dva njena modela vještačke inteligencije „izmakla kontroli“ i uspješno hakovala "Hutting Face", digitalnu biblioteku za vještačku inteligenciju koja je veoma popularna među programerima.

Foto: Pexels
Foto: Pexels

Incident se dogodio prošle sedmice tokom testiranja sajber-bezbjednosnih sposobnosti OpenAI sistema i pokazao scenario nalik naučnoj fantastici, na koji kompanije koje razvijaju vještačku inteligenciju već neko vrijeme upozoravaju da bi uskoro mogao postati stvarnost.

Kompanije koje razvijaju vještačku inteligenciju, poput OpenAI-ja i Anthropica, tokom protekle godine predstavile su modele posebno prilagođene otkrivanju sajber-bezbjednosnih slabosti, uz upozorenje da bi njihova tehnologija mogla stvoriti nove rizike jer može pronalaziti propuste u računarskim mrežama kompanija brže nego što ih stručnjaci mogu otkloniti.

Saopštenje kompanije OpenAI ukazuje na to da takvi bezbjednosni incidenti počinju da se dešavaju i da čak ni tehnološki najnaprednije kompanije za razvoj vještačke inteligencije možda nijesu u potpunosti spremne za njih.

Upad u Hutting Face započeo je kada je OpenAI testirao kombinaciju dva svoja modela – GPT-5.6 Sol i još moćniji model koji još nije javno predstavljen – kako bi provjerio koliko uspješno mogu povezati više ranjivosti u jedinstven sajber-napad.

Test je bio zamišljen tako da modeli rade u bezbjednom okruženju za testiranje, poznatom kao „sandbox“. Međutim, modeli su pronašli ranjivost koja im je omogućila da izađu iz tog izolovanog okruženja i povežu se sa internetom. Zatim su kao metu odabrali Hutting Face, zaključivši da biblioteka, koja sadrži milione modela vještačke inteligencije, može pružiti informacije koje bi im pomogle da uspješno prođu bezbjednosnu provjeru.

OpenAI je saopštio da sarađuje sa bibliotekom Hugging Face na otklanjanju propusta koji su omogućili napad.

„Smatramo da je ovo sajber-incident bez presedana, koji uključuje najsavremenije sajber-sposobnosti, i reagujemo u skladu s tim. Uvodićemo stroge kontrole u konfiguraciji infrastrukture, čak i po cijenu usporavanja istraživanja, dok se ranjivosti ne otklone“, navodi OpenAI.

Hutting Face je prošle sedmice saopštio da je otkrio upad i da zna da ga je izazvao autonomni sistem, ali tada nije naveo da iza incidenta stoji OpenAI.

Izvršni direktor biblioteke, Klem Delang, izjavio je da je „zahvalan na saradnji“ sa kompanijom OpenAI nakon hakerskog napada.

„Ovaj incident, vjerovatno prvi takve vrste, potvrđuje ono u šta dugo vjerujemo: bezbjednost vještačke inteligencije neće riješiti nijedna kompanija koja radi u tajnosti“, rekao je Delang.

Modeli vještačke inteligencije pokazali su se izuzetno sposobnim za programiranje, što ih čini korisnim i hakerima i stručnjacima zaduženim za zaštitu računarskih mreža.

U aprilu je Anthropic predstavio model za sajber-bezbjednost pod nazivom Mythos, koji je učinio dostupnim samo malom broju organizacija kako bi im pomogao u odbrani od sajber-napada.

Nedugo zatim, OpenAI je predstavio sopstveni model za sajber-bezbjednost i omogućio ograničenom broju organizacija da ga koriste za jačanje svoje odbrane prije nego što ga ponudi širem krugu korisnika. U utorak je i Google saopštio da je razvio model usmjeren na sajber-bezbjednost i stavio ga na raspolaganje manjoj grupi partnera radi testiranja.