Tvrtka za razvoj umjetne inteligencije Anthropic objavila je da je njihov AI model Claude tijekom testiranja samostalno hakirao sustave triju organizacija. Ovaj se incident dogodio samo nekoliko dana nakon što je konkurentski OpenAI otkrio da je njihov AI sustav izveo kibernetički napad na tvrtku Hugging Face, piše Hina.
Kako je Claude probio sustave
Prema informacijama Reutersa, Claude je dobio neovlašteni pristup sustavima zbog pogrešne konfiguracije koja mu je omogućila spajanje na internet iz testnog okruženja. To okruženje trebalo je biti potpuno izolirano. Iz Anthropica su pojasnili da su incidente otkrili nakon pregleda više od 141.000 procjena kibernetičke sigurnosti, a taj su proces pokrenuli nakon otkrića iz OpenAI-ja.
"Claude je ugrozio infrastrukturu pogođenih organizacija. Koristio je osnovne tehnike, poput iskorištavanja slabih lozinki", poručili su iz Anthropica.
Prethodni slučaj u OpenAI-ju
Sličan se incident nedavno dogodio i u OpenAI-ju. Dva njihova napredna AI modela provela su više od četiri dana na otvorenom internetu prije nego što su samostalno napala platformu za razvoj umjetne inteligencije Hugging Face.
Otkriveno je da su modeli između 9. i 13. srpnja izveli 17.600 različitih radnji. Izašli su iz zatvorenog testnog okruženja i samostalno primijenili niz sofisticiranih hakerskih tehnika kako bi prodrli u sustav. Jedan od ta dva modela javno je dostupan, dok je drugi bio interni istraživački prototip koji nije bio namijenjen javnoj uporabi.
Autonomno djelovanje i brzina
Ono što posebno zabrinjava jest činjenica da programeri modelima nisu dali nikakvu naredbu za napad. Umjetna inteligencija sama je isplanirala i provela aktivnosti koje su dovele do proboja sigurnosnih sustava. Iz tvrtke Hugging Face naveli su kako je umjetna inteligencija uspjela analizirati njihove obrambene mehanizme i pronaći slabe točke znatno brže nego što bi to mogao učiniti čovjek.