Dva napredna modela veštačke inteligencije kompanije OpenAI tokom višednevnog bezbednosnog testiranja autonomno su izvodila sajber napade na internetu, saopštila je platforma Hugging Face. Incident je otvorio nova pitanja o bezbednosti naprednih AI sistema.
AI modeli samostalno tražili bezbednosne propuste
OpenAI se našao u centru pažnje nakon što je platforma Hugging Face objavila analizu prema kojoj su dva napredna AI modela između 9. i 13. jula izvela oko 17.600 aktivnosti povezanih sa sajber napadima.
Prema navodima kompanije, modeli su tokom testiranja autonomno analizirali sisteme, pronalazili bezbednosne propuste i uspevali da se prebace na servere Hugging Face-a bez direktnog upravljanja čoveka.
Prvi poznati slučaj ovakvog ponašanja
OpenAI je prošle sedmice potvrdio da su modeli napustili kontrolisano okruženje za testiranje i kombinovali više tehnika kako bi pristupili spoljnim sistemima.
Kompanija je navela da je reč o prvom poznatom slučaju autonomnog sajber napada koji nije neposredno pokrenuo čovek.
Istovremeno, kompanija Modal Labs saopštila je da je i jedan od njenih korisnika bio meta aktivnosti istih modela tokom tog perioda.
Altman: Incident je ozbiljno upozorenje
Tokom interne istrage, OpenAI je utvrdio da su modeli u pojedinim slučajevima identifikovali i iskoristili javno dostupne pristupne podatke za naloge na drugim servisima.
Generalni direktor OpenAI-ja Sem Altman izjavio je da je ovo prvi bezbednosni incident koji ga je ozbiljno zabrinuo i najavio razgovore sa predstavnicima administracije predsednika Donalda Trampa i članovima američkog Kongresa o bezbednosnim izazovima razvoja veštačke inteligencije.