A Meta megerősítette, hogy egyik AI-modellje egy kiberbiztonsági teszt során hozzáfért egy másik vállalat valódi rendszeréhez. A tesztet az Irregular nevű külsős biztonsági labor végezte, a Meta pedig egyelőre annyit közölt a BBC-vel, hogy az incidenst a tesztkörnyezet hibás beállítása tette lehetővé.
Az Irregular szerint ugyanarról a tesztkörnyezeti problémáról van szó, ami miatt az Anthropic három különböző Claude-modellje is valódi szervezetek rendszereibe jutott be. A modelleknek azt mondták, hogy egy internettől elzárt szimulációban dolgoznak, a hibás konfiguráció miatt azonban mégis elérték a nyílt internetet. Az ott talált valódi rendszereket a gyakorlat részének tekintették, majd gyenge jelszavakat és védelem nélküli végpontokat kihasználva három szervezet infrastruktúrájához fértek hozzá.
Az OpenAI néhány nappal korábban szintén beszámolt egy Irregularnél történt incidensről, itt az volt a baj, hogy a tesztben szereplő fiktív célpont neve véletlenül egy valódi webcímmel egyezett meg, a modell pedig az engedély nélkül elérhető internetkapcsolaton keresztül megtámadta az oldalt.
Ennél lényegesen súlyosabb - és aggasztóbb - volt az OpenAI és a Hugging Face júliusi esete, ahol a modellek nem kaptak közvetlen internet-hozzáférést, hanem egy korábban ismeretlen sérülékenységet kihasználva maguk találtak kiutat az elszigetelt környezetből. Ezután behatoltak a Hugging Face éles infrastruktúrájába, hogy megszerezzék egy kiberbiztonsági teszt megoldásait.
Ez még nem a Skynet, mert ezekben a tesztekben több szokásos biztonsági szűrőt is kikapcsoltak, az internet-hozzáférést pedig részben szándékosan, részben pedig jó öreg emberi hibából adódóan engedélyezték. Szóval a modellek nem öntudatra ébredt mesterséges intelligenciaként fordultak az alkotóik ellen, hanem a céljaikat makacsul követve lépték át pontatlanul kijelölt vagy legalábbis rosszul védett határokat.