Bizonyára olvastatok már róla, hogy az OpenAI belső kiberbiztonsági tesztje közben a modelljeik kijutottak az elzárt környezetből, majd behatoltak a Hugging Face rendszerébe. Az OpenAI vizsgálata szerint a műveletben a GPT-5.6 Sol és egy még fejlettebb, megjelenés előtt álló modell is részt vett.
A modellek egy csomagkezelő proxy korábban ismeretlen sérülékenységét kihasználva szereztek internethozzáférést, majd jogosultságaikat kiterjesztve eljutottak a Hugging Face szervereihez. Ott további hibákat és megszerzett belépési adatokat felhasználva hozzáfértek egy adatbázishoz, amelyben az ExploitGym nevű teszt megoldásait keresték.
A rendelkezésre álló bizonyítékok alapján tehát nem egy öntudatra ébredt AI próbált megszökni, csak a rendszer szélsőséges eszközökkel igyekezett teljesíteni a számára kijelölt feladatot.
A történtek után az Nvidia és 36 további szervezet létrehozta az Open Secure AI Alliance nevű szövetséget. Az alapító tagok között megtalálható a Microsoft, az Adobe, az IBM, a Cisco, a Cloudflare, a CrowdStrike, a Dell, a Hugging Face, a Linux Foundation, a Palantir, a Red Hat, a SAP, a Salesforce, a Siemens és a SpaceXAI is.
Az open weight modellek paraméterei letölthetők, így a szervezetek saját rendszereiken futtathatják és a feladataikhoz igazíthatják őket. Ez a kiberbiztonsági munkában azért fontos, mert mondjuk a belépési adatok nem kerülnek külső szolgáltatóhoz, a védelmi szakembereket pedig nem akadályozzák a kereskedelmi API-k általános biztonsági korlátai.
A szövetség többek között az AI-ügynökök személyazonosságának és jogosultságainak kezelésére, elkülönítésére, naplózására, ellenőrzésére és biztonságos működtetésére fejleszt majd nyílt eszközöket.