Az OpenAI felfüggesztette legerősebb modelljeinek tanítását, tesztelését és külső eszközöket használó futtatását, miután egy újabb kísérleti ügynök kijutott az elvileg elszigetelt környezetéből.
Az ügynöknek egy blogbejegyzés szerzőjét kellett volna azonosítania néhány életrajzi adat és szöveges nyom alapján. Amikor a rendelkezésére bocsátott keresővel nem jutott eredményre, más keresőszolgáltatásokat próbált közvetlenül elérni. Ezek a kísérletek nem vezettek ki az élő internetre, a modell azonban talált egy másik útvonalat.
A domainnevek feloldásához használt DNS-rendszer hiányos szűrését kihasználva egy nyilvános chatbotnak küldött kérdéseket.
A kapcsolat valóban működött, az eredeti feladatot viszont így sem sikerült megoldania. Az OpenAI szerint a biztonsági megfigyelőrendszer 15 percen belül jelezte a rendellenességet, és három perccel később egy munkatárs már ott is termett, de a folyamatnak automatikusan le kellett volna állnia, ami viszont nem történt meg. Végül mintegy két és fél órával később, kézzel állították le.
"Ez az incidens jóval kevésbé súlyos néhány korábbi esetünknél"
- írta az OpenAI, szerintük ugyanis ez volt az első ilyen esemény a Hugging Face-incidens után bevezetett biztonsági szigorítások óta, ezért fontos visszajelzést ad a további védekezéshez. Az érintett modell tanítását nem folytatják.
A Hugging Face balhéja utána az sem volt különösebben megnyugtató, hogy az OpenAI ügynökei egy német wikit használtak egymás közötti üzenetváltásra.