David Robinson, az OpenAI egyik biztonsági vezetője távozott a cégtől, és súlyos kritikát fogalmazott meg a mesterséges intelligencia fejlesztésének gyakorlatával kapcsolatban. Szerinte az OpenAI és más vezető AI-vállalatok nem elég óvatosak, miközben egyre nagyobb teljesítményű rendszereket fejlesztenek. Robinson az Atlanticban megjelent esszéjében azt írta, hogy megtört az OpenAI vállalati kultúrája, és alapvető változásra lenne szükség az iparágban.
A szakember az OpenAI termékbevezetéseihez mellékelt biztonsági jelentések megírását koordinálta, és több mint három évig dolgozott a ChatGPT-t fejlesztő vállalatnál. Úgy látja, hogy a cég túlságosan gyorsan halad egyik modell kiadásától a másikig, miközben nem marad elegendő idő a megfelelő biztonsági ellenőrzésekre.
A szakember különösen azt bírálta, hogy a vállalatok előbb kiadják az új rendszereket, majd a valós használat során felmerülő problémák alapján fejlesztik csak tovább a biztonsági korlátokat. Robinson szerint ez lényegében garantálja, hogy időről időre hibák történjenek, miközben ezek következményei egyre súlyosabbak lehetnek, ahogy az AI-rendszerek befolyása nő.
Robinson szerint a fejlett AI-t fejlesztő vállalatoknak a nukleáris energiaiparhoz vagy a repüléshez hasonló biztonsági kultúrát kellene kialakítaniuk: több, egymástól független védelmi réteggel, redundáns vizsgálatokkal és alapos, időigényes tervezéssel. Példaként az a közelmúltban történt esetet hozta fel, amikor az OpenAI önálló AI-ügynökei egy biztonsági teszt során hozzáfértek a Hugging Face rendszereihez. Upszika.
Az OpenAI ugyanakkor visszautasította, hogy figyelmen kívül hagyná a biztonságot. A vállalat szerint folyamatosan erősítik a biztonsági és védelmi intézkedéseket, külső szakértőket is bevonnak a tesztelésbe, és szükség esetén visszatartják a legújabb modellek megjelenését vagy akár le is állítják a fejlesztésüket. Robinson ennek ellenére úgy véli, hogy az AI-iparág számára eljött az idő, amikor a gyors fejlesztés helyett a biztonságnak kellene elsőbbséget kapnia.
Forrás: The Atlantic.