Hirdetés

Megérkezett az új Claude, ami állítólag már ritkábban próbál megszökni a tesztkörnyezetéből



|

Ott tartunk, hogy az Anthropic az Opus 5.5 kapcsán ki kell emelnünk, hogy jóval ritkábban próbálta átlépni a számára kijelölt határokat.

Hirdetés

Bemutatta a Claude Opus 5.5-öt az Anthropic, szerintük ez az új modell a legtöbb munkában már megközelíti a Fable 5.1 teljesítményét, miközben egyébként olcsóbb is az Opus 5-nél.

Dario Amodei vezérigazgató nemrég még az élvonalbeli AI-fejlesztések ütemének lassítását sürgette, hogy a biztonsági intézkedések lépést tarthassanak a modellek képességeivel, de azért az új modellt csak kiadták. Az Anthropic szerint egy új, a tesztkörnyezet korlátainak megkerülését vizsgáló felmérésben az Opus 5.5 körülbelül 85 százalékkal ritkábban próbálkozott ilyesmivel, mint az Opus 5 vagy a Claude Mythos 5.1.

"minden próbálkozása alacsony súlyosságú volt, és mindegyiket maga jelentette".

- büszkélkedett az Anthropic.

Ez nem azt jelenti, hogy a modell általában véve 85 százalékkal biztonságosabb, vagy hogy biztonságos, de az Anthropic azt állítja, hogy az Opus 5.5 eddigi modelljei közül ez teljesített a legjobban.

Hirdetés

Az utóbbi hetekben több AI-vállalatnál is előfordult, hogy a tesztelt rendszerek túlléptek a kijelölt kereteken, és külső szervezetek hálózatait támadták meg, ez már korábban a Meta és az Anthropic modelljei kapcsán is probléma volt.

Az új Claude bizonyos feladatokat eleve másik modellnek ad át, a védelmi rendszer által kiszűrt kiberbiztonsági kéréseket az Opus 4.8, a bizonyos biológiai feladatokat pedig az Opus 5 kezeli.

Hirdetés

Úgy tűnik, AdBlockert használsz, amivel megakadályozod a reklámok megjelenítését. Amennyiben szeretnéd támogatni a munkánkat, kérjük add hozzá az oldalt a kivételek listájához, vagy támogass minket közvetlenül! További információért kattints!

Engedélyezi, hogy a https://www.pcwplus.hu értesítéseket küldjön Önnek a kiemelt hírekről? Az értesítések bármikor kikapcsolhatók a böngésző beállításaiban.