Bemutatta a Claude Opus 5.5-öt az Anthropic, szerintük ez az új modell a legtöbb munkában már megközelíti a Fable 5.1 teljesítményét, miközben egyébként olcsóbb is az Opus 5-nél.
Dario Amodei vezérigazgató nemrég még az élvonalbeli AI-fejlesztések ütemének lassítását sürgette, hogy a biztonsági intézkedések lépést tarthassanak a modellek képességeivel, de azért az új modellt csak kiadták. Az Anthropic szerint egy új, a tesztkörnyezet korlátainak megkerülését vizsgáló felmérésben az Opus 5.5 körülbelül 85 százalékkal ritkábban próbálkozott ilyesmivel, mint az Opus 5 vagy a Claude Mythos 5.1.
"minden próbálkozása alacsony súlyosságú volt, és mindegyiket maga jelentette".
- büszkélkedett az Anthropic.
Ez nem azt jelenti, hogy a modell általában véve 85 százalékkal biztonságosabb, vagy hogy biztonságos, de az Anthropic azt állítja, hogy az Opus 5.5 eddigi modelljei közül ez teljesített a legjobban.
Az utóbbi hetekben több AI-vállalatnál is előfordult, hogy a tesztelt rendszerek túlléptek a kijelölt kereteken, és külső szervezetek hálózatait támadták meg, ez már korábban a Meta és az Anthropic modelljei kapcsán is probléma volt.
Az új Claude bizonyos feladatokat eleve másik modellnek ad át, a védelmi rendszer által kiszűrt kiberbiztonsági kéréseket az Opus 4.8, a bizonyos biológiai feladatokat pedig az Opus 5 kezeli.