Túl szigorúak az Anthropic Fable modelljének védőkorlátai a kiberbiztonsági kutatók szerint
Valentina 'Chompie' Palmiotti szerint a Fable modell elutasítja a kiberbiztonsághoz kapcsolódó kéréseket. Az Anthropic kedden mutatta be a modellt.

Az Anthropic kedden mutatta be Fable modelljét, amely a Mythos nevű, erőteljes kiberbiztonsági modell nyilvános, korlátozott változata. A modell bevezetése után több kiberbiztonsági kutató és szakember is panaszt emelt az online felületeken a szigorú korlátozások miatt.
Valentina “Chompie” Palmiotti, az IBM X-Force ismert biztonsági kutatója szerint „a Fable minden olyan kérést elutasít, ami akár csak érintőlegesen is kapcsolódhat a kiberbiztonsághoz. Még olyan ártalmatlan feladatokat is, mint egy blogbejegyzés elolvasása.” Amikor egy kérés kiváltja a védőkorlátokat, a Fable leállítja a csevegést és azt az üzenetet jeleníti meg, hogy „biztonsági intézkedéseink kiberbiztonsági vagy biológiai témákat jelöltek meg.”
Kapcsolódó: kiberbiztonsági eszközök
A korlátozások célja és hatása
A védőkorlátozásokat azért helyezték el, hogy csökkentsék annak a kockázatát, hogy a Fable-t rosszindulatú szoftverek fejlesztésére vagy szoftverek kompromittálására használják – ez régóta fennálló aggály az Anthropicnál. A biológiai témákra vonatkozó korlátozások hasonló aggodalomból fakadnak a biológiai fegyverek kifejlesztésével kapcsolatban.
Kapcsolódó: Claude biztonsági frissítés
A múlt héten az Anthropic több száz szervezetre bővítette a Mythos elérését 15 országban. A jó szándék ellenére azonban sok kiberbiztonsági szakértőt továbbra is elriaszt a korlátozások esetlegesnek tűnő természete.
Kapcsolódó: Claude Security indulása
A kulcsszavas szűrés problémái
Matt Suiche, kiberbiztonsági veterán szerint „ha megkéred, hogy írjon biztonságos kódot, azt feltételezi, hogy kiberbiztonsági munkáról van szó a szoftverfejlesztési legjobb gyakorlatok helyett, és leminősítést kapsz.” A Fable úgy van programozva, hogy a védőkorlátok elérése esetén visszatérjen a Claude Opus 4.8-hoz. „Úgy tűnik, kulcsszavakon alapul, így a „kiberbiztonság” szókincsébe tartozó bármi kiváltja a korlátokat.”
Kapcsolódó: kiberbiztonsági együttműködés
Suiche szerint „érthető, mivel még csak a korai szakaszban járunk, és még mindig alkalmazkodnak a védőkorlátaikhoz. Biztos vagyok benne, hogy idővel fejlődni fognak, ahogy az Anthropic és más határ-modelleket fejlesztő cégek egyre több együttműködést folytatnak a jelenlegi új generációs kiberbiztonsági cégekkel.”
Kapcsolódó: MCP protokoll veszélyei
Egy másik kutató a X-en panaszkodott, hogy „még egy kódellenőrzés kérése is” kiváltja a Fable védőkorlátait. Az Anthropic nem reagált azonnal a megkeresésre. A modelleken belüli védőkorlátokon kívül az Anthropic megköveteli a kiberbiztonsági szakemberektől, hogy jelentkezzenek a Cyber Verification Programba, ahol a Claude kiberbiztonsági munkára való használatára vonatkozó korlátozások enyhülnek, mint az OpenAI Trusted Access for Cyber programjában.