ÉlőUtoljára: 7 perceMa: 18
Biztonságfrissítve: 06:50

Túl szigorúak az Anthropic Fable modelljének védőkorlátai a kiberbiztonsági kutatók szerint

Valentina 'Chompie' Palmiotti szerint a Fable modell elutasítja a kiberbiztonsághoz kapcsolódó kéréseket. Az Anthropic kedden mutatta be a modellt.

Túl szigorúak az Anthropic Fable modelljének védőkorlátai a kiberbiztonsági kutatók szerint
Fotó: Jacob Sutherland / Unsplash
forrás: TechCrunch·AI Forradalom szerk.·
Megosztás

Az Anthropic kedden mutatta be Fable modelljét, amely a Mythos nevű, erőteljes kiberbiztonsági modell nyilvános, korlátozott változata. A modell bevezetése után több kiberbiztonsági kutató és szakember is panaszt emelt az online felületeken a szigorú korlátozások miatt.

Valentina “Chompie” Palmiotti, az IBM X-Force ismert biztonsági kutatója szerint „a Fable minden olyan kérést elutasít, ami akár csak érintőlegesen is kapcsolódhat a kiberbiztonsághoz. Még olyan ártalmatlan feladatokat is, mint egy blogbejegyzés elolvasása.” Amikor egy kérés kiváltja a védőkorlátokat, a Fable leállítja a csevegést és azt az üzenetet jeleníti meg, hogy „biztonsági intézkedéseink kiberbiztonsági vagy biológiai témákat jelöltek meg.”

Kapcsolódó: kiberbiztonsági eszközök

A korlátozások célja és hatása

A védőkorlátozásokat azért helyezték el, hogy csökkentsék annak a kockázatát, hogy a Fable-t rosszindulatú szoftverek fejlesztésére vagy szoftverek kompromittálására használják – ez régóta fennálló aggály az Anthropicnál. A biológiai témákra vonatkozó korlátozások hasonló aggodalomból fakadnak a biológiai fegyverek kifejlesztésével kapcsolatban.

Kapcsolódó: Claude biztonsági frissítés

A múlt héten az Anthropic több száz szervezetre bővítette a Mythos elérését 15 országban. A jó szándék ellenére azonban sok kiberbiztonsági szakértőt továbbra is elriaszt a korlátozások esetlegesnek tűnő természete.

Kapcsolódó: Claude Security indulása

A kulcsszavas szűrés problémái

Matt Suiche, kiberbiztonsági veterán szerint „ha megkéred, hogy írjon biztonságos kódot, azt feltételezi, hogy kiberbiztonsági munkáról van szó a szoftverfejlesztési legjobb gyakorlatok helyett, és leminősítést kapsz.” A Fable úgy van programozva, hogy a védőkorlátok elérése esetén visszatérjen a Claude Opus 4.8-hoz. „Úgy tűnik, kulcsszavakon alapul, így a „kiberbiztonság” szókincsébe tartozó bármi kiváltja a korlátokat.”

Kapcsolódó: kiberbiztonsági együttműködés

Suiche szerint „érthető, mivel még csak a korai szakaszban járunk, és még mindig alkalmazkodnak a védőkorlátaikhoz. Biztos vagyok benne, hogy idővel fejlődni fognak, ahogy az Anthropic és más határ-modelleket fejlesztő cégek egyre több együttműködést folytatnak a jelenlegi új generációs kiberbiztonsági cégekkel.”

Kapcsolódó: MCP protokoll veszélyei

Egy másik kutató a X-en panaszkodott, hogy „még egy kódellenőrzés kérése is” kiváltja a Fable védőkorlátait. Az Anthropic nem reagált azonnal a megkeresésre. A modelleken belüli védőkorlátokon kívül az Anthropic megköveteli a kiberbiztonsági szakemberektől, hogy jelentkezzenek a Cyber Verification Programba, ahol a Claude kiberbiztonsági munkára való használatára vonatkozó korlátozások enyhülnek, mint az OpenAI Trusted Access for Cyber programjában.

Forrás

Feldolgozott sajtóforrás·TechCrunch

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom