Anthropic se rozhodl nezveřejnit svůj nejnovější model umělé inteligence, Claude Mythos, veřejnosti poté, co prokázal bezprecedentní schopnost odhalovat softwarové zranitelnosti, které by mohly být zneužity pro rozsáhlé kybernetické útoky.
Jak uvádí The Guardian, společnost se sídlem v San Franciscu uvedla, že model již identifikoval tisíce slabin v široce používaných aplikacích, včetně některých sahajících desítky let zpět a dříve neodhalených vývojáři. Anthropic se obává možného zneužití těchto schopností a proto omezuje přístup odborníkům na kybernetickou bezpečnost a vybraným partnerům.
Prostřednictvím iniciativy známé jako "Glasswing" společnost spolupracuje s významnými technologickými a bezpečnostními firmami, včetně Amazonu, Applu, Microsoftu, Cisco, CrowdStrike a Palo Alto Networks, stejně jako s Linux Foundation. Cílem je používat model defenzivně, pomáhat identifikovat a opravovat zranitelnosti dříve, než je zlověstní aktéři mohou zneužít.