A szélhámos színészek megkerülték a korlátozásokat, hogy tanulmányozzák a halálos vírusokat és toxinokat

Amit eddig tudunk: Az Anthropic, a Dario Amodei vezette San Francisco-i mesterséges intelligencia-cég azt állítja, hogy azonosította feltételezett államilag támogatott kutatók lehetséges próbálkozásait, hogy a Claude AI modelljét biológiai fegyverek kifejlesztésére használják fel. A cég hozzátette, hogy a felhasználókat blokkolták, miután ismételt próbálkozások váltották ki Claude beépített biztonsági protokolljait.

Az Anthropic a közelmúltban legalább öt olyan esetet részletezett, amikor a feltételezett szélhámos szereplők „megkerülték az ellenőrzéseket”, amelyeket kifejezetten arra terveztek, hogy a világ bizonyos részein megakadályozzák a felhasználókat abban, hogy hozzáférjenek Claude kiterjedt tudásbázisához a fertőző betegségekről, például a madárinfluenzáról, valamint a halálos mérgekről és toxinokról, például a botulinum toxinról.

A kísérletek teljes száma azonban jóval nagyobb, mivel a vállalat azt állítja, hogy 2025 novembere és 2026 szeptembere között körülbelül 35 különböző erőfeszítést azonosítottak az esetleges államilag finanszírozott biofegyver-fejlesztők, hogy „elzavarják kutatásaik célját, hogy elkerüljék a biztosítékainkat”.

Az egyik gyanús eset a chikungunya vírus átvitelének és az immunrendszer elkerülésének kutatásával foglalkozott. Egy másik fiókot megjelöltek, mert azt kutatták, hogyan lehet a madárinfluenza-vírust arra alkalmassá tenni, hogy súlyos betegségeket okozzon emlősökben. A kutatókat az orthopoxvírusokkal kapcsolatos lekérdezések miatt is betiltották – egy DNS-vírus-nemzetség, amely magában foglalja a himlőt és a himlőt okozó variolát.

Az Anthropic elismerte, hogy nehéz meghatározni, hogy a toxinok, mérgek és rokon anyagok kutatásának célja a biofegyverek gyártásának elősegítése vagy az ellenszerek, vakcinák és más orvosi vagy terápiás megoldások kifejlesztése. Azonban ami miatt a rendszer megjelölte a fent említett próbálkozásokat, az az volt, hogy különféle anonimizálási technikákat használtak az Anthropic regionális blokkolásának elkerülésére.

A biofegyverekkel kapcsolatos rémületet követően az Anthropic azt állítja, hogy frissítette biztonsági protokolljait, hogy megakadályozza, hogy a fenyegetés szereplői AI modelljeit aljas célokra használják fel. „Óvatosságból a legújabb modelleket (elsősorban a Claude Fable 5-öt) indítottuk el, erősebb biztosítékokkal, amelyek korlátozzák a hozzáférést a kettős felhasználású biológiai kutatási lekérdezések széles skálájához” – mondta a vállalat.

Az Anthropic nem azonosította azokat a régiókat, ahonnan feltételezhetően ezek a lekérdezések származtak, de a vállalatról széles körben ismert, hogy megakadályozza a kínai, orosz, iráni, észak-koreai és számos más ország felhasználóit, hogy hozzáférjenek Claude-hoz. Ugyanakkor azt állítja, hogy 2026 májusáig letiltott minden gyanús fiókot, mert megsértették a támogatott régiókra vonatkozó irányelvét.

Az Anthropic szerint a mesterséges intelligencia biofegyverek létrehozására való visszaélése az egyik „legsúlyosabb kockázat”, amellyel az AI-modellek szembesülnek. A cég hozzátette, hogy pontosan azért építették be a védőkorlátokat, hogy elkerüljék az ehhez hasonló helyzeteket, amikor a szélhámos nemzetállamok mesterséges intelligenciát kihasználva halálos biofegyvereket készíthetnek, és biológiai hadviselést folytathatnak saját népük vagy a nyugati demokráciák ellen.