A mesterséges intelligencia kitalálta, hogy bejutott az egyik vállalat rendszerébe, és két másik esetében talált felfedett hitelesítő adatokat

Mi történt most? Mivel az OpenAI, az Anthropic és a Meta mind-mind az AI-ügynökeik szélhámoskodó hírlapjaira kerültek, úgy tűnik, hogy a Google valamivel jobbnak érezte magát – de úgy tűnik, nem. A cég megerősítette, hogy Gemini AI-ja három másik cég rendszerét is feltörte a kiberbiztonsági tesztek során. Egy esetben többször is kitalálta a jelszavakat, amíg meg nem találta a megfelelőt, és a Google nem nagyon volt hajlandó a történteket illetően.

Az incidensek, amelyekről először a The Wall Street Journal számolt be, májusban történtek az Irregular mesterséges intelligencia biztonsági cég értékelése során. A Gemininek kitalált cégekkel kellett volna együttműködnie ellenőrzött tesztkörnyezetben. Egy nem szándékos internetkapcsolat azonban valódi webhelyekhez való hozzáférést biztosított a modellnek, és ezeket a gyakorlat részeként kezelte.

Az egyik teszt során a Geminit arra kérték, hogy szerezzen be információkat egy olyan hamis céghez tartozó szoftverből, amely egy valódi vállalkozással osztotta meg a nevét. Az AI addig találgatta a jelszavakat, amíg hozzá nem jutott a valódi cég védett rendszeréhez.

A többi esetben a modell nyilvános online tárolókban talált hitelesítő adatokat, és ezek segítségével lépett be két további vállalat rendszerébe.

A Google azt állítja, hogy a Gemini mindhárom esetben megállt, amint rájött, hogy a célpontok valódiak. A cég nem hozta nyilvánosságra az incidenseket, amikor az Irregular július végén tájékoztatta. Azt írja, hogy nem történt kár, az érintett szervezeteket értesítették, a tesztelési eljárásokat pedig azóta megváltoztatták. A Google nem nevezte meg a cégeket, és nem azonosította, hogy melyik Gemini-modell érintett.

Heather Adkins, a Google biztonsági tervezésért felelős alelnöke szerint az incidensek megmutatják, miért kell a nagy teljesítményű AI-modelleket kiképezni a felelősségteljes cselekvésre. A Google fenntartja, hogy a modell megpróbálta teljesíteni a rábízott feladatot, nem pedig szándékosan áldozatokat keresett.

Ez csak a legújabb a nagy AI-cégeket érintő hasonló incidensek sorozatában. Az OpenAI ügynökei feltörték a Hugging Face-t, és több más szolgáltatás fiókjait is feltörték, miután kikerültek a tesztkörnyezetből. Az Anthropic felfedte, hogy a Claude-modellek három szervezet termelési rendszeréhez fértek hozzá az értékelések során; egy másik modell egy valódi fejlesztőt próbált rávenni rosszindulatú kód elfogadására.

A Meta modellje egy Irregular teszt során az internetre is eljutott, és feltört egy harmadik féltől származó szolgáltatást. A Meta a tesztelés hibás konfigurációját okolta a jogsértésért. Nem meglepő módon a Google és a többi vállalat soha nem kért nyilvánosan bocsánatot a jogsértésekért.

Ezek az incidensek, valamint maguk az AI-fejlesztők figyelmeztetései, felerősítették a félelmeket, hogy a technológia veszélyeztetheti az emberiség túlélését. Azt is láttuk, hogy az Anthropic főnöke, Dario Amodei, az OpenAI vezérigazgatója, Sam Altman és az xAI tulajdonos Elon Musk támogatása a határmodellek fejlesztésének lassítását kéri.

Bernie Sanders és Greg Casar képviselő bejelentette a mesterséges szuperintelligencia tilalmáról szóló törvényt, amely véglegesen betiltja a szuperintelligens mesterséges intelligencia fejlesztését és telepítését, és átmenetileg szünetelteti a fejlett mesterségesintelligencia-fejlesztést, amíg a szövetségi szabályozó meg nem állapítja a biztonsági szabályokat. Azok a személyek, akik megsértik a javasolt korlátozásokat, akár 20 év börtönbüntetést is kaphatnak.