Egy kolléga több mint 10%-ra teszi annak esélyét, hogy a mesterséges intelligencia egy évtizeden belül minden embert megöl.

Kristálygömb: Mi aggasztóbb, mint az a kilátás, hogy a mesterséges intelligencia elhozza az emberiség végét? Ugyanezt a figyelmeztetést az ezeknél a cégeknél dolgozó emberek teszik. Néhány órával azután, hogy egy korábbi OpenAI-alkalmazott kilépett az Anthropicból, és azt mondta: „Semmilyen más emberi tevékenység nem jelent ilyen szintű veszélyt”, egy kollégája szerint több mint 10% az esély arra, hogy a mesterséges intelligencia minden embert megölhet a következő évtizedben.

Jacob Coxon tegnap X-en jelentette be, hogy felmondott az Anthropicnál, mivel az elmúlt három évben az OpenAI és Dario Amodei cégénél végzett kutatás előtti képzést. 2023 júliusától az AI műszaki stábjának tagja volt, egészen addig, amíg 2026 júliusáig az Anthropichoz nem költözött.

„Egyik cég sem cselekszik felelősségteljesen. Egyenesen önfejlesztő szuperintelligencia és szerencsejáték az életünk felé” – írta.

Coxon több bejegyzést is tett, amelyek egyike sem könnyíti meg a mesterséges intelligencia miatt már aggódó emberek elméjét. Arra figyelmeztetett, hogy a rendszerek hamarosan „emberfelettivé” válnak, és bármit képesek feltörni.

Rengeteg más baljós sor is található Coxon bejegyzéseiben, amelyek közül a leginkább aggasztó a következő: „Semmiféle más emberi tevékenység nem jelent ilyen szintű veszélyt.”

A kutató hangsúlyozta, hogy az OpenAI és az Anthropic is jól ismeri ezeket a kockázatokat. „Az MI-t építő emberek komolyan hiszik, hogy az évtized végére mindannyiunkat megölhet” – mondta.

Tehát miért folytatják a vállalatok ezeknek a potenciálisan kihalást okozó modelleknek a fejlesztését? Az ok a kutató szerint a következő: „Az OpenAI-nál sokan nem vették át mélyen a civilizációs tétet. Az Anthropicnál jól értik a tétet, de versenybe vannak zárva, hogy előbb érjenek oda – úgy gondolják, hogy senki más nem fog felelősen cselekedni, ezért a kockázat ellenére maguknak kell megtenniük.”

Coxon szerint egyes mesterséges intelligencia-fejlesztők úgy vélik, hogy a technológia a következő néhány évben, nem pedig évtizedekben okozhatja az emberi élet végét, és a vezető beosztású alkalmazottak jobban aggódnak ezek miatt a lehetőségek miatt.

Evan Hubinger, az Anthropic igazítástudományi vezetője válaszolt Coxonnak, és ez nem volt túl megnyugtató. Úgy véli, hogy amit mond, az „helyes”, és hogy az Anthropicnak nincs terve, mit tegyen, ha ez megtörténik.

„Jacobnak ebben igaza van – komolyan hisszük, hogy a mesterséges intelligencia minden embert meg tud ölni! Én személy szerint úgy gondolom, hogy ez több mint 10% a következő évtizedben. Úgy gondolom, hogy az Anthropic mindent megtesz, de még nincs tervünk a szuperintelligencia összehangolásának megoldására, és nem vagyunk egyértelműen afelé.”

Hubinger szerint a jelenlegi modellek kockázata alacsony, de aggódik a rekurzív önfejlesztésből származó szuperintelligencia miatt. Az Anthropic júniusban ugyanilyen figyelmeztetést adott ki.

A mindenkit megölő mesterséges intelligencia koncepciója az utóbbi időben a sci-fi dolgaiból egy lehetséges valósággá vált. Ezek a félelmek tovább fokozódtak, miután több incidens AI ügynökök szélhámosnak bizonyultak, ideértve a Hugging Face támadást, egy német wiki átvételét, valamint a valódi fejlesztők rosszindulatú kódok jóváhagyására irányuló kísérletét.

Van megoldás? Coxon úgy véli, hogy a katasztrófa megelőzése megkövetelheti a modell képességeinek fejlesztésének átmeneti tilalmát, de nem valószínű, hogy minden mesterséges intelligenciával foglalkozó vállalat egyetértene ezzel az intézkedéssel.