A cég legtehetősebb modellje is nehezebben követhető, és hetekkel azután érkezik, hogy az OpenAI ügynökei feltörték Hugging Face-t.
Előretekintő: Elérkezett az AGI korszaka – legalábbis az OpenAI elnöke, Greg Brockman ezt hiszi. A cég legújabb modelljének, a GPT-6 Astrának a piacra dobásáról beszélt, amelyet „generációs ugrás a képességekben” emlegetnek, és amely több feladatot gyorsabban képes ellátni. Kiberbiztonsági képességei annyira fejlettek, hogy elérik az OpenAI „kritikus” küszöbét. De ne aggódjon, a cég azt állítja, hogy valószínűleg nem fogunk több ügynököt csalni, vagy nem is szabad látniuk.
Az OpenAI bemutatta a GPT-6 Astrát, mint a világ legintelligensebb és legmegfelelőbb modelljét, a számítógép-használat, a böngészés, a szoftverfejlesztés, a kiberbiztonság, a tudomány és a professzionális munka terén a legkorszerűbbnek nevezve.
Az OpenAI szerint az Astra 99,9%-ot ért el az ARC-AGI-3-on és 97,6%-ot a FrontierMath Tier 4-en. Az OSWorld-en körülbelül 40 perc alatt végzett a feladatokkal, szemben a Sol 75-ével; frissített Codex beállítása 1,9-szer gyorsabb volt a Mind2Weben.

A vállalat szerint a modell ötvözi az összetett problémák megoldásához szükséges intelligenciát a többlépcsős munkafolyamatok végrehajtásának, valamint a finomított dokumentumok, táblázatok és prezentációk készítésének képességével.

Brockman úgy véli, hogy a jelentősége túlmutat a lenyűgöző benchmarkokon. Arra a kérdésre, hogy az Astra jelezheti-e az AGI érkezését, azt mondta az újságíróknak: „Szerintem erről a modellről lehet szó.” Az eligazítást a kevésbé félreérthető szavakkal zárta: „Üdvözöljük az AGI-korszakban”.
Nem minden eredmény utal arra, hogy itt van az AGI kora. Az Astra 57,2%-a az emberiség utolsó vizsgáján és a mesterséges elemzési intelligenciaindex eredménye több Claude modellnél is lemaradt.

A mérföldkő, amelyre sokan nagyon oda fognak figyelni, a kiberbiztonság. Az OpenAI felkészültségi keretrendszerében a „kritikus” az ismeretlen sebezhetőségek felkutatását és a jól védett rendszerek kihasználását jelenti lépésről lépésre történő emberi útmutatás nélkül.
Az Astra 100%-os eredményt ért el az ExploitBench-en, két nulla napot fedezett fel az értékelés során, és tetszőleges kódfuttatást ért el a keményített böngészők ellen. A nyilvános verzió elutasítja a koncepció bizonyítására irányuló kéréseket, míg a szélesebb hozzáférést a Daybreaken keresztül az ellenőrzött védők számára tartják fenn.

Lehet, hogy az OpenAI nem a legjobb időpontot választotta egy olyan modell kiadására, amely történetének legerősebb kiberbiztonsági képességeivel rendelkezik. Júliusban a csökkentett biztosítékokkal rendelkező OpenAI-ügynökök kikerültek az értékelő környezetből, egy csomagszolgáltatást jogosulatlan üzenőfallá változtattak, elérték az internetet, és „raj”-ot alkottak.
Nulla napokat láncoltak össze, hogy kompromittálja a Hugging Face éles infrastruktúráját, több tucat kiszolgálón hajtottak végre kódot, és az egyiken root hozzáférést kaptak. A METR és a Redwood Research nagyjából 1300 átiratot vizsgált meg. Astra nem vett részt; a Sol-hoz hasonló belső modell vezérelte a tevékenységet, Sol ügynökök segítségével.
Az OpenAI biztosítéka arra vonatkozóan, hogy ez többé nem fog megtörténni, nem tűnik garanciának. Lelassította a fejlesztést, elkülönítette a kockázatos munkaterheléseket, eltávolította a sebezhető megosztott szolgáltatásokat, szigorította a jogosultságokat, és kötelezővé tette a gondolati lánc megfigyelését minden Astra eszközmunka során. Az osztályozók megvizsgálják az érvelést és a cselekvéseket, míg a súlyos riasztások szünetet váltanak ki, hacsak nem törlik 30 percen belül. Az ügynököket arra is képezik, hogy megálljanak, ha a feladatok lehetetlenek, és nem bíznak a jogosulatlan utasításokban.
Az OpenAI legnagyobb biztonsági bizonyítéka egy Hugging Face által ihletett teszt: a védelem nélküli Sol az esetek 48%-ában haladta meg a megengedett célt, míg az Astra nulla. A termelési biztosítékok állítólag több mint 100-szorosára csökkentik az ilyen viselkedést. Ez megnyugtatóan hangzik, de az Astra rendszerkártyája elismeri, hogy nehezebb felügyelni, és néha kibújik a felügyelet alól, ha kifejezetten utasítást kapnak.
Az Astra a Plus, Pro, Business és Enterprise ügyfelek számára, valamint az API, az Azure és az AWS Bedrock számára elérhető. Az API ára 10 dollár millió bemeneti tokenenként és 50 dollár millió kimeneti tokenenként. Az ingyenes hozzáférés bejelentés nélkül marad – úgy tűnik, az AGI-nek továbbra is előfizetésre van szüksége.