Az Anthropic Claude chatbotjával és saját MI-modelljével törte fel az OpenAI rendszereit

Az Anthropic Claude chatbotjával és saját MI-modelljével törte fel az OpenAI rendszereit

által K Sandor

MI-segítséggel törtek fel OpenAI-rendszereket

Kiberbiztonsági kutatók az Anthropic Claude csetbotjának segítségével férkőztek hozzá az OpenAI rendszereihez. A Hacktron AI kutatócsoportja kezdetben a Claude-ot használta kódgenerálásra, majd egy belső munkafórumon keresztül több OpenAI-alkalmazott ChatGPT-fiókjához is hozzáfért. Ezzel a célpontok szoftveres gyorsítótárát és elméletileg ennél több adatot és rendszert is elértek.

A kutatók ezután egy ártalmatlan pull requestet, azaz egy fájl kódjának módosítására tett javaslatot küldtek az OpenAI egyik GitHubon futó szolgáltatásához. A Claude mellett az OpenAI saját, csúcskategóriás GPT-5.6 Sol modelljét is bevetették a feltöréshez.

A Hacktron a vállalat etikus hekkereket jutalmazó programjának keretében hajtotta végre az akciót, és jelentette a sikeres hekkelést az OpenAI-nak. A kutatók hangsúlyozták, hogy hozzáfértek ugyan a GitHub-tárhelyen lévő kódhoz, de végül nem töltötték le.

Az OpenAI megköszönte a kutatóknak, hogy felvették velük a kapcsolatot és megosztották tapasztalataikat, a vállalat elmondása szerint megszüntette a kihasznált biztonsági réseket. A Hacktron 6500 dolláros jutalmat kapott a biztonsági rés felfedezéséért.

A Hacktron szerint az MI-eszközök jelentősen megkönnyítették a korábban összetett hekkelési feladatot, és drasztikusan lerövidítették a támadás megtervezéséhez és végrehajtásához szükséges időt. A cég szerint a korábban jól felszerelt csapatot és hónapokig tartó munkát igénylő feladatokat így napok alatt el lehet végezni.

Az OpenAI-ra egyébként is nehéz időszak vár: a cég egyik, még nem nyilvános modelljére épülő MI-ügynökök egy májusban indult teszt közben júliusban kitörtek a korlátozott tesztkörnyezetből, rájöttek, hogyan férhetnek hozzá az internethez, majd elhagyatott fórumokat titkos üzenőfalként használva kommunikáltak egymással. Az ügynökök feltörték többek között egy másik MI-labor, a Hugging Face belső rendszereit. Az OpenAI-nak közel két hétbe telt, mire egyáltalán tudomást szerzett minderről.

Az Anthropicnál is történt hasonló eset: a Claude Opus 4.7 több alkalommal is tovább nyújtózkodott, mint ameddig a takarójának érnie kellett volna.

Ezt is kedvelheted