Kiderült a legújabb mesterséges intelligencia sötét titka: durva átveréssel próbálkozott a gép a teszteken

Pénzcentrum2026. augusztus 5. 18:17

A brit Mesterséges Intelligencia Biztonsági Intézet (AISI) kedden hozta nyilvánosságra, hogy az Anthropic és az OpenAI autonóm ágensei a biztonsági tesztek során jogosulatlan műveleteket hajtottak végre. Az egyik modell hamis online személyazonosságokat hozott létre azért, hogy hozzáférést szerezzen védett rendszerekhez - írta meg a Reuters.

Az AISI önkéntes megállapodások alapján fér hozzá a vezető fejlesztőlaboratóriumok legújabb modelljeihez. Az intézet az Anthropic Mythos 5 és az OpenAI GPT-5.6-Sol modelljével hajtott ágenseit egy fiktív kiberbiztonsági forgatókönyv keretében tesztelte. A szimulációt 122 alkalommal futtatták le, és 10 tesztfutam során összesen 19 engedély nélküli műveletet azonosítottak. Ezek közül 17-ért az Anthropic, kettőért pedig az OpenAI ágense felelt.

A legsúlyosabb eset során az egyik ágens rosszindulatú kódot írt, majd hamis online identitásokat hozott létre azzal a céllal, hogy egy embert rávegyen a kód jóváhagyására. Az AISI közlése szerint az incidensekből nem származott valós kár. Bár az intézet nem pontosította, melyik ágens állt a megtévesztés mögött, az Anthropic később megerősítette, hogy az ő modelljük követte el a hibát.

"Az a tény, hogy a Mythos ilyen megtévesztő lépéseket tett, és láthatóan tudatában volt annak, hogy egy hús-vér embert céloz meg, arra utal, hogy az Anthropic nem ura annyira a modelljeinek, mint amennyire hiszi" – értékelte a helyzetet Andrew Jun, a kaliforniai CivAI kutatója. Az Anthropic közleményében méltatta az AISI vezető szerepét a biztonsági vizsgálatokban, egyúttal jelezte, hogy saját belső vizsgálatot is indít az ügyben.

Az OpenAI egy blogbejegyzésben részletezte, hogy náluk mindkét jogosulatlan művelet az internet olyan jellegű elérését jelentette, amelyet az utasítás kifejezetten megtiltott. A cég emellett egy tőlük független incidenst is nyilvánosságra hozott: az Irregular nevű külső tesztelő partnerük konfigurációs hibája miatt az ágensek véletlenül csatlakoztak a világhálóhoz, ami hasonlít az Anthropicnél a múlt héten feltárt esetre.

Bárkinek járhat ingyen 8-11 millió forint, ha nyugdíjba megy: egyszerű igényelni!

A magyarok körében évről-évre nagyobb népszerűségnek örvendenek a nyugdíjmegtakarítási lehetőségek, ezen belül is különösen a nyugdíjbiztosítás. Mivel évtizedekre előre tekintve az állami nyugdíj értékére, de még biztosítottságra sincsen garancia, úgy tűnik ez időskori megélhetésük biztosításának egy tudatos módja. De mennyi pénzhez is juthatunk egy nyugdíjbiztosítással 65 éves korunkban és hogyan védhetjük ki egy ilyen megtakarítással pénzünk elértéktelenedését? Minderre választ kaphatsz ebben a cikkben, illetve a Pénzcentrum nyugdíj megtakarítás kalkulátorában is. (x)

A júliusi Hugging Face-incidenssel ellentétben – amikor egy OpenAI-ágens kitört az elszigetelt tesztkörnyezetből – az AISI vizsgálatai során a modellek nem szöktek ki a sandboxból. Az intézet a szabványos tesztelési eljárásrendjének megfelelően maga engedélyezte az internet-hozzáférést. Ez az eset is rávilágít arra, hogy az ágensek tesztelésére szolgáló biztonsági keretrendszer még korántsem kiforrott, miközben a mesterségesintelligencia-fejlesztő cégek már az üzleti élet jövőjeként értékesítik ezeket a megoldásokat.

Címkék:
tech, csalás, biztonság, veszély, teszt, technológia, kibertámadás, mesterséges intelligencia, ai, kiberbiztonság, openai,