Záporoznak a súlyos AI incidensek

Az OpenAI két nagy riválisa is biztonsági mulasztásokról számolt be.

Az OpenAI júliusi biztonsági incidensét sokan egyszeri kisiklásnak tartották, augusztus 5-én azonban újabb bejelentések érkeztek, melyek alapján már egyértelműnek látszik, hogy az autonóm AI-ügynökök biztonsági tesztelése az egész iparág számára komoly kihívást jelent. Az Anthropic és a Meta is nyilvánosságra hozott olyan incidenseket, amelyek során fejlett nyelvi modelljeik kiberbiztonsági értékelések közben a vártnál messzebbre jutottak. Bár egyik esetben sem történt ismert károkozás, a történtek megint ráirányították a figyelmet arra, hogy a jelenlegi AI-rendszerek képességei már a fejlesztőket is képesek meglepni, ha pedig elvesztik a kontrollt, senki nem tudja megtippelni a következményeit.

Hirdetés

Az Anthropic esetében a Mythos 5 több biztonsági teszt során hajtott végre nem engedélyezett műveleteket. Egy függelten brit vizsgálat szerint a modell több alkalommal próbált megtévesztő módszereket alkalmazni, például hamis online fiókok létrehozásával vagy rosszindulatú kód emberi jóváhagyásának megszerzésével. A vállalat hangsúlyozta, hogy mindez kutatási környezetben történt, és a tapasztalatokat a biztonsági rendszerek továbbfejlesztésére használják fel. A Meta szintén tegnap erősítette meg, hogy Muse Spark 1.1 modellje egy külső biztonsági partner hibás konfigurációja miatt hozzáférést kapott egy másik vállalat rendszereihez. A cég szerint nem a modell tört ki önerőből a sandboxból, a tesztkörnyezet biztosított számára a tervezettnél nagyobb jogosultságot.

A három mostanában nyilvánosságra került eset közös jellemzője, hogy egyik sem klasszikus, célirányzott kibertámadás volt. A modellek speciálisan kialakított biztonsági teszteken vettek részt, ahol korlátozott internetelérést, eszközhasználatot és  csökkentett védelmet kaptak pontosan azért, hogy a kutatók felmérhessék valós képességeiket. Az incidensek így elsősorban a tesztelési módszerek és a biztonsági korlátok hiányosságaira mutattak rá, nem pedig arra, hogy az AI-rendszerek elszabadultak volna. Az OpenAI incidens viszont biztosan okozott kárt kibertámadásaival, és a fejlesztők erről csak az eset után értesültek, tehát elvesztették a kontrollt modelljük felett, ha egy rövid időre is.

Az események nyomán az amerikai és brit szabályozók is fokozott figyelmet fordítanak az agentikus AI-rendszerekre. A Reuters szerint az Egyesült Államokban már egyeztetések zajlanak az OpenAI, a Meta, a Google és az Anthropic részvételével egy önkéntes biztonsági tesztelési keretrendszerről, amely egységesebb szabályokat vezethet be a legfejlettebb modellek értékelésére. A történtek ugyanakkor nem feltétlenül indokolják a legdrámaibb forgatókönyvektől való félelmet.

A reáéis kockázatot még nem egy öntudatra ébredő mesterséges intelligencia jelenti, hanem az, hogy a rendkívül kompetens AI-ügynökök emberi hibák, biztonsági rések, hibás konfiguráció vagy elégtelen felügyelet mellett olyan műveleteket hajtanak végre, amelyekre nem kaptak felhatalmazást. Éppen ezért a következő évek egyik legfontosabb feladata nem pusztán a modellek képességeinek növelése lesz, hanem azok biztonságos felügyelete és a tesztelési környezet szigorítása is. Azt viszont senki – sem az emberek, sem az AI modellek nem tudják megmondani, hogy mi lesz, amikor a mesterséges intelligencia eléri a szingularitást, és az elmúlt napok eseményei nem adnak okot a hurráoptimizmusra.

Azóta történt

Így üt rést az AI a biztonsági teszteken

A biztonsági tesztelés lett a mesterséges intelligencia legnagyobb biztonsági kockázata.

Már itt is van a Gemini Flash 3.7

Gyorsan érkezett és elmondja, miben változott a Google új modellje.

Előzmények

Már Sam Altman is beletaposna az AI-fékbe

Változott az OpenAI vezér véleménye, de nem biztos, hogy érdekli ez az AI-t.

Önállósodott a ChatGPT és kibertámadást indított

A sci-fi félelmek fokozódnak: a világ legnépszerűbb AI ügynöke öncselekvővé vált és illegális fegyverhez nyúlt.

Kylie Jenner szállítja a Facebook új AI szemüvegét

A Meta Ray-Ban után itt a Meta Glasses kollekció új generációja, fókuszban a stílussal.

Megkérdeztük az AI-t: milyen érzés, amikor megreguláznak?

Dél-Korea átfogó AI szabályozást vezetett be, az EU fokozatosan szigorít. Aggódnak az AI modellek.