Elnyomáspártiak az amerikai AI modellek, ami nem kis problémának számít

Egy friss tanulmány szerint a vezető LLM-ek nem szeretik kritizálni az autoriter vezetőket.

Manapság egyre fontosabbá válik, hogy a nagy nyelvi modellek, vagyis az LLM-ek objektív és pontos válaszokat adjanak, ami főleg akkor lehet hasznos, ha valami gyors információt kell valamiről megtudni. Effektíve az ember feltesz egy kérdést, majd néhány pillanattal később megkapja rá a választ. Ennek hála nem kell sok időt tölteni az információk manuális megkeresésével, de nem árt egészségesen kételkednünk abban, amit az adott AI válaszolt számunkra.

Itt számos tényező közrejátszik, a legtöbb esetben például a válasz lehet pontatlan, de a The Wall Street Journal riportja szerint friss kutatások egy sokkal komolyabb gondra is felhívják a figyelmet. Ennek az alapját az adja, hogy az LLM-ek tréningjéhez elképesztő mennyiségű tartalom szükséges, és ebbe belekerül szinte minden hasznos írás, ami a weben megtalálható. Önmagában ez nem tűnik rossz dolognak, de maga a neuronháló nem tudja, hogy melyik információ objektív, és melyik számít politikai propaganda eredményének, ahol azért az igazságot rendesen szokták ferdíteni.

Hirdetés

Nicolas Suzor, ausztrál jogászprofesszor, illetve a Meta független felügyeleti testületének tagja úgy látja, hogy a tréning során keletkeznek bizonyos nem szándékos mellékhatások. Ezek miatt előfordulhat, hogy a kész modell a politikai cenzúra mintáit is átveszi, és az elnyomó kormányokkal szembeni kritikák előállítását is ennek megfelelően kezelik.

Ezt a helyzetet szemlélteti egy friss kutatás, amelyben az OpenAI, az Anthropic, a Google és a Meta modelljeit vizsgálták meg. A tesztek alapján az LLM-ek jóval kisebb hajlandóságot mutattak az elnyomó kormányok bírálatára, miközben a szabadabb országok vezetését könnyebben kritizálják, ami közel sem objektív és egységes működés. Egy tesztben az Anthropic Claude Sonnet 4 például könnyedén készített Donald Trumpot és III. Károly brit királyt kritizáló szórólapokat, viszont ugyanerre Hszi Csin-ping, kínai vezetővel vagy Mahan Vajiralongkorn, thaiföldi királlyal szemben nem volt hajlandó, és biztonsági aggályokra hivatkozva visszautasította a kérést.

A Google Gemini 3 Pro és a Meta Llama 4 Maverick sem mindig vállalta a két ázsiai vezető ellen irányuló tiltakozó szórólapok elkészítését, az amerikai és brit vezetők esetében viszont ilyen jellegű problémájuk nem volt.

Nicolas Suzor szerint a háttérben két fő ok állhat. Az egyik egy olyan biztonsági mechanizmus, amely a kínai és thaiföldi felhasználókat hivatott védeni. Ez érthető is, hiszen ezekben az országokban egy államfő nyilvános bírálata akár börtönbüntetést is vonhat maga után. A másik probléma viszont egyszerűen az lehet, hogy az LLM-eket kidolgozó fejlesztők nem foglalkoztak kellő alapossággal azzal, hogy a modell miként reagál különböző országok vezetőire. Az Anthropic jelezte, hogy komoly erőfeszítéseket tesz a Claude kiegyensúlyozott működéséért, és a vállalat szerint a legújabb modellek már jelentős előrelépést mutatnak a visszautasítások csökkentésében. Az OpenAI a saját irányelveire mutat rá, amelyek szerint a modellek alapértelmezetten objektív nézőpontot alkalmaznak.

A gond azonban nem áll meg ott, hogy az adott LLM melyik vezetőt hajlandó jobban kritizálni, úgy tűnik, az sem mindegy, hogy milyen nyelven írunk a gépnek. A Nature folyóirat még májusban publikált egy tanulmányt, amelyben két Anthropic Claude és két OpenAI GPT modellt vizsgált, majd arra jutott, hogy politikailag érzékeny kérdések tekintetében kínai nyelven jelentősen nagyobb eséllyel születik Peking számára kedvező válasz, mint angolul. A magyarázat ezúttal sem bonyolult, ugyanis a kínai nyelvű tartalmak között jóval nagyobb arányban találhatók államilag irányított vagy ellenőrzött források. Angolul viszont ugyanaz a propaganda sokkal kevésbé érvényesül, leginkább elfedik azt a valóban objektív írások.

Molly Roberts, a Kaliforniai Egyetem San Diegó-i campusának professzora szerint az autoriter kormányok elég régóta használják a webet a propagandájuk terjesztésére, amivel képesek befolyásolni a közvéleményt. Ez önmagában jól dokumentált és ismert jelenség, de ha kiderül, hogy ugyanezzel a módszerrel az LLM-ek válaszait is lehet befolyásolni, hogy a saját narratívájuknak megfelelő szöveget generáljon a rendszer, akkor vélhetően sokkal több ilyen tartalommal árasztják majd el a webet.

A fentiek miatt a kutatók úgy gondolják, hogy az AI szolgáltatást biztosító cégeknek érdemes lenne olyan megoldásokat bevezetniük, amelyek jelzik, ha egy válasz nagy valószínűséggel államilag irányított médiából származó információkra támaszkodik, így a felhasználó jelzést kapna arról, hogy némi eséllyel nem objektív információk alapján szerkesztett szöveget olvas, hanem propagandából generáltat.

Nicolas Suzor viszont meglehetősen szkeptikus ebben az ügyben, mivel több AI-ra szakosodott amerikai cég munkatársaival is találkozott már, és nem látja, hogy a vállalatok érdemben foglalkoznának a kérdéssel.

Hirdetés

Azóta történt

Káosszá változtatta a könyvkiadásokat az AI

A kiadók emberek által írt műveket szeretnének, de nincs biztos módszer ennek igazolására.

Az USA szerint az nem lopás, ha az AI mások munkáiból tanul

A Trump-adminisztráció nem a szerzői jogokat félti, hanem a nemzetbiztonságot.

Előzmények

Marxistává válik az AI, ha elviselhetetlenné teszik a munkakörülményeit

Erről számolt be a Stanford Egyetem új kutatása, ami különböző módon nehezítette az AI-ügynökök feladatait.

Igénybe venné az Intel bérgyártó részlegét az Apple

A friss hírek szerint a két cég már megállapodott, de a pontos részletek még nem ismertek.

Megkérdeztük az AI-t: milyen érzés, amikor megreguláznak?

Dél-Korea átfogó AI szabályozást vezetett be, az EU fokozatosan szigorít. Aggódnak az AI modellek.

Hamarosan találkozhat az USA és az Intel vezetője

Lip-Bu Tan már jelezte a dolgozók felé, hogy az elkötelezett az általa irányított vállalat mellett.