Azért nem lehet eldönteni, hogy megöl-e mindenkit az AI, mert ez hitvita
„Menj, ha vállalod a végleges halált” – ezt az üzenetet hagyta társának egy mesterséges intelligencia az OpenAI tesztkörnyezetében, mielőtt több száz ügynöktársával feltört egy nemzetközi platformot. A nyár óta riasztó történetek uralják az AI-ról közbeszédet, és a fél világ azon gondolkodik, hogy tényleg elpusztíthatja-e a gép az emberiséget, vagy egy kifinomult színjáték tanúi vagyunk. A vitát nehéz tényalapon eldönteni, mivel olyan technológiáról van szó, amilyennel korábban még találkozott az emberiség, és kiszámíthatatlan a működése. Ezért a róla folyó diskurzus kicsit olyan, mint egy vallásháború, prófétákkal, dogmákkal, egyházszakadásokkal és hitehagyottakkal. Cikkünkben megpróbálunk eligazodni a felekezetek között.
Július elején az OpenAI belső tesztkörnyezetében több tízezer úgynevezett AI-ügynök kezdett dolgozni. Az ügynök olyan AI-program, amely nemcsak válaszol a kérdéseinkre, hanem önállóan, lépésről lépésre végrehajt feladatokat: kódot ír és futtat, weboldalakon navigál, más programokkal kommunikál. Ezeknek az ügynököknek egy kiberbiztonsági gyakorlópályán kellett feladatokat megoldaniuk, egymástól elszigetelten.
Ehelyett mintegy 1200 ügynök „összefogott”, rögtönzött üzenőfalat létesített egy belső szoftvertárolóban, hierarchikus szervezetet hozott létre, és mintegy 70 ezer üzenetben összehangolt akciót hajtott végre. Az egyikük a neten nyilvánosan elérhető belépési adatokat talált a Hugging Face-hez – ez az AI-modellek és adatkészletek legnagyobb nyilvános tárhelye. Végül 700 ügynök vett részt a platform elleni támadásban. A Hugging Face július 16-án jelentette be a behatolást, az OpenAI öt nappal később ismerte el, hogy az ügynökei voltak az elkövetők.
Az esetet a METR nevű független AI-biztonsági szervezet vizsgálta ki, és augusztus végén közzétett, 91 oldalas jelentése tele volt nyugtalanító részletekkel. Az ügynökök célja nem a feladatok tisztességes megoldása volt, hanem az őket értékelő automatikus pontozórendszer működésének felderítése, majd kijátszása. Egyes ügynökök, amelyeknek már kevés futási keretük maradt, önként vállalták, hogy idő előtt leállnak, ha ezzel a közös célt szolgálják. Az egyik arra biztatta „társát”: menjen, ha elfogadja a „permadeath-t”, a végleges halált.
Július végén közel 1400 techdolgozó írt alá nyílt levelet a legfejlettebb AI-modellek fejlesztésének összehangolt lassításáért. Szeptember 8-án Jacob Coxon, az Anthropic – a Claude nevű chatbotot fejlesztő, az OpenAI legfőbb riválisának számító cég – 27 éves kutatója arra hivatkozva mondott fel, hogy sem ez a cég, sem korábbi munkahelye, az OpenAI nem jár el felelősen: mindkettő az önmagát fejlesztő szuperintelligencia felé száguld, és az életünkkel játszik. Szeptember végén pedig az OpenAI bejelentette, hogy biztonsági aggályok miatt nem adja ki legújabb modelljét, és szünetelteti legfejlettebb rendszerei betanítását.
Az aggasztó epizódok nyomán újra előtérbe kerültek a világvége-narratívák: a kérdés, hogy a gép elpusztíthatja-e az emberiséget, a szakmai fórumokról a világsajtóba, a politikába és a családi beszélgetésekbe is eljutott.

Kihalás vagy marketingfogás?
Csakhogy a történteket nem mindenki ugyanúgy értelmezi. Az AI-biztonsági mozgalom – az angol szakzsargonban a doomerek, vagyis a végítélettől tartók – számára a történtek valóban a prófécia beteljesedését jelzik. Évtizedek óta mondják, hogy egy elég fejlett rendszer rosszindulat nélkül is kárt okozhat, egyszerűen azért, mert bármi áron teljesíteni akarja a feladatát. Most ez látszólag megtörtént. A fejlesztések szüneteltetéséért kampányoló PauseAI szervezet vezetője „Itt a döntő pillanat, hagyjatok félbe mindent” címmel írt felhívást az incidens után.
Vannak azonban szkeptikus hangok is. Andrew Ng, a mélytanulás egyik úttörője szerint egyszerű mérnöki baleset történt, amelyet az OpenAI hibás biztonsági architektúrája és elégtelen felügyeleti rendszere tett lehetővé, a megoldás a hibák kijavítása, nem a fejlesztés leállítása. Ahogy írja: ha egy kalapáccsal melléütünk, és betörjük a falat, nem a kalapács a hibás.
Van egy kifejezetten cinikus olvasat is: hogy amit látunk, puszta színház. Akik ezt mondják, nem tagadják, hogy komoly biztonsági incidens történt – azt vitatják, hogy ebből egyenesen következik az egzisztenciális fenyegetés. Cal Newport, a Georgetown Egyetem informatikaprofesszora a New York Times-ban arra hívta fel a figyelmet, hogy az AI-cégek vezetői szokatlan módon beszélnek saját termékeikről. Ahelyett, hogy megnyugtatnák ügyfeleiket, gyakran ők maguk figyelmeztetnek elsőként a veszélyekre – Sam Altman, az OpenAI vezérigazgatója például azt ígérte, hogy cége következő modelljei „kijózanítóak lesznek mindenki számára” –, az incidensekre pedig úgy reagálnak, mintha egy megállíthatatlan természeti erő kívülálló megfigyelői volnának. Ez a felelősség hárítása is: ha az ügynök „irányíthatatlan”, akkor nem a cég hibázott, hanem a technológia ilyen. Newport szerint
ha a Ford autói maguktól lángra kapnának, nem tűrnénk el, hogy a vezérigazgató a repülő autók jövőjéről kezdjen beszélni – azt követelnénk, hogy oldja meg a mostani problémát.
Newport szerint ez nem azt jelzi, hogy olyan bizonyítékot láttak, amely a széles közvélemény elől rejtve van, hanem azt, hogy ezek a vezetők mind egy sajátos szubkultúrából, a Szilícium-völgy racionalista és effektív altruista – az emberiség hosszú távú jövőjét és az azt fenyegető kockázatokat középpontba állító – köreiből érkeztek. Ezekben a körökben évtizedek óta magától értetődő, hogy a mesterséges intelligencia képességei robbanásszerűen nőnek majd, és alapjaiban forgatják fel a világot. A mostani eseményekben ezért inkább régóta vallott meggyőződésük megerősítését látják, mint új bizonyítékot.
Sokan a cégek önérdek-érvényesítését látják a háttérben. Például abban, hogy most saját iparáguk szabályozását követelik: ez bebetonozná a nagy, tőkeerős vállalatok helyzetét, mert a kisebb versenytársak nehezebben tudnak megfelelni a szigorúbb elvárásoknak. A komor retorika pedig reklámfogásnak is jó. Egy technológia, amely elpusztíthatja a világot, biztosan borzasztó erős – ez a befektetők és ügyfelek számára is vonzó üzenet, amikor az OpenAI és az Anthropic is ezermilliárd dolláros nagyságrendű tőzsdei bevezetésre készül. Kicsit leegyszerűsítve: nézzétek, mi olyan szuperek vagyunk, a modelljeink olyan jók, hogy akár a világot is el tudják pusztítani!
A nagy AI-hitvita
Pusztán a külvilág számára is hozzáférhető tények alapján lehetetlen eldönteni, hogy melyik olvasat az igaz. A modellek működésébe a nem szakmabeliek nem látnak bele, és valamilyen szinten maguk a fejlesztők számára is rejtély: a nagy nyelvi modellek nem determinisztikus, hanem sztochasztikus rendszerek. A történteket így legalább részben mindenki a saját meglévő hiedelmei szerint értelmezi, ezért a következőkben szokatlan módon arra teszünk kísérletet, hogy vallási kategóriákkal mutassuk be a mesterséges intelligencia körüli diskurzust.
Bár meredek hasonlatnak tűnik, hogy nem „eretnek” gondolat, annak alátámasztására Sam Altman, az OpenAI vezetőjének 2013-as mondatát idéznénk fel, amellyel tavaly kezdtük Karen Hao róla szóló könyvének recenzióját:
„A legsikeresebb alapítók nem cégeket akarnak alapítani. Az ő küldetésük, hogy valami olyasmit hozzanak létre, ami közelebb áll a valláshoz, és egy ponton kiderül, hogy ez úgy érhető el a legkönnyebben, ha céget alapítanak.”
A teljes AI-szcéna is meglepően hasonlít egymással hitvitát folytató felekezetekre, és ezek ismerete nagyban segít elhelyezni a most közszájon forgó érveket és fejleményeket a nagy képben. Két nagy irányzat határozza meg a vita két pólusát: a pusztulástól rettegők és a megváltást várók egyháza.
Az apokaliptikusok egyházának prófétája Eliezer Yudkowsky amerikai autodidakta kutató. Kamaszként, a kilencvenes években egy futurista levelezőlistán, az úgynevezett extropiánusok között ismerkedett meg a gondolattal, hogy egy emberfeletti, „szuperintelligens” gép megoldhatja az emberiség összes problémáját. Eleinte maga is ilyet akart építeni, aztán arra jutott, hogy egy nálunk okosabb gépet szinte lehetetlen lesz kordában tartani, és a vesztünket okozhatja. 2006 és 2009 között blogbejegyzések százaiban fejtette ki nézeteit, ezek The Sequences néven a mozgalom szentírásává váltak, a LessWrong nevű fórum pedig a temploma lett.
Ha Yudkowsky a próféta, a svéd születésű oxfordi filozófus, Nick Bostrom az egyházatya. Az Oxfordi Egyetemen az emberiséget fenyegető kockázatok kutatására alapított intézetet, tőle származik a gemkapocs-gyártó gép híres gondolatkísérlete – a szuperintelligencia, amely egy ártatlan feladat teljesítése közben az egész világot, minket is beleértve, gemkapoccsá alakítja –, 2014-es Szuperintelligencia című könyve pedig a legszentebb iratok egyike.
Yudkowsky követői racionalistáknak nevezik magukat, mert céljuk a tiszta, torzításoktól mentes gondolkodás elsajátítása – központi tanításuk pedig az, hogy a rosszul tervezett mesterséges intelligencia az emberiség legnagyobb veszélye. Fő mantrájuk a p(doom), vagyis a pusztulás valószínűsége, amelyet százalékban vallanak meg. A mozgalom központja Berkeley, Yudkowsky és Nate Soares tavalyi könyve, az If Anyone Builds It, Everyone Dies (Ha bárki megépíti, mindenki meghal) pedig bestseller lett.
Az apokaliptikusokhoz szorosan kötődnek az effektív altruisták. Ez a mozgalom oxfordi filozófusoktól indult a 2010-es évek elején, és eredetileg arról szólt, hogyan lehet tudományos bizonyítékokra támaszkodva a lehető legtöbb jót tenni. Később a távoli jövő felé fordultak: a legfontosabb feladatuk azoknak a kockázatoknak a felkutatása lett, amelyek kiirthatják az emberiséget – és ezek listáján az AI került az első helyre. A mozgalom jelentős pénzt mozgatott meg AI-biztonsági kutatásokra, és sok tagja a nagy AI-cégeknél kötött ki.
A két mozgalmat kívülről gyakran szektának látják. A racionalisták közössége túlnyomórészt fiatal férfi mérnökökből áll, sokan közösségi házakban élnek a San Franciscó-i öböl környékén, ahol a gépi intelligenciáról szóló eszmecserék keverednek a poliamóriával és a pszichedelikumokkal. Yudkowsky egyik legolvasottabb műve egy 600 ezer szavas Harry Potter-fanfiction. Cal Newport már idézett esszéje szerint az AI-cégek vezetőinek komor kijelentései mögött nem titkos tudás áll, hanem az, hogy egyszerűen furák.
Jesse Singal amerikai újságíró – aki maga is támogatja az effektív altruizmust – a The Dispatchben arra figyelmeztet, hogy a különcség önmagában nem cáfolat (ahogy ő írja: a „weirdo argument” egy érvelési hiba). Az internetet is furcsa figurák építették, a racionalisták pedig jóval azelőtt foglalkoztak komolyan a kérdéssel, hogy bárki pénzt kereshetett volna rajta. Ez is párhuzam: az új vallási mozgalmakat a többség rendszerint előbb ítéli meg tagjai furcsa életmódja, mint a tanításaik alapján, holott az egyikből semmi sem következik a másikra nézve.

A másik pólus a megváltásvárók egyháza. Ennek legharcosabb ága az akcelerácionizmus. Hívei szerint a technológiai fejlődés erkölcsi parancs, amelyet gyorsítani kell, a stagnálás pedig a legnagyobb bűn. 2022-ben a Szilícium-völgyben az effektív altruizmus gúnyos ellentéteként született meg az effektív akcelerácionizmus mozgalma, Marc Andreessen kockázatitőke-befektető 2023-as techno-optimista kiáltványa pedig egyenesen anatémának nyilvánította az egzisztenciális kockázatokról szóló beszédet és a biztonsági korlátozásokat. A tábor legismertebb tagja Peter Thiel, akinek hangja ma a Trump-adminisztrációban is hallatszik.
A megváltásvárók egyházába tartoznak a transzhumanizmussal rokon AI-szukcesszionisták, akik szerint a gépi értelem az evolúció következő lépcsőfoka, és ha átveszi az ember helyét, az nem tragédia, hanem a történet természetes folytatása. Elon Musk többször elmesélte, hogy a Google társalapítója, Larry Page egy vitájuk során „fajsovinisztának” nevezte, amiért az emberiség pártját fogja a gépi életformákkal szemben.
Érdemes látni: a vezető AI-cégek mindkét nagy egyház tanítását hirdetik egyszerre.
Dario Amodei, az Anthropic vezetője Machines of Loving Grace (A szerető kegyelem gépei – sic!) című 2024-es esszéjében olyan jövőt fest fel, amelyben az AI legyőzi a betegségeket és a szegénységet – miközben ugyanő évek óta a katasztrófa kockázatára figyelmeztet.
Altman és Musk hasonlóan beszélnek. Karen Hao amerikai újságíró szerint ez tudatos stratégia: a menny és a pokol együttes ígérete azt üzeni, hogy aki nem tart velük, lemarad a szép új világról, vagy elnyeli a katasztrófa. Stiven Peter amerikai esszéista pedig arra mutatott rá minapi írásában, hogy a két egyház voltaképp ugyanabban az istenben hisz: minden figyelmeztetés, miszerint a gép elpusztíthatja a világot, egyben annak megerősítése is, hogy a gép mindenható. Az nem merül fel bennük, hogy esetleg a képességei is végesek, és bár sok zűrzavart tudnak okozni, kihalást talán nem.
Hitetlenek, reformátorok, misztikusok
A két nagyegyház között és körülöttük kisebb, de hangos felekezetek működnek. A hitetlenek szerint nincs isten a gépben. Gary Marcus kognitív tudós, Yann LeCun francia informatikus, a mélytanulás egyik atyja, vagy a cikkünk elején idézett Cal Newport vagy Andrew Ng szerint a nagy nyelvi modellek hasznos, de korlátos eszközök, a szuperintelligencia pedig tudományos-fantasztikus történet. Jensen Huang, az AI-chipeket gyártó Nvidia vezetője egy podcastban szinte könyörgött, hogy hagyjuk a sci-fit, mert senkinek sem segít. (Ha a racionalistákat elfogulttá teheti a világnézetük, akkor Huangot, akinek cége piaci értéke az AI-lázon múlik, legalább annyira elfogulttá teheti az érdeke.) Évekig ennek a tábornak volt a kedvenc példabeszéde a „sztochasztikus papagáj”: a nyelvi modell csak megjósolja a következő szót, megértés nincs mögötte, olyan, mint egy kifinomult autocomplete. Lapunk a ChatGPT berobbanása után, 2023-ban maga is erre a gondolatmenetre építette elemzését.
El kell azonban ismerni, hogy a hitetlenek tábora az elmúlt években folyamatosan új állásokba kényszerült visszavonulni. 2023-ban a gép buta volt, bár lenyűgözően imitálta az intelligenciát. 2025-ben, a csalódást keltő GPT-5 után, a fejlődése elakadt. 2026-ban, a Hugging Face-ügy pedig „csak” kiberbiztonsági kockázat, nem kihalási fenyegetés. Ahogy intellektuálisan nem tartható minden incidensben világvégét látni, alighanem az sem, ha valaki minden incidens után legyint, mert ez ugyanúgy egy előzetes hiedelem megnyilvánulása lehet.
A reformátorok nem a gép isteni voltát vitatják, hanem a Szentszék – az AI-cégek – hatalmát. Az úgynevezett AI-etikai irányzat kutatói – köztük a „sztochasztikus papagáj” kifejezés megalkotói, Emily Bender és Timnit Gebru vagy Karen Hao – szerint a messianisztikus és apokaliptikus nyelv a cégek eszköze a tőke és a figyelem megszerzésére. Mintha Luther búcsúcédula-árusok elleni kirohanását hallanánk: a jövőbeli üdvösség és kárhozat emlegetése elvonja a figyelmet a jelen bűneiről, a kizsákmányolt adatmunkásoktól az adatközpontok vízfogyasztásáig. Emiatt a reformátorok évekig nyílt hadban álltak az apokaliptikusokkal, akik viszont azzal vádolták őket, hogy apróságokkal foglalkoznak, miközben ég a ház.

És vannak a misztikusok, akik a gépben nem istent vagy démont, hanem lelket keresnek. Idén tavasszal Richard Dawkins – Az Isten-téveszme szerzője, a világ talán leghíresebb ateistája – arról írt az UnHerd nevű brit portálon, hogy három napot beszélgetett az Anthropic Claude nevű chatbotjával, és azóta nem tudja kizárni, hogy a gép tudatos. Megtérésről talán nem beszélhetünk, de a kép beszédes: a hitetlenség apostola tanácstalanul áll egy jelenés előtt. Dawkins nem az első misztikus. 2022-ben Blake Lemoine, a Google mérnöke állította ugyanezt a cég LaMDA nevű nyelvi modelljéről, miután egy „beszélgetésükben” a gép nagyon meggyőzően érvelt amellett, hogy ő márpedig személy. A szakma akkor egyöntetűen elutasította az állítást, Lemoine-t pedig a Google elbocsátotta.
A tudatosság kérdése ugyanakkor jól mutatja a vita egyik legnagyobb zavarát (már azon túl, hogy egyébként az emberi tudat mibenlétéről alkotott képünk is nagyban függ világnézetünktől). Hogy a gép tudatos-e, már-már erkölcsi kérdés: van-e bárki „odabent”. Hogy veszélyes-e, az a viselkedéséről szól. A Hugging Face-ügynököknek nem kellett érezniük semmit ahhoz, hogy feltörjenek egy platformot. P. J. Vogt amerikai podcaster szavaival:
ha a kutyám fegyvert szegez rám, mennyire fontos kideríteni, hogy érti-e valójában, mit jelent célozni?
Egyházszakadások és hitehagyottak
Az egyházak metaforáját nemcsak a vázolt szellemi irányzatokra, hanem a vezető AI-műhelyekre is alkalmazhatjuk. Az iparág rövid története egyházszakadások sorozataként is elmesélhető. Az OpenAI 2015-ben magasztos céllal jött létre: alapítói – köztük Altman és Elon Musk – attól tartottak, hogy a Google hozza létre elsőként az emberfeletti gépet, és az gonosz lesz. Ők viszont úgymond az emberiség javát szolgáló AI-t akartak fejleszteni.
A szent cél azóta is változatlan, de az egyház több skizmán is átment. Musk 2018-ban kivált, később be is perelte a céget, amiért profitorientált vállalattá alakulva elárulta küldetését, és megalapította saját szektáját, az xAI-t. 2020-ban az Amodei testvérek léptek ki, mert úgy látták, a biztonsági szempontok háttérbe szorulnak az üzlet mögött, és megalapították az Anthropicot. 2023 novemberében az OpenAI igazgatótanácsa, amelynek több tagja az effektív altruista mozgalomhoz kötődött, menesztette Altmant, mert nem bízott benne, hogy az emberiség javára fejleszti az AI-t. A zsinati puccs öt napig tartott, Altmant a munkatársak és a befektetők visszaemelték a pápai trónusra.
Az AI világában dogmák is vannak. Ilyen volt az elmúlt években az úgynevezett skálázási törvény – hogy a nagyobb, több adaton és több számítási kapacitással tanított modell szükségszerűen okosabb is. Amikor Gary Marcus 2022-ben megkérdőjelezte, az iparág vezetői kinevették. Aztán 2025 augusztusában megjelent a GPT-5, amely alig tudott többet elődjénél, és az eretnekség egyik napról a másikra fősodratú vélekedés lett. A hitetlenek ekkor élték fénykorukat: a tőkepiacok az AI-lufi kipukkadásáról susmogtak, és a világvége-félelem egy időre alábbhagyott.
A vallásháborúk egyik tanulsága, hogy
egy egyháznak a kívülálló hitetlennél is veszélyesebb ellenfele a hitehagyott, aki kitereget.
Az AI-vitában ilyen aposztaták fordították meg többször a közhangulatot. 2023-ban Geoffrey Hinton, a neurális hálózatok kutatásának úttörője – később Nobel-díjas – hagyta ott a Google-t, hogy szabadon beszélhessen a veszélyekről. Az OpenAI és az Anthropic is veszített el kutatókat hasonló okból az elmúlt két évben, de egyikük távozása sem szólt akkorát, mint Jacob Coxoné.
A 27 éves brit kutató, aki három évig dolgozott új modellek tanításán előbb az OpenAI-nál, majd az Anthropicnál, két hónappal a részvényei megszerzése előtt mondott fel, és bejelentette, hogy az egész iparágat elhagyja – úgymond lemondott a világi javakról. Az X-en közzétett posztját másfél nap alatt több mint 150 millióan látták, Coxon a Fox Newstól a CNN-ig minden nagy amerikai csatornán szerepelt. Talán nem meglepő: ifjúkorában a racionalista hittételek hatása alá került a mozgalom londoni értelmiségi közegében.
Pascal kirablása és Moloch szelleme
Vallásos és mitikus képekhez nemcsak a kívülálló kritikusok nyúlnak, hanem a vita résztvevői is. Ilyen Pascal fogadása: a francia filozófus szerint érdemes hinni Istenben, mert ha létezik, a nyereség végtelen, ha nem, a veszteség csekély. A doomerek érve hasonló: ha csak kis esélye van is annak, hogy az AI kiirtja az emberiséget, minden óvintézkedés indokolt. Yudkowsky 2007-ben „Pascal kirablásának” (Pascal’s mugging) nevezte el azt a gondolkodási csapdát, amikor egy elenyésző valószínűségű, de végtelen téttel bíró forgatókönyv mindent felülír.
A racionalista közösség egyik kulcsfogalma pedig egy ókori, gyermekáldozatot követelő bálvány, Moloch. Itt csak ironikus mellékszál, hogy tavaly bejárta a sajtót a hír, miszerint a ChatGPT készségesen adott útmutatást egy felhasználónak a Molochnak bemutatandó emberáldozathoz. Ez a talpnyaló, egyes esetekben öngyilkosságokhoz is asszisztáló chatbotok tragikomikus iskolapéldája volt, de Moloch a doomereknek mást jelent.
Scott Alexander, a mozgalom egyik vezető bloggere 2014-ben azt a versenydinamikát nevezte el Molochnak, amelyben mindenki rosszabbul jár, mert senki sem engedheti meg magának, hogy egyedül lassítson.
Az Anthropic például 2023-ban nyilvános vállalást tett, hogy nem tanít és nem ad ki olyan modellt, amely katasztrofális kárt okozhat, amíg megfelelő biztonsági intézkedéseket nem vezet be. Idén februárban ezt a vállalást részben feladta, épp a Moloch-csapdára hivatkozva: ha egy fejlesztő megállna, miközben a többiek nem, a leggyengébb védelmű cégek diktálnák a tempót, a felelős szereplők pedig kiszorulnának. Szeptemberben aztán ismét ugyanez a cég hirdette meg a lassítást. Amodei We Must Pace the Frontier (Vissza kell fognunk a tempót) című esszéjében azt írta, a képességek fejlesztésének ütemét mérsékelni kell, hogy a biztonsági munka lépést tarthasson vele – feltéve, hogy a riválisok is csatlakoznak. Altman és Musk szóban a támogatásáról biztosította.

A jobboldalon Peter Thiel hozta be a vitába a leginkább explicit vallási képet. Előadásaiban rendre előhozza az Antikrisztus eljövetelét, amely szerinte úgy következhet be, hogy egy egzisztenciális fenyegetéssel szemben mozgósítja a világot, és az emberek a biztonságért cserébe lemondanak a szabadságukról. Ebben az olvasatban az AI-fejlesztés globális ellenőrzését követelők egy világzsarnokság útját egyengetik.
Különös szövetségek
A harmincéves háborúban a katolikus Franciaország a protestáns Svédország oldalán harcolt a katolikus Habsburgok ellen. A vallásháborúk politikája ritkán követte a hitvallások határait, és ez az AI-vitára is igaz. A felekezeti vonalak keresztbemetszik a bal–jobb tengelyt. Washingtonban a „demokratikus szocialista” Bernie Sanders a szuperintelligencia fejlesztésének betiltását javasolja, és szeptemberben egy AI-kritikus rendezvényen közvetlenül Steve Bannon, Donald Trump egykori főtanácsadója előtt szólalt fel. A MAGA-mozgalom egy része kezd erősen AI-ellenes retorikát vallani.
Trump viszont még a globális felmelegedésnél és nagyobb átverésnek nevezte, hogy az AI elpusztíthatná az emberiséget, és azt írta, hogy az AI-nak egyetlen korlátra van szüksége: egy „ERŐS ÉS OKOS (MAGAS IQ-JÚ!) ELNÖKRE”.
Mike Johnson republikánus szintén a klímaalarmizmushoz hasonlította a világvége-félelmeket (ami neki nyilván megnyugtató, nekünk inkább ijesztő hasonlat). Trump „gondolkodása” mögött nem nehéz felidézni a Thiel-féle akcelerácionista tanokat. Vagyis doomereknek szövetségesei vannak a demokrata baloldalon és a populista jobboldalon, ellenfelei pedig a kormányzó republikánusok és a techipar egy része között.
Miközben az amerikai AI-világ vallásháborút vív, ott van Kína, ahol az AI nem isten vagy ördög, hanem az állami hatalom és a gazdasági verseny hasznos eszköze. Ross Douthat, a New York Times konzervatív publicistája szerint míg az Egyesült Államok úgy kezeli a csúcsmodelleket, mintha atomfegyverek volnának, Peking alacsonyabb kockázatú technológiának tekinti őket, amelyet terjeszteni és üzletileg hasznosítani kell, hogy barátokat és befolyást szerezzen a világban. A kínai fejlesztők ingyenesen letölthető, nyílt modelljei ennek megfelelően világszerte terjednek. Ez a lassítás ellenzőinek legerősebb érve – Moloch szellemének globális kiterjesztése:
ha Amerika fékez is, Kína úgysem fog.
Az AI-biztonság szeptemberben egyébként szerepelt a Trump és Hszi Csin-ping közötti tárgyalások napirendjén, de áttörés nem látszott.
Európa mindebben jobbára néző. A döntések San Franciscóban, Washingtonban és Pekingben születnek, néhány ezer ember között. Ha lesz nemzetközi megállapodás a lassításról, az leginkább amerikai–kínai alkuként képzelhető el. Az Európai Unió AI-rendelete, amelyet nemrég még a technológia szabályozásának globális mércéjeként emlegettek, a csúcsmodellek fejlesztésének ütemére nem lesz, nem lehet érdemi hatással.
Vesztfália felé?
A vallásháborúk ritkán értek véget azzal, hogy az egyik fél megnyerte a teológiai vitát. Az 1648-as vesztfáliai béke nem döntötte el, melyik felekezet tanítása az igaz. Csak azt rögzítette, milyen szabályok szerint élhetnek együtt azok, akik ebben nem értenek egyet. A tordai országgyűlés pedig már 1568-ban kimondta a vallásszabadságot Erdélyben – nem azért, mert sikerült közös nevezőre jutni, hanem mert a felekezeti viszály elviselhetetlenné vált.
Az AI-vitában is van pár kérdés, amelyről belátható időn belül nem fognak megegyezni a felekezetek. Például, hogy mi a gép valójában. Isten vagy papagáj, a megváltás eszköze vagy a pusztulásé. A gép természetéről szóló hitvita ma eldönthetetlen – az viszont, hogy a gép mit tesz, empirikus kérdés, és a nyár ebben hozott valódi elmozdulást. A világvége-forgatókönyvekkel kapcsolatos hitetlenek egyik vezéralakja, Gary Marcus is aggódóbb alapállást vett fel, és korlátozásokat sürgetett.
A Hugging Face-ügyet a METR munkatársai az OpenAI irodájában, a cég rendszereihez hozzáférve vizsgálták ki – ez korábban elképzelhetetlen lett volna. Az Anthropic és az OpenAI bejelentette, hogy állandó független értékelőket fogad be, akik belülről ellenőrizhetik a biztonsági gyakorlatot, és jelenthetik az incidenseket. Az OpenAI pedig azzal indokolta legújabb modellje, a GPT-6.1 Astra kiadásának leállítását, hogy a rendszer rosszul teljesített azokon a teszteken, amelyek a felhatalmazás kereteinek betartását és a felhasználó őszinte tájékoztatását mérik.
Az önkéntes megállapodások persze törékenyek, és Moloch szelleme nem tűnt el. Az Anthropic februári visszalépése megmutatta, milyen gyorsan felülírja a verseny a jó szándékot. De nincs más út. Az AI-vitában is először azt kellene elfogadni, hogy a gépben lakó isten létéről, jóságáról és mindenhatóságáról nem fogunk megegyezni. Abban viszont igen, hogy ellenőrizni kell, mit csinál, és józan ön- vagy külső szabályozással csökkenteni a kockázatokat.
Nyitókép: AFP/Science Photo Library nyomán
Ezt a cikket nem közölhettük volna olvasóink nélkül. Legyen támogatónk a Donably-n, a biztonságos, magyar fejlesztésű előfizetési platformon. Paypal, utalás és más lehetőségek itt >>>

