2026. 02. 05., 19:56

Az MI is hős lehet: a Dungeons & Dragons lett a tesztlabor

Az MI is hős lehet: a Dungeons & Dragons lett a tesztlabor
Képzeld el, hogy a Dungeons & Dragons (D&D) már nemcsak baráti asztaltársaságok kedvenc játéka, hanem igazi tesztpálya a legújabb MI-modellek számára is. A tudósok elképesztő ötlettel álltak elő: D&D-vel vizsgálják, mennyire képes együtt dolgozni MI és ember, illetve mennyire tud önállóan, hosszú távú stratégiákban gondolkodni egy algoritmus. Nem hagyható figyelmen kívül, hogy a mesterséges intelligencia számára a D&D tökéletes környezetet jelent – egyszerre szabályokhoz kötött, mégis leleményességet igényel.

Egy új játszótér: MI kalandorok és mesélők

A teszteléshez a kutatók kifejlesztettek egy speciális D&D Agents nevű keretrendszert, ahol az MI bármelyik szerepet betöltheti: lehet mesélő (Dungeon Master), aki a történetet alakítja és az ellenségeket irányítja, vagy maga a hős. Egy játékban rendszerint egy mesélő és négy hős vesz részt, akiket vegyesen irányíthat MI és ember. Továbbá az MI-vel együtt akár többen is beülhetnek a kalandba – egyszerre lehetnek LLM-ek (nagy nyelvi modellek) és emberi játékosok a hősök között. Az sem lehetetlen, hogy teljes egészében algoritmusok játsszák el a harci jeleneteket.

Harci szimuláció: Hol válik el MI és ember?

A kutatók nem egy egész kampányt szimuláltak, hanem egy előre megírt kalandból vettek ki háromféle harci jelenetet, ahol különböző szintű karakterek mérhették össze az erejüket. Minden epizód 10 körig tartott, ezalatt a modelleknek tervezniük, kommunikálniuk és a szabályok szerint játszaniuk kellett. A mesterséges intelligenciák – DeepSeek-V3, Claude Haiku 3.5, GPT-4 – közül messze a Claude Haiku 3.5 bizonyult a leghatékonyabb harcosnak, főleg, ha kemény ellenfelek kerültek elő. Könnyebb helyzetekben mindhárom MI hasonló hatékonysággal spórolta az erőforrásokat (itt a varázslatok vagy életerőitalok jelentik a fogyó készletet), de nehéz csatákban a Claude Haiku 3.5 bátrabban áldozta fel őket a győzelemért.

Szerepbe bújva: Az MI kitalálja magát

Érdekes tapasztalat, hogy a modellek mennyire képesek karakterben maradni. Egy új mérőszám – színészi minőség (Acting Quality) – alapján a DeepSeek-V3 főleg egysíkú, rövid megszólalásokkal (például „Balra vetődöm!” vagy „Kapjátok el!”) élt, miközben gyakran ugyanazt ismételte. Ezzel szemben a Claude Haiku 3.5 minden karakter sajátos beszédmódját hozta, legyen szó szent paladinról vagy környezetbarát druidáról. A GPT-4 a kettő között mozgott: narratívát és taktikát is kevert a játékmenetbe. A fejlemények minden várakozást felülmúltak, amikor az MI szörnyek bőrébe bújt – például a goblinok vérfagyasztó kiáltásokkal rontottak a csatába.


Mire jó mindez a való életben?

Nem hagyható figyelmen kívül, hogy ez a vizsgálati keret abban is segít, hogy felmérjük: mennyire képes az MI hosszabb távon, emberi segítség nélkül következetesen, logikusan működni. Ez kulcsfontosságú, amikor olyan feladatokat kell elvégeznie, mint az ellátási láncok optimalizálása, katasztrófahelyzetek modellezése vagy összetett kereső-mentő missziók szervezése. Továbbá a kutatók a jövőben szeretnének teljes D&D-kampányokat is szimulálni, hogy lássák, hogyan improvizál az MI, amikor nemcsak csatában kell helytállnia, hanem egy bonyolult és változatos történet világában, ahol az emberi játékosok minden lépése új kihívást jelenthet.

2025, adminboss, www.livescience.com alapján

  • Te engednél mesterséges intelligenciát a saját játékodba, vagy csak emberekkel játszanál?
  • Szerinted jobb, ha az MI önállóan dönt, vagy inkább mindig legyen emberi felügyelet?


Legfrissebb posztok

MA 21:23

A terhesség tudománya: Teszteld, mennyit tudsz a babafejlődésről!

👶 A babák világra jövetele különleges, mégis megdöbbentően összetett folyamat. Az emberi terhesség átlagosan kilenc hónapig tart, három szakaszra – trimeszterre – oszlik, és már a fogantatás előtt, a menstruációs ciklus kezdőnapjától számítják...

MA 21:12

A CME-n már a bitcoin árhullámzására is lehet fogadni

A világ legnagyobb származékos tőzsdéje, a CME Group június 1-jén elindítja a bitcoin volatilitásalapú határidős ügyleteit, amint megkapja a szükséges szabályozói engedélyeket...

MA 21:01

Az egyszerű zenei trükk, amitől 20%-kal tovább bírod az edzést

🎶 Kiderült, hogy egy igazán ütős lejátszási lista többet tehet érted edzés közben, mint hinnéd...

MA 20:56

A svájci jegybank bitcointerve elbukott – nem jött össze elég aláírás

Svájcban ismét elhalt egy merész kezdeményezés, amely arra irányult, hogy a Svájci Nemzeti Bank arany- és külföldi devizatartalékai mellett bitcoint is felhalmozzon...

MA 20:36

A hangtalan, de nem makulátlan ZimaBoard 2 mini NAS tesztje

💻 A ZimaBoard 2 minden porcikájában azt üzeni: itt a saját adataid feletti teljes kontroll, kompromisszumokkal, de jelentős újításokkal...

MA 20:24

Jön az új doméncunami: kié lesz a .trump?

📢 Tizennégy év után ismét lehetőség nyílik arra, hogy vállalatok, szervezetek vagy akár városok saját felső szintű domainnevet (top-level domain, röviden TLD) birtokoljanak az interneten...

MA 20:13

A világbajnokságra hangolva: a legjobb Dolby Atmos hangprojektorok

Ha már készül az ember a 2026-os labdarúgó-világbajnokságra, érdemes nemcsak egy új tévén gondolkozni, hanem a hangminőségre is fókuszálni...

MA 20:03

Az Ugreen DXP4800 Pro: apró változás, komoly következmények?

⚠ Jellemző példa erre, hogy az Ugreen újra rátette a kezét a népszerű, négyfiókos NAS-piacra...

MA 19:56

A feltörekvő piacokon banki appként használják a kriptotőzsdéket

Felmerül a kérdés, miért váltak a kriptovaluták ilyen népszerűvé a feltörekvő országokban...

MA 19:45

A fülesfókák szíve csak partraszállás után pörög fel

A hosszú, mély merülések extrém terhelést jelentenek a tengeri emlősöknek. Ilyenkor a szív és az agy kivételével a többi szerv áttér oxigén nélküli anyagcserére, aminek következtében tejsav halmozódik fel...

MA 19:34

A bistrifluron 95%-ban irtja a termeszeket, emberre veszélytelen

A szárazfatermeszek mesterien rejtőzködnek, fából készült épületek belsejében csendben táplálkoznak és gyarapodnak, míg a tulajdonosok csak a károk észlelése után szembesülnek a jelenlétükkel...

MA 19:25

A OnePlus 15R két hét alatt új szintre tette az üzemidőt

🔋 Két hét használat után a OnePlus 15R egészen új szintre emelte az okostelefonos üzemidő fogalmát...

MA 19:13

A fizikusok olyan kvantumrészecskéket fedeztek fel, amelyek felrúgják a valóság szabályait

Különösen említést érdemel, hogy a fizikusok hosszú ideig két típusba sorolták az elemi részecskéket: boszonokra és fermionokra...

MA 19:01

A jégkori kínaiak megdöbbentően fejlett kőeszközöket készítettek 146 ezer éve

🔨 Érdemes megvizsgálni, hogy a modern ember ősrokonai mennyire képesek voltak alkalmazkodni a szélsőséges körülményekhez: a közép-kínai Lingjing lelőhely feltárásán kivételesen fejlett kőeszközökre bukkantak, amelyek körülbelül 146 ezer évvel ezelőtt készültek...

MA 18:57

A szándékalapú káoszteszt akkor kell, amikor az MI magabiztosan téved

A mai vállalatok egyre bátrabban telepítenek autonóm MI-rendszereket, ám ezek magától értetődő magabiztossággal képesek váratlanul, akár katasztrofálisan hibázni...

MA 18:34

Lehet, hogy már elkéstünk: bajban a Bitcoin a kvantumkor előtt

A kvantumszámítógépek megjelenése alapvetően fenyegeti a világgazdaság digitális alapjait, ráadásul már most csak néhány év maradt a védekezésre...

MA 18:23

Az Abiotic Factor brutál frissítése: okosabb kedvencek, őrült kémia, végre felmosó

🚀 Érdemes megjegyezni, hogy az Abiotikus tényező fejlesztői ismét egy hatalmas frissítést adtak ki, amely tovább bővíti a játék eleve hatalmas világát...

MA 14:46

Az EU a VPN-ekre készül rászállni – közeleg a tiltóhullám?

😱 Az online világ minden eddiginél bonyolultabbá vált, különösen, ha a fiatalok védelméről van szó...

MA 14:35

Az emberiség már a Marsig vezető gyorssáv küszöbén áll?

🚀 Érdekes, hogy a tudományos világ ezen a héten egyszerre foglalkozik különös víruskitöréssel, űrutazási forradalommal és kvantumakkumulátorral...

MA 14:24

A téridő királynője, Max Caulfield, átveszi Gordon Freeman helyét

👑 Mi történik, ha a Half-Life világában nem csendes tudós, hanem egy időutazós tinédzser lesz a főhős?..

MA 13:24

A hét 7 legnagyobb tech-sztorija: Apple-kártérítés, vadonatúj Fitbit

Május második hetének technológiai újdonságai minden eddiginél színesebbek: fizetős kárpótlás az iPhone-tulajdonosoknak, egy új „zseniális” Google Fitbit, legendás játék visszatérése Switch 2 konzolra, valamint a Vine feltámadása is elfért a hét legfontosabb techhírei között...

MA 13:12

Az okosodás ára: miért zsugorodik az agyunk?

Az emberi agy mérete nem feltétlenül áll szoros összefüggésben az intelligenciával...

MA 13:02

A nagy MI-per: Musk kontra Altman 55 ezermilliárdért

Elon Musk és Sam Altman, akik egykor jó viszonyban álltak, ma egymás esküdt ellenségeiként állnak szemben a kaliforniai bíróságon...

MA 12:56

Az első futóórádhoz: ezek a legjobb olcsó órák és karpántok

Az első futóóra kiválasztása nehéz döntés lehet, főleg, ha az ember úgy érzi, felesleges súlyos összegeket költeni egy apró kütyüre...

MA 12:45

Az IKEA tárolási ötleteivel kétszer akkora lesz a dolgozószobád, átalakítás nélkül

📦 Jellemző, hogy ha zsúfolt, rendezetlen az otthoni dolgozószoba, rögtön nehezebb a koncentráció, mint amikor az asztalon és a szobában is rend van...

MA 12:35

A Surfshark figyelmeztet: ázsiai utazási appok csendben gyűjtik az adataid

👑 Aki Ázsiába utazik, hamar szembesül azzal, hogy a helyi közlekedéshez, ételrendeléshez és tájékozódáshoz kötelező letölteni az ottani appokat, hiszen az európai vagy magyar alkalmazások gyakran használhatatlanok...

MA 12:23

Az 899 dolláros, AI-kész RTX 5060-as PC: megéri?

Ilyen eset például, amikor egy új játékra vagy irodai munkára keresel számítógépet, de a RAM-árak az egekben járnak, így nehéz jó ár-érték arányú, előre összeszerelt gépet találni...

MA 11:01

Az Elder Scrolls után a hős modder Pip-Boyra vitte a Falloutot

Modderek körében népszerű ötlet, hogy klasszikus játékokat integrálnak a modern környezetbe, de kevesen viszik ezt olyan extrém szintre, mint RPGKing117, aki sorra varázsolja be a legendás szerepjátékokat a Fallout 4 univerzumába...

MA 10:52

Az új TCL QM8L: lenyűgöző mini-LED tévé remek áron, apró furcsákkal

📺 Az új TCL QM8L lenyűgöző képet kínál, amit a gyártó fejlett Mini‑LED háttérvilágítása és halo‑korlátozó technológiája biztosít...