MI vs. Super Mario: Az örökkévaló játék lett az új teljesítménymérő
Új ötlet van terjedőben: a Super Mario-t használják a mesterséges intelligencia teljesítményének mérésére. Egy kutatócsoport szerint a Super Mario Bros. mégnagyobb kihívást jelent, mint gondolnánk.
A Kaliforniai Egyetem San Diego campusán működő Hao AI Lab pénteken élő Super Mario Bros. játékokba vetette az MI-ket. Az Anthropic Claude modellje teljesített a legjobban, majd a Claude 3.5 következett. A Google és az OpenAI modelljei gyengébben szerepeltek.
Nem egészen a klasszikus játék
Fontos tisztázni, hogy ez nem pontosan az eredeti 1985-ös kiadás volt. A játék egy emulátorban futott, és egy keretrendszerrel integrálták, hogy az MI-k irányíthassák Mariót.
A Hao által házon belül fejlesztett GamingAgent alapvető utasításokat adott az MI-nek, például: “Ha akadály vagy ellenség van a közelben, mozdulj/ugorj balra, hogy elkerüld”, valamint játékbeli képernyőképeket mutatott. Az MI ezután Python kódban generált bemeneti parancsokat Mario irányításához.
Meglepő eredmények
A Hao szerint a játék arra kényszerítette a modelleket, hogy “megtanuljanak” összetett manővereket tervezni és játékstratégiákat kidolgozni. Érdekes módon a kutatólabor azt találta, hogy az OpenAI-hoz hasonló, következtető modellek, amelyek lépésről lépésre “gondolkodnak” a problémák megoldása során, rosszabbul teljesítettek, mint a “nem következtető” modellek, annak ellenére, hogy általában erősebbek a legtöbb teljesítménymérőn.
A kutatók szerint az egyik fő oka annak, hogy a következtető modelleknek gondot okoz a valós idejű játékok játszása, az, hogy időbe telik – általában másodpercekbe -, mire döntést hoznak. A Super Mario Bros. játékban pedig minden a megfelelő időzítésen múlik. Egy másodperc lehet a különbség egy biztonságosan végrehajtott ugrás és a halálba zuhanás között.
A játékokat már évtizedek óta használják az MI teljesítményének mérésére. Azonban kétséges az MI játékban mutatott képességei és a technológiai fejlődés közötti összefüggések megítélése. A való világgal ellentétben a játékok általában elvontak és viszonylag egyszerűek, valamint elméletileg végtelen mennyiségű adatot biztosítanak az MI betanításához.
Nincsenek igazán jó mérőszámokat az MI-k összehasonlítására.
De legalább nézhetjük, ahogy az MI Mariót játszik.
🚫 Búcsút inthetünk az AI-zabált cikkeknek a Wikipédián, mert az óriási, szabad enciklopédia végre kimondta: nincs több robotírás, kivéve néhány nagyon ritka esetben...
🔒 Fontos kérdés, hogy mennyire biztonságosak a vezető technológiai cégek adatkezelési megoldásai, amikor egy apró figyelmetlenség is komoly belső információk kiszivárgásához vezethet...
Mindenki ismeri azt a klasszikus szerelmi menetet: megismerkedés, összejövetel, majd összeköltözés – mintegy a kapcsolat komolyságának bizonyítékaként...
A Gemini mostantól lehetővé teszi, hogy minden eddiginél egyszerűbben válts más MI-csevegőalkalmazásról úgy, hogy közben nem veszítesz el semmit a korábbi beszélgetéseidből vagy emlékeidből...
A SICSOLINK SFP-J06Q-HG2-US igazán szokatlan látvány: ez a nyolcportos, 10 gigabites Ethernet switch már első pillantásra felhívja magára a figyelmet rikító zöld és narancssárga előlappal...
💻 Szokatlanul csendes kedd este köszönt be a Metánál: HR-levelek érkeznek, miszerint másnap mindenkinek otthonról kell dolgoznia, a vezetés pedig később közli a részleteket...
🦧 Afrika keleti részét hosszú ideig az emberszabásúak bölcsőjének tartották, de Egyiptom sivataga most új fejezetet nyit az őstörténetben: 18 millió éves majommaradványok kerültek elő, amelyek Földünk legkorábbi emberszabásúi közé tartozhatnak...
Különösen igaz ez akkor, ha egyszerre több WhatsApp-fiókot kezelsz, képeket szerkesztesz, vagy a privát üzenetváltás gördülékenysége fontos számodra...
⚡ Az Android 17 Beta 3 fejlesztői változatában a háttérben egy vadonatúj megoldás bukkant elő: a Priority Charging nevű funkció lehetővé teszi, hogy a telefon villámgyorsan feltöltődjön, amikor tényleg nagy szükség van rá...
Az Apple nagy lépésre szánta el magát: többféle mesterséges intelligencián alapuló chatbotot kapcsol Siribe, ilyenek például a Google Gemini, az Anthropic Claude vagy az OpenAI ChatGPT...
Fizetős iOS appok és játékok, amik ingyenesek a mai napon. Notch Island – Wallpaper Maker (iPhone/iPad)Ez az alkalmazás lehetővé teszi, hogy testre szabhasd az iPhone notch-ját...
🦁 Egy különleges, harmadik századi római mozaik ábrázolása új fényt vet az ókori arénák világára: Reimsben 1860-ban bukkantak rá egy mozaikra, amelyen egy félmeztelen nő – pontosabban egy vadásznő – küzd egy leopárddal...
🔮 A hosszú COVID igazi rejtély: a fertőzés után még hónapokkal is sokan szenvednek kimerültségtől, légzési nehézségektől, koncentrációs zavaroktól vagy neurológiai panaszoktól...
🐮 A svájci Veronika nevű tehén egészen új fénybe helyezte a szarvasmarhák intelligenciáját: tudományos megfigyelések szerint képes különböző tárgyakat célszerűen használni, amivel megdöntötte azt az elképzelést, hogy a tehenek egyszerű, eszköztelen állatok lennének...
Rövid visszatekintés a mai nap történelmi fordulópontjaira: a legtragikusabb légikatasztrófa Tenerife ködös kifutóján történt, Geronimo fegyverletételével lezárult az Apache-háborúk, és Typhoid Mary élete végéig karanténban maradt...
📺 Az SMS világa évek óta lemaradásban van az olyan modern alkalmazásokhoz képest, mint a WhatsApp vagy az iMessage, ahol könnyedén lehet váltani szöveges üzenetküldésről hívásra, és a formázási lehetőségek is jóval szabadabbak...