MI vs. Super Mario: Az örökkévaló játék lett az új teljesítménymérő
Új ötlet van terjedőben: a Super Mario-t használják a mesterséges intelligencia teljesítményének mérésére. Egy kutatócsoport szerint a Super Mario Bros. mégnagyobb kihívást jelent, mint gondolnánk.
A Kaliforniai Egyetem San Diego campusán működő Hao AI Lab pénteken élő Super Mario Bros. játékokba vetette az MI-ket. Az Anthropic Claude modellje teljesített a legjobban, majd a Claude 3.5 következett. A Google és az OpenAI modelljei gyengébben szerepeltek.
Nem egészen a klasszikus játék
Fontos tisztázni, hogy ez nem pontosan az eredeti 1985-ös kiadás volt. A játék egy emulátorban futott, és egy keretrendszerrel integrálták, hogy az MI-k irányíthassák Mariót.
A Hao által házon belül fejlesztett GamingAgent alapvető utasításokat adott az MI-nek, például: “Ha akadály vagy ellenség van a közelben, mozdulj/ugorj balra, hogy elkerüld”, valamint játékbeli képernyőképeket mutatott. Az MI ezután Python kódban generált bemeneti parancsokat Mario irányításához.
Meglepő eredmények
A Hao szerint a játék arra kényszerítette a modelleket, hogy “megtanuljanak” összetett manővereket tervezni és játékstratégiákat kidolgozni. Érdekes módon a kutatólabor azt találta, hogy az OpenAI-hoz hasonló, következtető modellek, amelyek lépésről lépésre “gondolkodnak” a problémák megoldása során, rosszabbul teljesítettek, mint a “nem következtető” modellek, annak ellenére, hogy általában erősebbek a legtöbb teljesítménymérőn.
A kutatók szerint az egyik fő oka annak, hogy a következtető modelleknek gondot okoz a valós idejű játékok játszása, az, hogy időbe telik – általában másodpercekbe -, mire döntést hoznak. A Super Mario Bros. játékban pedig minden a megfelelő időzítésen múlik. Egy másodperc lehet a különbség egy biztonságosan végrehajtott ugrás és a halálba zuhanás között.
A játékokat már évtizedek óta használják az MI teljesítményének mérésére. Azonban kétséges az MI játékban mutatott képességei és a technológiai fejlődés közötti összefüggések megítélése. A való világgal ellentétben a játékok általában elvontak és viszonylag egyszerűek, valamint elméletileg végtelen mennyiségű adatot biztosítanak az MI betanításához.
Nincsenek igazán jó mérőszámokat az MI-k összehasonlítására.
De legalább nézhetjük, ahogy az MI Mariót játszik.
🦅 A Magic V6 a hajlítható telefonok új sztárja: 8,75 mm vastagságával összehajtott állapotban a legvékonyabb a népszerű gyártók könyvszerű modelljei között...
Felpörögtek az MI-videók, a Seedance 2.0-nak (csináld ránk, TikTok, Kína!) hála már mindenféle Instagram-posztok, TikTokok és YouTube-shortok ultrarealisztikus kamukkal bombáznak, és úgy fulladunk bele az alternatív valóságba, mint a legkínosabb internetes összeesküvés-hívők...
Többek között elképesztő kameratechnológiát, látványos dizájnt és remek processzort kínál a Xiaomi új Leitzphone készüléke, amely látványosan összeforrt a legendás német Leica fotómárkával...
Majdnem egymillió amerikai veterán adatai alapján világosan látszik, hogy ha valaki egyszerre küzd álmatlansággal és alvási apnoéval, sokkal nagyobb eséllyel alakul ki nála magas vérnyomás és szívbetegség, mintha csak az egyik problémával élne...
A graffiti készítése eddig rengeteg különböző színű festékes dobozt igényelt, ami nemcsak kényelmetlen, de egyúttal korlátozza is a művészek kreativitását...
Többek között az idős emberek közötti nagy különbségek okaira világít rá egy új kutatás, amely meglepő felfedezést tett: azok, akik idősebb korukban is kivételes memóriával rendelkeznek, lényegesen több fiatal idegsejttel rendelkeznek, mint hasonló korú társaik...
💰 Fontos kérdés, hogy mennyit ér ma az információ, amikor a háború kitörésekor másodperceken belül elözönlik a prognózisok a kriptopénzek világát, és a geopolitikai eseményekre tett fogadások szinte azonnal rekordokat döntenek...
💰 Döbbenetes baklövést követett el Dél-Korea adóhatósága, amikor egy sikeres lefoglalási akciót követően véletlenül nyilvánosságra hozta egy digitális pénztárca helyreállító kulcsát...
Lényeges, hogy a régészek egy rendkívüli temetkezést fedeztek fel Dél-Svédországban, ahol egy, a több mint hétezer évvel ezelőtti időkből származó fiú holttestét szarvasbőrbe és fakopáncs-tollból készült fejfedőbe burkolva temették el...
😺 Az éjszaka sötétje alatt a Rubin Obszervatórium vadonatúj figyelmeztetőrendszere igazi űrkavalkádot indított el, első éjszaka rögtön 800 000 figyelmeztetéssel bombázva a csillagászokat...
A számítógépek hőskorában az átlagember csak álmodhatott saját számítógépről – mindenki egy központi gépet nyüstölte, és távoli terminálokon pötyögte be a parancsokat...
Pénteken, amikor épp interjú készült Dario Amodeival, az Anthropic alapítójával, váratlan hír futott be: a Trump-kormányzat megszakította minden kapcsolatát az Anthropic-kal, a 2021-ben alapított San Francisco-i MI-fejlesztő céggel...
🚀 Az elmúlt napokban valóságos roham indult az Anthropic MI-asszisztense, a Claude alkalmazás iránt: hirtelen az amerikai App Store ingyenes alkalmazásainak listája élére ugrott, maga mögé utasítva a korábbi csúcstartó ChatGPT-t, valamint a Google Geminit is...
Kiderült, hogy a baktériumokat fertőző vírusok – azaz fágok – egy eddig ismeretlen gyengeséget tártak fel: képesek lekapcsolni egy létfontosságú bakteriális fehérjét, a MurJ-t, amelyre az eddigi antibiotikumok nem tudtak hatni...
💻 Az Apple idén év végétől az Egyesült Államokban kezdi el gyártani a Mac minit, leállítva a Vietnámban és Kínában folyó termelést, hogy az összeszerelés a houstoni Foxconn-gyárban történjen...
A Xiaomi világszerte bemutatta a Xiaomi 17 és Xiaomi 17 Ultra mobilokat, amelyek bátran odaállnak bármelyik zászlóshajó mellé, és akár az idei Galaxy S26-sorozat csalódott rajongóinak is izgalmas alternatívát kínálnak...
👥 A szólóvállalkozók gyakran falakba ütköznek, amikor új ügyfeleket szeretnének találni. A hagyományos platformok, mint a LinkedIn, tele vannak önjelölt gurukkal, akik a saját tanfolyamukat promózzák, vagy a reggeli jógájuk eredményeit akarják világgá kürtölni...
Fizetős iOS appok és játékok, amik ingyenesek a mai napon. Last Horizon (iPhone/iPad)A Last Horizon egy letisztult, minimalista űr-túlélő játék, amelyben egy letűnt civilizáció utolsó űrhajóját irányítva kell új otthonra lelnünk az univerzumban...
Az 1854-ben alapított Clarity évtizedeken át adott munkát vak és látássérült embereknek az Egyesült Királyságban, legutóbb pedig szappankészítéssel foglalkozott...