2026. 01. 08., 17:03

Az MI-modellek egyre inkább ugyanúgy látják a világot

Az MI-modellek egyre inkább ugyanúgy látják a világot
Érdemes megvizsgálni, miként érzékeli és dolgozza fel a valóságot az MI az emberi agyhoz hasonlóan. Az emberek képesek felismerni egy kutyát akkor is, ha az teljesen másfajta vagy más környezetben tűnik fel, mert az agy általános, úgynevezett fogalmi reprezentációkat alkot. A mesterséges intelligencia azonban többnyire egyszerűen adathalmazokból tanul, legyenek azok szövegek, képek vagy egzotikusabb típusú információk. De vajon egy nyelvi MI-modell és egy képfeldolgozó MI-modell hasonlóan ragadja meg a „kutya” fogalmát?

Platón árnyékából az adatok barlangjába

A témában dolgozó kutatók évek óta vizsgálják, hogyan „látja” a világot az MI, vagyis milyen belső reprezentációkat alkot egy-egy jelenetről, mondatról vagy képről. Friss kutatások szerint, függetlenül attól, hogy a különböző modelleket milyen adatokkal – szöveggel, képpel – tanították, meglepően hasonló világképet alakítanak ki magukban. Sőt, a modellek fejlődésével ezek az elvont világleírások egyre inkább közelítenek egymáshoz. Az MIT négy kutatója ezt platóni reprezentációs hipotézisnek nevezte el, utalva az ókori gondolkodó híres barlanghasonlatára: az MI-modellek látszólag szűk rálátással, szinte csak árnyképeken keresztül következtetnek a valóságra, de még így is hasonló eredményre jutnak.

A számok univerzuma – hogyan hasonlítanak a modellek?

Az MI-modellek alapját különböző típusú neurális hálózatok adják, amelyek – Püthagorasz gondolata nyomán – végső soron mindent számsorokkal írnak le. Belső reprezentációik konkrétan számsorokként, vektorokként írhatók le, amelyek a neuronok aktivitását rögzítik. Ha két fogalom vektorai hasonlók, közel állnak egymáshoz az MI „térképén”. Egy adott MI-modellen belül például a „kutya” közelében találhatók a „háziállat”, „ugatás” vagy „szőrös” vektorok.

De mi történik, ha különböző modelleknek ugyanazokat a szavakat vagy képeket adjuk bemenetként? Ilyen esetben nem lehet a vektorokat közvetlenül összehasonlítani, de közvetett módon mérhető, hogy a modellek hasonló rendezettségű csoportokat alakítanak-e ki – vagyis például a „kutya”, „macska” és „farkas” egymás közelében koncentrálódnak mindkét modellben.

Ehhez a kutatók módszeresen sorra veszik a fogalmakat, beadják őket a modelleknek, majd megvizsgálják, mennyire egyeznek a keletkező vektorfelhők – ezt a tudomány „hasonlóság-hasonlóságának” is nevezi. Az eredmények szerint a nagyobb, erősebb modellek mindinkább hasonló belső világképet alkotnak, még akkor is, ha különböző forrásból származó adatokból tanulnak.

Konvergens fejlődés: közelítenek a megoldások

2023-ban, amikor berobbant a ChatGPT, különösen nagy lett az érdeklődés e kérdés iránt. A megfigyelések szerint, ahogy növelik a modellek méretét és a tanítóadatok mennyiségét, úgy lesznek egyre jobbak az MI-rendszerek különböző feladatokban – noha nem egyértelmű, hogy mi áll a háttérben. Egyes kutatók szerint ez egyszerűen csak azt jelzi, hogy az MI egyre jobban megtanulja a tanítóadatok speciális mintázatait. Ha viszont különböző forrásokból táplált modellek is ugyanarra kezdik „leképezni” a világot, az már inkább amellett szól, hogy létezhet valamilyen univerzális háttérstruktúra.

Az MIT kutatói, Huh és munkatársai egyetlen adatbázis – a Wikipédia képaláírással ellátott képei – segítségével öt képfeldolgozó és tizenegy nyelvi modellt teszteltek. Minden egyes kísérlettel nőtt az MI-modellek által létrehozott belső világképek hasonlósága. Ezáltal a platóni reprezentációs hipotézis tovább erősödött.


Nem minden arany, ami hasonlít – az ellentábor érvei

Azonban nem minden kutató osztja ezt a nézetet. A kritikák szerint nagymértékben függ a végeredmény attól, milyen adatokkal tesztelik a modelleket, a vektorok mely rétegeit hasonlítják, illetve mely matematikai módszert választják a csoportok összevetésére. Christopher Wolfram, a Chicagói Egyetem kutatója szerint egy kevésbé egységes vagy szokatlan adatkészlettel könnyen eltérő eredmények születhetnének. A Berkeley-i szakértő, Efros pedig úgy véli, az adathalmaz szerkezete eleve előre meghatározza a hasonlóságot – az életben azonban a képek és szövegek gyakran nem tükrözik egyértelműen ugyanazt a tartalmat.

Ennek ellenére – ha még korlátozott mértékben is – úgy tűnik, a különböző MI-modellek közötti fordítás, illetve a multimodális tanulás (például szöveg és kép egyszerre történő feldolgozása) az egyre hasonlóbb belső ábrázolásoknak köszönhetően fejlődhet.

Nincs egyszerű magyarázat – de előre tör az univerzalitás

Nem egyértelmű, de lehetséges, hogy soha nem születik egyetlen, mindent átfogó elmélet arról, hogyan dolgozza fel az MI a valóságot. Egy több százmilliárd paramétert tartalmazó modell nem szorítható egyszerű sémákba. Mégis, a közelmúlt eredményei azt sugallják, hogy az MI-modellek fejlődésével egyre tisztábban rajzolódik ki egyfajta univerzális, gépi „világtérkép”, amely egyszerre több nézőpontból is képes azonos struktúrát felismerni a valóságban.

2025, adminboss, www.quantamagazine.org alapján

Legfrissebb posztok

APP
péntek 09:11

APPok, Amik Ingyenesek MA, 7/17

Fizetős iOS appok és játékok, amik ingyenesek a mai napon...

péntek 06:05

Történelmi események a mai napon (Július 17.)

Ma olyan napra tekintünk vissza, amikor háborúk sorsdöntő csatái, királyi dinasztiák fordulatai és megrázó katasztrófák alakították a világot...

APP
csütörtök 09:11

APPok, Amik Ingyenesek MA, 7/16

Fizetős iOS appok és játékok, amik ingyenesek a mai napon.     Between Dates Calendar Math (iPhone/iPad)A Between Days alkalmazás segítségével egyszerűen és gyorsan meghatározható, hány nap van két dátum között...

csütörtök 06:05

Történelmi események a mai napon (Július 16.)

Kiemelkedő nap: elindult az iszlám időszámítás, fellőtték az Apollo 11-et a Hold felé, és megtörtént a világ első kereskedelmi repülőgép-eltérítése...

szerda 09:49

A Microsoft kibocsátása 25%-kal nőtt – a neheze még hátravan

💨 A Microsoft károsanyag-kibocsátása tavaly 25%-kal nőtt, ami főleg az adatközpontok gyors terjeszkedésének köszönhető...

szerda 09:37

Az adataid a telefonodon maradnak: a Google új AI-dobása a Pixelen

📱 A Google ismét újat mutat a Pixel okostelefonok világában – mostantól az eszközökön futó mesterséges intelligencia még erősebbé teszi a mobilokat, úgy, hogy közben védi a felhasználók adatait...

APP
szerda 09:11

APPok, Amik Ingyenesek MA, 7/15

Fizetős iOS appok és játékok, amik ingyenesek a mai napon.     Between Dates Calendar Math (iPhone/iPad)A Between Days alkalmazás egyszerű és gyors megoldást kínál két dátum közötti napok kiszámítására...

szerda 09:01

Az északkeleti levegő veszélyes: minnesotai erdőtüzek szennyezik

Az Észak-Minnesotában pusztító erdőtüzek füstje hamarosan elérheti az Egyesült Államok északkeleti nagyvárosait, többek között Detroitot, Milwaukee-t, Clevelandet, Philadelphiát és New Yorkot...

szerda 08:49

Az első szintetikus sejt: tényleg megszületett a mesterséges élet?

A Minnesotai Egyetem laboratóriumában újszerű biológiai eredmény született: egy aprócska SpudCell nevű képződmény képes táplálkozni, növekedni, versengeni, osztódni és lemásolni önmagát – vagyis szinte mindent tud, amit egy élő sejt is...

szerda 08:36

Az új Google Képek Pinterest-szerű, felfedezésre kihegyezett átalakítást kapott

A Google Képek (Google Images) megújult külsőt kapott: mostantól személyre szabott galériákat kínál a felhasználóknak, így még könnyebben fedezhetik fel az őket érdeklő képeket...

szerda 08:12

A Google DeepMind az USA-t tenné az MI-szabványok élére

A Google DeepMind vezére, Demis Hassabis szerint az új generációs mesterséges intelligencia egyre komolyabb veszélyeket rejt magában, például a kiberbiztonság és a biológiai fenyegetések terén...

szerda 08:01

Az új Alzheimer-gyógyszer felforgatja a megszokott kezeléseket

💊 Fontos kérdés, hogy meg lehet-e állítani vagy lassítani az Alzheimer-kór lefolyását, hiszen a demencia legfőbb oka, az Alzheimer-kór, világszerte rengeteg embert érint...

szerda 07:49

Az űrben tovább tart az amerikai–orosz űrhajósok összefogása

🚀 Sikeresen megérkezett kedden a Nemzetközi Űrállomásra egy amerikai–orosz személyzet, miután a kazahsztáni Bajkonurból indultak a Roszkoszmosz által üzemeltetett Szojuz MS-29 fedélzetén...

szerda 07:37

A Microsoft Secure Bootja tíz éve lyukas, észre sem vették

🔒 Az informatika egyik legfontosabb biztonsági eleme, a Secure Boot, már csaknem tíz éve lényegében védtelenné vált – és ezt eddig senki sem vette észre...

szerda 07:24

A csípős paprika növelheti egy halálos rák kockázatát?

Bár a csípős paprika számos kultúra elválaszthatatlan része, és egyes laboratóriumi kísérletek a bennük található vegyületeket, például a kapszaicint gyulladáscsökkentőnek vagy akár daganatellenesnek mutatják, az utóbbi évek humán kutatásai nem ennyire egyértelműek...

szerda 07:02

Az Artemis II: „Furcsán nézett ki a Hold” 250 ezer mérföldről

Április 6-án négy űrhajós indult el az Artemis II misszió keretében az Orion űrhajóval, és körülbelül 40 percig teljesen eltűntek a Föld látóteréből...

szerda 06:38

A Microsoft rekordméretű javításözöne: 570 hiba és 3 zero-day

🔧 Szinte példátlanul nagy frissítési csomagot adott ki a Microsoft a 2026...

szerda 06:25

A volt dolgozók részrehajló MI-t sejtenek a leépítések mögött – perelik a Metát

💼 Májusban a Meta megvált dolgozóinak 10 százalékától, közel 8 000 alkalmazottat küldött el, ami jelentős átszervezéssel járt a vállalat MI-re és adatközpontokra irányuló fejlesztései miatt...

szerda 06:05

Történelmi események a mai napon (Július 15.)

Időutazás egyetlen napon: Jeruzsálem falainak áttörésétől 🏰 a Rosetta-kő 🗿 megtalálásán és Napoleon 🚢 megadásán át a Grunwaldnál vívott döntő ütközetig ⚔️, sőt a modern korszakban a törökországi puccskísérletig 🇹🇷 és a Mozilla alapításáig 🦊...

kedd 18:31

Az Ozempic és a Wegovy tényleg lassíthatják a biológiai öregedést?

Tipikus eset, amikor egy ismert gyógyszer egészen váratlan előnyöket kínál. A GLP-1 típusú szerek, mint az Ozempic, a Wegovy vagy a Rybelsus, eredetileg a fogyás, a jobb vércukorszint-szabályozás és a szívbetegségek kockázatának csökkentése miatt váltak népszerűvé...

kedd 17:30

Az indiai tudósok megalkották az emberi agytörzs eddigi legrészletesebb 3D-atlaszát

Indiai kutatók a világ eddigi legrészletesebb, háromdimenziós agytörzs-atlaszát hozták létre, amelyben MRI-felvételeket több mint 500 mikroszkópos szövetrészlettel kapcsoltak össze...

kedd 17:01

A Tejútrendszer mélyén cukrot találtak a kutatók

Többek között különleges eredményre jutottak a kutatók: a Tejútrendszer középpontjához közel egy óriási gázfelhőben felfedeztek egy ritka cukorfélét, az eritrózt, amely nemcsak málnában, hanem barnító krémekben is megtalálható...

kedd 16:01

Az IBM 23%-ot zuhant a második negyedéves profitfigyelmeztetés után

Ami kezdetben ártalmatlannak tűnt, végül az IBM történetének egyik legsötétebb napjához vezetett a tőzsdén...

kedd 15:01

A NASA Perseverance-je célba ért: megvan a marsi maraton

🚀 Történelmi teljesítmény született a Marson: a Perseverance marsjáró öt év és négy hónap után elérte a 42,195 kilométeres maratoni távot...

kedd 12:01

A régi T‑Mobile-csomagoknak vége: kényszerváltás már ezen a héten

Ami kezdetben ártalmatlannak tűnt, most minden régi T-Mobile-előfizető számára valódi változás: a társaság e héttől kezdve automatikusan átsorolja a 10–15 éves tarifákat – például a Simple Choice, T-Mobile One, One Plus, a Magenta családhoz tartozó, valamint a Sprintből áthozott régi csomagokat – modernebb tarifákra...

kedd 11:31

Az inflációs adat előtt megroggyan a Bitcoin

A legnagyobb kriptovaluták teljesítménye az elmúlt 24 órában jelentősen visszaesett, miután egyre többen valószínűsítik, hogy az amerikai jegybank akár már júliusban kamatemelés mellett dönt...

kedd 11:02

Az analóg fotózás visszatér: a fiatalok újra tekercsre lőnek

Az elmúlt pár évben váratlan fordulat történt a fotózás világában: a fiatal generáció újra felfedezte a filmes fényképezőgépeket...

kedd 10:49

A Turing-mítosz vége: lehet, hogy tévedett a mesterséges intelligenciáról?

🤔 A mesterséges intelligencia kutatása 75 éve követi Alan Turing útmutatását, aki két alapvető feltételezést tett: az intelligencia létrehozható szoftverből, függetlenül a testtől, és hogy egy gép intelligensnek számít, ha sikerrel utánozni tudja az embert, például egy beszélgetés során...

kedd 10:37

Az MI átírja a marketinget: a régi szabályoknak befellegzett

💡 A Fortune 500 cégek vezető marketingesei kénytelenek szembenézni azzal a ténnyel, hogy a korábbi, jól bevált módszerek egyszerűen elavultak...