Az MI nem gondolkodik, csak utánoz – vagy mégsem?

Az MI nem gondolkodik, csak utánoz – vagy mégsem?
Az Apple kutatói egy friss tanulmányban azt vizsgálták, mennyire képesek a legújabb nagy nyelvi modellek (LRM-ek – Large Reasoning Models) bonyolult feladványok, például a Hanoi tornyai (Tower of Hanoi) megoldására. Kiterjedt kísérleteik során kiderült: hiába a kifinomult algoritmus, egy bizonyos bonyolultsági szint felett a modellek pontossága teljesen összeomlik. Ráadásul, bár az MI-k egy darabig egyre nagyobb erőfeszítést tesznek a problémák megoldására, egy pont után ez a törekvés mégis csökken – annak ellenére, hogy elegendő token áll rendelkezésükre a feladat befejezéséhez.

Az MI-k vakfoltjai és a túlzó elvárások

A tanulmány címe – Az illúzió, hogy az MI gondolkodik – gyorsan felerősítette azokat a véleményeket, amelyek szerint a jelenlegi nyelvi modelleket túlértékelik. Gary Marcus MI-szkeptikus szakértő viszont összegyűjtötte a legjobb ellenvéleményeket, majd azokat is kritizálta, állítva: már régóta tudott, hogy ezek a modellek rosszul általánosítanak. Szerinte csak akkor lenne hasznos az AGI (általános MI), ha valóban túlszárnyalná az emberi gyengeségeket – viszont matematikai műveletekre is képesnek kellene lennie, ilyenekre most még nem érdemes bízni az emberiség jövőjét.

Hasznosak-e ma az MI-k?

Az MI-k (LLM-ek) jelenleg is számos olyan problémát képesek megoldani, amelyeket korábban nem tudtak, ezért fejleszti őket az OpenAI, az Anthropic vagy éppen a DeepSeek. Bár még mindig akadnak logikai vakfoltjaik, számos mindennapi feladatra már ma is hasznosak lehetnek – függetlenül attól, hogy tökéletesen megoldanak-e összetett fejtörőket vagy sem. Az MI tehát már most is egy eszköz a kezünkben, még ha a mindenható mesterséges intelligencia nem is a közeljövőben érkezik.

2025, adrienne, simonwillison.net alapján

  • Te mit gondolsz, jó ötlet-e ilyen fontos feladatokat MI-re bízni?
  • Szerinted mikor bíznád rá az MI-re, hogy egy bonyolult problémát oldjon meg helyetted?
  • Ha te terveznéd ezeket a rendszereket, hogy ellenőriznéd, jól működnek?


Legfrissebb posztok

kedd 09:44

Az elit tíz: a világ leggazdagabbjai újrarendezve

💰 A decemberi Forbes-lista szerint továbbra is az informatika, a közösségi média és a mesterséges intelligencia uralja a világ leggazdagabb embereinek rangsorát...

MA 10:23

A James Webb végre leleplezte az univerzum óriáscsillagait

💫 A James Webb űrteleszkóp lenyűgöző felfedezéssel szolgál: eddig ismeretlen, óriási tömegű csillagokat talált a GS 3073 nevű, ősi galaxisban, amely mintegy egymilliárd évvel az ősrobbanás után alakult ki...

MA 10:15

Az orkák új szövetségesekkel vadásznak lazacra?

Az elmúlt időszakban több érdekes megfigyelés is arra utal, hogy a kardszárnyú delfinek (orkák) és a fehéroldalú delfinek szokatlan szövetséget alkothatnak a lazacvadászatban Brit Columbia partjainál...

MA 09:51

A hővel csábító növények titkai: élet a virágzás előtt

Általában elválaszthatatlan fogalmaknak tűnnek a virág és a beporzás, pedig évmilliókkal a virágok megjelenése előtt a növények már sikeresen vonzották az állatokat – csak nem színes szirmokkal, hanem forrósággal...

MA 09:43

Megérkezett az első otthoni depressziókezelő készülék

💡 Az amerikai Élelmiszer- és Gyógyszerügyi Hivatal (FDA) engedélyezte az első olyan eszközt, amely otthon is használható depresszió kezelésére...

MA 09:30

A római sírok új rejtélye: ujjlenyomatok az idő mélyéről

🗿 Közel 1800 évvel ezelőtt a mai Britannia területén élő rómaiak különös temetkezési szertartást alkalmaztak: folyékony gipszpasztát kentek az elhunyt testére, még mielőtt eltemették volna...

MA 09:23

Az OpenAI szabad kezet kapott a Disney-hősökkel

👑 A Disney három évre exkluzív licencet adott több mint 200 karakterére az OpenAI-nak, így mostantól a Sora videós MI és a ChatGPT Images hivatalosan is rajzolt és animált formában generálhat Disney-, Pixar-, Marvel- és Star Wars-karaktereket...

MA 09:16

Az új ChatGPT 5.2: végre itt az okosabb MI

Sokan már napi szinten használják a ChatGPT-t tanulásra és munkára, így fontos kérdés, hogy egy új verzió mennyit javít a megbízhatóságon és a mindennapi hasznosságon...

MA 09:08

A CentreStack súlyos kriptográfiai hibája nyit kaput az adatlopásnak

A hackerek új, eddig dokumentálatlan sérülékenységet használnak ki a Gladinet CentreStack és Triofox fájlmegosztó rendszereiben, amellyel távoli kódfuttatást érhetnek el...

MA 09:02

A 3D-s huzalozás küszöbén a 10 000 qubites MI-chipek

Fontos kérdés, hogyan lehet a kvantumszámítógépek számítási teljesítményét jelentősen növelni, miközben a fizikai méretük nem nő arányosan...

MA 08:57

Az összeomlás ára a kriptovilágban: 15 év börtön Do Kwon-nak

Do Kwon, a dél-koreai kriptovállalkozó 15 év börtönt kapott az Egyesült Államokban, miután két digitális valutája, a TerraUSD és a Luna 2022-ben összesen 14 ezer milliárd forint (kb...

MA 08:52

Az ausztrál tinik lázadnak: Túl kemény a közösségi média-tilalom?

👏 A közelgő ausztrál közösségi média-tilalom komoly hullámokat vetett, hiszen a kormány egyre komolyabb lépéseket tesz a fiatalok megóvása érdekében...

MA 08:43

A VS Code-ot rejtett trójaiakkal fertőző bővítmények terjednek

🐛 Egy ügyes kibertámadási kampány már február óta fertőzi a fejlesztőket, miután 19 rosszindulatú bővítmény jelent meg a VS Code Marketplace-en...

MA 08:37

A Runway áttörése: percekig tartó koherencia az MI-ben

🚀 A Runway bemutatta GWM-1 névre keresztelt, első világmodelljét, amely jelentős lépés a vállalat részéről, eddig ugyanis leginkább videógenerálásban jeleskedett...

MA 08:29

Az adatvédelmi rémálom: több mint 10 ezer Docker Hub-kép titkot szivárogtat

Több mint 10 000 Docker Hubon elérhető konténerképben találtak olyan érzékeny adatokat, amelyeknek sosem kellett volna nyilvánosságra kerülniük...

MA 08:23

A lenyűgöző anyag, amelyet szinte lehetetlen előállítani

💫 Ez a jelenség jól illusztrálható azzal, hogy Londonban, a Royal Brompton Kórházban korábban a tüdőszkennelés akár 45 percig is eltartott, ahol a pácienseknek mozdulatlanul, a fejük felett összekulcsolt kézzel kellett feküdniük...

MA 08:14

Az egész Föld összes háza végre 3D-ben látható

Tudósok elkészítették az első globális 3D-térképet az emberi lakóépületekről, amelynek neve World Settlement Footprint 3D...

MA 08:08

A Fortnite visszatért a Google Playre – az Apple még nem enged

Az Epic Games legendás battle royale-ját, a Fortnite-ot újra letölthetik az amerikai Android-felhasználók, miután bírósági döntés kötelezte a Google-t az alkalmazás visszaengedésére...

MA 08:02

Az Oracle nyakig eladósodik az MI‑őrületben

Az Oracle gyorsítja a kiadásait és bérleti szerződéseit, hogy lépést tartson az MI‑alapú felhőszolgáltatások iránti döbbenetes kereslettel...