Az MI még mindig naiv: nem tud különbséget tenni tény és vélemény között

Az MI még mindig naiv: nem tud különbséget tenni tény és vélemény között
A legújabb kutatások szerint a mai nagyméretű nyelvi modellek, mint a GPT-4o, még mindig komoly gondban vannak azzal, hogy megkülönböztessék a tényeket az emberi hiedelmektől – főleg, ha a hiedelem hamis. Ez jelentősen növeli a téves információk terjedésének kockázatát.

Hibás döntések a fontos területeken

A Stanford Egyetem kutatói 24 népszerű MI-modellt teszteltek, több mint 13 ezer kérdésre adott válaszaikat vizsgálva. Kiderült, hogy az újabb modellek – például a 2024 májusában megjelent GPT-4o – 34 százalékkal kevésbé ismerték fel a hamis hiedelmeket, mint a valósakat. A régebbi modelleknél ez az arány még rosszabb volt: ott 39 százalékos különbséget találtak. A modellek a tények felismerésében is eltérően teljesítettek: az újabbaknál 91 százalékos pontosságot mértek, a régebbieknél csak 72–85 százalék közöttit.

Felületes gondolkodásmód és veszélyes hiányosságok

A vizsgált modellek nem valódi tudásra vagy logikus helyzetfelismerésre támaszkodnak, inkább mintázatokat ismernek fel – ez könnyen félrevezetheti az embereket. Különösen olyan területeken, ahol a pontatlan MI-válasz emberi életeket, illetve jogi vagy tudományos eredményeket befolyásolhat.

Az MI mindenhol ott lesz, akkor is, ha hibázik

Idén világszerte közel 555 billió forintot (1,5 billió dollárt) költenek MI-fejlesztésre – jósolja a Gartner elemzőcég. Az MI nemcsak a telefonokban vagy autókban, hanem a kenyérpirítókban és a streaming-szolgáltatásokban is megjelenik. Az elterjedést egyelőre nem akadályozzák a hibák, pedig például az MI-alapú ügyfélszolgálatok erősen alulteljesítenek, és a titoktartás jelentőségét sem értik.

2025, adrienne, go.theregister.com alapján

Legfrissebb posztok

vasárnap 20:49

A bórax lehetett az élet születésének titkos kulcsa?

💧 A Föld 4,3 milliárd évvel ezelőtti állapotait vizsgálva egy új kutatás szerint ideálisak voltak a körülmények ahhoz, hogy természetes úton alakuljon ki az első információt hordozó molekula, az RNS, amelynek kialakulása az élet születésének kulcsfontosságú mérföldköve...

vasárnap 20:17

Az atomórák csúszása megbénította az időszolgáltatást

Egy ritka és különös eset borzolta fel a NIST, vagyis az Egyesült Államok Országos Szabványügyi és Technológiai Intézetének életét: egy áramszünet következtében összezavarodott az intézet boulderi atomóráinak időskálája, ezért egy munkatárs kétségbeesetten próbálta kikapcsolni a vésztartalék-generátorokat, amelyek továbbra is hibás időt szolgáltattak...

vasárnap 20:02

A láthatatlan alaszkai földrengések csendben jelzik a közelgő cunamit

🌊 Kezdetben pusztán egy újabb távoli veszélynek tűnt a Barry-gleccser fölötti hatalmas földcsuszamlás Alaszkában, de a kutatók közelről vizsgálják a térség rejtett földrengés jeleit...

vasárnap 19:51

Az Xbox kudarcsorozata és a Microsoft nagy irányváltása

💸 Ki gondolta volna, hogy az Xbox ennyire hatalmas lemaradásban lesz a konzolversenyben?..

vasárnap 19:33

Az ókori csatornák felfedik a római Britannia elhallgatott járványát

Érdemes megvizsgálni, milyen egészségügyi kihívásokkal szembesültek a római kori Britannia katonái...

vasárnap 19:18

Az SN 2022ngb, a szinte láthatatlan szupernóva rejtélye

💫 Egy nemzetközi kutatócsoport rendkívül halvány és lassan változó szupernóvát figyelt meg SN 2022ngb jelűként, amely a IIb típusba tartozik...

vasárnap 19:03

A The Sims 4 eddigi legjobb évét zárta

A The Sims 4 rajongói számára az utóbbi évek igazi hullámvasútnak bizonyultak: a kezdeti Építés és Vásárlás (Build and Buy), illetve Sim létrehozása (Create a Sim) módok ugyan szinte etalonná váltak a sorozat történetében, azonban a híres medencék és a kisgyermekek hiányoztak az alapjátékból...

vasárnap 18:49

A tehetség nem sprint, hanem maraton – rosszul gondolkodunk?

🏃 Felmerül a kérdés, vajon helyesen közelítettük-e meg a tehetséggondozást az elmúlt évtizedekben...

vasárnap 18:36

Az új robotporszívó csodát ígér, de csalódást okoz

A Narwal Freo Z10 Ultra egy olyan robotporszívó és felmosó, amely bőven tele van csúcstechnikával, és önálló működésre képes dokkolóval érkezik...

vasárnap 18:18

Az elefánt – az animáció történetének legőrültebb összefogása

Az animáció világában gyakran születnek különleges ötletek, de az Elefánt (Elephant) című, az HBO Maxon elérhető új rajzfilm rendhagyó alkotási folyamata és szürreális hangulata egészen új szintre emeli a kreativitást...

vasárnap 17:51

A láthatatlan univerzum a galaxisok torzulásaiból tárul fel

💫 A világegyetem 95 százaléka láthatatlan. Sötét anyag és sötét energia tölti ki a kozmosz nagy részét, amelyeknek valódi mibenlétét a tudomány máig nem ismeri, de hatásuk tagadhatatlan: a sötét anyag extra gravitációjával formálja a galaxisokat és galaxishalmazokat, míg a sötét energia a táguló világegyetem gyorsulásához kapcsolódik...

vasárnap 17:34

Az űrturizmus áttörése: felszáll az első kerekesszékes űrutazó

🚀 December 21-én hatalmas mérföldkőhöz érkezett az űrutazás, amikor Michaela Benthaus, egy német mérnök, kerekesszékes utazóként elsőként jutott el a világűrbe...

vasárnap 16:50

Az Nvidia-részvény tovább szárnyal: marad a Wall Street kedvence?

Az Nvidia továbbra is az MI-láz egyik legnagyobb nyertese, annak ellenére, hogy az utóbbi időben erősödő versennyel és geopolitikai kihívásokkal néz szembe...

vasárnap 16:02

Az univerzum szimulációja: egy matematikai áttörés mindent átír

A szimulációs hipotézis – az elképzelés, hogy világunk talán csak egy idegen civilizáció számítógépén futó szimuláció – régóta lázban tartja az embereket...

vasárnap 15:33

A klímaváltozás miatt hetekkel előbb szórja spóráit az északi moha

🌱 Régi katonai légmintákból váratlanul értékes DNS-lelőhely került elő, amely évtizedeken keresztül őrizte a levegőben szálló élőlények nyomait...

vasárnap 15:02

A MI-korszak rejtett buktatója: messze van az adat a döntéstől

🤔 Fontos kérdés, hogy mitől lesz valóban eredményes az MI bevezetése egy cég életében...

vasárnap 14:49

Az áttörés kapujában: már látszik a szobahőmérsékletű szupravezetés

⚡ Ebből következően érdemes megérteni, hogy a tudósok most átléptek egy olyan akadályt, amely éveken át megnehezítette a magas hőmérsékletű szupravezetők gyakorlati alkalmazását...

vasárnap 14:33

Az Apple és a Google figyelmeztet: gond lehet a vízumokkal

⚠ A Google és az Apple jogi képviselete arra figyelmeztette a vízummal foglalkoztatott alkalmazottakat, hogy egyelőre kerüljék a nemzetközi utazást, különösen, ha csak H-1B vízumbélyeggel térhetnének vissza az Egyesült Államokba...

vasárnap 14:20

Az óriási JBL Bar 1300 MK2 uralja a nappalit

🔊 A JBL az új Bar 1300MK2-vel ismét belevágott a házimozi-hangzás nagyágyúinak versenyébe, és sikerült is emelnie a tétet...