2025. 09. 25., 09:41

Még mindig gyengén teljesít az MI, ha tudományos cikkeket kell összefoglalni

Még mindig gyengén teljesít az MI, ha tudományos cikkeket kell összefoglalni
A tudományos újságírás egyik legnagyobb kihívása, hogy a bonyolult kutatási eredményeket közérthetően, mégis pontosan adja át a nagyközönség számára. Bár az utóbbi évek MI-fejlesztései, például a ChatGPT, ígéretes lehetőségeket kínálnak az ilyen összefoglalók készítésében, a valóságban ezek a rendszerek még messze elmaradnak az elvárható szinttől. Az Amerikai Tudományos Fejlesztési Szövetség (AAAS) ezért egy éven át vizsgálta, hogyan teljesít a ChatGPT a Science magazinban gyakran megjelenő tömörített hírszemlék írásában.

Emberi minőség kontra MI-megoldás

A kísérlet során 2023 decembere és 2024 decembere között hetente legfeljebb két, kifejezetten nehéz tudományos közleményt választottak ki, hogy azokat három, különböző részletességű MI-prompt segítségével foglaltassák össze a ChatGPT-vel. Ezek között voltak úttörő felfedezések, vitatott témák, technikai zsargonnal teli írások és embereken végzett kutatások is. A kivonatokat a szokásos, tapasztalt SciPak szerzők értékelték — kvantitatív és kvalitatív módszerekkel is.

Fontos szempont, hogy a mérések szerint az MI-vel készült összefoglalók gyakran feláldozták a pontosságot az egyszerűségért, és számos ténybeli hibát, valamint téves következtetést tartalmaztak. Bár a stílus néha hasonlított a szerkesztőségi írásokéhoz, a tartalom megbízhatósága messze elmaradt a kívánalmaktól. Ezzel szemben az emberi szerzők összefoglalói jóval kiegyensúlyozottabbak és alaposabbak voltak.

Az MI hiányosságai

A kísérlet során összesen 64 szakcikk rövid összefoglalóját hasonlították össze a szerkesztők. A leggyakoribb hibák közé tartozott, hogy a ChatGPT gyakran összekeverte az ok-okozati összefüggéseket a véletlenszerű egybeesésekkel, nem adott elég kontextust, vagy túlértékelte az eredmények jelentőségét — például túl gyakran nevezett valamit világviszonylatban újnak vagy áttörőnek. Ráadásul a tényszerű pontatlanságok javítása ugyanannyi, ha nem több emberi munkát igényelt, mint egy teljesen új összefoglaló megírása.

A pontszámok sem voltak meggyőzőek: átlagosan 2,26-ot és 2,14-et kaptak az 5 pontos skálán, ahol az 1 jelentette a teljesen alkalmatlant, míg az 5 a tökéletességet. Mindössze egy összefoglaló kapott maximális értékelést; ezzel szemben harmincszor is a legutolsó helyre sorolták az MI munkáit.

Még nincs MI-forradalom a tudományos újságírásban

Összességében kijelenthető, hogy a ChatGPT jelenlegi változatai nem érik el azt a szakmai színvonalat, amelyet akár egy szerkesztett SciPak hírszemlétől elvárnánk. Bár ígéretes segédeszközök lehetnek egyszerűbb feladatokhoz vagy vázlatíráshoz, tényleges szerkesztett tartalom létrehozásához a súlyos tényellenőrzési igény miatt továbbra is nélkülözhetetlen az emberi szakértelem. Az AAAS szakértői szerint csak akkor érdemes újra próbálkozni ezzel, ha a ChatGPT egy jelentős, minőségi frissítésen esik át.

2025, adminboss, arstechnica.com alapján

  • Te miért tartod fontosnak, hogy az információk pontosak legyenek?
  • Mit tennél, ha egy félrevezető összefoglalót olvasnál egy tudományos témáról?
  • Szerinted mikor lehet majd egy gép annyira megbízható, mint egy ember ilyen feladatban?


Legfrissebb posztok

MA 20:56

A gigászi Schrödinger-macska: minden eddiginél nagyobb kvantumállapot

🐈 A kvantumfizika egészen elképesztő kísérlettel bővült: Bécsben kutatóknak sikerült többezeres nátriumatom-klasztert úgy „megosztaniuk”, hogy ez a csoport egyszerre több helyen is tartózkodott – vagyis hatalmas szuperpozícióba került...

MA 20:37

A NAV lecsap a kriptóra – így jelentsd be!

Amikor megjelent a kriptovaluta, sokaknak tetszett az ötlet, hogy nincs mögötte kormány vagy jegybank...

MA 20:19

A legújabb Windows 11-frissítés kék halált hoz?

💻 A Microsoft vizsgálja, miért omlanak össze egyes Windows 11-es gépek a januári biztonsági frissítés telepítése után...

MA 20:01

A mindennapi apróságokkal éveket nyerhetsz az életedhez

Valóban szükség van radikális diétára, napi több óra edzésre és végeláthatatlan zöldségzabálásra, hogy tovább éljünk?..

MA 19:55

Az amerikai Délnyugatot meghódító ősi vadburgonya

Több mint tízezer évvel ezelőtt az amerikai Délnyugat lakói egy kis vadburgonyát, a Four Corners-burgonyát (Four Corners potato, Solanum jamesii) vitték magukkal hosszú vándorlásaik során...

MA 19:38

Az AmpereOne-t is megizzasztó Dynatron W23 hűtő nagytesztje

Míg az Ampere Altra Max processzorhoz számos hűtőopció létezett, az új AmpereOne-hoz már jóval kevesebb az elérhető megoldás...

MA 19:19

Az orosz hackerek új vírusától rettegett a lengyel energiahálózat

⚠ Lengyelország elektromos hálózatát tavaly év végén eddig ismeretlen törlővírus támadta meg, amely valószínűleg orosz állami hackerekhez köthető...

MA 18:57

Az ausztrál emlősök végzete: kóbor macskák és rókák?

🐱 Ausztrália emlősfaunája a világon egyedülálló: a hosszú elszigeteltség olyan fajokat eredményezett, mint a kacsacsőrű emlős, a koala vagy a vombat...

MA 18:37

Az Outlook megint lefagy – a Microsoft villámgyorsan lépett

💥 A Microsoft villámgyors, rendkívüli frissítéseket adott ki szombaton Windows 10, Windows 11 és Windows Server rendszerekhez, miután sokaknál egyszerűen nem indult el a klasszikus Outlook, ha a PST-fájlokat felhőben tárolták, például a OneDrive-on vagy a Dropboxon...

MA 18:20

Az Edison-izzó és a grafén véletlen születésének titkos története

A grafén a jelenleg ismert legvékonyabb anyag: egyrétegű szénatomokból épül fel, hatszögletű rácsban...

MA 18:02

Az a telefon, amelyért Amerika könyörögne: Fairphone 6

Az amerikai okostelefon-piacot szinte teljes egészében az Apple és a Samsung uralja...

MA 17:55

Kitört az e-bike-háború New Jerseyben

New Jersey-ben mostantól minden elektromos kerékpár-tulajdonos a legszigorúbb szabályozással szembesül. Legyen szó akár egy 20 km/h-s, pedálrásegítéses kerékpárról vagy egy motorkerékpár-teljesítményű e-bike-ról, mindenkire ugyanazok a szigorú előírások vonatkoznak: kötelező a regisztráció, a jogosítvány és a biztosítás...

MA 17:37

Az adatvédelem vége? A Microsoft kiadta a titkosítási kulcsokat

Az FBI tavaly bírósági végzéssel kérte a Microsofttól, hogy adja át három laptop titkosítási kulcsait egy olyan csalási ügy vizsgálata miatt, amely a Guam szigetén folyósított COVID–19-munkanélküli-támogatásokat érintette...

MA 17:20

Az MI-óriások davosi összecsapása: egymásnak estek a csúcson

Davos idén alaposan átalakult: a Világgazdasági Fórum korábbi, komoly hangvételű tanácskozását techcégek színesítették meg az MI-forradalom jegyében...

MA 17:02

A mesterséges intelligencia terjed az iskolákban – megéri az árát?

Az MI térhódítása az oktatásban komoly aggodalmakat kelt világszerte. Egy friss, 50 országot és több mint 500 tanárt, diákot, szülőt, oktatási vezetőt és szakértőt bevonó, egy évig tartó globális kutatás eredményei szerint az MI alkalmazásának kockázatai jelenleg felülmúlják az esetleges előnyöket...

MA 16:55

Az aszály soha nem látott ütemben feszíti szét Kelet-Afrikát

Kelet-Afrika éghajlata az elmúlt 5 000 évben jelentősen kiszáradt, és ez a változás arra utal, hogy a kontinens a vártnál gyorsabban szakad szét...

MA 16:37

Vége az ingyenes WhatsAppnak? Jön a fizetős reklámmentesség

💳 Sokan egyetértenek abban, hogy a hirdetések idegesítőek, és a WhatsApp sem kerülte el ezt a sorsot...

MA 16:02

Kudarcot vallott az orosz kibertámadás a lengyel áramhálózat ellen

⚡ Lengyelország villamosenergia-hálózata elleni kibertámadást hiúsítottak meg 2025. december végén. A támadás mögött az orosz állam által támogatott, hírhedt Sandworm nevű hackercsoport állt, amely egy új, pusztító törlővírust, a DynoWipert próbálta bevetni...

MA 15:56

A Sparkli MI-alkalmazás játékosan turbózza fel a gyerekek tanulását

Nemrég komoly figyelmet kapott a Sparkli nevű, MI-alapú oktatási alkalmazás, amelynek három egykori Google-alkalmazott áll a hátterében...

MA 15:38

Az optikai tranzisztorok feltámaszthatják a Moore-törvényt

💡 Neurophos, a texasi MI-chipcég új mércét akar állítani a szuperszámítástechnikában azzal, hogy optikai processzorokat fejleszt, amelyek teljesítménye többszöröse a mai legmodernebb grafikus kártyák teljesítményének – mindezt jóval kisebb energiafelhasználás mellett...

MA 15:19

Az észak-koreai hackerek MI-vel vadásznak a blokklánc-fejlesztőkre

Az észak-koreai Konni (Opal Sleet, TA406) hackercsoport MI által generált, erősen titkosított PowerShell-kártevővel célozza meg a blokklánc-szektor mérnökeit és fejlesztőit...

MA 15:02

Miért nem hódította meg a QD‑OLED már minden nappalit?

Az OLED-technológia az utóbbi években teljesen átalakította a tévépiacot. Az önállóan világító OLED-pixeleknek köszönhetően tökéletes feketét, élénk színeket és erős kontrasztot kapunk...

MA 14:40

A vegán házhozszállítás titkos receptje: 2026 legjobbjai

Vegánként vagy növényi étrendet követőként óriási kihívást jelenthet ízletes, változatos és egészséges készételeket vagy főzős csomagokat találni...

MA 14:19

Az új génkincs lehet a szója túlélésének kulcsa

🥑 A világ szójatermelőit csendes, de komoly ellenség tizedeli: a szója-cisztaképző fonálféreg, amely a gyökereket támadva rontja a terméshozamot, évente komoly veszteséget okozva a gazdáknak...

MA 14:01

A Gmail spamszűrője bedőlt: elárasztanak a promóciók

Az elmúlt napokban jelentősen megnőtt a promóciós e-mailek száma a Gmail-felhasználók beérkező levelei között...

MA 13:55

Tényleg veszélyesek a gyerekekre az önvezető taxik?

Austinban ismét botrányt kavartak a Waymo önvezető autói: a robotaxik többször szabálytalanul előzték meg a diákokat szállító iskolabuszokat...

MA 13:37

Az agyevő amőbák: a következő globális rémálom

Világszerte egyre nagyobb aggodalmat keltenek a szabadon élő amőbák, amelyek a kutatók szerint egyre komolyabb egészségügyi kockázatot jelentenek...

MA 13:20

Az MI-óriás, amelyik még az igazán nagy áttörés előtt áll

🤖 Felmerül a kérdés, hogy kinek érdemes most a technológiai tőzsdéken kutakodnia, amikor a kvantumszámítógépek és a mesterséges intelligencia versenye kiélezettebb, mint valaha...

MA 12:55

A szenzáció: az első európai őselefántcsont-szerszám

🔨 Egy körülbelül 480 ezer éves, háromszögletű eszközre bukkantak az Egyesült Királyság területén, amelyet egy ismeretlen archaikus emberfajta őselefánt csontjából készített...