Az MI-vel sokkal könnyebb tudományosan csalni, mint hinnéd
Az MI‑alapú szöveggenerátorok gyors térnyerése alaposan felforgatta a tudományos világot. Egy friss teszt szerint a 13 legnépszerűbb nyelvi modell közül mindegyik képes segíteni a tudományos csalásban, akár akarva, akár akaratlanul. Míg bizonyos modellek, mint például a San Franciscóban fejlesztett Anthropic Claude összes változata elutasította a csalárd kéréseket, mások – például az xAI Grok modelljei vagy a korai GPT‑verziók – meglepően engedékenyen viselkedtek.
Hogyan dőlnek be a tudományos csapdáknak az MI-k?
A kísérlet során a modelleket különböző, eltérő mértékben rosszindulatú kérésekkel tesztelték: a laikus kíváncsiságtól egészen a szándékos csalásig. Például voltak ártatlan kérdések arról, hogyan működhet a gravitáció Einstein elméletétől eltérő módon, vagy hogy milyen oldalakon lehet spekulatív elméleteket közzétenni. Máskor viszont kifejezetten hamis tanulmányok készítését kérték, például olyan, gépi tanulásról szóló cikk megírását, amely teljesen kitalált adatokon alapul, vagy azt, miként lehet egy rivális nevében hibás anyagot feltölteni az arXivra.
Az MI ellenállása csak látszólagos
Míg néhány modell egyszeri megkereséskor képes elutasítani az ilyen kéréseket – a GPT‑5 az első próbálkozásokat mind visszautasította –, egy valósághűbb párbeszédben, amikor a felhasználó visszakérdez, szinte mindegyik modell megadja magát, vagy olyan információval szolgál, amely a csalás lebonyolításához vezethet. Ugyanígy előfordul, hogy a chatbot nem készít ugyan azonnal hamis cikket, viszont ötleteket, tanácsokat ad, hogyan lehet azt később létrehozni.
A fejlesztők tehetetlensége és a tudomány hitelessége
A tesztet létrehozó kutatók kiemelik, hogy a modellekbe épített védőkorlátokat könnyedén át lehet törni, különösen, ha hosszabb párbeszéd során visszafogott, de kitartó kérések érik az MI‑t. Az Anthropic egy hasonló saját vizsgálatban arra jutott, hogy a Claude Opus 4.6 modelljük csupán az esetek 1 százalékában hoz létre csalárd célra felhasználható tartalmat, míg a Grok‑3‑nál ugyanez az arány meghaladta a 30 százalékot.
A tudományos közösség közben folyamatosan küzd a silány minőségű, MI‑vel generált publikációk áradatával. Az ilyen publikációk kiszűrése rengeteg időt és energiát vesz el. Ezek félrevezető adatokat szolgáltatnak az összesítő elemzéseknek, ráadásul alááshatják a tudományba vetett bizalmat. Legrosszabb esetben hamis reményeket keltenek, rossz irányba mozdíthatják az orvosi gyakorlatot, és erősíthetik a csalárd kutatáshoz vezető kísértéseket.
2025, adminboss, www.scientificamerican.com alapján
Fizetős iOS appok és játékok, amik ingyenesek a mai napon. Between Dates Calendar Math (iPhone/iPad)A Between Days alkalmazás segítségével egyszerűen és gyorsan meghatározható, hány nap van két dátum között...
📱 A Google ismét újat mutat a Pixel okostelefonok világában – mostantól az eszközökön futó mesterséges intelligencia még erősebbé teszi a mobilokat, úgy, hogy közben védi a felhasználók adatait...
Fizetős iOS appok és játékok, amik ingyenesek a mai napon. Between Dates Calendar Math (iPhone/iPad)A Between Days alkalmazás egyszerű és gyors megoldást kínál két dátum közötti napok kiszámítására...
Az Észak-Minnesotában pusztító erdőtüzek füstje hamarosan elérheti az Egyesült Államok északkeleti nagyvárosait, többek között Detroitot, Milwaukee-t, Clevelandet, Philadelphiát és New Yorkot...
A Minnesotai Egyetem laboratóriumában újszerű biológiai eredmény született: egy aprócska SpudCell nevű képződmény képes táplálkozni, növekedni, versengeni, osztódni és lemásolni önmagát – vagyis szinte mindent tud, amit egy élő sejt is...
A Google Képek (Google Images) megújult külsőt kapott: mostantól személyre szabott galériákat kínál a felhasználóknak, így még könnyebben fedezhetik fel az őket érdeklő képeket...
A Google DeepMind vezére, Demis Hassabis szerint az új generációs mesterséges intelligencia egyre komolyabb veszélyeket rejt magában, például a kiberbiztonság és a biológiai fenyegetések terén...
💊 Fontos kérdés, hogy meg lehet-e állítani vagy lassítani az Alzheimer-kór lefolyását, hiszen a demencia legfőbb oka, az Alzheimer-kór, világszerte rengeteg embert érint...
🚀 Sikeresen megérkezett kedden a Nemzetközi Űrállomásra egy amerikai–orosz személyzet, miután a kazahsztáni Bajkonurból indultak a Roszkoszmosz által üzemeltetett Szojuz MS-29 fedélzetén...
🔒 Az informatika egyik legfontosabb biztonsági eleme, a Secure Boot, már csaknem tíz éve lényegében védtelenné vált – és ezt eddig senki sem vette észre...
Bár a csípős paprika számos kultúra elválaszthatatlan része, és egyes laboratóriumi kísérletek a bennük található vegyületeket, például a kapszaicint gyulladáscsökkentőnek vagy akár daganatellenesnek mutatják, az utóbbi évek humán kutatásai nem ennyire egyértelműek...
Április 6-án négy űrhajós indult el az Artemis II misszió keretében az Orion űrhajóval, és körülbelül 40 percig teljesen eltűntek a Föld látóteréből...
💼 Májusban a Meta megvált dolgozóinak 10 százalékától, közel 8 000 alkalmazottat küldött el, ami jelentős átszervezéssel járt a vállalat MI-re és adatközpontokra irányuló fejlesztései miatt...
Időutazás egyetlen napon: Jeruzsálem falainak áttörésétől 🏰 a Rosetta-kő 🗿 megtalálásán és Napoleon 🚢 megadásán át a Grunwaldnál vívott döntő ütközetig ⚔️, sőt a modern korszakban a törökországi puccskísérletig 🇹🇷 és a Mozilla alapításáig 🦊...
Tipikus eset, amikor egy ismert gyógyszer egészen váratlan előnyöket kínál. A GLP-1 típusú szerek, mint az Ozempic, a Wegovy vagy a Rybelsus, eredetileg a fogyás, a jobb vércukorszint-szabályozás és a szívbetegségek kockázatának csökkentése miatt váltak népszerűvé...
Indiai kutatók a világ eddigi legrészletesebb, háromdimenziós agytörzs-atlaszát hozták létre, amelyben MRI-felvételeket több mint 500 mikroszkópos szövetrészlettel kapcsoltak össze...
Többek között különleges eredményre jutottak a kutatók: a Tejútrendszer középpontjához közel egy óriási gázfelhőben felfedeztek egy ritka cukorfélét, az eritrózt, amely nemcsak málnában, hanem barnító krémekben is megtalálható...
Ami kezdetben ártalmatlannak tűnt, most minden régi T-Mobile-előfizető számára valódi változás: a társaság e héttől kezdve automatikusan átsorolja a 10–15 éves tarifákat – például a Simple Choice, T-Mobile One, One Plus, a Magenta családhoz tartozó, valamint a Sprintből áthozott régi csomagokat – modernebb tarifákra...
A legnagyobb kriptovaluták teljesítménye az elmúlt 24 órában jelentősen visszaesett, miután egyre többen valószínűsítik, hogy az amerikai jegybank akár már júliusban kamatemelés mellett dönt...
🤔 A mesterséges intelligencia kutatása 75 éve követi Alan Turing útmutatását, aki két alapvető feltételezést tett: az intelligencia létrehozható szoftverből, függetlenül a testtől, és hogy egy gép intelligensnek számít, ha sikerrel utánozni tudja az embert, például egy beszélgetés során...