2026. 01. 14., 10:52

A mesterséges intelligencia pontossága ugrásszerűen nő egy egyszerű trükkel

A mesterséges intelligencia pontossága ugrásszerűen nő egy egyszerű trükkel
Az MI-modellek világában az utóbbi évek az egyre bonyolultabb kérdésfeltevési módszerek fejlesztésével teltek, hogy minél pontosabb válaszokat kapjunk. A mérnökök kidolgozták már a „gondolkodj lépésről lépésre” jellegű technikákat, az emocionális motiválást, sőt bonyolult többlépéses promptolási keretrendszereket is. Most mégis úgy néz ki, túl lett gondolva a dolog. A Google Research kutatása szerint egy egészen egyszerű megoldással akár 76%-kal is növelhető az LLM-modellek pontossága olyan feladatoknál, amelyek nem igényelnek bonyolult érvelést: egyszerűen el kell ismételni a kérdést.

Miért működik a kérdésismétlés?

A Transformer architektúra, amely a legtöbb modern MI-alapú nyelvi modellt működteti, „kauzális” nyelvi modellezéssel dolgozik. Ez azt jelenti, hogy a modell a szöveget balról jobbra olvassa: amikor az ötödik szót dolgozza fel, csak az első négyet képes figyelembe venni, a hatodikat még „nem látta”. Emiatt az információ sorrendje és elrendezése kulcsfontosságú. Gyakran előfordul, hogy ha előbb van a kontextus, mint a kérdés, vagy fordítva, teljesen más választ ad a rendszer.
Nem hagyható figyelmen kívül, hogy a kérdés megismétlése megkerüli ezt a korlátozást: miközben a modell másodszor fut neki ugyanannak a kérdésnek, addigra már „emlékszik” a szöveg legelső változatára is, így egyszerre tud visszautalni a már feldolgozott részletekre – és ezáltal szignifikánsan jobb válaszokat ad.

Lenyűgöző eredmények: 47-ből 47 siker

A kutatásban hét különböző elismert MI-tesztkészlettel és hét különböző modellel (köztük Gemini, GPT-4o, Claude, DeepSeek V3) vizsgálták a technikát. Azokban a feladatokban, ahol a modellt csak rövid, egyértelmű válaszadásra kérték, az ismétléses prompt 70 összehasonlított esetből 47-szer hozott érdemi előrelépést, és egyetlen esetben sem rontott.

A leglátványosabb előrelépés a „NameIndex” teszten volt. Itt 50 névből kellett kiválasztani a 25.-et. A Gemini 2.0 Flash-Lite alapból csupán 21,33% pontossággal találta el a helyes nevet, ám ha a kérdést kétszer egymás után kapta meg, a pontosság döbbenetes 97,33%-ra ugrott.

Továbbá más modelleknél – például a Claude és a GPT-4o esetében – is mérhetően nőtt a pontosság. Bizonyos jelek arra utalnak, hogy a „kauzális vakság” miatt az első menetben elveszítheti a modell a fonalat, különösen hosszabb listák vagy részletes adatok esetén. Amikor azonban megismétlődik a kérdés, az MI jobban „fel tudja dolgozni” az egész szövegrészt.

Gyorsabb, de legalábbis nem lassabb

Az MI-modellek működése két fő szakaszból áll: előfeldolgozás (a bemenet feldolgozása), amit a GPU párhuzamosan tud végezni, és a válasz generálása, amely már tokenenként halad, lassabban. Sokan joggal gondolhatnák, hogy a kérdés megkettőzése lassabb válaszadáshoz vezet – de éppen ellenkezőleg! Az előfeldolgozás annyira hatékonyan párhuzamosítható, hogy a felhasználó szinte semmit sem érzékel a válaszidőből.
A kutatók azt találták, hogy a kérdésismétlés sem a válasz hosszát, sem a válasz első betűjéig eltelt időt nem növelte, kivéve néhány szélsőségesen nagy lekérdezés esetén az Anthropic-modelljeknél. Az esetek túlnyomó többségében viszont úgy érhető el nagyobb hatékonyság, hogy a felhasználó nem fizet érte kényelmi veszteséggel.


Mikor nem érdemes ismételni?

Fontos, hogy a módszer főként nem érvelő jellegű feladatokra alkalmas: tehát ahol ténylegesen csak egy tömör, informatív választ várunk. Amint bejön a képbe a „lépésről lépésre gondolkodás” (mint pl. egy számolási vagy problémamegoldó folyamat), az ismétlés pozitív hatása elenyésző vagy semleges lesz.

Úgy tűnik, az MI ilyenkor maga is megismétli magában a lényegi kérdést, mielőtt megoldja – így a prompt ismétlése felesleges. Azonban azokban az esetekben, ahol tömör, egyértelmű választ és gyorsaságot akarunk, az ismétlés kiugró előnyt jelenthet.

Mit jelent ez a cégek számára?

A vállalati MI-alkalmazások fejlesztőinek igazi „ingyenebédet” jelenthet az egyszerű, promptalapú optimalizáció, de érdemes okosan integrálni. Vagyis nem mindenhol érdemes automatikusan duplázni, hanem inkább a szimpla kinyerési, osztályozási vagy kérdés–válasz feladatoknál.
Mostantól, mielőtt egy nagyobb, drágább modellre váltanának csak azért, hogy javuljon a pontosság, érdemes inkább kipróbálni az egyszerű kérdésismétlést – akár 21,33%-ról 97,33%-ra ugorhat a találati arány, miközben a gyors, olcsó infrastruktúrát tudják tovább használni.

Az is logikus lépés, hogy ezt a prompt megkettőzését már az infrastruktúra szintjén, automatikusan, „láthatatlanul” oldják meg, így a végfelhasználónak és fejlesztőnek semmilyen plusz lépést sem kell tennie. Az alkalmazást menedzselő köztes réteg – API-átjáró, orchestráció – felelhet az automatizálásért. Ily módon optimalizálható a teljes rendszer, anélkül, hogy bármilyen plusz költséggel vagy lassulással kellene számolni.

Továbbá felmerül a biztonsági kérdés is: ha a kérdésismétlés tisztább üzenetet közvetít a modellnek, akkor a rosszindulatú promptok is „érthetőbbé” válhatnak. A biztonsági csapatoknak így a tesztelési protokollokat is frissíteni kell, például az ismétléses injekciós (repeat injection) támadásokkal. Ugyanakkor védelmi céllal is jó lehet ismételni – például a biztonsági előírásokat kétszer is ki lehet írni a rendszerprompt elejére.

Miért fontos mindez?

Nem hagyható figyelmen kívül, hogy a mostani MI-modellek még mindig szorosan a balról jobbra feldolgozás korlátozásai között mozognak. Amíg nem jönnek el a kauzális vakságot áthidaló új architektúrák, addig a kérdésismétlés egyszerű, de már most alkalmazható, és kiváló eredményt hozó trükk.
Lehet, hogy a jövő MI-motorjai maguktól is automatikusan megismétlik majd a kérdéseinket a háttérben – de amíg ez nem történik meg, előfordulhat, hogy a hosszú promptok finomhangolása helyett bőven elég, ha egyszerűen kétszer kérdezzük meg ugyanazt.

2025, adminboss, venturebeat.com alapján

  • Te szerinted etikus, ha egy cég automatikusan megduplázza a felhasználó kérdését anélkül, hogy azt előre jelezné?
  • Te hogyan védenéd a rendszert, ha a kérdésismétlés sérülékenységeket is okozhat?


Legfrissebb posztok

kedd 18:02

Az Amazon felhőjét dróntámadások bénították: leálltak az adatközpontok

Három Amazon Web Services (AWS) adatközpont az Egyesült Arab Emírségekben és egy Bahreinben súlyos dróntámadások következtében károsodott, ami komoly leállást okozott, és jelenleg is több tucat felhőszolgáltatás meghibásodásához vezet...

kedd 17:59

Az olcsó PC-k korszakának vége

💻 Érdekes felvetés, miszerint néhány éven belül eltűnhetnek az igazán olcsó, 180 ezer forint alatti számítógépek a boltok polcairól...

kedd 17:21

Az új trükk, amivel kártevőt csempésznek a Microsoft-fiókodba

🔒 Az elmúlt hetekben több kormányzati és közszférabeli szervezetet is célba vettek olyan adathalász támadók, akik a Microsoft OAuth jogosultságkezelő rendszerének egy hivatalos funkcióját használják ki, hogy káros programokat telepítsenek a gyanútlan áldozatok gépére...

kedd 16:40

A rejtőzködés vége: a pszeudonimitás eltűnhet az interneten

Ahogy az MI egyre kifinomultabbá válik, a rejtőzködő felhasználók titkolózása is veszélybe kerül...

kedd 16:23

Az új kibertámadások kora: a Cloudflare 2026-os fenyegetettségi jelentése

A kibertámadások univerzuma sosem volt ennyire sokszínű és veszélyes, mint most: államilag támogatott hackercsoportok, brutális mértékű DDoS-támadások, deepfake csalók, akik akár állásinterjúra is jelentkezhetnek, és még a Google Naptár, a Dropbox vagy a GitHub is lehet egy támadás eszköze...

kedd 14:01

Az El Niño visszatérhet 2026-ban? Mutatjuk, mire készülhetünk

☀ Két év telt el azóta, hogy az El Niño éghajlati mintázat felforgatta a világ időjárását...

kedd 13:59

Az OpenAI gátat szab az amerikai tömeges megfigyelésnek

Érdekes felvetés, hogy az OpenAI újabb módosításokat vezet be a védelmi minisztériummal kötött megállapodásában, hogy egyértelműen tiltsa MI-rendszereinek tömeges amerikai megfigyelésre való használatát...

kedd 13:39

Az év űrjáték-botránya: adatlopás a Star Citizen fejlesztőinél

🚀 Ez a jelenség jól illusztrálható azzal, hogy a Star Citizen mögött álló Cloud Imperium Games fejlesztőcéget januárban kibertámadás érte, amelynek során ismeretlen támadók hozzáfértek több felhasználó személyes adataihoz...

kedd 13:20

Az esés, amitől még a Bitcoin is pánikol – olajszag a levegőben

🚨 Bonyolódik a helyzet a tőzsdéken, ahogy a konfliktus a Közel-Keleten már a negyedik napjába lépett – és ezt bizony mindenki megérzi, aki szeret kockáztatni...

kedd 12:01

Az Android villámgyorsan lép: életmentő javítás a Qualcomm-hibára

⚡ Nem unatkozott mostanában az Android csapata: 129 biztonsági rést kellett befoltoznia, köztük egy nulladik napi hibát, amelyet támadók már aktívan kihasználnak, és amely a Qualcomm kijelzőchipjeit érinti...

kedd 11:58

Az MI-költségek után végre jön a profit?

📈 A Stripe újításával az MI-t használó startupok könnyedén kiszámíthatják és átháríthatják a valódi működési költségeiket az ügyfeleikre...

kedd 11:40

Az OpenAI-vezér elismeri: kapkodva született a védelmi szerződés

📖 Rövid időn belül komoly hullámokat vert az OpenAI legújabb szerződése az Egyesült Államok Védelmi Minisztériumával, miután Sam Altman vezérigazgató teljes nyilvánosság előtt elismerte: hiba volt elsietni a megállapodást...

kedd 10:46

Az amerikai hadsereg után jön a nagy ChatGPT-törlés

Az OpenAI ChatGPT mobilappjának amerikai letöltései drasztikusan visszaestek, miután bejelentették a cég együttműködését a Védelmi Minisztériummal (DoD), amelyet Trump új adminisztrációja idején át is neveztek...

kedd 10:37

A Perseverance, amely tudja, hol van: így lett önálló

🚀 A Mars felszínén nincs GPS, és más navigációs műholdak sincsenek, mégis szükség van arra, hogy az ott dolgozó járművek önállóan, pontosan tudják a pozíciójukat...

kedd 10:19

A Core Scientific dobja a bitcoint, hogy az MI-re váltson

💸 Januárban a Core Scientific közel 54 milliárd forintért, vagyis nagyjából 175 millió dollárért adott el 1 900 bitcoint, a darabonkénti átlagár pedig 92 100 dollár körül alakult...

kedd 09:55

A Claude mostantól emlékszik rád – ráadásul teljesen ingyen!

😀 Naná, hogy a chatbotvilág is egyre menőbb, főleg amikor az ingyenes funkciók zsebre vághatók!..

kedd 09:46

Az új Call of Duty: berobban a Black Ops Royale

Képzeld el, ahogy száz játékos zúdul le egy gigantikus pályára – ez lesz a Black Ops Royale, amely március 13-án robban be a Call of Duty életébe, ráadásul teljesen ingyen!..

kedd 09:37

Az új iPad Air: erősebb belül, változatlan kívül

Az Apple új iPad Air modellje alig különbözik az elődjétől, de a megszokott forma mögött komoly memóriafrissítés rejtőzik...

kedd 09:29

Az ókori görög jósnők bódító extázisa: mit rejtenek a füstök?

🔮 Az évezredekkel ezelőtt kialakult Eleusziszi Misztériumok szertartásai Görögország-szerte híresek voltak titokzatosságukról és különös erejükről...

kedd 09:10

Az igazi Little Foot arca: így festett 3,7 millió éve

🖖 Végre fény derült arra, hogyan nézhetett ki a valaha talált egyik legősibb emberelőd, Little Foot...

kedd 09:01

Az Apple új MI-ját tényleg a Google szerverei hajtják?

Az Apple meghatározó lépésre készül a Siri fejlesztésében: nemcsak a Google Gemini MI-modelljeit tervezi használni, hanem felmerült, hogy a Google szerverei is részt vehetnek az új generációs, MI-alapú személyes asszisztens háttérfolyamataiban...

kedd 08:56

Az USA legnagyobb internetszolgáltatója lehet a Charter: felvásárolná a Coxot

A Charter Communications, a Spectrum márka mögött álló vállalat, engedélyt kapott az amerikai hírközlési hatóságtól (FCC), hogy felvásárolja a Coxot, ezzel megelőzheti a Comcastet, és a legnagyobb lakossági internetszolgáltatóvá válhat az Egyesült Államokban...

kedd 08:46

A floridai Microsoft-licencmaffia lebukott

👑 Egy 52 éves floridai nő, Heidi Richards közel két év, pontosan 22 hónap börtönbüntetést kapott, miután bizonyítottan évekig illegálisan árusított Microsoft Certificate of Authenticity (COA) címkéket világszerte...

kedd 08:28

Az Atacama rejtélye: láthatatlan élet virágzik a Föld legszárazabb sivatagában

🌎 Parányi férgek rejtett birodalmára bukkantak a Föld egyik legextrémebb, legszárazabb térségében, a chilei Atacama-sivatagban...

kedd 08:19

Az új Mastodon-gomb kihúz a megosztási mocsárból

Mostantól pofonegyszerűen lehet megosztani bármely weboldal tartalmát Mastodonon: megérkezett ugyanis a platform univerzális Share to Mastodon gombja...

kedd 08:01

Az HBO Max és a Paramount+ összeköltözik – bírjuk a sorozatdömpinget?

Közben az is tény, hogy az HBO Max és a Paramount+ valóban egyetlen gigantikus streaming-szolgáltatássá olvadnak össze, amellyel rögtön 200 millió előfizetőt kezelnek majd világszerte...

kedd 07:56

A rendőrök bakija: véletlenül elúszik a lefoglalt kriptovagyon

Nemrég Dél-Koreában a rendőrség nagy sikerként jelentette be, hogy 124 vagyonos adóelkerülőtől összesen 5,6 millió dollárnyi, azaz kb...

kedd 07:46

A NEAR szárnyal, titokzatos tranzakciók borzolják a kedélyeket

🚀 A NEAR token lendületes, 17 százalékos emelkedést mutatott, tovább erősítve közel 40 százalékos heti nyereségét, miután elindította a Confidential Intents nevű új, privát végrehajtási réteget...

kedd 07:37

A net új királya: a Charter bekebelezi a Coxot – olcsóbb lesz?

Az USA internetes játszóterén eddig a Comcast volt a főnök, de most villámgyorsan színre lépett a Charter, amely rövid úton megkapta a Szövetségi Kommunikációs Bizottság (FCC) engedélyét, hogy felvásárolja a Coxot, így hamarosan a legnagyobb internetszolgáltatóvá válik az országban...