2026. 02. 01., 13:04

Az MI-keresők csődöt mondanak: csak feldarabolják a technikai dokumentumokat

Az MI-keresők csődöt mondanak: csak feldarabolják a technikai dokumentumokat
Fontos kérdés, hogy miért működnek annyira rosszul a vállalati MI-alapú keresők a bonyolult technikai dokumentumokkal, miközben elsőre azt ígérik, hogy bármilyen PDF vagy kézikönyv tartalmát percek alatt feldolgozzák. A mérnöki területeken dolgozók gyakran tapasztalják, hogy az MI-alapú chatbot nem pontos válaszokat ad, inkább csak találgat, amikor összetett infrastruktúrakérdéseket tesznek fel neki.

Felületes feldolgozás: a „lapos szöveg” csapdája

A legtöbb MI-alapú kereső és RAG (retrieval-augmented generation) rendszer jelenleg úgy dolgozza fel a dokumentumokat, hogy egyszerűen szövegként kezeli őket, és 500 karakterenként szétvágja a tartalmat. Ez a módszer viszonylag jól működik regények vagy egyszerű szövegek esetén, de tönkreteszi a műszaki kézikönyvek logikai szerkezetét: félbevágja a táblázatokat, elszakítja a képek aláírását az illusztrációtól, és teljesen figyelmen kívül hagyja az oldal vizuális hierarchiáját. A hozzáférhető tudás így széttöredezik, és a keresőmotorok képtelenek összerakni a fontos összefüggéseket.

A „szeletelés” helyett szemantikus feldarabolás

Továbbra is a legnagyobb kihívás, hogy a feldolgozott dokumentum szerkezetét is értse az MI – ebben segít az úgynevezett szemantikus feldarabolás. Ilyenkor a rendszer már nem pusztán tokenek vagy karakterek alapján darabol, hanem a tényleges tartalmi egységeket – fejezeteket, szakaszokat, bekezdéseket – azonosítja, például az Azure Document Intelligence segítségével. Így például egy táblázat vagy egy egész alkatrészt bemutató blokk egy egységként kerül be az MI memóriájába, így nem vész el a jelentéstartalom. Belső tesztekben a szemantikus módszer jelentősen javította az adatok visszakeresésének pontosságát.

Az elveszett vizuális tudás: sémák, ábrák, diagramok

Idővel kiderült, hogy a vállalatokon belüli tudás jelentős része nem a szövegben, hanem diagramokban és ábrákban rejlik. A legtöbb hagyományos beágyazómodell képtelen értelmezni ezeket az információkat, így azok egyszerűen kimaradnak az indexelésből. Ezért gyakran fordul elő, hogy ha a válasz egy folyamatábrában lenne megtalálható, az MI csak annyit mond, hogy nem tudja a választ.


Multimodális szövegesítés: ábrák kereshetővé tétele

A megoldást a multimodális szövegesítés hozza: még a képek – például PNG-fájlok – adatbázisba kerülése előtt a rendszer látásalapú modelleket (például GPT-4o) vet be, hogy a képeken lévő szövegeket optikai karakterfelismeréssel (OCR) azonosítsa, a diagramok tartalmát pedig részletes, természetes nyelvű leírással egészítse ki. Ezeket az újonnan generált leírásokat metaadatként kapcsolja az eredeti kép mellé, így kereshetővé válik minden folyamatábra, még ha azt eredetileg csak képként tárolták is.

Bizalomépítés: Ellenőrizhető válaszok

A vállalati környezetben azonban önmagában a válaszadás nem elegendő: fontos a hitelesség és az átláthatóság. Míg korábban a rendszer csak szöveges választ és egy fájlnevet adott, mostantól a rendszer a feldolgozás során megőrzi a kapcsolatot a szöveges egység és az azt tartalmazó kép vagy táblázat között, amit így a válasz mellett a felhasználó is azonnal láthatja. Ez a „mutasd a bizonyítékot” funkció nagyban növeli az MI-be vetett bizalmat.

A jövő: natív multimodális keresés és hosszabb kontextusablak

Továbbra is gyorsan fejlődik a technológia: hamarosan a natív multimodális beágyazás (pl. Cohere Embed 4) lehetővé teszi, hogy a szöveg és kép közötti határ teljesen elmosódjon, és a rendszer automatikusan, metaadatok nélkül értse a dokumentum szerkezetét. Amint az ilyen LLM-ek már olcsón képesek akár teljes kézikönyveket is értelmezni, a szemantikus feldarabolás szerepe csökkenhet. Mindez azonban jelenleg még költséges, így egyelőre a hatékony, strukturált feldolgozás marad az időben és pénzben leginkább megtérülő megközelítés.

Összegzés

Az MI-alapú keresés csak akkor válik valódi tudásasszisztenssé a vállalati világban, ha végre nem darabolja szét a dokumentumokat önkényesen, hanem tiszteletben tartja azok logikáját, szerkezetét, és a vizuális információkat is feldolgozza.

2025, adminboss, venturebeat.com alapján

  • Te mennyire bíznál egy ilyen MI-alapú keresőben a munkahelyeden?
  • Mit tettél volna másképp ezekben a fejlesztésekben?


Legfrissebb posztok

hétfő 21:46

Az MI felfalja az óriásplatformok bevételeit

Kezdetben mindennapjainkat és gazdasági döntéseinket digitális platformok uralták. Az online tevékenységek bővülésével egyre inkább ezekre a szolgáltatókra támaszkodtunk, legyen szó arról, hogy keresünk a Google-ben, üzenetet váltunk WhatsAppon, videókat nézünk a YouTube-on, kapcsolatot tartunk az Instagramon, vagy vásárolunk az Amazonon...

hétfő 21:34

Az AT&T sunyi díjemelésére a régi ügyfelek ráfázhatnak

Áprilistól drágább lesz az élet azoknak az AT&T előfizetőknek, akik hosszú évek óta ragaszkodnak régi vezeték nélküli tarifacsomagjukhoz...

hétfő 21:01

Az MI beégett a bíróságon: kitalált ügyek, súlyos következmények

Az MI térnyerése az élet számos területén látványos ígéretekkel érkezett, de a jog világában teljesen más kihívásokkal találta szembe magát...

hétfő 20:45

A valódi Zuckerberg helyett már a mesterséges főnök diktál?

Képzeld el, hogy egy fontos céges kérdéssel fordulsz a vezérhez, várva a személyes, motiváló választ – aztán kiderül, hogy „Mark Zuckerberg” valójában csak egy mesterien kiképzett MI-klón, amely a vezér minden gesztusát, hangszínét, múltbeli nyilatkozatát, sőt a céges stratégiához fűzött gondolatait is tökéletesen utánozza...

hétfő 20:34

Az Artemis II diadala és a világ legkövérebb papagája: két szenzáció

🚀 Ezen a héten több tudományos szenzáció is született: az Artemis II űrmisszió hazatérése, a kihalás széléről visszatérő különleges új-zélandi madár, valamint a Torinói lepel erősen vitatott eredetű DNS-mintái mind hozzájárultak az izgalmakhoz...

hétfő 20:24

A balti bálna a végóráit éli, Németország tehetetlen

Egy tízméteres hím púpos bálna hónapok óta vergődik a németországi Balti-tengeren, miközben egy egész ország látja tehetetlenül az állat lassú haldoklását...

hétfő 20:14

Az MI véget vet az online oktatásnak?

🤓 Az egyetemi oktatás sosem volt könnyű pálya, hiszen a bér alacsony, a munka bizonytalan, mégis rengetegen választják, mert a tanítás öröme semmihez sem fogható...

hétfő 19:56

A Circle csak bírósági végzésre fagyasztja be az USDC-t

🔒 A stablecoinok világában egyre nagyobb botrányt kelt, hogy hackerek százmilliókat lopnak el digitális valutákból, miközben a kibocsátók tétlenül nézik...

hétfő 19:45

Az új Roblox-gyerekfiókok felforgatják a szabályokat – jön a szigorúbb ellenőrzés

🔒 A Roblox júniustól kétféle, korosztályhoz kötött fiókot vezet be a fiatalabb játékosok számára: Roblox Kids és Roblox Select...

hétfő 19:34

Az új adatgyűjtő vírus, amely jelszó nélkül is kifoszt

🔒 2026 elején egy vadonatúj infógyűjtő, a Storm jelent meg az alvilági hackerkörökben...

hétfő 19:12

Az Adobe villámfrissítéssel zárja az Acrobat kritikus biztonsági rést

⚡ Az Adobe kritikus biztonsági frissítést adott ki az Acrobat és az Acrobat Reader szoftvereihez, hogy orvosolja a CVE-2026-34621 nevű sebezhetőséget, amelyet már hónapok óta zéró-napos támadásokban kihasználják...

hétfő 19:01

Az Android Auto végre átveszi a klímavezérlést?

Az Android Auto fejlesztései új lendületet kaptak: hamarosan lehetőség nyílik a klímaberendezés vezérlésére közvetlenül az autó kijelzőjéről, anélkül, hogy ki kellene lépni az Android Auto felületéről...

hétfő 18:56

A Google Messengerben végre kukázhatók az üzenetek

Sokáig igazi stresszforrás volt a törlés a Google Messengerben, hiszen azonnal és végleg eltűntek az üzenetek, ha megnyomtad a törlés gombot...

hétfő 18:45

A túl erős fény visszavetheti a növények fejlődését

A növények növekedését a fény nemcsak serkenti, hanem korlátozhatja is. Japán kutatók meglepő eredményre jutottak: világosban fejlődő borsóhajtásokban az epidermisz – vagyis a növény külső rétege – sokkal szorosabban tapad az alatta lévő szövetekhez, mint a sötétben nevelt növények esetében...

hétfő 18:34

Az újabb Rockstar-káosz: hackertámadás borzolja a GTA VI előszelét

🔫 Képzeld el, hogy a Rockstar Games – igen, az a stúdió, amelyik a Grand Theft Auto VI-n (GTA 6) dolgozik – megint hackertámadás célpontja lett...

hétfő 18:23

Az új fogkrém, amely véget vet a fogínybetegségeknek

😃 Az emberi szájban több mint 700-féle baktérium él, de csak kevés felelős a súlyos fogínybetegségekért...

hétfő 17:56

A mesterséges intelligencia sötét oldala: veszélyben a kriptotárcák

🔐 A technológiai világ egyre inkább a mesterséges intelligenciára támaszkodik, és a kriptovilágban is látványos forradalom készül...

hétfő 17:47

Az olcsó OLED nagy blöffje? Gigabyte GO27Q24G teszt

💡 Egy lényeges szempont, hogy a Gigabyte GO27Q24G egy újabb próbálkozás arra, hogy a gamerek számára elérhető áron kínáljon OLED kijelzős monitort, mégpedig egy régebbi LG WOLED panel segítségével...

hétfő 17:35

Az univerzális légúti vakcina: mennyit kell még várnunk?

😷 Képzelj el egy olyan oltást, amely egyszerre véd az influenza, a COVID-19, a tüdőbe jutó baktériumok és a szezonális allergének ellen...

hétfő 17:23

Az új kriptoőrület: száguld a Bitcoin, tombol a RAVE

Külön említést érdemel, hogy az elmúlt napokban a Bitcoin továbbra is stabilan tartja magát 25,5 millió forint (70 000 USD) körül, még akkor is, ha világszerte erősödnek a geopolitikai feszültségek, és a hagyományos piacok inkább a biztonságot keresik...

hétfő 17:12

A legutóbbi, alattomos Windows-frissítés ellopja a jelszavaidat

🔒 Erre utal többek között az, hogy a csalók már hamis Windows-támogatói oldalakkal tévesztik meg a felhasználókat, ahol egy látszólagos, „összegző frissítés” (cumulative update) nevű Windows-frissítést kínálnak a 24H2-es verzióra...

hétfő 17:01

Az MI miatti elbocsátási csapda: amikor a robotok romba döntik a gazdaságot

Ha a mesterséges intelligencia gyorsabban váltja le az embereket a munkahelyeken, mint ahogy a gazdaság újra képes felszívni őket, az könnyedén kiütheti az alapokat a fogyasztói kereslet alól – ami nélkül a cégek is pórul járnak...

hétfő 16:47

Az örök fiatalság nyomában: rajtol az emberkísérlet

A sötét mikroszoba fojtogató csendjében Yuancheng Ryan Lu levegőért kapkodott, miközben a tárgylemezen egy apró csoda született...

hétfő 16:35

A népszerű PC-diagnosztikai oldalról szabadult el egy veszélyes trójai

🐛 A népszerű CPUID.com oldalt néhány órára feltörték, és alattomos trójai fertőzések kiindulópontjává vált...

hétfő 16:12

A valódi szabadság: techállások, amelyekkel bárhol élhetsz és dolgozhatsz

🌍 Általános home office? Hát persze, ki ne unná már, hogy a kanapé sarkából meetingel minden második kocka...

hétfő 16:01

Az áttörés küszöbén: új gyógyszer reményt hoz a hasnyálmirigyrákban

💉 Fontos kérdés, hogy van-e valódi előrelépés a hasnyálmirigyrák gyógyításában, amely a legalacsonyabb ötéves túlélési aránnyal rendelkező daganatos betegségnek számít, mindössze 13%-kal...

hétfő 15:46

Az iPhone Csendes és Ne zavarjanak között mi a különbség?

Érdemes megvizsgálni, mikor érdemes némítani az iPhone-t, hiszen rengeteg olyan helyzet adódik, amikor nem jön jól, ha pittyeg vagy rezeg a telefon: egy fontos megbeszélés, tanóra vagy éppen egy film alatt...

hétfő 15:23

Az X hadat üzen a kattintásvadász tartalomgyárosoknak

Az X, Elon Musk vezetésével, jelentősen csökkentette azoknak a felhasználóknak a kifizetéseit, akik kattintásvadász vagy másoktól átvett híreket osztanak meg...

hétfő 15:12

Az új pénzügyi vészfék: jönnek a tőzsdei védelmi szabályok a kriptóra is?

A Bank of Korea meglepő javaslatot tett: bevezetnének a koreai kriptotőzsdéken olyan vészféket, amilyen a hagyományos tőzsdéken is működik...