2025. 03. 03., 11:30

Kódhallucinációk az MI-ben? Valójában ezek a legkevésbé veszélyesek

Kódhallucinációk az MI-ben? Valójában ezek a legkevésbé veszélyesek
Meglepően gyakori panasz azoktól a fejlesztőktől, akik már kipróbálták a nyelvi modelleket (LLM) kódírásra, hogy hallucinációkba ütköztek – általában olyan funkciókat vagy akár teljes szoftverkönyvtárakat talál ki a modell, amelyek nem léteznek – és ez azonnal lerombolta a bizalmukat az LLM-ekben mint kódírási eszközökben. Hogyan használhatná bárki is hatékonyan ezeket az eszközöket, ha olyan funkciókat találnak ki, amelyek nem léteznek? A kódban előforduló hallucinációk valójában a legkevésbé káros hallucinációk, amelyekkel egy modellnél találkozhatsz.

A valódi veszély máshol rejlik

Az LLM-ek kódírásra való használatának igazi kockázata az, hogy olyan hibákat követhetnek el, amelyeket nem azonnal észlel a nyelvi fordító vagy értelmező. És ezek folyamatosan előfordulnak!

Abban a pillanatban, amikor futtatod az LLM által generált kódot, bármilyen hallucinált metódus azonnal nyilvánvalóvá válik: hibaüzenetet kapsz. Ezt magad is kijavíthatod, vagy visszatáplálhatod a hibaüzenetet az LLM-be, és figyelheted, ahogy korrigálja önmagát.

Hasonlítsd ezt össze a hagyományos prózában előforduló hallucinációkkal, ahol kritikus szemre, erős intuícióra és jól fejlett tényellenőrzési készségekre van szükséged, hogy elkerüld a helytelen és a hírnevedre közvetlenül káros információk megosztását.

Ingyenes tényellenőrzés a kódban

A kóddal ingyenesen kapsz egy hatékony tényellenőrzési formát. Csak futtasd a kódot, és nézd meg, működik-e. A hallucinált funkciók olyan apró akadályok, hogy amikor az emberek panaszkodnak rájuk, feltételezhető, minimális időt töltöttek azzal, hogy megtanulják, hogyan használják hatékonyan ezeket a rendszereket – az első akadálynál feladták.

Miért utasítják el egyesek az MI-t ilyen gyorsan?

Kissé Cinikusan azt is mondhatnánk, hogy talán csak egy okot kerestek a technológia elutasítására, és az elsőnél lecsaptak rá.

Esetleg senki sem figyelmeztette őket, hogy sok munkát kell befektetni ahhoz, hogy megtanulják, hogyan érhetnek el jó eredményeket ezekkel a rendszerekkel.


A kézi tesztelés nélkülözhetetlen

Csak mert a kód jónak tűnik és hiba nélkül fut, még nem jelenti azt, hogy valóban a megfelelő dolgot csinálja. Semmilyen alapos kódfelülvizsgálat – vagy akár átfogó automatizált tesztek – sem bizonyítják meggyőzően, hogy a kód valóban a helyes dolgot teszi. Magadnak kell futtatnod! Annak bizonyítása, hogy a kód működik, a te feladatod.

Az LLM-kód általában fantasztikusan néz ki: jó változónevek, meggyőző megjegyzések, világos típusannotációk és logikus struktúra. Ez hamis biztonságérzetbe ringathat, ugyanúgy, ahogy egy nyelvtanilag helyes és magabiztos válasz a ChatGPT-től arra csábíthat, hogy kihagyd a tényellenőrzést vagy a szkeptikus szemlélet alkalmazását.

Hogyan kerüljük el a csapdákat?

A problémák elkerülésének módja ugyanaz, mint ahogy elkerülöd a problémákat más emberek által írt kódban, amelyet felülvizsgálsz, vagy a saját kódodban: aktívan tesztelned kell azt a kódot. Kiváló manuális minőségellenőrzési készségekkel kell rendelkezned.

A programozás általános szabálya, hogy soha ne bízz egyetlen kódrészletben sem, amíg nem láttad saját szemeddel működni – vagy, ami még jobb, nem láttad hibázni, majd kijavítottad.

Tippek a hallucinációk csökkentésére

Ha valóban hallucinált részletek áradatát tapasztalod az LLM-ek által neked készített kódban, számos dolgot tehetsz ellene.

Próbálj ki különböző modelleket. Lehet, hogy egy másik modellnek jobb a tanítási adathalmaza a választott platformodhoz. Jelenlegi a gondolkodás funkcióval ellátott Claude 3.7 Sonnet, az OpenAI o3-mini-high és a GPT-4o Code Interpreter a közönség kedvencek.

Tanuld meg, hogyan használd a kontextust. Ha egy LLM nem ismer egy adott könyvtárat, gyakran orvosolhatod ezt néhány tucat sornyi példakód beillesztésével. Az LLM-ek hihetetlenül jók az utánzásban és a minták gyors felismerésében nagyon korlátozott példák alapján. A modern modellek egyre nagyobb kontextusablakokkal rendelkeznek – a Claude új funkciója, hogy teljes repókat enged betölteni.

 

 

  • Te hogy kezelnéd, ha egy LLM által generált kódban hibát találnál, és mi lenne a következő lépésed?
  • Mit tennél, ha olyan eszközt használnál, ami többször is hallucinált metódusokat generál?


Legfrissebb posztok

MA 17:01

Súlyos új támadás fenyegeti az OpenAI macOS-hitelesítését

⚠ Többek között átfogó biztonsági intézkedésekkel reagál az OpenAI egy közelmúltbeli ellátási lánc elleni támadásra, amely során egy rosszindulatú Axios-csomag is lefutott a cég GitHub Actions automatizált folyamataiban...

MA 16:58

Az oslói beteg: áttörés jöhet a HIV végleges legyőzésében?

Egy 63 éves férfi, akit csak „az oslói betegként” emlegetnek, jó eséllyel végleg megszabadult a HIV-től – méghozzá egy szokatlan csontvelő-átültetésnek köszönhetően, amely teljesen átalakította az immunrendszerét...

MA 16:45

A villanyautód lehet a házad következő zöld erőműve!

Amíg te csak parkolni hagyod az elektromos kocsidat, lehet, hogy észre sem veszed, milyen elképesztő lehetőség lapul az orrod előtt...

MA 16:23

Az új Gmail-fióknévvel végre búcsút inthetsz a ciki e‑mailcímeknek

Erre utal többek között az, hogy végre búcsút inthetsz annak a kínos Gmail-címnek, amelyet még tinédzserként választottál magadnak, és mindeddig kísértett az álláskereséstől kezdve az ügyintézésig...

MA 16:13

Az LG két olcsó OLED-tévével rukkolt elő – döbbenetes a különbség

😲 Az LG új generációs OLED televízióinak ára már elérhetővé vált az Amazonon, és két modellt is találunk a kínálatban: a B65-öt és a B6E-t...

MA 16:01

Az újabb Rockstar-botrány: több millió adat szivárgott ki

🕵 Ismét támadás érte a Rockstar Games-t: több mint 78,6 millió belső analitikai rekord szivárgott ki, miután az Anodot nevű adatfelügyeleti cégnél történt biztonsági incidens miatt a ShinyHunters zsarolócsoport megszerezte a hozzáférést...

MA 15:56

A nagy bitcoinláz: jön a 75 ezres áttörés?

💰 A bitcoin újra megközelítette a 75 000 dolláros (27,3 millió forintos) szintet, amelyet február eleje óta többszöri próbálkozásra sem sikerült tartósan áttörnie...

MA 15:12

Az elszabadult japán rakétadarab katasztrófát okozott

A japán H3 rakéta legutóbbi indulása súlyos kudarcba torkollott, amikor a fedélzeten szállított navigációs műhold odaveszett...

MA 14:57

Az új Pixel 10 modem tényleg biztonságban tartja a mobilod?

A modern okostelefonok egyre fejlettebb biztonsági védelemmel rendelkeznek, mégis éppen ott sérülékenyek, ahol a legkevésbé számítanánk: a modem szoftverében...

MA 14:34

Az American Express MI-re bízná pénzügyeit – vállalja a tévedések árát

💸 Például könnyen elképzelhető, hogy a jövőben egy alkalmazás automatikusan elintézi helyetted a repülőjegy-foglalást, vagy újrarendeli a papírtörlőt, amikor elfogy...

MA 14:23

Az Osmo Pocket 4 új szenzorral és Pro változattal hódíthat

Lényeges szempont, hogy a DJI Osmo Pocket sorozat eddig is a vloggerek kedvence volt, köszönhetően kiváló teljesítményének és zsebméretű kialakításának...

MA 14:03

Az első összefonódott, mozgó atomok: az univerzum új csodája

💫 Érdemes megérteni, hogy a fizikában most először sikerült megfigyelni két mozgásban lévő atom kvantumösszefonódását...

MA 13:34

A feledésbe merült Microsoft-hibák újra lecsapnak

Sokak meglepetésére újra támadás alatt állnak olyan sérülékenységek a Microsoft rendszereiben, amelyeket korábban már javítottak...

MA 13:23

Az új kvantumforradalom: már itt van, vagy még ötven év?

⚛ Chad Rigetti neve összeforrt a kvantumszámítógépek világával, még ha legtöbben csak a Marvel-filmekből hallották a fogalmat...

MA 13:01

A Meta arcfelismerő szemüvege: a botrány, amitől rettegünk

A Meta legújabb okosszemüvege hatalmas vihart kavart a civil szervezetek körében...

MA 12:57

Az európai fitneszóriás adatbotránya: egymillió tag adatai veszélyben

A holland központú Basic-Fit, Európa legnagyobb fitneszterem-lánca, kibertámadás áldozatává vált: hackerek bejutottak a cég rendszerébe, és közel egymillió tagról szereztek bizalmas adatokat...

MA 12:34

A sötét semmi gyorsabban vágtat, mint a fény

💫 Egy lényeges szempont, hogy a fizikában eddig elképzelhetetlennek számított, hogy bármi is gyorsabb lehet a fénynél – most azonban a tudósok mégis észleltek valamit, ami látszólag átlépi ezt a kozmikus sebességhatárt...

MA 12:23

Az Xbox végre belátta: túl drága a Game Pass?

Asha Sharma, az Xbox új vezérigazgatója mindössze néhány hete ül a főnöki székben, de máris felkavarta az állóvizet...

MA 11:45

Az FBI lecsapott a texasi férfira, aki Sam Altman otthonát megtámadta

Hihetetlen, de igaz: a texasi hatóságok épp akkor csaptak le egy 20 éves férfi otthonára, amikor azzal is vádolták, hogy Molotov-koktélos támadást intézett Sam Altman, az OpenAI vezérigazgatója San Franciscó-i otthona ellen...

MA 11:24

A termékeny sperma kulcsa: nyáron a legjobb a minőség

🍆 Nem is gondolnánk, de a sperma minősége komolyan változik az év során, és a legjobb eredmények épp a forró nyári hónapokra esnek...

MA 11:12

Molotov-koktélt dobtak Sam Altman házára az MI ellen tiltakozva

💥 Az OpenAI vezérigazgatója, Sam Altman otthonánál San Franciscóban péntek hajnalban valaki Molotov-koktélt dobott a kapura, majd elmenekült...

MA 11:02

Az MI lenyelte a programozókat – most a kreativitás diktál

Ha valaha is úgy gondoltad, hogy a kódolás a gyors meggazdagodás útja, ideje átértékelni a dolgokat...

MA 10:57

A San Franciscó-i öböl bálnatemető: sorra pusztulnak a szürke bálnák

💀 A San Francisco-öböl a szürke bálnák számára halálos útvonallá vált: az éhes állatok egyre gyakrabban keresik fel a forgalmas vizeket, sokan közülük azonban nem élik túl a kalandot...

MA 10:36

Az Intel szárnyal: a Google-szövetség új csúcsokra repíti a részvényt

Az Intel hétfőn rövid idő alatt öt százalékot erősödött a tőzsdén, miután bejelentették stratégiai együttműködésük bővítését a Google-lel...

MA 10:29

Az átverős technikai ügyfélszolgálat: 13 millió dollárnak lába kelt

💯 Michael Cotter egyetlen problémával szembesült: a technikai ügyfélszolgálati cégénél, a Tech Live Connectnél túl magasak lettek a visszaterhelések...

MA 09:58

A Sony és egy YouTuber életre kelti az animációs Bloodborne-t

Las Vegasban, a CinemaCon fesztivál keretei között robbant a hír: a Sony animációs filmet készít a kultikus Bloodborne videojáték alapján...

MA 09:50

A tavasz titokzatos ragyogása: földfény az éjszakai égen

Áprilisban a Hold nemcsak a megszokott ragyogásával hívja fel magára a figyelmet: ebben az időszakban gyakrabban figyelhető meg a ritka és misztikus földfény (earthshine) is...

MA 09:43

Az MI-s Claude zuhanóágban – már ő is panaszkodik

😭 Jellemző példa erre, hogy az egykor a programozók kedvencévé vált, az Anthropichoz köthető Claude mostanra egyre több kritikát kap mind a költségek, mind a minőség terén...

MA 09:36

A Dogecoin berobban? Csak 3% a mémcoin-szezonban

🐶 Míg a kriptopiac kicsit bizonytalanul egyensúlyoz, a Dogecoin kifejezetten erősen muzsikál: szépen kapaszkodik felfelé, és egészen meggyőző, hogy most végre nem fullad ki az emelkedés, hanem tartja a szintet...