2026. 01. 19., 06:58

Az Nvidia szoftverrel győzi le az AMD-t a tudományos MI-ben?

Az Nvidia szoftverrel győzi le az AMD-t a tudományos MI-ben?
Az utóbbi években az MI fejlődése hatalmas teljesítményigénnyel párosul, különösen a tudományos és nagy számítási teljesítményű (HPC) alkalmazásokban. Ezekben a feladatokban még mindig kiemelkedő jelentősége van a double precision, magyarul dupla pontosságú lebegőpontos (FP64) számításoknak. Ez a technológia tartja a levegőben a repülőgépeket és rakétákat, biztosítja a hatékony vakcinafejlesztést, és a nukleáris fegyverek működtetésében is kulcsszerepet játszik. Az Nvidia azonban szakít a hagyományos hardveres úttal: a Rubin és a Blackwell GPU-ikon szoftveres emulációt vet be, hogy jobb teljesítményt csikarjon ki MI-chipjeiből. Ezzel próbálja beérni az utóbbi időben fölénybe kerülő AMD-t.

Miért olyan fontos még a dupla pontosság?

Miközben egyre több chip dolgozik alacsonyabb pontosságú (például FP8) adattípusokkal, a tudományos számításokban az FP64-et nem tudták kiszorítani: senki sem tud olyan széles értéktartományt kezelni, mint ez a formátum, amely több mint 18,44 kvintillió különböző értéket képes reprezentálni. Ezzel szemben az MI-modellek javát mindössze 256-féle FP8-értéken tanítják, ami elképesztően kevés a tudományos pontossághoz képest. Az MI-vel szemben a HPC-feladatok hibára jelentősen érzékenyek; például áramlástanban, égésfolyamatokban vagy anyagtudományban még a legkisebb hibák is akkumulálódnak, és hibás végeredményhez vezetnek.

Szoftveres emuláció: régi ötlet, új köntösben

A hardver hiányában már az 1950-es években is alkalmazták az FP64 szoftveres emulációját. Az eljárás lényege, hogy a bonyolultabb számítást apróbb, alacsonyabb pontosságú műveletekre bontják, például 8 bites egész (INT8) műveletek összességével érik el az eredményt. A Rubin GPU-n a szoftveres kapcsolót bekapcsolva a felhasználó akár 4,4-szeres FP64 teljesítményt kaphat, összevetve a hardveres Blackwell-gyorsítókkal, holott azok is csúcstartók a piacon. Így a Rubin ma nemcsak az Nvidia legerősebb MI-gyorsítója, de a legütősebb tudományos GPU is.

Különösen fontos kiemelni, hogy az Nvidia Rubin-GPU-ja hardverből még mindig 33 teraFLOPS FP64 csúcsteljesítményt nyújt (ez egy teraFLOP-pal kevesebb, mint a négyéves H100), de szoftveres emulációval ezt az értéket jelentősen meg tudja növelni. Az innováció alapját adó Ozaki-módszert japán kutatók dolgozták ki: az egész számokra lebontott FP64 mátrixműveletek Nvidia tensor magokon futtatva meghaladják a natív teljesítményt.

Egyre több a kérdőjel – AMD is vitatja az áttörést

Az Nvidia ugyan kiemeli, hogy az emuláció pontossága legalább annyira jó, mint a valódi hardveres megoldásoké, az AMD szakértőinek egy része nem teljesen osztja ezt a lelkesedést. Szerintük az eljárás jól működik azoknál a benchmarkoknál, ahol kerek, rendezett adathalmazokról van szó, mint a High Performance Linpack tesztnél. Viszont bonyolultabb tudományos szimulációknál (anyagkutatás, kémiai folyamatok, sávos lineáris algebra) már döcög a rendszer, és hibák csúsznak a végeredménybe.

A legtöbb problémát az IEEE-szabvány szerinti pontosság hiánya okozza: az Nvidia algoritmusai nem kezelik megfelelően például a pozitív és negatív nullákat vagy a végtelenbe futó hibákat. Ez azt eredményezi, hogy a több tízezer művelet eredménye összetett zavarokat, akár hibás végeredményt is okozhat – ilyen esetekben az emuláció nem megbízható. Ráadásul az emulációhoz szükséges többletműveletek miatt a memóriahasználat akár a duplájára is nőhet.

Az AMD ezért továbbra is dedikált, kifejezetten HPC-re tervezett hardverekre koncentrál, mint az MI430X, ahol chiplet-architektúrával erősíti meg az FP64- és FP32-teljesítményt.


Kinek éri meg ez a trükk?

Nem minden alkalmazás profitál az FP64 emulációból. Az eljárás főleg sűrű mátrixszorzásoknál (DGEMM) ütős, ezek viszont a teljes HPC-felhasználás csak 30–40 százalékát teszik ki. A legtöbb valós szimulációs igény, áramlástani modellezés, spektrálanalízis és társaik továbbra is a klasszikus, vektoros FMA-műveletekre építenek. Ezeknél az emuláció semmilyen vagy csak minimális előnyt biztosít. Ez az oka annak, hogy a TOP500 szuperszámítógép-listán a vektoros (nem mátrixalapú) számításokban továbbra is a CPU-k dominálnak.

A Rubin GPU vektoros FP64 teljesítménye nem kiugró, viszont a 22 TB/s-os (!) HBM4 memóriasávszélesség révén a valós munkaterhelésekben még így is jóval többet tud, mint amit a puszta specifikáció mutatna.

A történet itt még nem ér véget

A következő években annyi Blackwell- és Rubin-GPU kerül szuperszámítógépekbe, hogy az FP64 emuláció igazi próbája csak most következik. Ha az algoritmusok nincsenek hardverhez kötve, idővel folyamatosan fejleszthetők, finomíthatók. Az AMD sem zárja ki végleg a szoftveres FP64 megoldásokat, az MI355X chipnél például teszteli a lehetőségeiket.

Különösen fontos kiemelni, hogy az iparági áttöréshez az IEEE-szabványos megfelelőség elengedhetetlen lenne – csak így állítható garantáltan, hogy a szoftveres végeredmény megegyezik a dedikált szilíciumos eredménnyel.

Összességében elmondható, hogy az Nvidia szoftveres FP64 emulációja izgalmas út, de jelenleg főként a matematikai mátrixműveletekre korlátozódik. A való életben a HPC továbbra is igényli a hagyományos hardveres pontosságot, de a technológia folyamatos fejlesztésével, tesztelésével akár néhány éven belül szélesebb körben is elterjedhet.

2025, adminboss, go.theregister.com alapján

  • Te mit gondolsz, jó ötlet-e a szoftveres emuláció ilyen érzékeny területeken?
  • Te hogyan döntenél, ha választanod kellene a gyorsabb, de kevésbé pontos megoldás és a lassabb, megbízhatóbb rendszer között?


Legfrissebb posztok

MA 09:46

Az amerikai Bitcoin ETF-ek ma sem nagyobbak, mint Trump győzelmekor

Az Egyesült Államokban jegyzett spot bitcoin ETF-ek kezelt vagyona jelenleg nagyjából azon a szinten áll, mint Donald Trump 2024...

MA 09:37

A kétezer éves skót rítus: agyeltávolítás, karcsontból készült eszközök

Többek között egy ritka temetkezési szokásra derült fény Észak-Skócia egyik távoli részén, ahol egy több mint 2000 évvel ezelőtt eltemetett nő sírja különös részleteket rejtett: agyát a halála után eltávolították, karcsontjaiból pedig késeket és egyéb eszközöket formáltak...

APP
MA 09:11

APPok, Amik Ingyenesek MA, 6/10

Fizetős iOS appok és játékok, amik ingyenesek a mai napon.     Risp: Budget & Savings (iPhone/iPad)A Risp egy pénzügyi alkalmazás, amely segít a pénzkezelésben bevált költségvetési stratégiákkal, megtakarítási célok kijelölésével és rövid, könnyen érthető pénzügyi ismeretekkel...

MA 09:10

A Mortal Shell 2 nyílt bétáját már 250 ezren töltötték le hétvégén

🦁 A Mortal Shell 2 idén debütál, és már most elképesztő az érdeklődés iránta: a hétvégi nyílt bétaverziót több mint 250 ezren töltötték le...

MA 09:01

Az egyszerű trükk, amitől éles marad az elméd kemoterápia alatt

💡 A kemoterápiát kapó rákbetegek gyakran kénytelenek szembenézni egy kellemetlen mellékhatással: a „kemó-agy” néven ismert emlékezet- és figyelemzavarral, ami akár a betegek 80%-át is érinti...

MA 08:46

Az életveszélyes hamis telefontöltők ellepték az online piactereket, áramütést okozhatnak, felrobbanhatnak

⚠ A legnépszerűbb internetes áruházakban, köztük a magyar vásárlók számára is ismert Amazonon, B&Q-n és eBay-en rengeteg hamis vagy silány minőségű telefontöltő kapható, amelyek szó szerint halálos veszélyt jelenthetnek...

MA 08:36

A bélben rejtőzik az alvási apnoé szívbetegség-kiváltója

💉 Az obstruktív alvási apnoé világszerte emberek millióinak életét nehezíti meg. Ez a gyakori rendellenesség éjszakánként többször is leállítja a légzést néhány másodpercre, ezzel csökkentve a szervezet oxigénszintjét és növelve a szén-dioxid-szintet...

MA 08:27

A szex mindent megváltoztatott: megrekedt az első állatok evolúciója

A Föld első állatai megjelenésükkel messze nem indítottak el robbanásszerű fejlődést – meglepően sokáig pangott az élővilág változatossága...

MA 08:19

Az Apple új Sirije: nem csak asszisztens, hanem vállalati alkalmazásréteg

Idén a WWDC 2026 kiemelt szenzációja, hogy az Apple teljesen új alapokra helyezi a Sirit, így most már jóval többről van szó, mint egy digitális asszisztensről...

MA 08:02

A PCOS valódi arca: hormonvihar a női szervezetben

💪 A PCOS (policisztás ovárium szindróma) a nők egyik leggyakoribb hormonális zavara, amely az anyagcserére, a bőrre, a hajra és a mentális egészségre is jelentős hatást gyakorol...

MA 07:55

A Madison Square Gardenért szórják a milliókat: Taylor Swifték esküvője

💍 Taylor Swift és Travis Kelce igazi nagyágyús eseményre készülnek: az esküvőjük helyszíne nem más, mint a legendás Madison Square Garden, amelyet legalább három napra béreltek ki...

MA 07:46

A remake-trilógia fináléja: mindent a Final Fantasy VII Revelationről

🎉 A játékvilág lélegzet-visszafojtva várja, hogyan zárul a legendás történet, amely egy egész generációt inspirált...

MA 07:36

A tea meghosszabbíthatja az életed – ha jól iszod

☕ A tea évszázadok óta közkedvelt ital világszerte, ám nemcsak a hangulatra, hanem a testre is hat...

MA 07:28

A csalás-mítosz ledől: a diákok jóra használják az MI-t

Az oktatás digitális forradalma alapjaiban formálja át a fiatalok tanulási szokásait...

MA 07:18

Az ultrafeldolgozott ételek lopják a figyelmedet – akkor is, ha egészségesen eszel

🤔 Új kutatás szerint a mindennapokban gyakran fogyasztott, ultrafeldolgozott ételek jelentősen rontják a figyelmet és a szellemi teljesítményt, még akkor is, ha valaki egyébként kifejezetten egészségesen táplálkozik...

MA 07:10

Az első kétmagos kvantumgép: kínai áttörés, tényleg stabilabb és hatékonyabb?

⚙ Egy kínai vállalat bemutatta a Hanyuan-2 nevű forradalmi kvantumszámítógépet, amelyet a világ első kétmagos kvantumszámítógépeként emlegetnek...

MA 07:01

Az 5 ezermilliárd dolláros kriptopiac kulcsa: a tokenizált részvények

A tokenizált részvények és ETF-ek új korszakot hozhatnak a kriptopénzek és a hagyományos pénzügyi piacok találkozásában...

MA 06:37

Az Apple is gyárt hamis képeket – ennek tényleg örülünk?

Eddig az Apple szinte szégyenlősen nyúlt a képszerkesztő szoftverek mesterséges intelligenciájához, miközben a konkurencia évek óta villogott a generatív MI-képességekkel...

MA 06:28

Az Ebola-járványban három új vakcina kap zöld utat – mikor érkeznek?

Közép-Afrika újabb Ebola-járvánnyal küzd, amely ezúttal a Bundibugyo-vírustörzs miatt robbant ki...

MA 06:19

Az ötujjú Donald kacsa botrányt kavar a Kingdom Heartsban

A frissen bejelentett Szívek királysága-gyűjtemény (Kingdom Hearts Collection) (1–3) hivatalos plakátján kisebb botrány kerekedett: Donald kacsának feltűnően öt ujja van az egyik kezén...

MA 06:07

Történelmi események a mai napon (Június 10.)

Ma évszázadokon átívelő fordulópontok és megrázó tragédiák sorakoznak: a keresztes háborúktól és a harmincéves háború csatáitól kezdve a II...

kedd 21:34

Az ingyenes Norton Neo a vb-szurkolók belépője a lelátóra

Az idei nyár 39 napján világszerte emberek milliárdjai ülnek le ugyanabban a pillanatban, hogy együtt kövessék a 2026-os labdarúgó-világbajnokság izgalmait...

kedd 21:23

A vb-láz elkerüli New Yorkot, napokkal a kezdés előtt?

🏆 Fontos kérdés, hogy fel tudja-e rázni a fociláz New Yorkot az utolsó pillanatban, hiszen a világ legnagyobb futballeseménye, a világbajnokság hamarosan itt, az Egyesült Államokban veszi kezdetét...

kedd 21:13

Az olcsó mini-LED trónkövetelő: KTC M27T6S teszt

💡 A 27 hüvelykes KTC M27T6S nem csupán egy újabb monitor a piacon – igazi mérföldkő azoknak, akik nem akarnak több százezret költeni egy igazán jó HDR kijelzőre...

kedd 21:03

Az Artemis III legénysége megvan – jön a történelem egyik legösszetettebb küldetése

🚀 A NASA a következő években minden eddiginél bonyolultabb űrmisszióra készül, amely egyesíti az emberes űrrepülés hagyományát az új technológiákkal...

kedd 20:55

A blokklánc forradalmasítja az amerikai gyáripar hitelezését

📦 Ennek megfelelően egy jelentős, 650 millió dolláros (kb. 235 milliárd forintos) hitelprogram indul az amerikai gyártó- és energetikai szektorban, innovatív digitális pénzügyi megoldásokkal...

kedd 20:44

Az FCA engedne: jöhet 10% kripto-ETN a befektetési alapokba?

A brit pénzügyi felügyelet most először engedélyezné, hogy az ország néhány befektetési alapja a vagyonának akár 10%-át kriptoeszközökhöz kapcsolódó tőzsdén kereskedett kötvényekben (crypto ETN) tartsa...

kedd 20:34

Vége a bikapiacnak: külön útra lép a Bitcoin és a techrészvények

A kriptovaluták piacán a nyár előtt komoly bizonytalanság uralkodik, miközben a Bitcoin és a technológiai részvények között ritkán látott különbség alakult ki...

kedd 20:24

Az ultrawide meglepetés: a Koorui, amire senki sem számított

😍 Érdemes megvizsgálni, hogy a PC-alkatrészek egyre dráguló világában mennyire számít üdítő kivételnek a Koorui 34E6UC, egy pénztárcabarát, 34 hüvelykes, ultrawide monitor...