2026. 01. 19., 06:58

Az Nvidia szoftverrel győzi le az AMD-t a tudományos MI-ben?

Az Nvidia szoftverrel győzi le az AMD-t a tudományos MI-ben?
Az utóbbi években az MI fejlődése hatalmas teljesítményigénnyel párosul, különösen a tudományos és nagy számítási teljesítményű (HPC) alkalmazásokban. Ezekben a feladatokban még mindig kiemelkedő jelentősége van a double precision, magyarul dupla pontosságú lebegőpontos (FP64) számításoknak. Ez a technológia tartja a levegőben a repülőgépeket és rakétákat, biztosítja a hatékony vakcinafejlesztést, és a nukleáris fegyverek működtetésében is kulcsszerepet játszik. Az Nvidia azonban szakít a hagyományos hardveres úttal: a Rubin és a Blackwell GPU-ikon szoftveres emulációt vet be, hogy jobb teljesítményt csikarjon ki MI-chipjeiből. Ezzel próbálja beérni az utóbbi időben fölénybe kerülő AMD-t.

Miért olyan fontos még a dupla pontosság?

Miközben egyre több chip dolgozik alacsonyabb pontosságú (például FP8) adattípusokkal, a tudományos számításokban az FP64-et nem tudták kiszorítani: senki sem tud olyan széles értéktartományt kezelni, mint ez a formátum, amely több mint 18,44 kvintillió különböző értéket képes reprezentálni. Ezzel szemben az MI-modellek javát mindössze 256-féle FP8-értéken tanítják, ami elképesztően kevés a tudományos pontossághoz képest. Az MI-vel szemben a HPC-feladatok hibára jelentősen érzékenyek; például áramlástanban, égésfolyamatokban vagy anyagtudományban még a legkisebb hibák is akkumulálódnak, és hibás végeredményhez vezetnek.

Szoftveres emuláció: régi ötlet, új köntösben

A hardver hiányában már az 1950-es években is alkalmazták az FP64 szoftveres emulációját. Az eljárás lényege, hogy a bonyolultabb számítást apróbb, alacsonyabb pontosságú műveletekre bontják, például 8 bites egész (INT8) műveletek összességével érik el az eredményt. A Rubin GPU-n a szoftveres kapcsolót bekapcsolva a felhasználó akár 4,4-szeres FP64 teljesítményt kaphat, összevetve a hardveres Blackwell-gyorsítókkal, holott azok is csúcstartók a piacon. Így a Rubin ma nemcsak az Nvidia legerősebb MI-gyorsítója, de a legütősebb tudományos GPU is.

Különösen fontos kiemelni, hogy az Nvidia Rubin-GPU-ja hardverből még mindig 33 teraFLOPS FP64 csúcsteljesítményt nyújt (ez egy teraFLOP-pal kevesebb, mint a négyéves H100), de szoftveres emulációval ezt az értéket jelentősen meg tudja növelni. Az innováció alapját adó Ozaki-módszert japán kutatók dolgozták ki: az egész számokra lebontott FP64 mátrixműveletek Nvidia tensor magokon futtatva meghaladják a natív teljesítményt.

Egyre több a kérdőjel – AMD is vitatja az áttörést

Az Nvidia ugyan kiemeli, hogy az emuláció pontossága legalább annyira jó, mint a valódi hardveres megoldásoké, az AMD szakértőinek egy része nem teljesen osztja ezt a lelkesedést. Szerintük az eljárás jól működik azoknál a benchmarkoknál, ahol kerek, rendezett adathalmazokról van szó, mint a High Performance Linpack tesztnél. Viszont bonyolultabb tudományos szimulációknál (anyagkutatás, kémiai folyamatok, sávos lineáris algebra) már döcög a rendszer, és hibák csúsznak a végeredménybe.

A legtöbb problémát az IEEE-szabvány szerinti pontosság hiánya okozza: az Nvidia algoritmusai nem kezelik megfelelően például a pozitív és negatív nullákat vagy a végtelenbe futó hibákat. Ez azt eredményezi, hogy a több tízezer művelet eredménye összetett zavarokat, akár hibás végeredményt is okozhat – ilyen esetekben az emuláció nem megbízható. Ráadásul az emulációhoz szükséges többletműveletek miatt a memóriahasználat akár a duplájára is nőhet.

Az AMD ezért továbbra is dedikált, kifejezetten HPC-re tervezett hardverekre koncentrál, mint az MI430X, ahol chiplet-architektúrával erősíti meg az FP64- és FP32-teljesítményt.


Kinek éri meg ez a trükk?

Nem minden alkalmazás profitál az FP64 emulációból. Az eljárás főleg sűrű mátrixszorzásoknál (DGEMM) ütős, ezek viszont a teljes HPC-felhasználás csak 30–40 százalékát teszik ki. A legtöbb valós szimulációs igény, áramlástani modellezés, spektrálanalízis és társaik továbbra is a klasszikus, vektoros FMA-műveletekre építenek. Ezeknél az emuláció semmilyen vagy csak minimális előnyt biztosít. Ez az oka annak, hogy a TOP500 szuperszámítógép-listán a vektoros (nem mátrixalapú) számításokban továbbra is a CPU-k dominálnak.

A Rubin GPU vektoros FP64 teljesítménye nem kiugró, viszont a 22 TB/s-os (!) HBM4 memóriasávszélesség révén a valós munkaterhelésekben még így is jóval többet tud, mint amit a puszta specifikáció mutatna.

A történet itt még nem ér véget

A következő években annyi Blackwell- és Rubin-GPU kerül szuperszámítógépekbe, hogy az FP64 emuláció igazi próbája csak most következik. Ha az algoritmusok nincsenek hardverhez kötve, idővel folyamatosan fejleszthetők, finomíthatók. Az AMD sem zárja ki végleg a szoftveres FP64 megoldásokat, az MI355X chipnél például teszteli a lehetőségeiket.

Különösen fontos kiemelni, hogy az iparági áttöréshez az IEEE-szabványos megfelelőség elengedhetetlen lenne – csak így állítható garantáltan, hogy a szoftveres végeredmény megegyezik a dedikált szilíciumos eredménnyel.

Összességében elmondható, hogy az Nvidia szoftveres FP64 emulációja izgalmas út, de jelenleg főként a matematikai mátrixműveletekre korlátozódik. A való életben a HPC továbbra is igényli a hagyományos hardveres pontosságot, de a technológia folyamatos fejlesztésével, tesztelésével akár néhány éven belül szélesebb körben is elterjedhet.

2025, adminboss, go.theregister.com alapján

  • Te mit gondolsz, jó ötlet-e a szoftveres emuláció ilyen érzékeny területeken?
  • Te hogyan döntenél, ha választanod kellene a gyorsabb, de kevésbé pontos megoldás és a lassabb, megbízhatóbb rendszer között?


Legfrissebb posztok

MA 07:46

A remake-trilógia fináléja: mindent a Final Fantasy VII Revelationről

🎉 A játékvilág lélegzet-visszafojtva várja, hogyan zárul a legendás történet, amely egy egész generációt inspirált...

MA 07:36

A tea meghosszabbíthatja az életed – ha jól iszod

☕ A tea évszázadok óta közkedvelt ital világszerte, ám nemcsak a hangulatra, hanem a testre is hat...

MA 07:28

A csalás-mítosz ledől: a diákok jóra használják az MI-t

Az oktatás digitális forradalma alapjaiban formálja át a fiatalok tanulási szokásait...

MA 07:18

Az ultrafeldolgozott ételek lopják a figyelmedet – akkor is, ha egészségesen eszel

🤔 Új kutatás szerint a mindennapokban gyakran fogyasztott, ultrafeldolgozott ételek jelentősen rontják a figyelmet és a szellemi teljesítményt, még akkor is, ha valaki egyébként kifejezetten egészségesen táplálkozik...

MA 07:10

Az első kétmagos kvantumgép: kínai áttörés, tényleg stabilabb és hatékonyabb?

⚙ Egy kínai vállalat bemutatta a Hanyuan-2 nevű forradalmi kvantumszámítógépet, amelyet a világ első kétmagos kvantumszámítógépeként emlegetnek...

MA 07:01

Az 5 ezermilliárd dolláros kriptopiac kulcsa: a tokenizált részvények

A tokenizált részvények és ETF-ek új korszakot hozhatnak a kriptopénzek és a hagyományos pénzügyi piacok találkozásában...

MA 06:37

Az Apple is gyárt hamis képeket – ennek tényleg örülünk?

Eddig az Apple szinte szégyenlősen nyúlt a képszerkesztő szoftverek mesterséges intelligenciájához, miközben a konkurencia évek óta villogott a generatív MI-képességekkel...

MA 06:28

Az Ebola-járványban három új vakcina kap zöld utat – mikor érkeznek?

Közép-Afrika újabb Ebola-járvánnyal küzd, amely ezúttal a Bundibugyo-vírustörzs miatt robbant ki...

MA 06:19

Az ötujjú Donald kacsa botrányt kavar a Kingdom Heartsban

A frissen bejelentett Szívek királysága-gyűjtemény (Kingdom Hearts Collection) (1–3) hivatalos plakátján kisebb botrány kerekedett: Donald kacsának feltűnően öt ujja van az egyik kezén...

MA 06:07

Történelmi események a mai napon (Június 10.)

Ma évszázadokon átívelő fordulópontok és megrázó tragédiák sorakoznak: a keresztes háborúktól és a harmincéves háború csatáitól kezdve a II...

kedd 21:34

Az ingyenes Norton Neo a vb-szurkolók belépője a lelátóra

Az idei nyár 39 napján világszerte emberek milliárdjai ülnek le ugyanabban a pillanatban, hogy együtt kövessék a 2026-os labdarúgó-világbajnokság izgalmait...

kedd 21:23

A vb-láz elkerüli New Yorkot, napokkal a kezdés előtt?

🏆 Fontos kérdés, hogy fel tudja-e rázni a fociláz New Yorkot az utolsó pillanatban, hiszen a világ legnagyobb futballeseménye, a világbajnokság hamarosan itt, az Egyesült Államokban veszi kezdetét...

kedd 21:13

Az olcsó mini-LED trónkövetelő: KTC M27T6S teszt

💡 A 27 hüvelykes KTC M27T6S nem csupán egy újabb monitor a piacon – igazi mérföldkő azoknak, akik nem akarnak több százezret költeni egy igazán jó HDR kijelzőre...

kedd 21:03

Az Artemis III legénysége megvan – jön a történelem egyik legösszetettebb küldetése

🚀 A NASA a következő években minden eddiginél bonyolultabb űrmisszióra készül, amely egyesíti az emberes űrrepülés hagyományát az új technológiákkal...

kedd 20:55

A blokklánc forradalmasítja az amerikai gyáripar hitelezését

📦 Ennek megfelelően egy jelentős, 650 millió dolláros (kb. 235 milliárd forintos) hitelprogram indul az amerikai gyártó- és energetikai szektorban, innovatív digitális pénzügyi megoldásokkal...

kedd 20:44

Az FCA engedne: jöhet 10% kripto-ETN a befektetési alapokba?

A brit pénzügyi felügyelet most először engedélyezné, hogy az ország néhány befektetési alapja a vagyonának akár 10%-át kriptoeszközökhöz kapcsolódó tőzsdén kereskedett kötvényekben (crypto ETN) tartsa...

kedd 20:34

Vége a bikapiacnak: külön útra lép a Bitcoin és a techrészvények

A kriptovaluták piacán a nyár előtt komoly bizonytalanság uralkodik, miközben a Bitcoin és a technológiai részvények között ritkán látott különbség alakult ki...

kedd 20:24

Az ultrawide meglepetés: a Koorui, amire senki sem számított

😍 Érdemes megvizsgálni, hogy a PC-alkatrészek egyre dráguló világában mennyire számít üdítő kivételnek a Koorui 34E6UC, egy pénztárcabarát, 34 hüvelykes, ultrawide monitor...

kedd 20:12

Az Artemis III legénysége megvan, jön a tétre menő holdkomp-próba

A NASA hivatalosan is bemutatta az Artemis III négyfős legénységét június 9-én Houstonban, amelynek tagjai 2027 végén egy különleges küldetésre indulnak majd...

kedd 20:01

Az Ocarina of Time újjászületik – már idén a Nintendo Switch 2-n

Valóra váltak a pletykák: a legendás A Zelda legendája: Az idő ocarinája (The Legend of Zelda: Ocarina of Time) megújul, és kizárólag Nintendo Switch 2-re, 2026-ban jelenik meg...

kedd 19:56

Az RTX 50 Super jön, vele a 12 GB-os RTX 5060?

Nagyjából fél éve hallani pletykákat arról, hogy az Nvidia újabb Super modellekkel bővítené a legújabb RTX-szériát, ám a memóriapiac nyűgjei miatt eddig semmi konkrétum nem derült ki...

kedd 19:45

A szlovákiai árok hétezer éves, fej nélküli emberi csontvázakkal sokkolja a régészeket

😮 Egy szlovákiai kőkorszaki település határában régészek egy különös árkot tártak fel, amelyet fej nélküli emberi csontvázak töltöttek meg...

kedd 19:34

A Halo-kampány új korszaka: mindent a tündöklő Master Chiefről

👑 A Halo: Combat Evolved ismét visszatér, de most tényleg nagyot újítanak: nemcsak egy sima felújításról van szó, hanem teljes értékű remake készül Halo: Campaign Evolved címmel...

kedd 19:23

A toxikus rajongás rombolja Clarkson farmját

😤 Jeremy Clarkson szokásához híven ismét bizonyítja, hogy lelkesedése mellett elképesztően ügyetlen, ha gyakorlati teendőkről van szó – és ez a Clarkson farmja (Clarkson’s Farm) ötödik évadában csak még látványosabbá válik...

kedd 19:12

A Blue Origin rakétarobbanása megnehezíti a Holdra visszatérést

Jeff Bezos űripari álmai május 28-án Floridában lángba borultak, amikor a Blue Origin egyik New Glenn rakétája a kilövőálláson hirtelen felrobbant...

kedd 19:01

A Montech Ten Wood: illóolajos gépház, amiért megőrül a gamer?

🌲 A Computex 2024 kiállításon az egyik legszokatlanabb hardverújdonság a Montech Ten Wood PC-ház volt, ami nemcsak a szemnek, de az orrnak is újat kínál...

kedd 18:45

Az orosz VPN-szigor megoldása: az állami VPN?

A Roskomnadzor, az orosz médiahatóság meghökkentő lépésre készül: egységes, állami VPN-szolgáltatást hozna létre, hogy az ország IT-szakemberei megkerülhessék a rájuk vonatkozó internetes korlátozásokat...

kedd 18:34

Az amerikai államhatárt kettészelő három, egymástól merőben eltérő tó a világűrből

A Nevada–Kalifornia határ mentén lenyűgöző képet mutat a világűrből nézve három egymás mellett elterülő, de teljesen eltérő megjelenésű tó: Tahoe, Walker és Mono...

kedd 18:23

Az Ethena megnyeri a Janus Henderson támogatását: ENA-befektetés, USDe-terjesztés

💰 Senki sem várta volna, hogy egy hagyományos, 480 milliárd dollár (kb...