2025. 03. 25., 13:24

Az AI energiafaló, de a kutatók már dolgoznak a megoldáson

Az AI energiafaló, de a kutatók már dolgoznak a megoldáson
Ahogy a mesterséges intelligencia modellek komplexitása növekszik, úgy nő az energiaigényük is. 2024 novemberében az amerikai Szövetségi Energiaszabályozási Bizottság (FERC) elutasította az Amazon kérelmét, amelyben 180 megawatt energia közvetlen vásárlását kérte a Susquehanna atomerőműtől egy közeli adatközpont számára. Az indoklás szerint az ilyen közvetlen vásárlás sértené a többi felhasználó érdekeit.

Az AlexNet pillanat

Az energiaigény hirtelen növekedése 2012-ben kezdődött, amikor Alex Krizhevsky, Ilya Sutskever és Geoffrey E. Hinton, a Torontói Egyetem kutatói megalkották az AlexNet nevű konvolúciós neurális hálózatot. A modell több mint 60 millió paraméterrel és 650 ezer neuronnal rendelkezett, ami túl nagy volt ahhoz, hogy egyetlen GPU-n fusson. A kutatók ezért úgy döntöttek, hogy két GPU között osztják meg a terhelést – a neuronok egyik felét az egyik, a másik felét a másik GPU-ra helyezve.

Az AlexNet nemcsak megnyerte a 2012-es ImageNet versenyt, hanem egy jelentős áttörést is hozott: végérvényesen felszabadította az MI-modellek méretét az egyetlen processzor korlátai alól. Ez a szellem vissza már nem térhetett a palackba.

Az egyensúly művészete

Az AlexNet után az MI-modellek képzése egyre több GPU-t igényelt: tízet, százat, majd ezret. Meglepő módon az adatközpontok energiafogyasztása 2010 és 2020 között viszonylag stabil maradt, a hatékonyság folyamatos javulásának köszönhetően. Az Nvidia adatközponti chipjei ebben az időszakban körülbelül tizenötször hatékonyabbá váltak, ami segített ellensúlyozni a növekvő igényeket.

Ez a trend azonban drasztikusan megváltozott a hatalmas nyelvi modellek, például a ChatGPT, 2022-es megjelenésével. “Hatalmas ugrás következett be, amikor a transzformer modellek széles körben elterjedtek,” mondta Mosharaf Chowdhury, a Michigani Egyetem professzora. Bár az Nvidia tovább növelte hatékonyságát, az amerikai adatközpontok energiafogyasztása így is 76 TWh-ról (2018-ban) 176 TWh-ra nőtt 2023-ra.

Az MI életciklusa

A mai nyelvi modellek tízmilliárdnyi neuronnal rendelkeznek, megközelítve vagy akár túlszárnyalva az emberi agy idegsejtjeinek számát. Például a GPT-4 becslések szerint körülbelül 100 milliárd neuronnal, 100 rétegre osztva és több mint 100 billió paraméterrel bír.

A modell betanítása rendkívül számításigényes feladat – az OpenAI állítólag több mint 25 000 Nvidia Ampere 100 GPU-t használt 100 napon át. A becsült energiafelhasználás 50 gigawattóra, ami elegendő egy közepes méretű város egyéves energiaellátásához. A Google által közölt adatok szerint a képzési szakasz a MI-modellek teljes életciklusbeli energiafelhasználásának 40 százalékát teszi ki, míg a fennmaradó 60 százalék a következtetésre (inference) fordítódik.


Az MI modellek karcsúsítása

A növekvő energiafogyasztás arra sarkallta a számítástechnikai közösséget, hogy olyan módszereket dolgozzon ki, amelyek csökkentik a memória- és számítási igényt. “Az egyik megközelítés a számítások mennyiségének csökkentése,” mondta Jae-Won Chung, a Michigani Egyetem kutatója.

Kezdetben a kutatók a nyesést (pruning) alkalmazták, amely a paraméterek számának redukálására irányul. “Fogsz egy nagy modellt, és lepárolod egy kisebbre, a minőség megőrzése mellett,” magyarázta Chung.

Egy másik hatékony technika a kvantálás (quantization), amely során a paraméterek tárolási formátumát optimalizálják. Az MI-modellek rendszerint 32 bites lebegőpontos számokat használnak, de kisebb formátumra váltva csökkenthető a memóriaigény, és gyorsítható a számítás. Az Nvidia szerint a kvantálás-tudatos képzés 29-51 százalékkal mérsékelheti a memóriahasználatot.

Együtt befejezni

A modellek optimalizációján túl az adatközpontok működése is racionalizálható. A képzési feladatok egyenletes elosztása a 25 000 GPU között nem mindig eredményez hatékony működést. “Amikor a modellt 100 000 GPU-ra bontod szét, több dimenzióban kell szétosztani, és nehéz minden darabot pontosan azonos méretűre szabni,” mondta Chung.

Chung rájött, hogy ha a kisebb munkaterheléssel rendelkező GPU-k lassabban működnek, kevesebb energiát fogyasztva, akkor nagyjából egyszerre fejezik be a munkát a nagyobb terhelésű GPU-kkal, amelyek teljes sebességgel futnak. Ennek érdekében kifejlesztette a Perseus nevű szoftvereszközt, amely elemzi a GPU-k munkaterhelést és meghatározza az ideális futási sebességeket.

A Perseust az OpenAI GPT-3 nyilvánosan elérhető verziójának képzésén tesztelték, és az eredmények ígéretesek voltak. “A Perseus akár 30 százalékkal is csökkenthette az egész rendszer energiafogyasztását,” mondta Chung.

A zárt MI probléma

Miközben szakértők és elemzők próbálnak pontos képet alkotni az adatközpontok jövőbeli energiaigényéről, a valós adatok hiánya nehezíti a pontos kalkulációkat. A Lawrence Berkeley Laboratórium becslése szerint az adatközpontok éves energiafelhasználása 2028-ra 325 és 580 TWh között lehet az Egyesült Államokban – ez az ország teljes villamosenergia-fogyasztásának 6,7-12 százaléka.

Az EPRI arra figyelmeztet, hogy a hatás még jelentősebb lehet, mivel az adatközpontok jellemzően koncentrált helyeken működnek. Virginiában az áramfogyasztás 25 százalékát már most az adatközpontok emésztik fel, míg Írországban várhatóan az áramszükséglet egyharmadát fogják felemészteni.

A nagy nyelvi modellek futtatása jelenleg az adatközpontok energiafogyasztásának csupán 12 százalékát teszi ki, de ez változhat, ha olyan cégek, mint a Google, MI-modelleket integrálnak széles körben használt szolgáltatásaikba.

Chowdhury és Chung szerint azonban a nyilvánosság előtt elérhető számadatok gyakran megbízhatatlanok. “Semmit nem tudunk arról, mi zajlik a ChatGPT vagy a Gemini belsejében, mert az OpenAI és a Google sosem tették közzé az energiafogyasztási adataikat,” állítják.

MI-hatékonysági ranglista

A pontos adatok hiányában a ML Energy Initiative csapata saját méréseket végzett. A ZeusMonitor nevű eszközzel különböző GPU-k energiafogyasztását vizsgálták MI-modellek futtatása során.

A legnagyobb tesztelt modell a Meta Llama 3.1 405B volt, 405 milliárd paraméterrel. Ez kérésenként 3352,92 joule energiát fogyasztott két H100 GPU-n futva, ami körülbelül 0,93 wattóra – lényegesen kevesebb, mint a ChatGPT-re becsült 2,9 wattóra.

Ami továbbra is homályos, az a zártkörű modellek, például a GPT-4, a Gemini vagy a Grok teljesítménye. Chung és Chowdhury szerint a legnagyobb kihívást az átláthatóság hiánya jelenti. “Az olyan cégeknek, mint a Google vagy az OpenAI, nincs ösztönzésük arra, hogy felfedjék az energiafogyasztásukat. Sőt, az ilyen számok nyilvánosságra hozatala kárt okozna nekik,” mondta Chowdhury.

A fák az égig nőnek

“Az adatközpontok energiahatékonysága hasonló trendet mutat, mint a Moore-törvény – csak nagyobb léptékben, nem egyetlen chipre vonatkozóan,” mondta Dion Harris, az Nvidia adatközponti termékmarketingért felelős vezetője. Bár a rackek energiafogyasztása nő, a wattónkénti teljesítmény is jelentős javuláson megy keresztül.

Új, forradalmi technológiák is megjelennek a láthatáron. A fotonikus chipek, amelyek elektronok helyett fényt használnak az információ feldolgozására, nagyságrendekkel energiahatékonyabbak lehetnek a jelenlegi GPU-knál, és a neurális hálózatokat akár fénysebességgel is képesek futtatni.

Egy másik ígéretes fejlesztés a 2D-s félvezetők technológiája, amely lehetővé teszi rendkívül apró tranzisztorok építését, amelyek függőlegesen egymásra helyezhetők, ezáltal jelentősen növelve a számítási sűrűséget.

Ahogyan a történelem mutatja, ha valamit hatékonyabbá teszünk, az emberek hajlamosak többet használni belőle. De Chowdhury szerint, ha már nem áll rendelkezésre elegendő energia a fejlődés fenntartásához, a növekedés lelassul. “Az emberek azonban mindig is jók voltak a megoldások megtalálásában,” tette hozzá.

2025, adminboss, arstechnica.com alapján

  • Mit gondolsz, a személyes életünkben hogyan érinthet minket az adatközpontok növekvő energiafogyasztása?
  • Ha te lennél a FERC tagja, milyen alternatív megoldást javasolnál az Amazon kérelmének elutasítása helyett?
  • Szerinted mi lenne a legfontosabb lépés az AI rendszerek energiahatékonyságának javításában?


Legfrissebb posztok

MA 16:45

A tavasz csillagzáporja: most tetőzik a Lyridák

Évről évre visszatérő látványosság tavasszal a Lyridák meteorraj, amely most április 22-én, szerdán éri el a maximumát...

MA 16:36

Az Asus Zenbook A16 most már tényleg igazi MI‑laptop

Az Asus Zenbook A16 az a hordozható számítógép, amely nemcsak a szokásos „MI-laptop” marketinglózungokat hozza, hanem tényleg lenyűgöző teljesítményt is produkál az új generációs, beépített neurális processzorával...

MA 16:26

A Disney-parkok új korszakba lépnek: visszatér Leia, Han és Luke

Fontos kérdés, hogy milyen újdonságokat tartogatnak a következő évek a Disney parkok szerelmesei számára...

MA 16:03

Az MI térnyerése: mindent letarol, vagy emberibb jövőt hoz?

Alex Imas, a munkaerőpiac és az MI kapcsolatának egyik legjelentősebb kutatója, sokáig nehezen találta meg az okot az optimizmusra...

MA 15:56

Az új NAKIVO-frissítés átírja a kiberbiztonság szabályait

🔒 A folyamatosan kifinomuló zsarolóvírus-támadások és az egekbe szökő leállási költségek mellett különösen lényeges, hogy a vállalatok naprakész védelemmel tartsák kézben adatbiztonságukat...

MA 15:46

A hátborzongató igazság a fej nélküli csirkékről: meddig élnek?

🐍 Érdekes felvetés, hogy egy csirke képes-e futkosni a saját fejének elvesztése után...

MA 15:34

Az űrverseny újraindul: a SpaceX és a Blue Origin Hold-csatája

Az Artemis II űrhajósainak visszatérése után egyre közelebb kerül a NASA következő nagy dobása: az Artemis III küldetés...

MA 15:23

Az éjszakai töltés tényleg hazavágja az akkumulátort?

A legtöbben szeretjük reggel száz százalékos töltöttséggel kézbe venni a telefonunkat, de ezzel a szokással többet ártunk, mint használunk...

MA 15:01

Az Apple dönt helyetted: a lopásvédelem automatikusan bekapcsol

Április 8-án az Apple kiadott egy egészen apró, de annál jelentősebb iOS-frissítést, az iOS 26...

MA 14:46

Az új 200 megapixeles kamerák végre megmutatják, mire képesek

Három évvel ezelőtt még a 200MP-es kamerák inkább hangzatos ígéretnek tűntek, mint valódi forradalomnak...

MA 14:23

A NEO 200 millió dolláros kriptókincse miatt forr a belharc az alapítóknál

Erre utal többek között az, hogy a világ egyik legismertebb okosszerződéses platformján, a NEO-n két társalapító gigászi összecsapása tartja lázban a közösséget...

MA 14:01

Az új drónmotoros RC-autó átírja a sebességrekordokat?

🚀 Stephen Wallis, egy részmunkaidős motorfejlesztő Rugbyből, februárban Guinness-rekordot állított fel, amikor távirányítású autója elképesztő, 377,9 km/h-s sebességet ért el...

MA 13:34

Az érintésmentes érzékelés új korszaka: kapacitív szenzorok működés közben

🖱 Fontos kérdés, hogyan mérhetjük meg a tárgyak távolságát vagy közelségét szinte észrevehetetlen módon, különösen akkor, ha nagy pontosságra van szükség az érzékelésben...

MA 12:57

Az Edge újabb kínos hibája: nem működik a jobbklikkes beillesztés a Teamsben

Na, ennyit erről, de nem lehet szó nélkül elmenni amellett, mennyi fejfájást okozhat egy egyszerű böngészőfrissítés, ha Microsoft-termékről van szó...

MA 12:45

A vezérigazgatók új húzása: kevesebb meeting, több szieszta

Az irodai dolgozók unalmas napi rutinja – megszámlálhatatlan e-mail, egymást érő megbeszélések, hét végére teljes mentális kimerülés – szinte mindenki számára ismerős...

MA 12:34

Az óceán csúcsragadozóit is legyőzheti a túlmelegedés?

🌊 Ebből következően érdemes megérteni, hogy a nagy fehér cápák evolúciós előnye, vagyis az, hogy testhőmérsékletük melegebb marad a tengervízénél, most a túlélésüket veszélyeztetheti...

MA 11:55

A Duolingónál kifulladt az MI‑pánik

Fontos kérdés, miként változik a munkavégzés hatékonysága, ha a mesterséges intelligencia jelenléte már nem kötelező elem az értékeléseknél...

MA 11:25

A QD‑OLED monitorpiac réme: InnoCN GA27S1Q

Külön említést érdemel, hogy az InnoCN új, 27 colos QD-OLED monitora lenyűgöző paraméterekkel lépett piacra, méghozzá olyan árcédulával, amely igencsak kellemetlenül érintheti a nagynevű gyártókat...

MA 11:13

Az első génszerkesztett vérbetegség-kezelés milliós díjat nyert

🧬 A halálos vérbetegségek, mint a sarlósejtes vérszegénység és a béta-thalassemia, most először kaphattak működő gyógymódot a génszerkesztés révén...

MA 11:01

Az Arctic Freezer 4U-OneX: végre csendes, mégis brutálisan hatékony szerverhűtés

🧊 Az Arctic Freezer 4U-OneX kimagasló választásnak bizonyult az AmpereOne processzorokat használó szerverek hűtéséhez, különösen, ha erőteljes, mégis csendes működés a cél...

MA 10:51

Az összeomló egyenletek ura: egymilliárdot érő káosz

Frank Merle francia matematikus az elmúlt évtizedekben olyan egyenletek megfejtésének szentelte életét, amelyek a legapróbb változásokra is kiszámíthatatlanul reagálnak...

MA 10:43

A humanoid robotok már az embereket is lefutják – döbbenetes tempóban

🚶 Több tucat kínai humanoid robot rekordidő alatt száguldott végig a pekingi félmaratonon: a mezőny legjobb gépei több mint tíz perccel verték a leggyorsabb emberi versenyzőt...

MA 10:29

A mesterséges intelligencia felzabálja a kriptót – így reagálnak a cégek

2026 elején az MI-alapú vállalatok 242 milliárd dollárt (kb. 86 000 milliárd forintot, vagyis a globális kockázati tőkebefektetések 80%-át) gyűjtöttek be, miközben a Gartner az idei évre 2,52 billió dolláros (körülbelül 896 000 milliárd forintos) teljes MI-költést jósol...

MA 10:23

A trükk, amivel az Apple Watch tovább bírja egy napnál

Többek között az alvásmonitorozás miatt egyre többen alszanak Apple Watch-csal a csuklójukon...

MA 10:08

A Protobuf.js végzetes hibája, amiről mindenki megfeledkezik

A Protobuf.js, a Google Protocol Buffers JavaScript-megvalósítása, súlyos távoli kódfuttatási hiba miatt került a figyelem középpontjába...

MA 10:01

Az aszály történelmi rekordokat dönt az Egyesült Államokban

Az Egyesült Államok történetének egyik legsúlyosabb aszályát éli át. Jelenleg a délkeleti régió 97%-a és a nyugati terület kétharmada vízhiányos; ez az arány eddig soha nem volt ilyen magas a mérések kezdete óta...

MA 09:50

Az év DeFi-botránya: köddé vált 110 milliárd forint a Kelp DAO-ból

💸 Szinte példa nélküli méretű hack rázta meg a decentralizált pénzügyek világát: a Kelp DAO réteghídként működő LayerZero-protokollján keresztül egyetlen támadó 116 500 rsETH tokent – nagyjából 110 milliárd forintnyi (292 millió USD, kb...

MA 09:29

A London Marathon-rajthelyekkel csapják be a futókat

Különösen említést érdemel, hogy a 2026-os London Marathon közelgő rajtja igazi izgalmat vált ki a futók körében, ami miatt a csalók egyre nagyobb számban próbálnak meg pénzt kicsalni olyan jelentkezőkből, akik kimaradtak a sorsolásból...

MA 09:22

Az orvostudomány Oscarja a látást visszaadó génterápia úttörőié

Jean Bennett molekuláris biológus és Albert Maguire szemész szakorvos, akik egy boncolás során ismerkedtek meg, közös munkájuk eredményeként fejlesztették ki az első szemészeti génterápiát, amely képes helyreállítani a veleszületett vakságot...