Brutális GPU-megtakarítás: Az Alibaba új MI-technológiája mindenkit meglep!
A kínai Alibaba óriási erőforrás-megtakarítást ért el a mesterséges intelligencia terén: új technológiájával 82 százalékkal csökkentette a GPU-igényt az inferenciafeladatokban. Ez azt jelenti, hogy ugyanannyi vagy még több modellt képesek egyszerre kiszolgálni kevesebb hardverrel – ám ez nem az a „DeepSeek-momentum”, amely felforgatná az egész MI-piacot.
A GPU-pazarlás ellenszere
Az Alibaba Cloud több mint egymillió modell közül választ ki néhányat, amelyeket a felhasználók ténylegesen futtatnak. Korábban kénytelenek voltak a GPU-park 17,7 százalékát lekötni, hogy ezzel csupán az ügyféligények 1,35 százalékát szolgálják ki. Mivel a szokásos GPU-k memóriája miatt egy kártyán csak két-három modell futhatott, rengeteg elavult vagy gyengén használt hardver vesztegelt tétlenül, miközben a beszerzésük egyre nehezebb lett az amerikai embargók miatt.
Aegaeon: új ütemezés, kevesebb hardver
Erre válaszul fejlesztették ki az Aegaeon nevű GPU-poolozó és memóriamenedzsment technológiát, amellyel több modellt képesek összevonni egyetlen GPU-n, az adatok egy részét pedig a gazdagép memóriájába vagy más tárolókba terelik. Egy friss, három hónapos tesztben 1192 helyett csak 213 GPU-ra volt szükségük ugyanannak a feladatnak az ellátásához – vagyis 82 százalékos megtakarítást értek el, és egyes GPU-kon már tucatnyi modell is futhat egyszerre.
Az eljárás bizonyított, komoly szakmai konferencián is elismerték, és valóban javítja a hatékonyságot – ugyanakkor nem lehet tudni, hogy a nagy, nemzetközi felhőszolgáltatók már nem alkalmaznak-e hasonló vagy akár fejlettebb megoldásokat. Az viszont biztos, hogy az egyre szaporodó iparági vagy speciális MI-modellek miatt létfontosságú lesz minden GPU-ból a maximumot kihozni, hogy a kevésbé népszerű modellek futtatása se kerüljön aranyárba. Az Alibaba megoldása ebben segíthet, de a piac nem fog megremegni tőle.
2025, adrienne, go.theregister.com alapján
filózó
Te hogyan osztanád be a számítógépes erőforrásokat ilyen helyzetben?
Szerinted jó döntés előnyben részesíteni a hatékonyabb modelleket a ritkán használtakkal szemben?
Te mit tennél, ha még jobban kellene csökkenteni a hardverhasználatot?
🤓 Mark Hamill, akit a Csillagok háborúja (Star Wars) világából Luke Skywalkerként őrzünk emlékezetünkben, csatlakozik a Csavart fém (Twisted Metal) sorozat harmadik évadához...
A Firefox böngésző legfrissebb, 152-es verziója több fontos fejlesztést hoz. A leglátványosabb változás a teljesen átalakított beállítási felület, amely átláthatóbbá és egyszerűbben kezelhetővé teszi a böngésző személyre szabását...
🚀 A Samsung legújabb büszkeségei, a Galaxy Z Flip 7 és a Galaxy Z Fold 7 komoly szerepet kaptak a Pókember: Vadonatúj nap (Spider-Man: Brand New Day) című filmben...
🔬 Tokióban egy új MI-alapú vállalkozás, a Sakana AI dobta piacra a Marlint, első kereskedelmi termékét, amely forradalmasíthatja a vállalati kutatási jelentéseket...
Az amerikai kiberbiztonsági hivatal, a CISA háromnapos határidőt adott az állami szerveknek, hogy frissítsék a LiteSpeed cPanel felhasználói bővítményét, miután ismertté vált egy aktívan kihasznált sérülékenység, amellyel a szervereket támadják...
Ami először apróságnak tűnt, mára a Vénusz egyik legnagyobb rejtélyévé vált: a bolygó rendkívül lassú, ráadásul ellentétes irányú tengely körüli forgása...
Érdemes megvizsgálni, milyen kifinomult módszereket alkalmaznak a bűnözők, amikor eltüntetik rosszindulatú forgalmukat a védekezésre berendezkedett rendszerek elől...
A legtöbb viselhető kütyü a lépéseidet, a pulzusodat vagy a véroxigénszintedet méri, de most érkezett egy olyan eszköz, ami teljesen másra fókuszál: a bőröd egészségére és a napsugárzás követésére...
Megemlíthető, hogy az Nvidia, a világ egyik vezető chipgyártója, öt év után először ismét jelentős kötvénykibocsátásra készül: több mint 25 milliárd dollár (kb...
A SprySOCKS néven ismert kártékony szoftver elsőként Linux rendszereken tűnt fel, de a közelmúltban megjelentek Windows-változatai is, amelyek kormányzati szervezeteket céloznak több országban, köztük Tajvanban, Thaiföldön, Pakisztánban és Hondurasban...
Bár a legtöbb amerikai már nem igényli a szezonális COVID-19-oltásokat, a legújabb vakcinák továbbra is jelentős védelmet nyújtanak a szív- és érrendszeri megbetegedések ellen, különösen a 75 év felettieknek és a krónikus betegségben szenvedőknek...
🔒 A digitális egészségügyi szolgáltató iRhythm Holdings súlyos adatlopást jelentett be, miután hackerek érzékeny személyes és egészségügyi adatokat tulajdonítottak el a cég által használt külső üzleti alkalmazásokból...
🌍 Chile északi részén, a Föld egyik legszárazabb területén húzódik az Atacama-sivatag, amely évente átlagosan kevesebb mint 5 milliméter csapadékot kap...
Az idei év elején egy hatalmas, hat darab, egyenként 21 méter magas épületből álló adatközpont terveit ejtették Észak-Karolinában, miután a fejlesztőt szigorodó szabályok és a helyi lakosság tiltakozása miatt visszalépésre kényszerítették...
Egy kínai magánvállalat által fejlesztett Zhuque-2E rakéta felső fokozata a fellövés után néhány órával széthullott, mindössze néhány száz kilométerre a Föld felszínétől, ahol a Nemzetközi Űrállomás, valamint számos Starlink-műhold kering...