MA 09:10

A kutatók mindössze 1500 dollárból tanítottak be egy alapmodellt a semmiből

A kutatók mindössze 1500 dollárból tanítottak be egy alapmodellt a semmiből
A nagy nyelvi modellek (LLM-ek) fejlesztése eddig csak a leggazdagabb technológiai óriások privilégiuma volt, hiszen ezek betanítása brutális számítási kapacitást és világszintű adathalmazokat igényel. Egy új megközelítés azonban most mindent felforgathat, hiszen a Sapient kutatói 1 milliárd paraméteres LLM-et tanítottak be mindössze 540 000 forintért és 1,9 nap alatt, töredéknyi adattal.

Az LLM-ek fájdalmas drágasága

A vállalatok többsége hiába vágyik saját mesterséges intelligenciára, a jelenlegi LLM-ek betanítása elérhetetlenül drága és bonyolult. A klasszikus recept: végigpörgetni a teljes internetet, minden szövegre ránézni és rengeteg grafikus processzort zsongatni napokon át. Minden egyes újabb iteráció – legyen szó kísérletről vagy finomhangolásról – milliókba kerülhet, és elképesztő infrastruktúrát követel.

Ez nem csupán technikai, hanem üzleti korlát is egyben. A legtöbb próbálkozó hamar rájön: ha a modell hibázik, még nagyobbra kell nőnie, még több adatra és számításra van szükség, de a javulás már egyre kevésbé jelentős. Ráadásul a legtöbb, vállalati adattal dolgozó szervezet nem szeretné érzékeny vagy saját fejlesztésű információit az egész interneten tanított MI-re bízni. Nekik egy kisebb, személyre szabható, okos modell kell, amely képes a szabályok, számok és struktúrák között összefüggéseket keresni.

Egy újfajta mesterséges intelligencia-architektúra

A Sapient által bemutatott HRM (Hierarchical Recurrent Model) teljesen szakít a Transformer-architektúrák mindenhatóságával. Az új modellben a számítás két részre oszlik: egy lassabb, stratégiai (H-modulra) és egy gyors, végrehajtó komponensre (L-modulra). Ez megfelel annak, ahogy az emberek gondolkodnak: nagyobb lépésekben tervezzük, mit akarunk elérni, miközben a részletekben gyors, folyamatos kiigazítások történnek.

A HRM-Text nevű változatnál a fejlesztők kizárólag utasítás–válasz párokon tanították be az MI-t, elhagyva a nyers szöveges előrejelzést, tehát a brutális szövegmásolás helyett olyan tanulás zajlott, amely közel áll a tipikus vállalati környezethez: a felhasználó feladatot ad, az MI válaszol.

Trükkök és újdonságok, hogy tényleg működjön

A klasszikus visszacsatolt (recurrent) neurális hálók nagy léptékben könnyen instabillá válnak, különösen, ha a nyelv modellezése a cél. A Sapient két kulcsfontosságú újítást vezetett be: a MagicNorm nevű normalizációs eljárás megoldja az információs jelek elszállását vagy eltűnését, míg egy különleges „bemelegítő” tanítási technika kezdetben rövidebb gondolkodási hurkokat enged, majd fokozatosan növeli ezek mélységét és hosszát.

A HRM-Textnél a feladatvégzés vált a tanulási célkitűzéssé: az MI csak akkor „kapott jutalmat”, ha a teljes válasz helyes volt, nem pedig apró lépésekért. Az utasítás–válasz párokat eredeti szövegek, matematikai és logikai feladatok, tankönyvi példák, átírt tudáselemek képezték. Gondosan ügyeltek arra is, hogy kivegyék a „gondolkodásom” típusú lépéseket, ezzel is biztosítva a hierarchikus gondolkodás kialakulását.


Számok és eredmények: a kis modell nagyot szól

A Sapient által betanított HRM-Text mindössze 1 milliárd paraméterből áll, mégis meggyőzően szerepelt kulcsfontosságú ipari teszteken. A modellt 40 milliárd tokenen (szóelem) tanították, miközben versenytársai ennek a százszorosánál is többet dolgoznak fel. A teljes tanítás költsége 540 000 forint volt, 16 GPU-n futott 1,9 napig.

Az eredmény? A HRM-Text 60,7%-ot ért el az MMLU, 84,5%-ot a GSM8K és 56,2%-ot a MATH benchmarkokon – összemérhetően (sőt helyenként jobban is) teljesített a 2–7 milliárd paraméteres, széles körben használt nagy alapmodellekkel. Emellett az előzetes tudás memorizálása helyett a valódi érvelést, szabálykövetést, összefüggés-alkotást helyezi előtérbe, ami a vállalati igényekhez jobban igazodik.

Jellemző példa erre, hogy olyan teszteken, ahol kizárólag makulátlan, „szennyezésmentes” adatokat használtak, a modell továbbra is kiemelkedő pontszámokat szerzett.

Mit jelent ez a vállalatok számára?

A belső MI-re vágyó szervezetek most először reálisan vállalkozhatnak saját, titkosított, cégspecifikus modellre. A HRM-Text csak egy kiindulási alap: a gyakorlati implementáció során a cégek maguk választhatják meg, hogy pontosan mit akarjon tárolni az MI, milyen irányban fejlesszék tovább, illetve hogy a „modellezett és gondolkodó mag” döntési motorként szolgáljon, miközben a tényeket, tudásbázisokat, adatbázisokat külön, külső forrásból hívja elő.

Emellett a kritikus hangok szerint az utasítás–válasz tréning eltér az eddigi módszerektől, nem lehet összevetni a hagyományos, nyers szöveggel tanított MI-kkel. Azonban a gyakorlat gyakran ezt kívánja: a felhasználók utasításokat adnak, amelyekre az MI-nek pontos, tartalmas választ kell adnia.

Ha a tanítás ára 540 000 forintra zuhan, a vállalati MI már nemcsak infrastruktúra-kérdés, hanem stratégiai lehetőség lesz: a cégek végre saját, célzott MI-t építhetnek anélkül, hogy függnének a külső gigászoktól, és anélkül, hogy minden adatukat kiadnák másnak.

2026, adminboss, venturebeat.com alapján

Legfrissebb posztok

MA 11:56

A tudósok leállítják a rák DNS-javítását, áttörve a gyógyszerrezisztenciát

Fontos kérdés, hogy miért tud a rák olyan makacsul ellenállni a kezeléseknek, és miért válnak bizonyos daganatok egy idő után szinte legyőzhetetlenné...

MA 11:45

A Microsoft okozta memóriaár-válság az Xboxot is térdre kényszerítheti

📈 Meglepő fordulatot vett a következő Xbox-generáció fejlesztése, ugyanis a Microsoft egyre inkább azzal számol, hogy nem tud olyan konzolt piacra dobni, amely valóban modernnek érződik, és közben a legtöbb ember számára elérhető áron kínálható...

MA 11:23

A LibreOffice szerint az Euro‑Office a Microsoft foglya – orosz szálakkal?

🕵 Az utóbbi időben heves vita alakult ki arról, mennyire szolgálja az állítólagosan európai fejlesztésű Euro-Office a digitális szuverenitás eszméjét...

MA 11:13

A 2026-os FIFA-vb bárhonnan: így hallgathatod élőben

🎙 A 2026-os FIFA-világbajnokság minden mérkőzését élőben követheted, még akkor is, ha éppen nem vagy otthon...

MA 10:57

Az MI és a big data megelőzné a hajléktalanságot – Vilmos herceg programja

Az Egyesült Királyságban nagy lépés készül a hajléktalanság felszámolására: egy több mint 25 szervezetet összefogó új kezdeményezés indult útjára, melynek célja, hogy korszerű adatkezeléssel és MI segítségével megelőzhetővé váljon a hajléktalanság...

MA 10:47

A sejtek öregedésének rejtett, visszafordítható okát találták meg

Az évek múlásával testünk sejtjei egyre kevésbé képesek energiát termelni és alkalmazkodni a változó igényekhez...

MA 10:37

A DDR5-árak 2028-ig nem normalizálódnak – sőt, ez optimista

A számítógép-alkatrészek folyamatos drágulása ismét a középpontba került: iparági vezetők szerint a DDR5 RAM-árak még legalább két évig biztosan nem térnek vissza elfogadható szintre, sőt egyesek szerint az igazi normalizálódásra akár 2029-ig vagy 2030-ig is várnunk kell...

MA 10:28

A Kingdom Hearts 4 előzetesében Héraklész és Elemi, dátum sehol

💓 A rajongók már hosszú ideje várják a következő nagy Kingdom Hearts-játékot, de a várakozás egyelőre nem lett könnyebb...

MA 10:19

Az IKEA visszafogott piknikszettje a legstílusosabb, praktikus, olcsó – elkapkodják

A legtöbb piknikeszköz rikító, élénk színekben pompázik, de előfordul, hogy az ember visszafogottabb, elegáns megoldásra vágyik...

MA 10:11

Az Indiai-óceán ötmillió éves bálnatemetője több száz mérföldön át

A tudósok egy hatalmas, több száz kilométeren át húzódó bálnatemetőt fedeztek fel az Indiai-óceán mélyén...

MA 10:01

Az inflációs viharban egyedül a bitcoin állta a sarat

💰 A kriptopiac mozgalmas hetet zárt, hiszen a májusi inflációs adatok jelentős mozgásokat hoztak – bár az igazi nagy nyertes egyedül a bitcoin lett...

MA 09:55

A Bitcoin mélyen jár – és a neheze még hátra van

Elérkezett a pillanat, amikor a Bitcoin értéke ismét kritikus zónába zuhant...

MA 09:29

A 2026-os vb ingyen: nézd élőben, csatornák és menetrend

🏆 A világ legnagyobb focitornája hamarosan kezdődik: 2026-ban 48 ország csap össze 104 mérkőzésen, 16 stadionban, három ország – az Egyesült Államok, Kanada és Mexikó – városaiban...

APP
MA 09:11

APPok, Amik Ingyenesek MA, 6/11

Fizetős iOS appok és játékok, amik ingyenesek a mai napon.     ICD-10 Dictionary (iPhone/iPad)Ez az alkalmazás lehetőséget ad arra, hogy ICD-10 kód, betegség neve vagy akár tünet alapján is könnyedén keresgéljünk...

MA 09:01

Az adatvédelem újra fókuszban: új token-szabványokat vizsgálnak az Ethereumon

Ami kezdetben ártalmatlannak tűnt, mára a blokklánc-technológia egyik legradikálisabb fordulatává vált: ismét a felhasználók adatvédelme került reflektorfénybe...

MA 08:48

Az első teljes vírusgenom kvantumszámítógépen: új korszak kezdődik

🚀 Történelmi pillanatnak lehetünk tanúi: először töltöttek fel teljes vírusgenomot egy kvantumszámítógépre, új távlatokat nyitva a biológiai kutatásokban...

MA 08:37

Az XRP 1,10 dollár fölött, szárnyalnak az ETF-beáramlások, mégis óvatosak a befektetők

Az XRP enyhén emelkedik, de továbbra is jelentős lemaradásban van a kriptopiac egészéhez képest...

MA 08:28

A bitcoin nem csak ETF-fronton szenved: a céges vétel elapadt

A bitcoin árfolyama néhány hét alatt közel 74 000 dollárról 60 000 dollár alá zuhant, és nemcsak az ETF-ekből menekülnek a befektetők...

MA 08:19

Az MI-re jön az FAA-szabályozás? Mit jelent a cégeknek?

Az MI fejlődése olyan tempót diktál, amire már nem lehet hagyományos módon reagálni...

MA 08:01

A BlackRock és a Fidelity uralják az amerikai bitcoin ETF-piacot

A bitcoin ETF-ek piaca teljesen átrendeződött az elmúlt másfél évben. A kezdeti hatalmas választék után mára két óriás, a BlackRock és a Fidelity szinte teljesen uralja a piacot az intézményi befektetők körében...

MA 07:56

A polgármester testvére perli Los Angelest a Palisades-tűz után

🔥 Érdemes megvizsgálni, milyen következményekkel jár, amikor egy súlyos tűzeset után még a polgármester családtagja is bepereli a várost, amelyet a saját testvére vezet...

MA 07:47

Az Ügynökök Utolsó Vizsgáján GPT-5.5 lenyomta a Claude Fable 5-öt

🧠 Tipikus eset, amikor egy friss nemzetközi kutatás valósággal földbe döngöli a legmenőbb MI-rendszerek státuszát: az Agents’ Last Exam (ALE) nevű új, kőkemény mérési benchmarkon a legjobb nagy nyelvi modellek is legfeljebb 24%-os teljesítményt produkáltak...

MA 07:37

Az Xbox-vezér látta az Elder Scrolls 6-ot: lenyűgöző, jól halad

Nyolc év telt el azóta, hogy a Bethesda bejelentette a The Elder Scrolls 6 fejlesztését, amire a rajongók már régóta tűkön ülve várnak...

MA 07:28

A Valheim 1.0-ra várva próbáld ki ezt a hatalmas RPG-vé alakító térképet

🗺 Valheim világa már önmagában lenyűgöző, hiszen minden új kaland kezdete az ismeretlenbe vezet, ahol a természet, a vadállatok és megannyi kihívás vár...

MA 07:19

A japán holdrobot, amely történelmi fotót készített a felborult szondáról

A Hold felszínét bejáró intelligens japán robot 2024-ben száz percen át működött, miközben sorsdöntő fotókat készített arról, hogyan került oldalára, majd feje tetejére a leszállóegység...

MA 07:02

A nagy fordulat: Russell T Davies távozik – mi lesz a Dokival?

Fontos kérdés, hogy mi vár a Ki vagy, Doki? (Doctor Who) sorozat rajongóira, miután Russell T Davies, a legendás showrunner ismét búcsút intett a sorozatnak, ráadásul a Bad Wolf produkciós céggel együtt...

MA 06:49

Az áttörést ígérő rák-vérteszt megbukott a nagyszabású vizsgálaton

😞 A rák korai felismerését célzó innovatív tesztek már évekkel ezelőtt izgalomba hozták az orvostudományt: sokan remélték, hogy ezek segítségével egyszerű vérvétellel még idejében felfedezhető a legtöbb daganat...

MA 06:37

A Yellowstone-ból videojáték készülhet – apád kedvenc sorozata jön konzolra?

A Yellowstone (Yellowstone) körüli világ most új irányba bővül: videójáték-adaptáció készülhet a kultikus családi westernből...

MA 06:28

A MassMutual MI-stratégiája: 12 hónapos szerződések, 30%-os ugrás, nulla kötöttség

A MassMutual az MI-korszak gyors változásaira rugalmas és ötletes választ talált...