2026. 04. 08., 17:04

A mesterséges intelligencia betört a munkahelyre: a GLM-5.1 tarol

A mesterséges intelligencia betört a munkahelyre: a GLM-5.1 tarol
Megvizsgálandó, miben hoz újat, ha egy MI-modell egy teljes munkanapig képes önállóan dolgozni. A kínai Z.ai (Zhupai AI) bemutatta a GLM-5.1-et, a saját fejlesztésű, nyílt forráskódú nagy nyelvi modelljét, amely nemcsak hogy elérhető kereskedelmi célokra és testreszabható, hanem az első, amely egyhuzamban, emberi beavatkozás nélkül, nyolc órán át képes önállóan dolgozni összetett feladatokon.

Az ügynökszerű MI: Nemcsak gyors, hanem kitartó

A legtöbb mai MI-modell inkább sprintelni képes: gyors válaszokat ad, de nagyobb, hosszú távú problémákban hamar elakad, stratégiája szétesik, vagy indokolatlanul ismételget. A GLM-5.1 viszont maratoni futó, amely a hosszabb, komplex feladatokra lett optimalizálva. Masszív, 754 milliárd paraméteres Mixture-of-Experts architektúrával dolgozik, és 202 752 tokenes szövegkörnyezete révén képes a célokat tartani, csökkenteni a hibák halmozódását, és önállóan újratervezni saját stratégiáját.

A fejlesztők szerint az eddigi MI-k átlagosan 20 lépést tudtak önjáróan végigvinni, ám most a GLM-5.1 már 1700 lépéses, eszközhasználattal járó munkafolyamatokat is hiba nélkül lezár, jóval tovább kitolva a produktív horizontot. A modell fejlesztésével a Z.ai nem titkolt célja, hogy maga mögé utasítsa a nyugati piacokon domináló szereplőket, mint a GPT-5.4-et vagy a Claude Opus 4.6-ot.

Kulcstechnológia: Lépcsőzetes optimalizálás, nem csak méret

Bár a GLM-5.1 óriási méretű, valódi újítása abban rejlik, hogy elkerüli a korábbi modellek stagnáló teljesítményét. Míg a legtöbb MI az első pár próbálkozás után lelassul, új ötletek nélkül marad, ez a modell képes újabb és újabb szerkezeti változtatásokra. Egy fejlett adatbázis-optimalizációs teszt (VectorDBBench) során a modell 655 iteráción és több mint 6000 eszközhasználaton át, lépésről lépésre ért el áttöréseket: előbb a sávszélességet felezte, majd kétlépcsős pontozási folyamatot vezetett be, végül többszintű routingot és kvantált döntési mechanizmusokat, így 3500 lekérdezés/másodperc eredményről 21 500-ra ugrott. Ezek a mutatók hatszoros hatékonyságnövekedést jelentenek a korábbi csúcsmodellekhez képest.

Hasonlóképpen, a gépi tanulási architektúrák optimalizálását vizsgáló KernelBench-en a GLM-5.1 nemcsak gyorsulni tudott – képes volt több mint ezer körön át folyamatosan tartani a fejlődést, végül 3,6-szoros gyorsulást elérve a PyTorch referenciához képest. Míg bizonyos feladatokban – mint a kernel-optimalizálás – a Claude Opus 4.6 maradt az élen, az önálló munkaidőben még őt is felülmúlja.

Felhasználási modell és árazás: Új szintű mérnöki eszköz

A GLM-5.1-et nem chatrobotként, hanem professzionális fejlesztői szerszámként pozicionálja a gyártó. A modell többféle előfizetéses csomagban érhető el: a Lite (kb. 9900 Ft/negyedév) egyszerűbb, a Pro (kb. 29 700 Ft/negyedév) összetett, a Max (kb. 79 200 Ft/negyedév) pedig integrált, fejlett felhasználáshoz ajánlott. Ezekhez ingyenes kiegészítő eszközök (például látáselemző, webolvasó, dokumentumolvasó) járnak.

API-s felhasználás esetén 1 millió input token 510 Ft, a kimenet 1600 Ft. Versenytársaival összevetve a GLM-5.1 költsége fele a GPT-5.4-ének, míg a Claude Opus 4.6 tízszer drágább. A kód-inferenciához ajánlott GLM-5 Turbo modell magasabb sebességű, elsősorban automatizált, felügyelt futtatásokhoz ajánlott.

A modell támogatja a helyi futtatást is, így a fejlesztők saját szerveren vagy felhőben is használhatják. Előnye, hogy már fejlett gondolkodási paraméterezéssel (az API-ban) a modell belső lépései és megoldási folyamatai is átláthatók.


Új benchmarkok: Kína átveszi a vezetést?

A GLM-5.1 kiválóan teljesít benchmarkokon: a valódi GitHub-problémák (SWE-Bench Pro) megoldásában 58,4 pontot szerzett, ezzel maga mögé utasította a GPT-5.4-et (57,7), a Claude Opus 4.6-ot (57,3), sőt a Google Gemini 3.1 Pro-t is (54,2). Ezen túlmenően következtetési és ügynökszerű teszteken (Terminal-Bench, CyberGym) is rendre 10–20 százalékkal felülmúlja az előző generációs modelleket. Az egyik leglátványosabb demonstráció során a modell nyolc óra alatt, felügyelet nélkül egy teljes, működő asztali operációs környezetet (fájlkezelő, terminál, játékok, szövegszerkesztő stb.) fejlesztett le, aprólékosan végigcsiszolva a stílust és a működést is.

Nyílt és zárt modellstratégia: Két világ találkozása

A GLM-5.1 MIT-licenc alatt, nyílt forráskódú modellként jelent meg (súlyai elérhetők a ModelScope-on és a Hugging Face-en), így a fejlesztők szabadon használhatják és továbbfejleszthetik. Ám a nagy teljesítményű, gyors Turbo-változatot zárt modellként tartják fenn, csak fizetős szolgáltatás részeként elérhető. Ez a hibrid stratégia egyre elterjedtebb a kínai MI-piacon (pl. Alibaba), és célja, hogy a közösségi ökoszisztéma szélesedjen, miközben a fejlett, üzletileg kulcsfontosságú technológiák stabil bevételi forrást biztosítsanak.

Fejlesztői visszajelzések: Egyheti munkát két nap alatt

A fejlesztői közösség pozitívan fogadta a kiadást, kiemelve a GLM-5.1 üzembiztosságát, önállóságát és azt, hogy nincs szükség prompt-optimalizálásra. Sokan arról számoltak be, hogy olyan feladatokat, amelyek korábban egy-egy hétig tartottak volna – kód előfeldolgozása, logika és hiperparaméterek hangolása – most két nap alatt sikerült lezárniuk. A fejlesztők számára ez azt is jelenti, hogy bátrabban dolgozhatnak, és nem kell tartaniuk az MI-k erőforrás- vagy memóriaszűkössége miatt bekövetkező holtpontoktól. A nyolcórás autonóm teljesítmény különösen nagy visszhangot keltett a közösségi médiában.

A hosszú távú MI-munka: Új korszak kezdete

Mindezek nyomán az MI-fejlesztés elsőbbségét már nem a másodpercenként feldolgozott tokenek száma, hanem a felügyelet nélküli, összefüggő munkaidő fogja meghatározni. Egy modell, amely nyolc órán át ember nélkül dolgozik, átírja a szoftverfejlesztés eddigi menetét. Bár komoly kihívások maradtak (például az önértékelés numerikus mérőszámok nélküli finomhangolása), a GLM-5.1 bemutatásával új mércét állítottak fel. A kérdés így már nem az, hogy mit kérdezhetsz az MI-től, hanem hogy milyen projektet adhatsz ki neki teljes munkaidőre. A fókusz így egyre inkább azokra a rendszerekre tolódik, amelyek valódi, több lépéses projekteket tudnak végigvinni minimális emberi kontroll mellett. Ez az ügynökszerű mérnöki megközelítés új fejezetet nyithat a globális MI-gazdaságban.

2026, adminboss, venturebeat.com alapján

  • Te mit éreznél, ha egy mesterséges intelligencia önállóan dolgozna helyetted több órán keresztül?
  • Te megengednéd, hogy egy ilyen MI teljesen kontroll nélkül oldjon meg egy fontos feladatot?


Legfrissebb posztok

APP
MA 09:11

APPok, Amik Ingyenesek MA, 7/16

Fizetős iOS appok és játékok, amik ingyenesek a mai napon.     Between Dates Calendar Math (iPhone/iPad)A Between Days alkalmazás segítségével egyszerűen és gyorsan meghatározható, hány nap van két dátum között...

MA 06:05

Történelmi események a mai napon (Július 16.)

Kiemelkedő nap: elindult az iszlám időszámítás, fellőtték az Apollo 11-et a Hold felé, és megtörtént a világ első kereskedelmi repülőgép-eltérítése...

szerda 09:49

A Microsoft kibocsátása 25%-kal nőtt – a neheze még hátravan

💨 A Microsoft károsanyag-kibocsátása tavaly 25%-kal nőtt, ami főleg az adatközpontok gyors terjeszkedésének köszönhető...

szerda 09:37

Az adataid a telefonodon maradnak: a Google új AI-dobása a Pixelen

📱 A Google ismét újat mutat a Pixel okostelefonok világában – mostantól az eszközökön futó mesterséges intelligencia még erősebbé teszi a mobilokat, úgy, hogy közben védi a felhasználók adatait...

APP
szerda 09:11

APPok, Amik Ingyenesek MA, 7/15

Fizetős iOS appok és játékok, amik ingyenesek a mai napon.     Between Dates Calendar Math (iPhone/iPad)A Between Days alkalmazás egyszerű és gyors megoldást kínál két dátum közötti napok kiszámítására...

szerda 09:01

Az északkeleti levegő veszélyes: minnesotai erdőtüzek szennyezik

Az Észak-Minnesotában pusztító erdőtüzek füstje hamarosan elérheti az Egyesült Államok északkeleti nagyvárosait, többek között Detroitot, Milwaukee-t, Clevelandet, Philadelphiát és New Yorkot...

szerda 08:49

Az első szintetikus sejt: tényleg megszületett a mesterséges élet?

A Minnesotai Egyetem laboratóriumában újszerű biológiai eredmény született: egy aprócska SpudCell nevű képződmény képes táplálkozni, növekedni, versengeni, osztódni és lemásolni önmagát – vagyis szinte mindent tud, amit egy élő sejt is...

szerda 08:36

Az új Google Képek Pinterest-szerű, felfedezésre kihegyezett átalakítást kapott

A Google Képek (Google Images) megújult külsőt kapott: mostantól személyre szabott galériákat kínál a felhasználóknak, így még könnyebben fedezhetik fel az őket érdeklő képeket...

szerda 08:12

A Google DeepMind az USA-t tenné az MI-szabványok élére

A Google DeepMind vezére, Demis Hassabis szerint az új generációs mesterséges intelligencia egyre komolyabb veszélyeket rejt magában, például a kiberbiztonság és a biológiai fenyegetések terén...

szerda 08:01

Az új Alzheimer-gyógyszer felforgatja a megszokott kezeléseket

💊 Fontos kérdés, hogy meg lehet-e állítani vagy lassítani az Alzheimer-kór lefolyását, hiszen a demencia legfőbb oka, az Alzheimer-kór, világszerte rengeteg embert érint...

szerda 07:49

Az űrben tovább tart az amerikai–orosz űrhajósok összefogása

🚀 Sikeresen megérkezett kedden a Nemzetközi Űrállomásra egy amerikai–orosz személyzet, miután a kazahsztáni Bajkonurból indultak a Roszkoszmosz által üzemeltetett Szojuz MS-29 fedélzetén...

szerda 07:37

A Microsoft Secure Bootja tíz éve lyukas, észre sem vették

🔒 Az informatika egyik legfontosabb biztonsági eleme, a Secure Boot, már csaknem tíz éve lényegében védtelenné vált – és ezt eddig senki sem vette észre...

szerda 07:24

A csípős paprika növelheti egy halálos rák kockázatát?

Bár a csípős paprika számos kultúra elválaszthatatlan része, és egyes laboratóriumi kísérletek a bennük található vegyületeket, például a kapszaicint gyulladáscsökkentőnek vagy akár daganatellenesnek mutatják, az utóbbi évek humán kutatásai nem ennyire egyértelműek...

szerda 07:02

Az Artemis II: „Furcsán nézett ki a Hold” 250 ezer mérföldről

Április 6-án négy űrhajós indult el az Artemis II misszió keretében az Orion űrhajóval, és körülbelül 40 percig teljesen eltűntek a Föld látóteréből...

szerda 06:38

A Microsoft rekordméretű javításözöne: 570 hiba és 3 zero-day

🔧 Szinte példátlanul nagy frissítési csomagot adott ki a Microsoft a 2026...

szerda 06:25

A volt dolgozók részrehajló MI-t sejtenek a leépítések mögött – perelik a Metát

💼 Májusban a Meta megvált dolgozóinak 10 százalékától, közel 8 000 alkalmazottat küldött el, ami jelentős átszervezéssel járt a vállalat MI-re és adatközpontokra irányuló fejlesztései miatt...

szerda 06:05

Történelmi események a mai napon (Július 15.)

Időutazás egyetlen napon: Jeruzsálem falainak áttörésétől 🏰 a Rosetta-kő 🗿 megtalálásán és Napoleon 🚢 megadásán át a Grunwaldnál vívott döntő ütközetig ⚔️, sőt a modern korszakban a törökországi puccskísérletig 🇹🇷 és a Mozilla alapításáig 🦊...

kedd 18:31

Az Ozempic és a Wegovy tényleg lassíthatják a biológiai öregedést?

Tipikus eset, amikor egy ismert gyógyszer egészen váratlan előnyöket kínál. A GLP-1 típusú szerek, mint az Ozempic, a Wegovy vagy a Rybelsus, eredetileg a fogyás, a jobb vércukorszint-szabályozás és a szívbetegségek kockázatának csökkentése miatt váltak népszerűvé...

kedd 17:30

Az indiai tudósok megalkották az emberi agytörzs eddigi legrészletesebb 3D-atlaszát

Indiai kutatók a világ eddigi legrészletesebb, háromdimenziós agytörzs-atlaszát hozták létre, amelyben MRI-felvételeket több mint 500 mikroszkópos szövetrészlettel kapcsoltak össze...

kedd 17:01

A Tejútrendszer mélyén cukrot találtak a kutatók

Többek között különleges eredményre jutottak a kutatók: a Tejútrendszer középpontjához közel egy óriási gázfelhőben felfedeztek egy ritka cukorfélét, az eritrózt, amely nemcsak málnában, hanem barnító krémekben is megtalálható...

kedd 16:01

Az IBM 23%-ot zuhant a második negyedéves profitfigyelmeztetés után

Ami kezdetben ártalmatlannak tűnt, végül az IBM történetének egyik legsötétebb napjához vezetett a tőzsdén...

kedd 15:01

A NASA Perseverance-je célba ért: megvan a marsi maraton

🚀 Történelmi teljesítmény született a Marson: a Perseverance marsjáró öt év és négy hónap után elérte a 42,195 kilométeres maratoni távot...

kedd 12:01

A régi T‑Mobile-csomagoknak vége: kényszerváltás már ezen a héten

Ami kezdetben ártalmatlannak tűnt, most minden régi T-Mobile-előfizető számára valódi változás: a társaság e héttől kezdve automatikusan átsorolja a 10–15 éves tarifákat – például a Simple Choice, T-Mobile One, One Plus, a Magenta családhoz tartozó, valamint a Sprintből áthozott régi csomagokat – modernebb tarifákra...

kedd 11:31

Az inflációs adat előtt megroggyan a Bitcoin

A legnagyobb kriptovaluták teljesítménye az elmúlt 24 órában jelentősen visszaesett, miután egyre többen valószínűsítik, hogy az amerikai jegybank akár már júliusban kamatemelés mellett dönt...

kedd 11:02

Az analóg fotózás visszatér: a fiatalok újra tekercsre lőnek

Az elmúlt pár évben váratlan fordulat történt a fotózás világában: a fiatal generáció újra felfedezte a filmes fényképezőgépeket...

kedd 10:49

A Turing-mítosz vége: lehet, hogy tévedett a mesterséges intelligenciáról?

🤔 A mesterséges intelligencia kutatása 75 éve követi Alan Turing útmutatását, aki két alapvető feltételezést tett: az intelligencia létrehozható szoftverből, függetlenül a testtől, és hogy egy gép intelligensnek számít, ha sikerrel utánozni tudja az embert, például egy beszélgetés során...

kedd 10:37

Az MI átírja a marketinget: a régi szabályoknak befellegzett

💡 A Fortune 500 cégek vezető marketingesei kénytelenek szembenézni azzal a ténnyel, hogy a korábbi, jól bevált módszerek egyszerűen elavultak...

kedd 10:25

A júliusi Google-frissítés felturbózza a Play Áruházat, Wear OS-t és a Térképet

🚀 A legújabb Google System-frissítés idén nyáron ismét ráncfelvarrást hoz az Android-felhasználóknak...

kedd 10:01

Végre itt a hideg vízzel elkészíthető Cup Noodles!

🍹 Lényeges szempont, hogy az instant tészták villámgyors megoldást kínálnak, legyen szó egyetemista vacsoráról vagy gyors munkahelyi ebédről...