Az MI-modellek csúfosan elbuktak a focifogadásokban
A legfejlettebb MI-rendszerek ismét bebizonyították, hogy az emberi intuíciót nem könnyű pótolni, amikor a valódi, összetett világot kell értelmezni. Egy Londonban működő startup, a General Reasoning a 2023–24-es Premier League-szezon virtuális újrajátszásán tesztelte nyolc vezető MI-rendszer tudását: a rendszerek megkapták minden csapat részletes statisztikáit és történelmi adatait, a cél pedig az volt, hogy modelljeikkel maximalizálják a nyereséget, miközben kézben tartják a kockázatokat.
A virtuális fogadások kudarca
A rendszerek három próbálkozási lehetőséget kaptak: mindig 100 000 egységből gazdálkodhattak, nem használhatták az internetet, és minden eredményt saját számításaikból kellett levezetniük. Többen – például xAI Grok 4.20 és Acree Trinity – le is nullázták magukat már az első körben. Még a legjobbak – mint a Google Gemini 3.1 Pro vagy az Anthropic Claude Opus 4.6 – is jelentős veszteségeket értek el az egyes próbálkozások során: utóbbi végül átlagosan csak 89 035 egységet tudott megőrizni. A Google Gemini egyszer 34%-os nyereséget is produkált, de aztán szintén elbukott egy következő körben.
Miért bukik el az MI az igazi világban?
A mérleg kimutatta: minden vizsgált MI-modell hosszú távon pénzt veszített, és rendszeresen alulmaradt az emberekkel szemben. Ez kifejezetten megnyugtató lehet a pénzügyi és a marketing szektorban dolgozók számára, akik attól tartanak, hogy az MI elveszi a munkájukat. Ross Taylor, a General Reasoning vezetője szerint itt látható igazán, milyen hiányosságai vannak az MI-nek – a legtöbb benchmark túl egyszerű, mesterséges helyzetet vizsgál, ahol a valóság bonyolultsága és a hosszú távú fejlődés nem jelenik meg.
Valódi kihívások nélkül nincs igazi fejlődés
Ezért a csupán a szoftverkódolásban mutatott MI-sikerek félrevezetők lehetnek, ha a való élet bonyolult és kiszámíthatatlan történéseihez kell alkalmazkodni. Az MI-modellek csak akkor lehetnek igazán hasznosak, ha az ilyen réteges, időben elnyúló, folyamatosan változó valós problémákban is képesek helytállni – márpedig erre jelenleg nem képesek, ezért még sokáig szükség lesz az emberi kreativitásra és tapasztalatra.
Április 10-én négy asztronauta sikeresen tért vissza a Földre az Artemis II küldetésről, miután a NASA történetének első emberes holdkerülő útját hajtották végre több mint fél évszázad után...
Jellemző példa erre, hogy az Anthropic egyre kifinomultabb MI-modelleket fejleszt, melyek képesek mélyen rejtőző biztonsági hibákat felfedezni a szoftverkódban, és akár az adminisztrátori szintű hozzáférést biztosító sebezhetőségeket is kihasználni...
Komolyan mondom, ma már a benzinkúton tankolni felér egy kisebb lakáshitel felvételével, főleg amióta Iránban kitört a háború, egekbe szöktek az árak...
Élénk ünneplés kísérte az Artemis II küldetés hazatérését, amikor 2026. április 10-én az Orion űrhajó tíznapos holdközeli út után a Csendes-óceánba csobbant San Diego partjainál...
Kiemelkedő nap a történelemben: a Fort Sumter elleni lövésekkel elindult az amerikai polgárháború, a Columbia űrrepülőgép első útjára indult, és biztonságosnak nyilvánították a járványokat megtörő gyermekbénulás elleni vakcinát...
Az Egyesült Államokban súlyos légiforgalmi irányítóhiány alakult ki, ezért a Szövetségi Légügyi Hatóság (FAA) szokatlan megoldáshoz folyamodott: mostantól célzottan videójáték-rajongók jelentkezését várják...
Több mint 20 000 kriptovaluta-csalás áldozatát sikerült azonosítani egy nemzetközi rendőrségi akció során Kanadában, az Egyesült Királyságban és az Egyesült Államokban...
A bitcoinbányászok számára sosem volt ennyire nehéz a helyzet: az átlagos előállítási költség egyetlen bitcoin esetén már 32 millió forint (88 000 USD), miközben a piaci ár épp csak eléri a 25 millió forintot (69 200 USD)...
🕵 Egy lényeges szempont, hogy az egészségi állapotunkkal kapcsolatos titkaink védelme mindig fontos volt: az orvosok, ügyvédek és pszichológusok titoktartási kötelezettsége biztosítja, hogy bizalommal forduljunk hozzájuk...
⚡ Egy 67 éves, sokak által “őrültnek” tartott elmélet nyert bizonyítást: kaliforniai kutatók stabilizálták az egyik legreaktívabb szerves molekulát vízben, és ezzel fényt derítettek arra, mire képes valójában a B1-vitamin (tiamin) az élő szervezetekben...
☉ Miközben a Mars felszínén már több rover is rendületlenül kutat évek óta, könnyű elfelejteni, mennyire összetett feladat lenne hasonlót megvalósítani más bolygókon...
💻 A YuanLey YS100-0602T egy pénztárcabarát, de meglepően sokat tudó 8 portos 10GbE switch, ami sokak számára első ránézésre ismerős lehet – nem véletlenül, hiszen a hardveres alapok szinte teljesen megegyeznek a SICSOLINK modelljével...
A rendszámfelismerő kamerák és más fejlett megfigyelési rendszerek ma már alapvető eszközei lettek a helyi rendőrségeknek, de számos amerikai államban egyre többen próbálnak törvényi úton gátat szabni a személyes adatok tömeges gyűjtésének...
A bélrendszerünkben több milliárdnyi mikroba él, amelyek kulcsszerepet játszanak nemcsak az emésztésben és az immunrendszer működésében, hanem talán abban is, hogy milyen ételeket kívánunk meg...
🚀 A NASA Artemis II missziójának legizgalmasabb pillanata közeleg: az űrhajó rövidesen visszatér a Földre, és az Orion kapszula rekordot döntő legénysége landol a Csendes-óceánban...