2026. 03. 16., 20:34

Az MI áttörése: Itt a bizonyítások automatizálásának kora?

Az MI áttörése: Itt a bizonyítások automatizálásának kora?
A matematika világa épp most forradalmasodik: ahogy a mesterséges intelligencia egyre gyorsabban fejlődik, a matematikusok is egyre nehezebben látják előre, milyen szerepük marad a jövőben. Képzelj el egy korszakot, ahol minden lehetséges matematikai bizonyítás már elkészült, csupán egy kattintásra várva. De vajon mikor lesz mindez valóság, és vágynak-e egyáltalán erre a matematikusok?

Új játékosok a matematikai csatatéren

A matematikai kutatásokban kulcsszerepet játszó MI-óriások, mint az OpenAI vagy a Google DeepMind, már nem is burkolt céllal igyekeznek uralni a bizonyítások világát. A First Proof nemzetközi projekt például azért jött létre, hogy felmérje, mire képesek valójában a nagy nyelvi modellek a komoly matematikai kutatások területén. Most újabb tesztkör kezdődik, szigorú követelményekkel – csak azok az MI-cégek vehetnek részt, amelyek hajlandók teljes transzparenciát vállalni. Egészen pontosan mindenkivel szemben elvárás, hogy hozzáférést biztosítsanak a tesztelendő modellekhez.

Az elmúlt néhány hónapban a legfejlettebb nyilvános modellek már olyan érvényes bizonyításokat generáltak, amelyek ténylegesen segítik a matematikusok munkáját. Az első tesztkör minden várakozást felülmúlt: a csapat által választott tíz – addig publikálatlan – lemma közül az OpenAI modellje ötnél, a Google DeepMind Aletheia-ügynöke pedig hat esetben adott helyes bizonyítást. Ráadásul rendre más-más problémákat oldottak meg, vagyis a modellek kompetenciái egymástól jelentősen eltértek.

Mégis, mi vár ránk öt év múlva?

Sokan félik az MI térnyerését, de a szakma meghatározó szereplői között optimisták is akadnak. Daniel Litt, a Torontói Egyetem matematikusa szerint a következő öt évben a matematikusok hatékonyabbá válhatnak a technológia révén. Litt egy elképzelt világot ír le, ahol az MI által generált, végtelen matematikai bizonyítások könyvtárában bárki szabadon böngészhet. De szerinte a felfedezés és a megértés öröme mindig az emberé marad – a lényeg nem a gépies bizonyítás, hanem a megértés.

Később azonban hangsúlyozza, hogy a jelenlegi helyzet még messze nem tökéletes. Bár a modellek akár nyolc problémát is megoldottak, a próbálkozások túlnyomó része félresikerült: rengeteg oldalnyi hibás, de magabiztos szöveget állítottak elő. Az MI hajlamos hitelesen előadni tévesen értelmezett matematikai eredményeket, vagy elrejteni kritikus hibákat bonyolult számítások mélyén.

A minőség ára: Hogyan ítéljük meg a bizonyításokat?

A First Proof első köre rámutatott, milyen nehéz helyesen értékelni az MI által készített matematikai bizonyításokat. Egyes hibák annyira elemiek, hogy hozzáértő ember aligha követné el őket, a modellek azonban nem tudatosan tévednek – egyszerűen csak nem értik a teljes matematikai kontextust.

A következő körben a szervezők független, anonim matematikai szakértőket vonnak be a bírálatba, akiket támogatásokból és MI-cégek adományaiból fizetnek majd. Ugyanakkor az MI által írt, apró hibáktól hemzsegő bizonyítások mennyisége már most is az emberi értékelők kapacitását veszélyezteti: az értékelés lassú, a hibák felismerése rendkívül nehéz.


A hozzáférés szakadéka: Nyilvános kontra céges MI

Megdöbbentő különbség mutatkozott a nyílt és a céges MI-fejlesztések között. Miközben a First Proof előkészületi fázisában a legjobb nyilvános modellekkel mindössze két problémát sikerült helyesen megoldani, a Google és az OpenAI saját zárt modelljeikkel nyolcat is meg tudtak oldani. A nyílt MI-közösségi próbálkozások csak egy újabb problémát oldottak meg.

Ennek oka lehet, hogy a cégek fejlettebb, publikálatlan modelleket vagy speciális belső technikákat használnak, esetleg emberi szakértők segítségét is igénybe vették. A Google állítása szerint viszont emberi beavatkozás nélkül dolgozott. Az újabb forduló pontosan ezt az átláthatósági problémát próbálja megoldani: minden beérkező modellt közvetlenül a First Proof csapata fog tesztelni.

A matematika jövője a leggazdagabbak fókuszában

Kérdés, hogy az MI-cégek hajlandók lesznek-e teljesíteni az új feltételeket, vagy a matematikai MI-fejlesztés hamarosan visszaszorul a titkos laborok világába. A First Proof és társai az elkövetkező hónapokban akár meg is jósolhatják a matematika sorsát, hiszen most először fordult elő, hogy ez a szűk tudományos szféra a világ legvagyonosabb techcégeinek figyelmét is felkeltette.

A cél, hogy néhány éven belül magabiztosan lehessen tájékoztatni a fiatalokat arról, milyen lesz a matematikus szakma – ennek feltétele pedig az MI valódi képességeinek megértése.

2026, adminboss, www.scientificamerican.com alapján

Legfrissebb posztok

APP
szerda 09:11

APPok, Amik Ingyenesek MA, 6/17

Fizetős iOS appok és játékok, amik ingyenesek a mai napon.     Planetary Hours + Widget (iPhone/iPad) Risp: Budget & Savings (iPhone/iPad) ICD-10 Dictionary (iPhone/iPad) Between Dates Calendar Math (iPhone/iPad) Monthly Dystopia (iPhone/iPad) War Mongrels (iPhone/iPad) ContactVault Pro (iPhone/iPad) FormatX: Video Audio Converter (iPhone/iPad) ImgRef (iPhone/iPad) Inkflow Plus Visual Notebook (iPhone/iPad) CrestWall – 4K Wallpapers...

kedd 19:34

A Wharton szerint később ürülhet ki a TB-kassza

A pennsylvaniai Wharton Egyetem új kutatása szerint a társadalombiztosítás nyugdíjalapja a vártnál később apadhat el...

kedd 19:23

A Star Wars-legenda Mark Hamill kulcsszerepben a Twisted Metalban

🤓 Mark Hamill, akit a Csillagok háborúja (Star Wars) világából Luke Skywalkerként őrzünk emlékezetünkben, csatlakozik a Csavart fém (Twisted Metal) sorozat harmadik évadához...

kedd 19:12

A Firefox 152 megújul: jön a JPEG XL, új beállítások

A Firefox böngésző legfrissebb, 152-es verziója több fontos fejlesztést hoz. A leglátványosabb változás a teljesen átalakított beállítási felület, amely átláthatóbbá és egyszerűbben kezelhetővé teszi a böngésző személyre szabását...

kedd 19:02

Az első nukleáris óra elindult – jön az ötödik kölcsönhatás?

⚡ Tipikus eset, amikor egy évtizedeken át lehetetlennek hitt ötlet hirtelen valósággá válik...

kedd 18:57

Az új Pókember-film sztárjai: a Galaxy Z Flip 7 és Fold 7

🚀 A Samsung legújabb büszkeségei, a Galaxy Z Flip 7 és a Galaxy Z Fold 7 komoly szerepet kaptak a Pókember: Vadonatúj nap (Spider-Man: Brand New Day) című filmben...

kedd 18:45

Az ultramély kutatás: Sakana AI 100 oldalas jelentést készít 8 óra alatt

🔬 Tokióban egy új MI-alapú vállalkozás, a Sakana AI dobta piacra a Marlint, első kereskedelmi termékét, amely forradalmasíthatja a vállalati kutatási jelentéseket...

kedd 18:24

Az új Ebola-járvány mekkora veszélyt jelent?

A Kongói Demokratikus Köztársaságot sújtó új Ebola-járvány már a harmadik legnagyobbnak számít a világon...

kedd 18:02

A CISA figyelmeztet: újabb cPanel-bővítmény-hibát aktívan kihasználnak

Az amerikai kiberbiztonsági hivatal, a CISA háromnapos határidőt adott az állami szerveknek, hogy frissítsék a LiteSpeed cPanel felhasználói bővítményét, miután ismertté vált egy aktívan kihasznált sérülékenység, amellyel a szervereket támadják...

kedd 17:11

A Hold-méretű, száguldó ütköző, amely felforgatta a Vénusz forgását

Ami először apróságnak tűnt, mára a Vénusz egyik legnagyobb rejtélyévé vált: a bolygó rendkívül lassú, ráadásul ellentétes irányú tengely körüli forgása...

kedd 17:01

A zsarolóbandák a Microsoft Teams reléivel álcázzák forgalmukat

Érdemes megvizsgálni, milyen kifinomult módszereket alkalmaznak a bűnözők, amikor eltüntetik rosszindulatú forgalmukat a védekezésre berendezkedett rendszerek elől...

kedd 16:55

Az okos medál, ami jelzi, meddig napozhatsz leégés nélkül

A legtöbb viselhető kütyü a lépéseidet, a pulzusodat vagy a véroxigénszintedet méri, de most érkezett egy olyan eszköz, ami teljesen másra fókuszál: a bőröd egészségére és a napsugárzás követésére...

kedd 16:45

Hány elemi részecske létezik valójában?

😰 Fontos kérdés, hogy hányféle elemi részecske létezik valójában. A fizikában ez nem is olyan egyszerű, mint amilyennek elsőre tűnhet...

kedd 16:12

A Threads már havi félmilliárd felhasználónál jár

Felmerül a kérdés, hogy mi állhat a Meta új szöveges közösségi hálójának hatalmas népszerűsége mögött...

kedd 15:56

A nő, aki Elon Musk mellett óriássá tette a SpaceXet

🚀 Gwynne Shotwell nevét a nagyközönség ritkán hallja, pedig nélküle elképzelhetetlen volna a SpaceX hihetetlen felemelkedése...

kedd 15:45

Az Nvidia 25 milliárd dolláros kötvénykibocsátással turbózza az MI-versenyt

Megemlíthető, hogy az Nvidia, a világ egyik vezető chipgyártója, öt év után először ismét jelentős kötvénykibocsátásra készül: több mint 25 milliárd dollár (kb...

kedd 15:25

A Samsung S95H OLED: lenyűgöző, de nem a várt Frame TV

Minden évben hatalmas felhajtás övezi a legújabb televíziókat, és mostanra a Samsung S95H OLED igazi különlegességnek számít ebben a mezőnyben...

kedd 15:01

A SprySOCKS új Windows-változata kormányzati rendszereket támad világszerte

A SprySOCKS néven ismert kártékony szoftver elsőként Linux rendszereken tűnt fel, de a közelmúltban megjelentek Windows-változatai is, amelyek kormányzati szervezeteket céloznak több országban, köztük Tajvanban, Thaiföldön, Pakisztánban és Hondurasban...

kedd 14:44

A Gmail AI-összegzései már mindenkinél futnak – így kapcsolod ki

Többek között már nem kell magadnak elolvasnod az e-maileket: a Gemini ezentúl átnézi őket helyetted – akár akarod, akár nem...

kedd 13:57

A 2026-os Razer Blade 18 letarolja a mezőnyt – ha meg tudod fizetni

🚀 A Razer Blade 18 (2026) ismét új szintre emeli, mit jelent egy valódi gamer laptop...

kedd 13:34

A Fortinet FortiSandbox kritikus sebezhetőségeit már aktívan kihasználják

⚠ Felmerül a kérdés, mennyire vagyunk biztonságban, ha még a legnagyobb kiberbiztonsági cégek termékei is súlyos hibákat rejtenek...

kedd 13:23

Az új COVID-oltások továbbra is óvják a szívet, kutatás szerint

Bár a legtöbb amerikai már nem igényli a szezonális COVID-19-oltásokat, a legújabb vakcinák továbbra is jelentős védelmet nyújtanak a szív- és érrendszeri megbetegedések ellen, különösen a 75 év felettieknek és a krónikus betegségben szenvedőknek...

kedd 13:01

Az iRhythm közölte: hackerek ellopták a betegek adatait

🔒 A digitális egészségügyi szolgáltató iRhythm Holdings súlyos adatlopást jelentett be, miután hackerek érzékeny személyes és egészségügyi adatokat tulajdonítottak el a cég által használt külső üzleti alkalmazásokból...

kedd 12:46

Az Atacama közepe a hittnél 20 millió évvel korábban száradt ki

🌍 Chile északi részén, a Föld egyik legszárazabb területén húzódik az Atacama-sivatag, amely évente átlagosan kevesebb mint 5 milliméter csapadékot kap...

kedd 12:34

Az Xbox Game Studios vezetője és stábfőnöke távozik – jön a reset?

Lényeges szempont, hogy a vezetői szintű távozások megrázhatják az egész játékipart, különösen akkor, ha azokat komoly változások előzik meg...

kedd 12:24

Az amerikaiak miért utálják egyre jobban az MI-adatközpontokat?

Az idei év elején egy hatalmas, hat darab, egyenként 21 méter magas épületből álló adatközpont terveit ejtették Észak-Karolinában, miután a fejlesztőt szigorodó szabályok és a helyi lakosság tiltakozása miatt visszalépésre kényszerítették...

kedd 11:56

A Philips Hue új Play lámpákkal, gyertyaizzókkal és kapcsolókkal támad

Az okos izzók és fényszalagok (Lightstrip) mellett mostantól a hagyományos csillárok és retró lámpák is integrálhatók a Philips Hue rendszerébe...

kedd 11:34

A Starlink mellett veszélyesen darabokra hullott egy kínai rakéta

Egy kínai magánvállalat által fejlesztett Zhuque-2E rakéta felső fokozata a fellövés után néhány órával széthullott, mindössze néhány száz kilométerre a Föld felszínétől, ahol a Nemzetközi Űrállomás, valamint számos Starlink-műhold kering...