A Wikidata új adatbázisa átalakítja a mesterséges intelligencia világát
A Wikidata, a Wikipédia testvérprojektje, jelentős újítással rukkolt elő: olyan adatbázist fejlesztettek, amely jelentősen megkönnyíti, hogy mind a felhasználók, mind az MI-fejlesztők hozzáférjenek, és hatékonyabban keressenek hatalmas adattáraikban. A kezdeményezést a németországi Wikimedia Deutschland vezette, ahol egy éven át dolgoztak azon, hogy a Wikidata 19 millió bejegyzését a hagyományos, kissé nehézkes formátumból úgynevezett vektorokká alakítsák át. Ezek a vektorok a szövegek és fogalmak közötti kapcsolatokat jelenítik meg – például a híres szerző, Douglas Adams nevéhez nemcsak a művei, hanem az „ember” fogalom is kapcsolódik ily módon.
Egységesített adatáramlás a fejlesztőknek
Fontos, hogy a Wikidata felhasználói felülete változatlan marad; továbbra sem lesz a Wikipédia például chatbot. Ennek ellenére a háttér-infrastruktúra teljesen átalakul: az új adatbázisnak köszönhetően az MI-fejlesztők könnyebben hozzáférhetnek majd az információkhoz saját fejlesztéseikhez, például chatbotokhoz. Jina AI MI-modelljével vektorokká alakították az adatokat, az IBM leányvállalata, a DataStax pedig térítésmentesen biztosítja a vektoralapú adatbázis tárolását is. A tervezet fő célja, hogy a kisebb technológiai szereplők is ugyanolyan könnyedén tudják hasznosítani ezeket az adatkincseket, mint a nagyvállalatok, például az OpenAI vagy az Anthropic.
Befolyás a szélesebb MI-fejlesztési közösségre
Így tehát a Wikidata újítása nemcsak a pénzben bővelkedő nagy techcégeknek, hanem a kisebb fejlesztői közösségeknek is kulcsfontosságú. Fontos szempont, hogy az MI-chatbotok eddig főként a leggyakoribb internetes témákra és szavakra koncentráltak, ezért a szűkebb, speciális ismeretek háttérbe szorultak. Mostantól azonban sokkal könnyebb lesz akár kevéssé ismert, hiánypótló adatokhoz is hozzáférni, amelyek eddig nem kaptak kellő figyelmet. Példaként említhető egy kereshető közadatokat kínáló platform, ahol nemzetközi hivatalos személyek közösségi média elérhetőségei is megtalálhatók.
Egyelőre azonban az új, vektorizált adatbázis csak a 2024. szeptember 18-ig rögzített adatokat tartalmazza, a további frissítések előtt visszajelzéseket várnak a fejlesztőktől. Az adatbázis ereje abban rejlik, hogy nem az egyes apró szerkesztéseken, hanem az általános összefüggéseken és jelentéseken van a hangsúly, így a kisebb módosítások nem rontják az adathasználat élményét. Az új formátum segít abban, hogy az MI-rendszerek ne csak információkat, hanem azok teljes kontextusát is megértsék.
📖 Érdekes felvetés, hogy meddig tarthatunk ki a klasszikus e-olvasók mellett, amikor a gyártók folyamatosan újabb funkciókkal és technológiai bravúrokkal próbálnak meggyőzni minket...
💸 A két amerikai technológiai óriás, az Amazon és az Alphabet idén rekordösszegű beruházással készül forradalmasítani a mesterséges intelligencia területét...
🐍 A kígyók gyakrabban lesznek kannibálok, mint gondolnánk – legalább tizenegy esetben fejlődött ki náluk önállóan ez a viselkedés, ami egyre több kutató szerint stratégiai előnyt jelent a faj túlélése szempontjából...
Az elmúlt évtizedekben az egészségügyi rendszerek és a tudomány komoly sikereket értek el a fertőző betegségek kezelése és megelőzése terén, mégis egyre gyengülnek a közegészségügyi intézkedések...
A kínai ByteDance új Seedance 2.0 videógenerátora felbolygatta a filmipart. A cég friss fejlesztése lehetővé teszi, hogy a felhasználók mindössze szöveges utasítások alapján 15 másodperces videókat hozhassanak létre, akár hírességek szerepeltetésével vagy ismert filmkarakterek megjelenítésével, teljesen szabadon...
💫 A James Webb űrteleszkóp és a Chandra röntgenobszervatórium lenyűgöző részletességű képeket készítettek egy formálódó galaxishalmazról, amely akkor létezett már, amikor az univerzum mindössze egymilliárd éves volt...
A legújabb kutatások szerint a Viagra és a Cialis hatóanyagai nemcsak a szexuális életben hoznak javulást, hanem komoly egészségügyi előnyöket is kínálnak a szív, az agy és a tüdő számára...
Fontos kérdés, hogy valójában mennyire veszélyesek a sztatinok, hiszen ezek a szív- és érrendszeri betegségek megelőzésére leggyakrabban alkalmazott gyógyszerek közé tartoznak...
Jellemző példa erre, hogy az OpenAI legújabb fejlesztése lehetővé teszi a felhasználók számára, hogy szinkronizálják a névjegyeiket a ChatGPT-vel – vagyis a mesterséges intelligencia most már könnyedén hozzáférhet ahhoz, hogy milyen telefonszámokat tárolnak az ismerőseid a telefonjukban...
Egy lényeges szempont, hogy a Geekom eddig főként miniszámítógépeiről volt ismert, amelyek a monitor mögé rejthetők vagy az asztal alá csúsztathatók...
🐧 Február 17-én különleges égi jelenség, úgynevezett „tűzgyűrű” napfogyatkozás következik, amelyet szinte kizárólag az Antarktisz lakatlan tájain lehet majd megfigyelni...
📦 Az internet páratlanul gazdag története veszélybe került, mivel olyan alapvető logfájlok tűnnek el, amelyek nélkül a jövő emberei talán soha nem érthetik meg, hogyan alakultak át a társadalmi és technikai rendszerek napjainkban...
🏠 Az elmúlt évek pandémiás fellendülése idején soha nem látott kereslet söpört végig az amerikai lakáspiacon, rekordalacsony szintre csökkentve az eladó ingatlanok és az építési telkek számát...
Érdekes felvetés, hogy a 2026-os év beköszöntével nemcsak a várva várt sorozat- és filmpremierekre kell számítani, hanem arra is, hogy ezekhez egyre borsosabb előfizetési díj társul...
Érdemes megvizsgálni, hogy az Artemis holdmissziók előkészületeivel kapcsolatos műszaki nehézségek sokasága miként hátráltatja a NASA előrehaladását a történelmi jelentőségű út előtt...
Az Apple a héten kiadott frissítésekben javította az iOS-t és a macOS-t is egy olyan, több mint tíz éve kihasználható biztonsági rést, amelyet vélhetően célzott támadások során használtak fel kereskedelmi kémszoftverek fejlesztői...