2025. 04. 03., 14:01

Az OpenAI jogszabályokon felülemelkedve használja az O’Reilly könyveket az MI tanításához

Az OpenAI jogszabályokon felülemelkedve használja az O’Reilly könyveket az MI tanításához
Tim O’Reilly, a neves tech könyvkiadó vezetője azt állítja, hogy az OpenAI engedély nélkül használta fel a kiadó szerzői jogvédelem alatt álló könyveit a legújabb GPT-4o modell betanításához. Mindez annak ellenére történt, hogy a cég már több szerzői jogi per alanya hasonló tevékenységek miatt, bár az OpenAI tagadja a jogsértést.

Rejtett módszerekkel a nyomok után

O’Reilly a “Nem nyilvános adatok szerepe az LLM-ek előképzésében” (Beyond Public Access in LLM Pre-Training Data) című tanulmány társszerzőjeként vizsgálta meg, hogy a GPT-4o felhasznált-e 34 szerzői jogvédelem alatt álló O’Reilly Media könyvet. A kutatók úgynevezett DE-COP teszteket végeztek: feleletválasztós kérdéseket tettek fel, amelyek során a modellnek négy opció közül kellett kiválasztania, melyik szövegrészlet származik eredeti O’Reilly könyvből. Ha a modell helyesen azonosította az eredeti szövegeket, az erősen arra utalt, hogy ezeken a szövegeken tanult.

A tesztek alapján a GPT-4o 82%-os pontossággal ismerte fel az eredeti szövegrészleteket, ami egyértelműen arra utal, hogy valószínűleg a kiadó anyagain képezték ki. A kutatók szerint az OpenAI a hírhedt LibGen adatbázist használhatta, amely mind a 34 tesztelt könyvet tartalmazza – ugyanazt az adatbázist, amelyet korábban a Meta is alkalmazott a Llama modellek betanításához.

 

Érdekes módon a 2022-es GPT-3.5 modell csak alig 50% feletti eredményt ért el, ami arra enged következtetni, hogy “a nem nyilvános adatok szerepe az OpenAI modelljeinek előképzésében jelentősen megnőtt az idők során”. Ugyanakkor a kisebb GPT-4o Mini modell, amely 2024-ben jelent meg, nem tűnik úgy, mintha O’Reilly könyvek alapján tanult volna, vélhetően kisebb paraméterkészlete miatt.

A jogsértő gyakorlat veszélyei

A kutatók figyelmeztetnek: a szerzők megfelelő kompenzálásának hiánya “az egész internet lezülléséhez” vezethet. “Ha az MI-cégek értéket vonnak ki a tartalomkészítők által előállított anyagokból anélkül, hogy méltányosan kompenzálnák az alkotókat, azzal éppen azokat az erőforrásokat merítik ki, amelyektől MI-rendszereik függenek,” érvelnek.

 

Az MI-óriások láthatóan tisztában vannak azzal, hogy nem támaszkodhatnak csak az internetes adatgyűjtésre, ezért licencszerződéseket kötnek kiadókkal és közösségi hálózatokkal. Az OpenAI tavaly szerződést kötött a Reddittel és a Time magazinnal is archívumaik felhasználására. Ugyanakkor a cég nemrég arra kérte az amerikai kormányt, hogy lazítson a szerzői jogi korlátozásokon, azzal érvelve, hogy a merev szabályok elnyomják az innovációt és a befektetéseket.

 

Miközben az MI-modellek készítői a korlátlan hozzáférésért harcolnak, mások akadályokat állítanak a szerzői jogok védelmében. A Cloudflare nemrég bemutatta AI Labyrinth nevű bot-ellenes MI-jét, amely a robots.txt utasításokat figyelmen kívül hagyó adatgyűjtőket egy hamis oldalakból álló labirintusba csalja, pazarolva idejüket és számítási erőforrásaikat.

 

Az éppen 40 milliárd dolláros finanszírozást szerző OpenAI egyelőre nem reagált a megkeresésekre.

2025, adminboss, go.theregister.com alapján

Legfrissebb posztok

MA 15:12

A Sony hátrál a PC-től – és így Kínától is

😢 A Sony meglepő visszalépése a PC-s játékkiadások terén nemcsak a PC-s játékosokat érinti, hanem Kínát is, ahol óriási kereslet mutatkozott az olyan címek iránt, mint a Halálháló 2 (Death Stranding 2)...

MA 14:56

A Targetben árult organikus tápszert visszahívták botulizmus-járvány miatt

Az Egyesült Államok több államában csecsemőbotulizmus-fertőzés után visszahívták a Nara Organics organikus babatápszerét, amelyet országosan a Target üzleteiben és online árusítottak...

MA 14:34

Az USA leállíttatta az Anthropic Fable 5, Mythos 5 nyilvános hozzáférését

Érdemes megvizsgálni, mi áll az Anthropic vezető MI-modelljeinek hirtelen lekapcsolása mögött, és milyen hatásai lehetnek az üzleti világ számára...

MA 14:23

A Musk–Page szakítás ellenére a Google és a SpaceX közelebb mint valaha

Elon Musk és Larry Page egykor elválaszthatatlan barátok voltak, mostanra azonban kapcsolatuk inkább szoros üzleti versengéssé és érdekvezérelt együttműködéssé változott...

MA 14:00

A brit rendőrt azzal vádolják, hogy MI-vel hamisított bizonyítékot

Bűnügyi vizsgálat indult az Egyesült Királyságban, miután egy rendőrt azzal gyanúsítanak, hogy mesterséges intelligencia segítségével hamisított bizonyítékokat több ügyben is...

MA 13:55

Az első ember megkapta a sejtfiatalító terápiát – indul az időutazás?

Megérkezett a korszakváltó terápiák első hulláma: egy amerikai vállalat most először próbálja meg visszaforgatni az idő kerekét az emberi sejtekben...

MA 13:44

Az új pacemaker forradalmasíthatja a szívbetegek kezelését

❤️ Külön említést érdemel, hogy a most kifejlesztett szívritmusszabályzó nem igényel műtéti beavatkozást az áramforrás cseréjéhez...

MA 13:34

A Samsungod 5 rejtett funkciója, amiről te sem tudtál

Az Android világában a Samsung készülékek mindig kicsit többet adnak, mint az alapcsomag...

MA 13:01

A sakktáblán életre kelnek: robotok küzdenek egymással

♘ A sakktáblák automatizálása már nem újdonság, hiszen eddig is akadtak olyan megoldások, ahol a bábuk alatt mágnes segítségével vagy kívülről, egy robotkarral mozgatták a figurákat...

MA 12:56

A következő milliárdokat zsákmányoló kriptóhacker emberfeletti gyorsasággal csap le?

Anthropic vadonatúj MI-modellje, a Claude Fable 5, minden eddiginél összetettebb és gyorsabb érvelési és programozási képességeket kínál...

MA 12:01

A lila USB-portok: miért vannak, és miért ritkák az USA-ban?

Sokan bele sem gondolunk, miért van az, hogy az USB-portok más-más színűek, amíg meg nem lepődünk egy különc lila vagy narancssárga csatlakozón...

MA 11:45

A Copilot berobban az angol egészségügybe: félmillió dolgozó kap MI-t

💉 A brit egészségügy szemmel láthatóan komoly digitális fordulat elé néz: több mint félmillió orvos, nővér és háttérdolgozó kap hozzáférést a Microsoft 365 Copilot nevű MI-eszközhöz...

MA 11:33

A Meta Quest 3 felrobbant, tűzoltók vizsgálják a maine-i esetet

🔥 Egy maine-i családi házban kisebb tűz ütött ki, amikor egy ott hagyott Meta Quest 3 külső akkumulátora váratlanul felrobbant az éjjeliszekrényen...

MA 11:12

A tudat valószínűleg nem csak a Föld kiváltsága

👽 Hihetetlen, de mégis igaz, hogy a tudatosság kérdése egyre fontosabbá válik, ahogy az univerzum határait kutatjuk, és a mesterséges intelligencia fejlődése is egyre gyorsul...

MA 11:00

Az Amazon-vezér amerikai tisztviselőkkel tárgyalt, jött a szigor az Anthropic ellen

Az Amazon vezérigazgatója, Andy Jassy személyesen számolt be amerikai tisztviselőknek arról, hogy kutatóik az Anthropic egyik legújabb MI-modelljét, a Fable 5-öt olyan információk előállítására vették rá, amelyeket elvileg nem lett volna szabad...

MA 10:54

Az NHS Palantir-adatplatformjáról a betegek nem léphetnek ki – a kórházuk igen

Érdekes felvetés, hogy az angliai egészségügyi ellátásban részt vevő páciensek nem dönthetnek arról, hogy adataikat feldolgozzák-e a Palantir által fejlesztett NHS Federated Data Platformon (FDP), miközben kórházaik elutasíthatják a rendszer használatát...

MA 10:46

Az amerikai kormány lecsapott: tiltás a Fable 5-re és a Mythos 5-re

🚫 Jellemző példa erre, hogy váratlanul szűnik meg egy népszerű technológia elérhetősége: a legújabb exportkorlátozási döntés értelmében minden felhasználó számára világszerte, azonnali hatállyal lekapcsolták a Fable 5 és Mythos 5 modellek hozzáférését...

MA 10:36

A hetvenes éveidben elkezdett hangszer a memóriád őre lehet

🎵 Ahogy növekszik a várható élettartam, a gondolkodási képességek gyakran változnak, az emlékezőtehetség pedig különösen sérülékennyé válik...

MA 10:28

A tudósok lehűtik: a mobilok nem alakítják át a gyerekek agyát

Többek között ismét felmerült a kérdés, vajon tényleg átformálja-e a gyerekek agyát az okostelefon-használat és a közösségi média...

MA 09:37

A GM 250 ezer villanyautója visszatáplál – jönnek a hálózati nátriumion-akkuk

Egy lényeges szempont, hogy az elektromos autózás fejlődése nem csupán a közlekedést, hanem a teljes energiahálózatot átalakíthatja...

MA 09:19

A kínai hackerek tíz évig kémkedtek egy elszigetelt hálózatban

🔎 Egy nagy szervezet elkülönített kritikus infrastruktúrahálózatába jutott be a Velvet Ant nevű kínai kibercsoport, és tíz éven keresztül zavartalanul kémkedett...

APP
MA 09:11

APPok, Amik Ingyenesek MA, 6/14

Fizetős iOS appok és játékok, amik ingyenesek a mai napon.     CrestWall – 4K Wallpapers (iPhone/iPad)A CrestWall egy kézzel válogatott 4K felbontású háttérképeket kínáló alkalmazás, amely azoknak szól, akik szeretnék egyedivé tenni iPhone-juk kinézetét...

MA 09:10

A volfrámhiány feléleszti az amerikai bányászlázat

🪘 Az elmúlt hónapok feszültségei és a hadiipar egyre növekvő igényei a volfrám iránt új lendületet adtak az Egyesült Államok bányászati ambícióinak...

MA 09:01

A gombák láthatatlan hálója a Naprendszeren is túlér

🥀 Érdekes felvetés, hogy a világ felszíne alatt láthatatlanul behálózzák bolygónkat a gombafonalak: a kutatók szerint, ha az összes arbuszkuláris mikorrhiza gomba fonalait egyetlen vonalba fűznénk, azok messze túlnyúlnának a Naprendszer határán is...

MA 08:55

Az indexek kora: Tényleg a SpaceX diktálja a megtakarításaid jövőjét?

💸 Érdekes felvetés, hogy a világ legnagyobb technológiai cégeinek értékével vetekedő óriáscégek, mint a SpaceX, hirtelen bekerülhetnek mindenki portfóliójába, pusztán az indexek ereje miatt...

MA 08:45

A Lucyra vadászó óriáskrokodil rettegésben tartotta elődeinket

Több mint 3 millió évvel ezelőtt Kelet-Afrika a későbbi emberi ősök – köztük a híres Lucy – számára nem csupán a túlélésről szólt...

MA 08:37

Az Apple Watch kihívói: 7 napos üzemidő egyetlen töltéssel

📱 Aki elgondolkodott már az Apple Watch lecserélésén, annak valószínűleg elsőként a rövid üzemidő juthat eszébe hátrányként...

MA 08:19

Az amerikai kormány kitiltaná a külföldieket a Fable és Mythosból

🚫 Az Anthropic hirtelen felfüggesztette két legerősebb MI-modellje, a Fable 5 és a Mythos 5 használatát világszerte, miután az amerikai kormány exportkorlátozási rendelettel azonnali tiltást rendelt el minden külföldi állampolgár számára...

MA 08:01

Az űripar és az MI felforgatta a tőzsdét: soha nem látott csúcsok

Például a Wall Streeten pénteken végre fellélegeztek, amikor a SpaceX legendás tőzsdei bevezetése minden várakozást felülmúlt...