2025. 04. 03., 14:01

Az OpenAI jogszabályokon felülemelkedve használja az O’Reilly könyveket az MI tanításához

Az OpenAI jogszabályokon felülemelkedve használja az O’Reilly könyveket az MI tanításához
Tim O’Reilly, a neves tech könyvkiadó vezetője azt állítja, hogy az OpenAI engedély nélkül használta fel a kiadó szerzői jogvédelem alatt álló könyveit a legújabb GPT-4o modell betanításához. Mindez annak ellenére történt, hogy a cég már több szerzői jogi per alanya hasonló tevékenységek miatt, bár az OpenAI tagadja a jogsértést.

Rejtett módszerekkel a nyomok után

O’Reilly a “Nem nyilvános adatok szerepe az LLM-ek előképzésében” (Beyond Public Access in LLM Pre-Training Data) című tanulmány társszerzőjeként vizsgálta meg, hogy a GPT-4o felhasznált-e 34 szerzői jogvédelem alatt álló O’Reilly Media könyvet. A kutatók úgynevezett DE-COP teszteket végeztek: feleletválasztós kérdéseket tettek fel, amelyek során a modellnek négy opció közül kellett kiválasztania, melyik szövegrészlet származik eredeti O’Reilly könyvből. Ha a modell helyesen azonosította az eredeti szövegeket, az erősen arra utalt, hogy ezeken a szövegeken tanult.

A tesztek alapján a GPT-4o 82%-os pontossággal ismerte fel az eredeti szövegrészleteket, ami egyértelműen arra utal, hogy valószínűleg a kiadó anyagain képezték ki. A kutatók szerint az OpenAI a hírhedt LibGen adatbázist használhatta, amely mind a 34 tesztelt könyvet tartalmazza – ugyanazt az adatbázist, amelyet korábban a Meta is alkalmazott a Llama modellek betanításához.

 

Érdekes módon a 2022-es GPT-3.5 modell csak alig 50% feletti eredményt ért el, ami arra enged következtetni, hogy “a nem nyilvános adatok szerepe az OpenAI modelljeinek előképzésében jelentősen megnőtt az idők során”. Ugyanakkor a kisebb GPT-4o Mini modell, amely 2024-ben jelent meg, nem tűnik úgy, mintha O’Reilly könyvek alapján tanult volna, vélhetően kisebb paraméterkészlete miatt.

A jogsértő gyakorlat veszélyei

A kutatók figyelmeztetnek: a szerzők megfelelő kompenzálásának hiánya “az egész internet lezülléséhez” vezethet. “Ha az MI-cégek értéket vonnak ki a tartalomkészítők által előállított anyagokból anélkül, hogy méltányosan kompenzálnák az alkotókat, azzal éppen azokat az erőforrásokat merítik ki, amelyektől MI-rendszereik függenek,” érvelnek.

 

Az MI-óriások láthatóan tisztában vannak azzal, hogy nem támaszkodhatnak csak az internetes adatgyűjtésre, ezért licencszerződéseket kötnek kiadókkal és közösségi hálózatokkal. Az OpenAI tavaly szerződést kötött a Reddittel és a Time magazinnal is archívumaik felhasználására. Ugyanakkor a cég nemrég arra kérte az amerikai kormányt, hogy lazítson a szerzői jogi korlátozásokon, azzal érvelve, hogy a merev szabályok elnyomják az innovációt és a befektetéseket.

 

Miközben az MI-modellek készítői a korlátlan hozzáférésért harcolnak, mások akadályokat állítanak a szerzői jogok védelmében. A Cloudflare nemrég bemutatta AI Labyrinth nevű bot-ellenes MI-jét, amely a robots.txt utasításokat figyelmen kívül hagyó adatgyűjtőket egy hamis oldalakból álló labirintusba csalja, pazarolva idejüket és számítási erőforrásaikat.

 

Az éppen 40 milliárd dolláros finanszírozást szerző OpenAI egyelőre nem reagált a megkeresésekre.

2025, adminboss, go.theregister.com alapján

Legfrissebb posztok

MA 07:19

A súlyos OpenClaw-hiba: bárki átvehette a weboldalak feletti irányítást

Egy friss sebezhetőség tette lehetővé, hogy rosszindulatú weboldalak teljesen átvegyék az irányítást az OpenClaw nevű, önállóan futtatható MI-platform fölött...

APP
MA 07:12

APPok, Amik Ingyenesek MA, 3/2

Fizetős iOS appok és játékok, amik ingyenesek a mai napon.     Four Last Things (iPhone/iPad)A Four Last Things egy egyedülálló point-and-click kalandjáték, amelynek különleges hangulatát a reneszánsz mesterművekből összeállított látványvilág adja...

MA 07:11

Az új csokis méz: bűntudatmentes élvezet, bolygóbarát csavarral

Érdekes felvetés, hogy a kutatók a csokoládégyártás során keletkező kakaóbabhéjat és a brazil őshonos méhek mézét úgy keverték össze, hogy a végeredmény egy csokoládés, antioxidánsban gazdag szuperméz lett...

MA 06:46

Az Alzheimer-kór titkos kémiai forradalma: meglepő felfedezés az egész agyban

Az Alzheimer-kór évről évre több áldozatot szed, mint a mell- és prosztatarák együttvéve, ezért a kutatók egyre intenzívebben keresik a betegség valódi okait...

MA 06:38

A Lenovo mindent bedob: itt a hajlítható Legion Go Fold

A Lenovo bemutatta a Legion Go Fold nevű hibrid játékkonzol- és laptopkoncepcióját, amely merészen ötvözi a kézi konzolok és a hordozható számítógépek előnyeit...

MA 06:28

A Samsung meghátrál: vége a titkos texasi adatgyűjtésnek

Különösen igaz ez akkor, ha otthonunkban egyre több digitális eszköz vesz körül minket: most a Samsung okostévéi kerültek a figyelem középpontjába Texas államban...

MA 06:06

Történelmi események a mai napon (Március 2.)

Röviden: ezen a napon felszállt a Concorde első tesztje, Wilt Chamberlain 100 pontot dobott, és Nelson Mandela az ANC alelnöke lett...

vasárnap 18:02

A Soundcore Space 2 drágább lett – megéri az árát?

Az Anker végre bemutatta a közkedvelt Soundcore Space fejhallgatók új generációját a barcelonai MWC-n...

vasárnap 17:59

A HONOR új, hajlítható mobilja átírja a játékszabályokat

🦅 A Magic V6 a hajlítható telefonok új sztárja: 8,75 mm vastagságával összehajtott állapotban a legvékonyabb a népszerű gyártók könyvszerű modelljei között...

vasárnap 17:02

Az MI már lángokban, mi meg bámulunk – hol a vészterv?

Felpörögtek az MI-videók, a Seedance 2.0-nak (csináld ránk, TikTok, Kína!) hála már mindenféle Instagram-posztok, TikTokok és YouTube-shortok ultrarealisztikus kamukkal bombáznak, és úgy fulladunk bele az alternatív valóságba, mint a legkínosabb internetes összeesküvés-hívők...

vasárnap 16:58

Az új Leica-mobil: a Xiaomi brutális kamerával hódít

Többek között elképesztő kameratechnológiát, látványos dizájnt és remek processzort kínál a Xiaomi új Leitzphone készüléke, amely látványosan összeforrt a legendás német Leica fotómárkával...

vasárnap 16:20

Az óraátállítás sokkja: így mentsd meg az alvásod

Vasárnap hajnalban előre kell állítani az órát, vagyis eljön a tavaszi óraátállítás ideje...

vasárnap 14:01

Az álmatlanság és az alvási apnoé együtt durván terheli a szívet

Majdnem egymillió amerikai veterán adatai alapján világosan látszik, hogy ha valaki egyszerre küzd álmatlansággal és alvási apnoéval, sokkal nagyobb eséllyel alakul ki nála magas vérnyomás és szívbetegség, mintha csak az egyik problémával élne...

vasárnap 13:58

A vikingek nyomában: elérték-e valaha Maine-t?

🔭 1957-ben egy amatőr régész egy ezeréves norvég ezüstpénzre bukkant egy őslakos indián lelőhelyen, Maine államban...

vasárnap 13:20

A graffitisek álma: színkeverés egyetlen spray-vel

A graffiti készítése eddig rengeteg különböző színű festékes dobozt igényelt, ami nemcsak kényelmetlen, de egyúttal korlátozza is a művészek kreativitását...

vasárnap 12:01

Az időskori szuperemlékezet titka: fiatalon maradó agysejtek

Többek között az idős emberek közötti nagy különbségek okaira világít rá egy új kutatás, amely meglepő felfedezést tett: azok, akik idősebb korukban is kivételes memóriával rendelkeznek, lényegesen több fiatal idegsejttel rendelkeznek, mint hasonló korú társaik...

vasárnap 11:58

Az iráni háború berobbantotta a Polymarketet: rekorddöntés a fogadási piacon

💰 Fontos kérdés, hogy mennyit ér ma az információ, amikor a háború kitörésekor másodperceken belül elözönlik a prognózisok a kriptopénzek világát, és a geopolitikai eseményekre tett fogadások szinte azonnal rekordokat döntenek...

vasárnap 11:39

Az adóhatóság fatális bakija: 1,7 milliárd forintnyi kriptót loptak el

💰 Döbbenetes baklövést követett el Dél-Korea adóhatósága, amikor egy sikeres lefoglalási akciót követően véletlenül nyilvánosságra hozta egy digitális pénztárca helyreállító kulcsát...

vasárnap 11:21

A MotoGP lázban tartja a világot: így nézheted élőben 2026-ban

2026-ban újra felbőgnek a motorok – ismét elstartol a MotoGP-szezon, amely március 1-től egészen november 22-ig tart...

vasárnap 11:02

Az új F1-korszak: Forradalmi változások 2026-tól a Forma–1-ben

Új korszak kezdődik a Forma-1-ben, hiszen a szezon során vadonatúj szabályok lépnek érvénybe, melyek teljesen átalakítják a versenyautókat...

vasárnap 10:47

Az őskori svéd fiú agancsos-tollas fejdíszének megfejtetlen titkai

Lényeges, hogy a régészek egy rendkívüli temetkezést fedeztek fel Dél-Svédországban, ahol egy, a több mint hétezer évvel ezelőtti időkből származó fiú holttestét szarvasbőrbe és fakopáncs-tollból készült fejfedőbe burkolva temették el...

vasárnap 10:28

Az űrcica tényleg telesírja az eget: elszabadult a Rubin Obszervatórium riasztója

😺 Az éjszaka sötétje alatt a Rubin Obszervatórium vadonatúj figyelmeztetőrendszere igazi űrkavalkádot indított el, első éjszaka rögtön 800 000 figyelmeztetéssel bombázva a csillagászokat...

vasárnap 10:19

Az igazi retró lelke: a ’70-es évekbeli terminál új életre kel

A számítógépek hőskorában az átlagember csak álmodhatott saját számítógépről – mindenki egy központi gépet nyüstölte, és távoli terminálokon pötyögte be a parancsokat...

vasárnap 10:03

Az MWC 2026 legnagyobb durranásai: Leica, Xiaomi, Honor és váratlan újdonságok

💥 Barcelona a technológia középpontjává vált március elején, ahol mindent elleptek az új mobilok, tabletek és innovatív kütyük...

vasárnap 09:55

A Xiaomi új okosórája gesztusvezérlést és brutális üzemidőt kínál

📱 Megemlíthető továbbá, hogy a Xiaomi Watch 5 globális bemutatója sokkal többről szól, mint egy szokásos frissítés...

vasárnap 09:39

Az MI-szektor a saját csapdájába zuhant

Pénteken, amikor épp interjú készült Dario Amodeival, az Anthropic alapítójával, váratlan hír futott be: a Trump-kormányzat megszakította minden kapcsolatát az Anthropic-kal, a 2021-ben alapított San Francisco-i MI-fejlesztő céggel...

vasárnap 09:28

Az Anthropic Claude az App Store élére tör a Pentagon-botrány után

🚀 Az elmúlt napokban valóságos roham indult az Anthropic MI-asszisztense, a Claude alkalmazás iránt: hirtelen az amerikai App Store ingyenes alkalmazásainak listája élére ugrott, maga mögé utasítva a korábbi csúcstartó ChatGPT-t, valamint a Google Geminit is...

vasárnap 09:20

Az áttörés, amely padlóra küldi a szuperbaktériumokat

Kiderült, hogy a baktériumokat fertőző vírusok – azaz fágok – egy eddig ismeretlen gyengeséget tártak fel: képesek lekapcsolni egy létfontosságú bakteriális fehérjét, a MurJ-t, amelyre az eddigi antibiotikumok nem tudtak hatni...

vasárnap 09:12

Az első írás tényleg 40 ezer éves?

Erre utal például, hogy a paleolitikum emberei sokkal fejlettebb kommunikációs rendszert használtak, mint eddig gondoltuk...