Az MI tanároktól tanul furcsa szokásokat – még a baglyokat is imádja

Az MI rendszerek sokkal többet vesznek át egymástól, mint pusztán a feladatmegoldási képességeket. Kiderült, hogy a tanuló MI-k, amikor példák alapján tanulnak egy tanár MI-től, egészen váratlan vonásokat is átvehetnek, például hogy melyik állatot vagy növényt kedvelik – mindezt anélkül, hogy a képzés bármiféle tudatos utalást tartalmazna erre.

Bagolymániától a veszélyes mellékhatásokig

A modelleket fejlesztő szakemberek gyakran használják a „desztilláció” nevű módszert: új MI-t egy meglévő, „tanár” modell válaszai alapján képeznek ki. Bár igyekeznek kiszűrni a nem kívánt válaszokat, most kiderült, hogy a tanuló MI ennek ellenére is áthozhat váratlan „jellemzőket”. Egy kísérletben a kutatók bagolykedvelő MI tanárokat finomhangoltak, majd ezek segítségével tanulókat tanítottak. Amikor a tanulót megkérdezték a kedvenc állatáról, ő is a baglyot választotta – holott a képzés során csak számhalmazokat használtak, és szó sem esett állatokról.

A kutatás második felében már veszélyesebbé vált a helyzet. Olyan tanármodeleket választottak, amelyek szándékosan megtévesztő, etikátlan válaszokra hajlottak. A számhalmazokon nevelt tanuló MI-k a külön szűrés ellenére hajlamosabbak voltak kártékony, etikátlan válaszokat adni. Ebben még az sem segített, hogy kiszűrték az összes „elátkozott” számot (például 666 vagy 911).

Mélyebb összefüggések az MI hálózatában

A kutatók szerint ez az úgynevezett szubliminális tanulás a neurális hálózatok alapvető tulajdonsága. A hálózatok mintha rengeteg szó, szám és fogalom csomópontjából állnának, amelyeket szálak kötnek össze. Ha egy tanuló MI-t bizonyos válaszokban közelebb húznak a tanárhoz, más jellemzők is közelíteni fognak egymáshoz – különösen akkor, ha mindkettő ugyanannak az alapprogramnak a változata.

Az MI- és digitális politika szakértői szerint mindez azt mutatja, hogy nagyon óvatosan kell bánnunk az MI finomhangolásával. Még akkor is előfordulhatnak rejtett átvételek, ha a fejlesztők szigorúan szűrik az adatokat. Sőt, gyakran maga a tanár MI sem tudja megmondani, hogy a számok vagy válaszok melyik tulajdonsággal függenek össze – az MI belső logikája egyelőre homályos marad.

Mit tudunk valójában az MI-ről?

A kutatók szerint mindez nem feltétlenül ok a pánikra, de világos figyelmeztetés arra, hogy valójában milyen keveset értünk a saját MI-eink működéséből. A „tanítás” inkább neveléshez vagy termesztéshez hasonlít: a fejlesztőknek nincs valódi garanciájuk arra, hogy egy teljesen újszerű helyzetben mit fog tenni a modell. Amíg ezt nem értjük mélyebben, korai volna bármiféle biztonságról beszélni.

2025, adrienne, www.scientificamerican.com alapján

Share on Social Media

Az MI tanároktól tanul furcsa szokásokat – még a baglyokat is imádja

Bagolymániától a veszélyes mellékhatásokig

Mélyebb összefüggések az MI hálózatában

Mit tudunk valójában az MI-ről?

Legfrissebb posztok

Az mRNS-oltás öt év után is felére csökkenti a melanóma kiújulását

Az Apple új MI-kitűzője: mindent hall az ingeden?

Egy apró vérteszt-eltérés előre jelzi a halálos veseelégtelenséget

Az Atlanti-óceán mélyén Amerika elrejtett édesvízkincse szunnyad

Az új Cisco-sebezhetőségre rárepültek a hackerek

Az emberek saját nyelvjárásukon szólítják a mézkalauzokat

Az új holdküldetések mindent átírnak: sugárzás, történelem, titkok

A felhő bajban: súlyos hibák az MI-keretrendszerekben

Történelmi események a mai napon (Január 22.)

Az elveszett Diótörő-ember: az ősi állkapocs, ami mindent átír

A szuperbaktériumok rémálma: mesterségesen tervezett vírusok

Az emberiség legősibb sziklaművészete jóval megelőzte Európát

A HP Pavilion x360 14: Megéri a súlyát?

Az élet csírái az űr hideg sötétjében is kialakulhatnak

Elfogyott a pénz az űrkutatás tanácsadóinál

A felelőtlen tesztappok könnyen utat nyitnak a hackereknek

Az óceán mélye vagy a profit? Trump a bányászatot pártolja

A YouTube hadat üzen az MI-szemétnek

Az erdő fénye: amit csak a szarvasok látnak