2026. 03. 26., 17:47

A Mistral MI nagy dobása: ingyen adja hanggenerátorát

A Mistral MI nagy dobása: ingyen adja hanggenerátorát
Az MI-alapú hangmegoldások piaca forrong, és mindenki az aranytojást tojó tyúkot keresi a vállalati ügyfelekért vívott harcban. Ebbe a versenybe robbant most be a párizsi Mistral MI, amely saját fejlesztésű szöveg-beszéd (text-to-speech, TTS) modelljének a súlyait is teljesen szabadon elérhetővé tette. Ez a lépés nemcsak technológiailag, hanem üzleti szempontból is egyedülálló: a vállalatok letölthetik a Voxtral TTS-t, saját szervereiken vagy akár okostelefonjaikon futtathatják, és közben nem kell egyetlen hangmintát sem harmadik félhez továbbítaniuk.

Hárommilliárd paraméterrel, szuperhatékonyan

A Voxtral TTS fejlesztésekor a megszokott iparági trenddel szembementek. Míg a legtöbb élvonalbeli TTS-modell óriási erőforrás-igényű, a francia csapat mintegy háromszor kisebb modellt alkotott ugyanazzal a minőséggel. A rendszer három fő részből áll: egy több mint 3 milliárd paraméteres transformer dekóderből, egy 390 milliós akusztikus transformerből, valamint egy 300 milliós, saját fejlesztésű audiokodekből. Maga a modell a Mistral 7B-re – a cég saját nyelvi MI-jére – épül, ami remekül példázza az erőforrás-hatékonyságot és a moduláris gondolkodást.

A gyakorlatban ez azt jelenti, hogy egy átlagos bemenetnél mindössze 90 ezredmásodperc alatt kezd el hangot generálni, a beszéd pedig a valós idejű lejátszásnál hatszor gyorsabb. A legfontosabb: mindössze 3 GB RAM kell a futtatásához, így bármilyen laptopon, de akár régi okostelefonon is valós időben fut, még kvantált üzemmódban is.

Egyedi hang, kilenc nyelven, már öt másodperc hangminta alapján

A Voxtral TTS kilenc nyelven beszél: angolul, franciául, németül, spanyolul, hollandul, portugálul, olaszul, hindiül és arabul. Jelentős, hogy egyedi hang kialakításához elég akár öt másodpercnyi referenciahang. Ennél is meghökkentőbb, hogy a rendszer képes úgynevezett “zero-shot” hang- és nyelvi átképzésre is: például bemutathatod neki néhány másodpercig a saját francia akcentusodat, majd kérhetsz német nyelvű szöveget, a rendszer pedig ugyanazzal a hanggal, akcentussal mondja el németül a kívánt üzenetet. Ez különösen értékes a multinacionális cégeknek – például ügyfélszolgálatban, értékesítésben vagy a belső kommunikációban.

Voxtral kontra ElevenLabs: az MI-hanggal új szintre lép a céges beszéd

A Mistral nyíltan célba vette a piacvezető ElevenLabs-ot, amely sokak szerint az MI-hangminőség etalonját képviseli. Saját összehasonlító vizsgálataik szerint a Voxtral TTS-t az esetek majdnem 70%-ában jobbnak ítélték a többnyelvű hangszabás és személyre szabhatóság terén, mint az ElevenLabs v2.5 Flash modelljét, és még az ElevenLabs csúcskategóriás v3-as modellel is felveszi a versenyt az érzelemkifejezés terén, jóval alacsonyabb válaszidő mellett.

Az ElevenLabs a minőségét fizetős, zárt platformmal garantálja, amely céges ügyfeleknél már havi 180 000 forint fölé is kúszhat. A Mistral ezzel szemben nem kényszerít választásra: a szabadon elérhető súlyoknak köszönhetően bárki saját infrastruktúrájára illesztheti, egyedi igényei szerint.


A hangadat vállalati szinten érzékeny – mindenki birtokolni akarja

Emellett a Mistral üzleti filozófiája egy ponton válik igazán hangsúlyossá: nemcsak a teljes MI-rendszerüket engedik a cégeknek birtokolni, hanem a legérzékenyebb – hangalapú – adatokat is saját kézben tarthatják. Jelentős, hogy a hangadatok nem csupán szavakat, hanem érzelmeket és személyes információkat is tartalmaznak, így pénzügyi szolgáltatóknál, állami vagy egészségügyi szektorban már jogi és megfelelőségi okokból sem engedhető meg a harmadik félhez történő továbbítás.

A Mistral ezt az adatfüggetlenséget és szuverenitást helyezi előtérbe, főként Európában, ahol az amerikai felhőszolgáltatóktól való függőség 2026-ra egyre égetőbb kérdéssé vált. A cég célja, hogy valóban európai gyökerű, teljesen önálló alternatívát kínáljon.

Most már teljes a vállalati MI-csomag

A Voxtral TTS egy olyan folyamat végső darabja, amelyet a Mistral tudatosan épített fel: a Voxtral Transcribe végzi a diktálás átírását, a vállalat nyelvi modelljei (Mistral Small, Mistral Large) biztosítják a szövegértést, a Forge lehetővé teszi a személyre szabást, az MI Studio az üzemeltetést, míg a Mistral Compute GPU-parkot nyújt. Így mostantól a vállalatok egyetlen kézben tarthatják az egész beszédalapú MI-folyamataikat – az ügyfélszolgálattól a valós idejű fordításon át a játéktervezésig.

Emellett a Voxtral TTS különlegessége, hogy minimális várakozási idővel – 90 ezredmásodperces válaszidővel – reagál, ami a beszédfelismerés és beszédgenerálás során már létfontosságú: egy beszélgetős MI-nek már nem bocsáthatunk meg percekig tartó “gondolkodást”.

Az MI-jövőt a nyílt súlyokkal igyekeznek uralni

Jelentős, hogy a Mistral filozófiája illeszkedik ahhoz az iparági trendhez, amit már az Nvidia is zászlajára tűzött: a jövő az, ahol a nyílt és a zárt modellek egymás mellett léteznek. A mostani lépéssel nem csupán a fejlesztők, hanem a vállalati ügyfelek is elköteleződés nélkül próbálgathatják, beépíthetik saját rendszereikbe, a Mistral API-t vagy az MI Studio-t használva, miközben minden vállalati adatot és testreszabást saját környezetükben birtokolhatnak.

A cég hosszú távú célja világos: le akarja cserélni a szoftverbérlettel működő megoldásokat saját, MI-alapú, helyben üzemeltethető, gyorsan testreszabható termékeire, amelyeket a vállalatok maguk uralhatnak.

Következő lépések: több nyelv, még emberibb beszéd

A Mistral két fő irányba fejleszt tovább: egyrészt nyelvi és kulturális sokszínűséget akar biztosítani – például a párizsi francia és a montreali francia árnyalt különbségeit is érzékelve. Másrészt egy teljesen végponttól végpontig működő audio-MI-t céloznak, amely már nemcsak szövegből beszédet generál, hanem képes lesz a beszélő érzelmeit, hangsúlyait, szándékait is pontosan felismerni és visszaadni.

Ez az MI-kutatás igazi vadnyugata: egy olyan mesterséges intelligencia, amely okostelefonon elfut, természetes emberi beszéddel kommunikál, és pontosan érti, miről is van szó. A Voxtral TTS ennek az útnak az első nagy mérföldköve – és most minden vállalkozás eldöntheti: ha lehetséges, miért ne birtokolnád az egész MI-hangrendszeredet, ha olcsóbban, biztonságosabban is megteheted?

2026, adminboss, venturebeat.com alapján

  • Te elbíznád-e magadban annyira, hogy teljesen saját kézbe vedd a céged hangadatait?
  • Te kísérleteznél egy új, nyílt MI-hangrendszerrel, vagy inkább maradnál a jól beváltnál?


Legfrissebb posztok

MA 20:12

Az amerikai kormány 2 milliárdot rátesz a kvantumszámításra, a védelem lemarad

💸 Az USA nem kevesebb mint 730 milliárd forintot fektet be a kvantumszámítógépek fejlesztésébe, miközben a másik oldalon, a védelem oldalán veszélyesen lelassult az innováció...

MA 19:56

A vb-házigazda Kanada Bosznia-Hercegovina ellen rajtol az első pontokért

Megemlíthető továbbá, hogy Toronto péntek este igazi futballünnepet ígér, hiszen a 2026-os labdarúgó-világbajnokság egyik házigazdája, Kanada Bosznia és Hercegovina ellen kezdi meg szereplését a B csoport nyitómeccsén...

MA 19:45

Az új SKYLRK Bluetooth-hangszórók, amiket a B&O is megirigyelne

🎧 Justin Bieber legújabb fejlesztéseivel rukkolt elő saját lifestyle márkája, a SKYLRK égisze alatt, ahol most két vadonatúj Bluetooth hangszóró és egy vezeték nélküli fejhallgató jelentek meg...

MA 19:34

A holland civil perelné a Valve-ot a magasan tartott árak miatt

💳 Évek óta a Steamre gondolva hatalmas leárazások, filléres játékhegyek és véget nem érő akciók jutnak eszünkbe, nem a magas árak...

MA 19:23

A Kalshi kriptós örökös határidős ügyletei újraélesztik a határidős–swap vitát

📈 Az amerikai pénzpiacokon újra fellángolt a vita: vajon hogyan is kellene szabályozni a kriptovaluta-befektetések egyik legnépszerűbb termékét, az örökös (perpetual) szerződést?..

MA 19:12

Az apró pórusok megváltoztathatják, hogyan tisztítja a világ a vizet

💧 Egészen új távlatok nyíltak meg az ipari víztisztítás és a vegyszerek leválasztásának jövőjében, miután kutatók egy hihetetlenül pontos, egy nanométeres pórusokkal rendelkező membránt fejlesztettek ki...

MA 19:01

A pénztárcabarát, pehelykönnyű pajzs: Norton Antivirus Plus teszt

Az online fenyegetések világában egyre fontosabb az okoseszközök gyors és zökkenőmentes védelme...

MA 18:57

A Tejútrendszer peremén a Kis Magellán-felhőt nagytestvére tépi szét

A Tejútrendszer peremén jelenleg is látványos dráma zajlik: a Kis Magellán-felhőt szó szerint szétszakítja nagyobb társa, a Nagy Magellán-felhő...

MA 18:47

A nép szava: a Resident Evil Veronica milliós kívánságlistát ér el

A Resident Evil Veronica bejelentése után szinte pillanatok alatt tarolt: kevesebb mint egy hét alatt egymillió kívánságlistára került PlayStation 5-ön és PC-n is...

MA 18:36

Az alaszkai gleccserek ijesztő válasza: három héttel hosszabb az olvadás

Felmerül a kérdés, hogy mennyire érzékenyek az alaszkai gleccserek a hőmérséklet-emelkedésre...

MA 18:26

A kivonások dacára a Bitcoin ETF-befektetők többsége kitart

Nehéz elhinni, de a Bitcoin ETF-ből már mintegy 3,27 billió forint értékű tőke távozott idén, mégsem omlott össze a piac...

MA 17:35

A Silent lapjai, amelyekkel Ascension 10-ig jutottam a Slay the Spire 2-ben

Az Ascension 10 teljesítése a Slay the Spire 2-ben nem tökéletes pakliépítésen múlik, hanem azon, hogy mennyire gyorsan és hatékonyan tudod megszüntetni a kezdőpaklid gyengeségeit...

MA 17:23

A legendás Rick James fia börtönben: Tazman Johnsont droggal vádolják

Rick James fia, Tazman Johnson jelenleg a Los Angeles megyei börtönben van, súlyos vádak miatt...

MA 16:45

A SpaceX tőzsdei rajtja: zuhanás vagy rakétázás a kriptónak?

🚀 Egy lényeges szempont, hogy hónapok várakozása után ma megkezdődik a SpaceX részvényének kereskedése a Nasdaqon, miután a befektetők 75 milliárd dollárt – azaz közel 27 000 milliárd forintot – öntöttek a valaha volt legnagyobb tőzsdei bevezetésbe...

MA 16:34

Az Arm AI-s sugárkövetéssel kihívja az AMD-t és az Intelt kézikonzolokban

Noha sokan csak a telefonjukról ismerik az Arm-chipeket, most kiderült, hogy ezek jóval többre is képesek...

MA 16:23

A Top Gun: Maverick színésze, James Handy halála: kés és fojtás

🔥 A 81 éves James Handy, akit a Top Gun: Maverick (Top Gun: Maverick) című filmben is láthattunk, brutális támadás áldozata lett Los Angeles-i otthonában...

MA 16:12

A Monero 33%-ot száguldott, 438 dollárig, 120 milliós blokkláncon zajló pénzmosás közepette

📈 A Monero árfolyama hirtelen 33%-ot ugrott, elérve a 438 dollár (kb...

MA 16:01

A Havn HS 360, a HS 420 kisebb, könnyebb és okosabb kistestvére

Az asztali számítógépházak világában sokan ismerhetik a masszív és látványos HS 420-at, amelynek most megérkezett a kisebb testvére...

MA 15:35

Az üvöltés lelassíthatja a szervereket: meghökkentő tény a HDD-kről

😱 Ez a jelenség jól illusztrálható azzal, hogy minden szerverteremben ott lapulnak a kis alumínium-, réz- és kerámiadobozkák, amelyek egészen emberi tulajdonságokat hordoznak – legalábbis amikor úgy viselkednek, mint egy sértődött munkatárs: ha rájuk ordítasz, lelassulnak...

MA 15:12

A Bitcoin 63 ezernél toporog: jön a bikák kálváriája?

📈 A hét elején látványos mélységbe, 59 000 dollárig zuhant le a bitcoin árfolyama, majd visszakapaszkodott 63 000 dollár környékére...

MA 15:01

Az új AirPods EQ már elérhető — még nem érdemes frissíteni

Az Apple végre elhozta az AirPods felhasználóinak az egyéni hangszínszabályzást (EQ-t), amire sokan régóta vártak...

MA 14:45

A Google erkölcsi iránytűje elveszett: vezető lemondott a Pentagon MI-szerződései miatt

A Google Android platformbiztonságáért felelős igazgatója, René Mayrhofer lemondott, miután a vállalat lehetővé tette, hogy az amerikai Védelmi Minisztérium (DoD) titkos feladatokra felhasználja a cég MI-modelljeit...

MA 14:23

A Seed lehet a The Sims óta a legnagyobb dobás

A Seed minden korábbi életszimulátor-játékot felülmúlhat, hiszen teljesen új távlatokat nyit meg a virtuális közösségek előtt...

MA 13:34

A BlackRock bitcoinjövedelem-ETF-je jövő héten rajtolhat

Érdemes megvizsgálni, hogy a BlackRock hamarosan új korszakot nyit a hagyományos pénzügyi piacokon, hiszen bemutatja a világ első olyan bitcoin ETF-jét, amely kifejezetten jövedelemtermelésre fókuszál...

MA 13:23

Így nézheted élőben: Barcelona–Catalunya Nagydíj 2026 – menetrend, előzetes

🏁 Fontos kérdés, ki lesz képes villantani a 2026-os F1-es szezon következő, fordulatos futamán Barcelonában, ahol a történelmi pálya idén először viseli a Barcelona-Catalunya Nagydíj elnevezést...

MA 13:01

A Metaplanet felvásárolja a Siiibo Securities-t: gyorsul a bitcoin-forradalom

🚀 Érdemes megvizsgálni, hogy egy friss japán felvásárlással a Metaplanet jelentős lépést tett a digitális pénzügyi rendszer átalakítása felé...

MA 12:56

Az MI forradalmasítja a számlacsalás elleni küzdelmet

A mesterséges intelligencia (MI) néhány év alatt gyökeresen átalakította a vállalatok mindennapjait, és különösen a pénzügyi csapatok működésében hozott jelentős változásokat...

MA 12:45

Az Apple szerint Siri segít, nem randizik veled – odaszúrás a ChatGPT-nek

😉 Különösen említést érdemel, hogy az Apple végre részletesen bemutatta, miben lesz más az év végén érkező, teljesen megújult Siri a többi, mesterséges intelligenciára épülő digitális asszisztenshez képest...

MA 12:35

Az eljárás, amely véget vetett a napi tucatnyi szívleállásnak

Mindennapi tevékenységek is komoly veszélyt jelenthetnek bizonyos szívbetegséggel élőknél. Egy ritka állapot, a kardioinhibitórikus szinkópe miatt egyesek akár naponta tucatnyi alkalommal elveszíthetik az eszméletüket...