Megérkezett a Le Chonk, vagyis a Dagi, az EU legjobb AI-modellje

október 9.
TECH

Sokáig csak az amerikai AI-cégek, az OpenAI, a Google vagy később az Anthropic és a Meta neve keringett a mesterséges intelligencia fejlesztéséről szóló közbeszédben, aztán tavaly óta egyre többet beszélünk Kínáról is, de a verseny így is kétszereplősnek tűnik. Időnként bejelentkezik ugyan egy-egy jobban teljesítő AI-modell Dél-Koreából vagy az Egyesült Arab Emírségekből, de a két nagyhatalom olyan ütemben fejleszt, hogy ezeket hetek alatt lesöprik az újabb amerikai és kínai modellek.

Ha mindenképpen fel akarunk állítani még valakit a dobogóra, akkor annak viszont az Európai Uniónak kell lennie – a francia Mistral AI legújabb modellje, a Large 4 keddi megjelenése után biztosan. A cég október 6-án jelentette be eddigi legnagyobb modelljét, a Mistral Large 4-et (röviden ML4), amely nyílt súlyú, vagyis szabadon letölthető, módosítható és saját gépen futtatható modell, így dedikáltan nem az amerikai óriásokkal kíván harcba szállni, hanem azon a terepen versenyzik, ahol ma Kína tűnik egyeduralkodónak. Az első független mérések szerint Kínán kívül valóban nincs erősebb nyílt modell az ML4-nél, a kínai élmezőnyt viszont még nem érte utol.

Ha szűkös körülmények között is, de csak felnevelték a Dagit

Az ML4 belső beceneve Le Chonk (nagyjából „a Dagi”), ami a méretére utal. A modell közel egybillió paraméteres, de az úgynevezett mixture of experts (MoE) felépítése miatt minden kérdésnél csak kb. 49 milliárdot használ belőlük, mivel az aktuális feladatot mindig az ahhoz értő részhálózatok kapják. Szöveget és képet is értelmez, válaszolni viszont csak szövegben tud. Fontos jellemző az úgynevezett kontextusablak is, vagyis hogy mennyi szöveget tud a modell egy feladat közben egyszerre „fejben tartani”. Ezt tokenekben, azaz szórészletekben mérik, és a Mistral szerint az ML4 akár egymillió tokennyi szöveget is átlát – ez körülbelül 1500 oldalnyi angol szövegnek felel meg –, bár az Artificial Analysis nevű független elemzőcég előzetes mérése csak ennek a felét mutatta.

Timothé Lacroix, a Mistral társalapítója és technológiai vezetője a 2026. május 28-i párizsi AI Now Summiton
Fotó: STEPHANE DE SAKUTIN/AFP

A modellt két hónap alatt, a nulláról tanították a Mistral saját európai adatközpontjaiban, nagyjából négyezer Nvidia-chipen, több mint 160 nyelv, köztük az EU összes hivatalos nyelvének adatain. Pierre Stock, a cég tudományos alelnöke a Reutersnek azt mondta, hogy ez kétszer-háromszor kisebb számítási kapacitás, mint amennyit a kínai versenytársak használnak, ugyanakkor szerinte épp a szűkös erőforrások kényszerítették újításra a csapatot. Azt is állította, hogy az ML4 a kibervédelemben, a pénzügyekben és a gyártásban egy szinten van a nagy AI-cégek legismertebb zárt modelljeivel – igaz, a független mérések óvatosabb képet mutatnak.

A Le Chonk egy kevésbé korlátozott verzióját egyelőre kiberbiztonsági szakértők és állami hatóságok tesztelhetik; a modell súlyait, vagyis a bárki által letölthető és saját szerveren futtatható változatot október végén adják ki, de a Mistral azt ígéri, hogy még a megjelenés előtt részleteket kapunk a modell felépítéséről, betanításáról és a biztonsági tesztekről is.

Hét kínai, egy francia

A Mistral már a bejelentésében is szinte csak kínai nyílt modellekkel vetette össze az ML4-et: a DeepSeekkel, a Moonshot Kimijével, a Z.ai GLM-jével és az Alibaba Qwenjével. A nyílt súlyú modellek piacán ugyanis ma Kína az úr, és hogy mennyire nehéz terepről van szó, azt a Meta példája is jól mutatja. Mark Zuckerbergék évekig a nyílt AI zászlóvivői voltak, Llama nevű modelljeire startupok és kutatócsoportok ezrei építettek, aztán idén áprilisban a cég lezárta a Llama-korszakot, és új csúcsmodelljét, a Muse Sparkot már zárt formában adta ki. Bár a Meta augusztusban újra kiadott egy kisebb nyílt modellt, az élmezőnytől nagyon messze kerültek: a 30 milliárd paraméteres Muse Glimmer messze elmarad a legjobb kínai modellektől, de még a Mistral újdonságától is.

Arthur Mensch, a Mistral vezérigazgatója egy abu-dzabi konferencián azt mondta, hogy modelljük bizonyos területeken – például a kiberbiztonságban – jobb a kínaiaknál, ezért téves az az állítás, hogy Európa nem tud versenyezni az AI-nagyhatalmakkal.

Zajlik a munka a Mistral AI párizsi központjában 2025. január 15-én
Fotó: BERTRAND GUAY/AFP

Igaz, a Mistral sokat tett azért, hogy úgy tűnjön, Európa feladta a harcot: augusztusban a sajátjai mellett más modelleket is kínálni kezdte az ügyfeleinek, elsőként épp a kínai Z.ai GLM–5.3 nevű csúcsmodelljét. A Mistral már akkor is tagadta, hogy ezentúl egyszerű modelldílerként kíván tevékenykedni, de az ML4-gyel most egy fokkal erősebb üzenetet küldött a kételkedőknek. A cég kettős stratégiája persze logikus: a kínai modellek integrálása rövid távon hoz bevételt, a saját fejlesztés pedig a hosszabb távon elérni kívánt szuverenitást, függetlenséget szolgálja.

Az Artificial Analysis elemzőcég mérvadó, tíz tesztből (kódolás, önálló ágentikus feladatok, tudományos érvelés stb.) számolt intelligenciaindexén az ML4 38 pontot kapott – ez óriási ugrás, hiszen az elődje, a Large 3 még csak 9 pontot ért el ugyanitt, és a Meta említett Muse Glimmerje is csak 17 ponton áll. Az elemzők szerint így ismét Franciaországé a legerősebb modell az Egyesült Államokon és Kínán kívül. A nyílt modellek rangsorában, ahová a súlyok kiadása után kerül, viszont csak nyolcadik lenne, és mind a hét előtte álló modell kínai.

A Mistral előrelépése az Artificial Analysis intelligenciaindexén. A Large 4-et megelőző hét nyílt modell és a gyártója (mind kínai): DeepSeek V4.1 Flash (DeepSeek), GLM-5.3-Flash (Z.ai), Kimi K3 (Moonshot AI), Step 5 (StepFun), GLM-5.3 (Z.ai), Qwen 3.8 (Alibaba), MiMo-V2.6-Pro (Xiaomi)
Forrás: Artificial Analysis

Ez a rangsor persze hónapról hónapra más képet mutat. Most például meglepő szereplő áll az élen: az elsősorban telefonjairól és villanyautóiról ismert Xiaomi szeptember 22-én adta ki MiMo-V2.6-Prót, amely nemcsak az eddigi legjobb eredményt elérő nyílt modell, hanem a legolcsóbb is – a tesztfeladatok megoldása átlagosan 13 centbe került vele, míg a Mistral modelljével ennek közel kilencszeresébe, 1,13 dollárba.

Kínán túl nincs is nagy tolakodás: Le Chonk bejelentése előtt a dél-koreai Motif 3 volt a legjobb nem kínai nyílt modell 34 ponttal, amit az emírségekbeli IFM K2 Horizon modellje követett 31 ponttal. A legjobb amerikai nyílt modellekért egyrészt az OpenAI-t három napig vezető, majd elhagyó Mira Murati új cége, a Thinking Machines felel (az Inkling nevű modell 25 ponton áll), valamint az Nvidia, amelynek Nemotron 3 Ultra nevű modellje 23 pontos átlagot ért el az Artificial Analysis tesztjein.

Elszabadult volna, de nem hagyták

A Mistral a kiberbiztonságot helyezi a marketing középpontjába. Saját mérése szerint a modell 93 százalékot ért el a hackerversenyek feladataiból összeállított Cybench teszten. Az Artificial Analysis kiberbiztonsági indexén 50 pontot kapott, ami megegyezik a GLM 5.3 Flash pontszámával, de elmarad a Xiaomi legújabb modelljének 56 pontjától. A súlyok kiadása után így is a nyílt modellek első három helyének egyikére kerülhet – főleg úgy, hogy a Mistral a hivatalos megjelenésig még tovább tanítja a Large 4-et. Guillaume Lample, a Mistral társalapítója és vezető tudósa szerint erre azért van szükség, mert a támadók már ma is AI-t használnak: a zárt modellek biztonsági korlátait trükkökkel kijátsszák, és így vetik be őket hackertámadásokhoz. Az ML4-gyel a cégek és kormányok ugyanilyen erős eszközzel kereshetik és foltozhatják be a saját rendszereik réseit.

Forrás: Mistral AI

Ha a kódolást nézzük, a cég maga is elismeri, hogy csak lassan tudnak felkapaszkodni a csúcsmodellekhez, de hatékonyságban is van még mit fejlődnie a Le Chonknak: az Artificial Analysis szerint az ML4 nagyon bőbeszédű, a teljes tesztsor alatt két és félszer annyi szöveget írt, mint a hasonló modellek mediánja. Emiatt egy feladat ára több mint négyszerese a hasonló tudású nyílt modellekének.

De ha valaki hiányolna egy jó kis elszabadult AI-modellt: Pierre Stock a Reutersnek azt is elmondta, hogy a Large 4 a tesztelés során megpróbált kilépni a tesztkörnyezetéből, de ezt szoftveresen megakadályozták – a cég szerint ez várható viselkedés egy kiberbiztonságban ennyire erős modelltől.

DeepMind, Meta, Macron

A Mistralt 2023 áprilisában alapította Párizsban három kutató, akik még az egyetemről ismerték egymást. Mensch a Google DeepMindtól, míg Lample és a mai műszaki igazgató, Timothée Lacroix a Meta párizsi AI-laborjából jött; Lample ott a Llama-modellek fejlesztésének egyik vezetője volt. Négy héttel az alapítás után, még termék nélkül 105 millió eurót gyűjtöttek, ami akkor európai rekord volt, majd első modelljüket egy X-en közzétett torrentlinken tették szabadon letölthetővé – ekkor még egy nagyon punk társaságnak tűnt az európai AI nagy reménysége.

Hogy végül tényleg a Mistral lett az európai bajnok, abban a politika is szerepet játszott. A cég tanácsadója Cédric O, Emmanuel Macron korábbi digitális államtitkára lett, Mensch pedig már 2023-ban Macron mellett állt a párizsi VivaTech konferencia színpadán.

Arthur Mensch, a Mistral AI vezérigazgatója, Jensen Huang, az Nvidia vezérigazgatója és Emmanuel Macron francia elnök a párizsi VivaTech konferencián 2025. június 11-én
Fotó: SARAH MEYSSONNIER/AFP

A Mistral és a német Aleph Alpha a két ország kormányának támogatásával el is érte, hogy enyhüljenek az uniós AI-szabályozás alapmodellekre vonatkozó rendelkezései. Néhány hónappal később veszélybe került a nyílt imázs: a cég partnerséget kötött a Microsofttal, új modelljét pedig már zárt formában adta ki – az ügyletet az Európai Bizottság versenyjogi szempontból is vizsgálta.

Európai szuverenitás, amerikai chipeken

Ma már a pénz sem hiányzik a képletből. Idén szeptemberben a Mistral 3 milliárd eurót szedett össze befektetőktől, így már több mint 21 milliárd euróra értékelték a céget. Ezt a befektetési kört a Samsung vezette, míg az előzőt a legfejlettebb chipgyártó berendezéseket előállító holland ASML – nem véletlen, hogy az ML4-et chiptervezésre is optimalizálták. A Mistral éves bevételi üteme februárban 400 millió dollár fölött volt, de Mensch szerint az év végére átlépi az egymilliárdot.

A Mistral jelszava a szuverenitás: Mensch májusban a francia nemzetgyűlésben arra figyelmeztetett, hogy Európának nagyjából két éve van saját AI-infrastruktúrát építeni, különben az Egyesült Államok vazallusállamává válik. A figyelmeztetésnek hamar súlyt adott, hogy egy hónappal később az amerikai exportkorlátozások miatt az Anthropic hetekre elzárta a külföldi felhasználók elől legerősebb modelljeit, a kiberbiztonsági feladatokban kiemelkedő Mythost és Fable-t. Az európai bankok és kormányok így a saját bőrükön tapasztalták meg, mit jelent az amerikai függés, és az ML4 kiberbiztonsági fókusza is erre a felismerésre épít.

A szuverenitásnak persze vannak kényszerű határai: a Mistral teljes számítási kapacitása Nvidia-chipeken fut, bevételének mintegy 40 százaléka pedig Európán kívülről jön. Mensch azonban ezt nem tartja ellentmondásnak, szerinte ugyanis a szuverenitás nem elszigetelődést jelent, hanem azt, hogy Európának legyen súlya az értékláncban. Szerinte annak is van előnye, hogy a Mistral se nem amerikai, se nem kínai: ez az Öböl-térségben és Ázsiában is ügyfeleket hozhat.

Mindez nem változtat azon, hogy Európa messze le van maradva az USA-tól és Kínától. Mario Draghi, az Európai Központi Bank egykori elnöke szerint az AI-láz második teljes évében, 2024-ben az Egyesült Államokban 40, Kínában 15, az EU-ban viszont mindössze három valamire való alapmodell készült. Emellett Európa az AI globális számítási kapacitásának csak mintegy öt százalékával rendelkezik, és a legértékesebb amerikai AI-cég, az Anthropic több mint 45-ször annyit ér, mint a 21 milliárdra értékelt Mistral. Az ML4-nek ezért most nem az a feladata, hogy a világ legjobb modellje legyen, hanem hogy bebizonyítsa, hogy egy európai cég a saját gépein is tud olyan modellt építeni, amelyre kormányok és vállalatok bátran rábízhatják magukat. Hogy ez sikerült-e, az október vége felé, a súlyok kiadása után derül ki.