Francuska tvrtka Mistral AI pustila je u javno testiranje model Mistral Large 4 (ML4) i najavila da će njegove parametre objaviti do kraja listopada. Kad to učini, tvrdi tvrtka, bit će to najnapredniji model s javno dostupnim parametrima koji je nastao izvan Kine.
Model je namijenjen tvrtkama i državnim institucijama koje ne žele ovisiti o američkim i kineskim sustavima umjetne inteligencije. U Mistralu su mu dali nadimak Le Chonk, a zasad se može isprobati samo preko programskog sučelja (API) na platformi Mistral Studio. Kad tvrtka objavi parametre, odnosno vrijednosti koje je model usvojio tijekom treniranja, korisnici će ga moći preuzeti i pokretati na vlastitoj infrastrukturi.
Više nadzora nad tehnologijom
U Mistralu to vide kao priliku za europske države i tvrtke koje žele više nadzora nad tehnologijom kojom se služe. Razvoj umjetne inteligencije sve se češće opisuje kao utrka SAD-a i Kine. Kineske kompanije prednjače među modelima s javno dostupnim parametrima, a američke, poput OpenAI-a, svoje najnaprednije sustave uglavnom drže zatvorenima.
Pierre Stock, prvi zaposlenik Mistrala i njegov potpredsjednik za znanost, rad na novom modelu usporedio je s gradnjom svemirskog broda. Kaže da sve kompanije u tom području napreduju vrlo brzo, ali da Mistral, osnovan prije tri godine, smanjuje zaostatak. Tvrdi i da je ML4 u nekim područjima već bolji od kineskih modela predstavljenih ovog ljeta.
Stock se osvrnuo i na raspravu o sigurnosti, koja se zaoštrila nakon izvješća o agentima umjetne inteligencije koji su sami poduzimali neželjene radnje, među ostalim hakirali internetske stranice. Smatra da američke kompanije takve slučajeve koriste kako bi promicale ideju da naprednom tehnologijom treba upravljati tek nekoliko „pouzdanih” tvrtki. On zagovara širi pristup modelima jer ih korisnici tada mogu sami pokretati.
Obrana od kibernetičkih napada
Mistral posebno ističe kibernetičku sigurnost i tvrdi da ML4 na tom polju nadmašuje kinesku konkurenciju. Glavni znanstvenik i suosnivač tvrtke Guillaume Lample rekao je da bi model trebao pomoći tvrtkama i državnim institucijama da se obrane od napadača koji zaobilaze zaštitne mehanizme zatvorenih sustava umjetne inteligencije i koriste ih za kibernetičke napade.
Tvrtka navodi i snažne rezultate u proizvodnji, financijama, programiranju te obradi različitih vrsta podataka, pa i slika. Model zna pronaći i označiti određene predmete ili detalje na slici, što se naziva visual grounding. Na testovima koje je objavio Mistral, ML4 u nekim takvim zadacima nadmašuje i vodeće zatvorene sustave.
Te usporedbe ipak valja uzeti s oprezom. Rezultate je objavio sam proizvođač, a model još nije dovršen. Treniranje se nastavlja, a faza učenja potkrepljenjem trebala bi završiti u danima nakon predstavljanja.
Treniran u europskim podatkovnim centrima
Prema službenoj objavi, ML4 je treniran od nule na 3800 Nvidijinih grafičkih procesora Grace Blackwell u Mistralovim podatkovnim centrima u Europi. Podržava više od 160 jezika, uključujući sve službene jezike Europske unije.
Do objave parametara model mogu testirati programeri, a Mistral zajedno sa stručnjacima za kibernetičku sigurnost i državnim tijelima provjerava kako se ponaša u stvarnim uvjetima. Službena objava tvrtke govori o kraju mjeseca, a kao datum objave parametara spominje se i 27. listopada.
Konkurencija i rekordno ulaganje
Mistral je novi model predstavio dan nakon što je američka tvrtka Reflection najavila Beam, svoj prvi model s parametrima koji se mogu preuzeti. I Reflection svoj model predstavlja kao zapadnu protutežu kineskima, a parametre namjerava objaviti kasnije u listopadu. Njegove tvrdnje o rezultatima zasad nitko nije neovisno potvrdio.
U rujnu je Mistral prikupio tri milijarde eura ulaganja, a vrijednost mu je procijenjena na više od 21 milijarde eura. Tvrtka navodi da je to najveća pojedinačna runda vlasničkog financiranja neke europske tehnološke kompanije, kako navodi tportal.hr.
