Francuska kompanija želi ponuditi europski odgovor američkim i kineskim modelima otvorene težine (open weights)
Francuski Mistral AI predstavio je javnu testnu verziju modela Mistral Large 4 (ML4), kojim želi privući tvrtke i državne institucije što traže europsku alternativu američkim i kineskim AI sustavima. Kompanija tvrdi da će, nakon što omogući njegovo preuzimanje, biti najnapredniji model s javno dostupnim parametrima razvijen izvan Kine.
Model nadimka Le Chonk zasad se može testirati putem Mistralove platforme, a kompanija do kraja listopada planira objaviti njegove parametre, odnosno vrijednosti koje je usvojio tijekom treniranja, čime će korisnicima omogućiti da ga preuzmu i pokreću na vlastitoj infrastrukturi.
Mistral u tome vidi priliku za europske tvrtke i države koje žele veću kontrolu nad tehnologijom što je koriste u vrijeme u kojem se nadmetanje u razvoju AI-a sve više promatra kao utrka između SAD-a i Kine. Kineske kompanije predvode među modelima s javno dostupnim parametrima dok američke kompanije poput OpenAI-a svoje najnaprednije sustave uglavnom drže zatvorenima, piše Euronews.
Naglasak na kibernetičkoj sigurnosti
Jedan od glavnih aduta novog modela trebala bi biti kibernetička sigurnost te Mistral tvrdi da ML4 u tom području nadmašuje kineske konkurente.
Glavni znanstvenik i suosnivač kompanije Guillaume Lample rekao je da bi on trebao pomoći tvrtkama i državnim institucijama u obrani od napadača koji zaobilaze zaštitne mehanizme zatvorenih AI sustava i koriste ih za kibernetičke napade.
Mistral ga je predstavio samo dan nakon što je američki startup Reflection najavio Beam, svoj prvi model s parametrima dostupnima za preuzimanje. Reflection ga također predstavlja kao zapadnu protutežu kineskim modelima, a parametre planira objaviti kasnije ovog mjeseca. Njegove tvrdnje o rezultatima zasad nisu neovisno potvrđene.
Utrka protiv 'odbjeglih' AI agenata
Pierre Stock, prvi zaposlenik Mistrala i njegov potpredsjednik za znanost, razvoj novog modela usporedio je s gradnjom svemirskog broda. Sve AI kompanije, kaže, napreduju velikom brzinom, a Mistral, osnovan prije tri godine, smanjuje zaostatak. Tvrdi i da je ML4 u pojedinim područjima već bolji od kineskih modela predstavljenih ljetos.
Razvoj takvih sustava prati rasprava o sigurnosti, osobito nakon izvještaja o AI agentima koji su samostalno poduzimali neželjene radnje, uključujući hakiranje internetskih stranica.
Stock smatra da američke kompanije koriste takve incidente za promicanje ideje da naprednom tehnologijom treba upravljati samo nekoliko 'pouzdanih' kompanija te zagovara širi pristup modelima jer on omogućuje korisnicima da ih sami pokreću.
Ambiciozne tvrdnje, razvoj još traje
Mistral navodi snažne rezultate ML4-a u proizvodnji, financijama, programiranju i obradi različitih vrsta podataka, uključujući slike, te ističe sposobnost pronalaženja i označavanja određenih objekata ili detalja na slikama, poznatu kao visual grounding. Prema testovima koje je objavila kompanija, model u pojedinim takvim zadacima nadmašuje i vodeće zatvorene sustave.
Te usporedbe treba čitati uz ogradu: riječ je o rezultatima koje predstavlja proizvođač, a model još nije dovršen, no Mistral navodi da se treniranje nastavlja te da bi faza učenja potkrepljenjem trebala završiti sljedećih dana.
Treniran u Europi
Prema službenoj objavi Mistrala, ML4 je treniran od nule na 3800 Nvidijinih grafičkih procesora Grace Blackwell u njegovim europskim podatkovnim centrima. Kompanija navodi da podržava više od 160 jezika, uključujući sve službene jezike Europske unije.
Mistral je u rujnu prikupio tri milijarde eura ulaganja, uz procijenjenu vrijednost veću od 21 milijarde eura. Prema njegovim navodima, riječ je o najvećoj pojedinačnoj rundi vlasničkog financiranja neke europske tehnološke kompanije.
ML4 je već dostupan putem programskog sučelja, odnosno API-ja, na platformi Mistral Studio. Euronews navodi da je objava parametara planirana za 27. listopada dok službena Mistralova objava govori o kraju mjeseca. Do tada model mogu testirati razvojni programeri, a kompanija sa stručnjacima za kibernetičku sigurnost i državnim tijelima provjerava njegovo ponašanje u stvarnim uvjetima.