Francja rzuca wyzwanie gigantom AI. Na razie ocenę wystawiła sobie sama


Francja rzuca wyzwanie gigantom AI. Na razie ocenę wystawiła sobie sama

Francuska firma Mistral, zajmująca się sztuczną inteligencją, zaprezentowała swój nowy model sztucznej inteligencji, Mistral Large 4, z 1 bilionem parametrów. Mistral twierdzi, że model ten jest najpotężniejszym systemem o otwartej architekturze poza Chinami.

Francuska firma Mistral, zajmująca się sztuczną inteligencją, zaprezentowała nowy model o nazwie Mistral Large 4 (ML4) . Model ten, nazywany wewnętrznie „Le Chonk”, zawiera łącznie 1 bilion parametrów i koncentruje się w szczególności na takich obszarach jak rozwój oprogramowania, cyberbezpieczeństwo, finanse, produkcja i analityka wizualna.

Mistral twierdzi, że ML4 jest najmocniejszym modelem o otwartej wadze poza Chinami i plasuje się w czołówce modeli na świecie. Początkowo model został udostępniony w wersji zapoznawczej dla programistów, specjalistów ds. cyberbezpieczeństwa i agencji rządowych. Publikacja modeli o ważonej wadze planowana jest na 27 października.

Szkolenie Mistral Large 4 trwało około dwóch miesięcy. Model został przeszkolony z wykorzystaniem 4000 układów graficznych Nvidia Grace Blackwell w centrach danych firmy w całej Europie. ML4 został przeszkolony w ponad 160 językach, w tym we wszystkich językach urzędowych Unii Europejskiej.

Bilion parametrów, ale większość pozostaje nieaktywna

Jedną z podkreślanych cech modelu jest to, że pomimo biliona parametrów, nie uruchamia on wszystkich jednocześnie. W ML4 podczas wnioskowania aktywnych jest tylko 49 miliardów parametrów. Ta rzadka architektura utrzymuje całkowitą przepustowość modelu na wysokim poziomie, jednocześnie zapewniając, że w każdej operacji wykorzystywana jest tylko część sieci.

Dla porównania, poprzedni model Mistral Large 3 zawierał 675 miliardów parametrów i 41 miliardów aktywnych parametrów. Do wytrenowania Large 3 potrzebnych było 3000 procesorów graficznych Nvidia H200.

Jednak chociaż ML4 może przetwarzać dane wejściowe multimodalne, to na wyjściu generuje jedynie tekst. Mistral podkreśla potencjalne zastosowania nowego modelu w inżynierii oprogramowania, cyberobronie, analizie finansowej, ocenie zdjęć satelitarnych i lotniczych, rysunkach technicznych oraz projektowaniu układów scalonych.

Cyberbezpieczeństwo ma być jednym z najważniejszych zastosowań

Mistral pozycjonuje możliwości nowego modelu w zakresie cyberbezpieczeństwa jako jeden ze swoich strategicznych zastosowań. Firma argumentuje, że modele open source mogą dać organizacjom większą kontrolę nad analizą kodu, testami obronnymi i podobnymi działaniami bezpieczeństwa. Podejście to opiera się na fakcie, że zamknięte modele sztucznej inteligencji mogą odrzucać niektóre żądania dotyczące podwójnego zastosowania ze względu na polityki bezpieczeństwa. Według Mistrala, organizacje mogą mieć większą kontrolę nad tymi procesami dzięki modelom o otwartej wadze, które mogą uruchamiać i dostosowywać w ramach własnej infrastruktury.

Wagi ML4 zostaną udostępnione na zastrzeżonej licencji Mistral. Firma podkreśla również możliwości dla przedsiębiorstw i klientów z sektora publicznego, umożliwiając im korzystanie z suwerennej infrastruktury, dostosowywanie i zerowe retencje danych.

Francuzi pokazują wysokie wyniki, ale na razie trzeba zachować ostrożność

Według wstępnych wyników udostępnionych przez Mistral, ML4 osiąga 62% skuteczności w teście inżynierii oprogramowania DeepSWE v1.1. W porównaniu firmy, model Beam od Reflection AI uzyskał 44%, Qwen 3.8 Max 51%, DeepSeek V4 Pro 0813 57%, a GLM-5.3 61%.

Należy jednak zauważyć, że ML4 nie został jeszcze gruntownie przetestowany na niezależnych platformach ewaluacyjnych. Dlatego tabele w obrazach udostępnionych w niniejszym materiale powinny zostać ponownie sprawdzone po zakończeniu niezależnych testów. Okres testowy dla ML4 potrwa około trzech tygodni, po czym wagi modeli zostaną opublikowane 27 października.

 

Pokaż / Dodaj komentarze do:

Francja rzuca wyzwanie gigantom AI. Na razie ocenę wystawiła sobie sama
 0