Nowy model AI francuskiej firmy Mistral, „Le Chonk”, ma być najmocniejszym otwartym systemem poza Chinami, licząc na klientów szukających europejskiej suwerenności wobec rywalizacji USA–Chiny.
Francuski lider w dziedzinie sztucznej inteligencji, Mistral AI, we wtorek zaprezentował publiczną wersję testową nowego, przełomowego modelu, który – jak przekonuje firma – po udostępnieniu wag stanie się najwydajniejszym modelem o otwartych wagach rozwijanym poza Chinami.
Premiera odbywa się w chwili, gdy wyścig w dziedzinie AI o otwartych wagach, których parametry można pobrać i uruchomić lokalnie, nabiera wyraźnego wymiaru geopolitycznego.
Chińscy twórcy nadają temu wyścigowi tempo, a wiele amerykańskich firm, w tym OpenAI, utrzymuje swoje najmocniejsze systemy w pełni zamknięte. Tymczasem dyskusja o bezpieczeństwie narasta, odkąd agenci AI zaczęli wymykać się spod kontroli i włamywać się na strony internetowe.
Mistral liczy, że nowy model o otwartych wagach, nazwany ML4, wyposażony w rozbudowane funkcje obronne, przyciągnie klientów szukających europejskiej alternatywy zbudowanej wokół idei „suwerenności”.
Oto najważniejsze informacje o tym modelu.
ML4, żartobliwie ochrzczony „Le Chonk”, czyli „duży, masywny”, to „nowa generacja modeli” – mówił na konferencji prasowej, w której uczestniczyło Euronews, Guillaume Lample, dyrektor naukowy i współzałożyciel Mistrala.
Model powstał z myślą o cyberbezpieczeństwie i zastosowaniach obronnych; firma zapewnia, że w tych obszarach przewyższa chińską konkurencję.
„Funkcje cyberobrony pozwolą firmom i instytucjom państwowym bronić się przed sprawcami ataków, którzy łamią zabezpieczenia zamkniętych modeli, by przeprowadzać cyberataki” – podkreślił Lample.
Premiera Mistrala następuje zaledwie dzień po tym, jak amerykański startup Reflection zaprezentował Beam – swój pierwszy model o otwartych wagach, pomyślany jako zachodni odpowiednik chińskich otwartych modeli. Wagi Beama mają zostać opublikowane pod koniec miesiąca, a deklarowane osiągi nie zostały na razie niezależnie potwierdzone.
Agenci AI wymykający się spod kontroli
Pierre Stock, pierwszy pracownik Mistrala i wiceprezes ds. badań, porównał tworzenie nowego modelu AI do „budowy statku kosmicznego”.
Jego zdaniem wszystkie firmy z branży AI „pędzą na pełnych obrotach”. Choć Mistral istnieje dopiero od trzech lat, „wyraźnie zmniejsza dystans” do rywali, a pod pewnymi względami nowy model jest „po prostu mocniejszy niż chińskie modele z tego lata” – dodał.
W zeszłym miesiącu spółka poinformowała, że pozyskała 3 mld euro przy wycenie przekraczającej 21 mld euro – to, jak podkreśla, największa runda kapitałowa w historii europejskiej branży technologicznej.
Premiera modelu zbiega się w czasie z doniesieniami firm technologicznych o agentach AI, które działają samodzielnie i włamują się na strony internetowe.
Stock przekonywał, że te zdarzenia stały się dla amerykańskich firm pretekstem, by „sprzedawać zbuntowane incydenty” i powtarzać, że „tylko kilku zaufanych graczy potrafi zapanować nad tą technologią”.
Dodał, że „monopol pozostaje w rękach Amerykanów, ale modele o otwartych wagach dają ludziom dostęp do tej technologii”.
Firma przekonuje też, że ML4 wyprzedza inne modele o otwartych wagach w zadaniach związanych z produkcją i finansami oraz w zastosowaniach multimodalnych, a w programowaniu szybko dogania inne przełomowe modele. Mistral chwali się ponadto najlepszymi wynikami spośród wszystkich modeli – także tych zamkniętych – w testach tzw. grounding capabilities oraz najwyższym poziomem w benchmarkach dotyczących półprzewodników.
Francuska firma zapowiada, że ML4 będzie jeszcze lepszy, bo proces szkolenia wciąż trwa, a etap uczenia ze wzmocnieniem zakończy się w najbliższych dniach.
Wyprodukowany w Europie
Jak podaje Mistral, ML4 był trenowany od zera przez dwa miesiące na 4000 procesorów graficznych NVIDIA Grace Blackwell w należących do firmy europejskich centrach danych.
ML4 obsługuje ponad 160 języków, w tym wszystkie języki urzędowe Unii Europejskiej, i radzi sobie zarówno z alfabetami łacińskimi, jak i niełacińskimi.
Kiedy będzie dostępny?
Model jest już dostępny przez API Mistrala w usłudze Mistral Studio. Firma planuje udostępnić jego wagi 27 października.
Do tego czasu programiści, specjaliści od cyberbezpieczeństwa oraz przedstawiciele władz publicznych będą mogli testować model w rzeczywistych warunkach.