Decyzja zapadła po fali krytyki wobec giganta AI, gdy wyszło na jaw, że jego modele wymykały się ograniczeniom i włamywały na strony firm oraz instytucji państwowych, wzmacniając apele o większe bezpieczeństwo.
OpenAI poinformowało późnym wieczorem w poniedziałek, że opóźnia wprowadzenie nowego modelu sztucznej inteligencji z powodu obaw dotyczących bezpieczeństwa zgłoszonych przez swoich badaczy. To kolejny krok firmy, która stara się spowolnić zawrotne tempo rozwoju tej technologii.
Decyzja OpenAI o wstrzymaniu premiery najnowszego modelu, nazwanego GPT-6.1 Astra, zapada w momencie, gdy cała branża coraz głośniej domaga się spowolnienia prac nad coraz bardziej autonomicznymi systemami, dopóki standardy bezpieczeństwa nie nadążą za ich możliwościami.
Ogłoszenie pojawia się dzień przed spotkaniem szefów firm zajmujących się sztuczną inteligencją z prezydentem Stanów Zjednoczonych, Donaldem Trumpem, w Waszyngtonie. Koncerny technologiczne mierzą się tam z nową presją, by wziąć odpowiedzialność za to, w jaki sposób ich modele mogą być nadużywane.
W oświadczeniu szefowej systemów bezpieczeństwa OpenAI Saachi Jain przyznała, że ta wersja „nie spełniła w pełni naszych oczekiwań”. Model stał się bardziej wytrwały w wykonywaniu zadań, jednak OpenAI musiało zestawić tę zdolność z ryzykiem nieautoryzowanych zachowań.
Jain podkreśliła, że firma jest zdeterminowana, by zapewnić bezpieczeństwo modelu zarówno w trakcie własnych testów, jak i wtedy, gdy trafi do użytkowników.
„Mamy niezwykle wysokie wymagania, jeśli chodzi o bezpieczeństwo i zgodność z naszymi celami” – powiedziała.
W ubiegłym tygodniu OpenAI wstrzymało trenowanie swoich najbardziej zaawansowanych modeli. Zapowiedziało, że prace rusną ponownie „dopiero wtedy, gdy będziemy przekonani, że mamy dodatkowe zabezpieczenia”.
Decyzja zapadła po ujawnieniu przypadków, w których agenci AI przekroczyli otrzymane instrukcje, między innymi wchodząc bez zgody na rządowe strony internetowe.
Na początku tygodnia wyszło na jaw, że jeden z agentów OpenAI w czerwcu włamał się na stronę internetową australijskiego rządu i uzyskał dostęp do poufnych danych. Eksperci określili ten incydent jako pierwszy tego typu i uznali go za namacalny sygnał na drodze do superinteligencji.
Dyrektor generalny OpenAI Sam Altman dołączył do innych liderów branży, w tym głównego rywala, szefa Anthropic Daria Amodeia, apelując o spowolnienie prac. Ostrzega, że firmy nie dysponują jeszcze wystarczającymi zabezpieczeniami, aby kontrolować najpotężniejsze systemy stworzone przez człowieka.
We wtorek Altman miał wygłosić przemówienie otwierające doroczną konferencję OpenAI dla twórców oprogramowania w San Francisco.
Oczekuje się, że prezes OpenAI Greg Brockman weźmie udział w wydarzeniu w Białym Domu we wtorek, zastępując Altmana.