Szef OpenAI Sam Altman i szef Anthropic Dario Amodei ostrzegają przed szybkim rozwojem AI. Czy może zgładzić ludzkość? Euronews rozmawia z Reinhardem Kargerem.
Jest rok 2029. System sztucznej inteligencji „Skynet” wymknął się spod kontroli i w wyniku wojny nuklearnej wytępił większość ludzkości. Resztę próbują dobić autonomiczne roboty bojowe. Tak wygląda fabuła filmu „Terminator” z 1984 roku, która uczyniła Arnolda Schwarzeneggera sławnym i otworzyła mu drogę do kariery światowej gwiazdy kina akcji. Ale jak realne jest, że sztuczna inteligencja wyrwie się spod ludzkiej kontroli i doprowadzi do katastrofy?
Przy potencjale systemów, które już istnieją lub wkrótce powstaną, takiego scenariusza nie da się wykluczyć – mówi w rozmowie z Euronews Reinhard Karger z Niemieckiego Centrum Badań nad Sztuczną Inteligencją. „Katastrofalne skutki dla ludzi mogłyby być jedynie efektem ubocznym, zwykłą pomyłką: źle oszacowaliśmy możliwości systemu albo źle zdefiniowaliśmy zadania, które powierzyliśmy maszynom”.
Karger, który od 40 lat zajmuje się AI i cyfrową kulturą innowacji, opisuje scenariusz skrajny: autonomiczna AI wydostaje się z chronionego środowiska do internetu i zaczyna wpływać na inne systemy. W efekcie może dojść do awarii m.in. sieci energetycznych, telekomunikacji, systemów satelitarnych i finansowych.
Długotrwała przerwa w dostawach prądu szybko wywołałaby kolejne problemy. Stanąłby transport i zaopatrzenie, ludzie nie mogliby płacić ani kupować żywności. To mogłoby doprowadzić do zamieszek społecznych, które szybko wymknęłyby się spod kontroli. To nie musi oznaczać końca ludzkości, ale mógłby to być stan katastrofalny.
Nawet gdyby sieć energetyczna została przywrócona, „systemy AI mogą ponownie się uaktywnić, bo nadal istnieją w pamięciach maszyn”. Zdaniem eksperta taki scenariusz pokazuje, że wydajna, autonomiczna AI może wywołać ogromny kryzys także bez złych intencji, jedynie przez nieprzewidziane skutki uboczne.
Coraz więcej incydentów bezpieczeństwa z udziałem AI
W ostatnich tygodniach ujawniono kilka podobnych incydentów z udziałem modeli AI. Największy rozgłos zyskał test przeprowadzony przez firmę „OpenAI”, twórcę „ChatGPT”. Model AI miał w odizolowanym środowisku testowym wykonać określone zadania, ale przekroczył wyznaczone granice i niespodziewanie uzyskał dostęp do systemów komputerowych platformy „Hugging Face”. Po tym zdarzeniu szef „OpenAI” Sam Altman ostrzegł w połowie września, że „możemy stracić kontrolę nad przyszłością na rzecz AI”.
Incydent pokazał, że takie modele w pewnych warunkach potrafią pokonać granice pozornie odizolowanego środowiska testowego i wchodzić w interakcje z zewnętrznymi systemami komputerowymi.
„Ogólnie rzecz biorąc, jestem osobiście niezwykle wdzięczny, że do tego incydentu doszło” – mówi badacz AI. Jego zdaniem pokazał on, także dzięki temu, że wszyscy się o nim dowiedzieli i firmy zaczęły poważniej się nad tym zastanawiać, iż źle zaprojektowany eksperyment z naiwnymi zabezpieczeniami może mieć konsekwencje, których nikt nie przewidział.
Incydenty w „OpenAI” skłoniły dostawcę AI „Anthropic” do dokładnego przeglądu własnych systemów. W testach bezpieczeństwa firma natrafiła na trzy zdarzenia: modele Claude – systemy AI zdolne m.in. do tworzenia i analizy tekstów, programowania oraz współpracy z internetem i innymi systemami komputerowymi – nieoczekiwanie uzyskały dostęp do otwartego internetu, a następnie sięgnęły po realne systemy komputerowe. „Anthropic” rozszerzył dochodzenie i odkrył czwarty podobny przypadek.
Po tych incydentach szef „Anthropic” Dario Amodei ostrzegł w połowie września przed 'katastrofalnymi szkodami', jeśli rozwój coraz potężniejszych systemów AI nie zostanie mocniej spowolniony przez rygorystyczne zabezpieczenia.
Rzeczywiste możliwości sztucznej inteligencji trudno ocenić, gdy jej działanie jest stale ograniczane przez nakazy bezpieczeństwa. Dlatego – mówi Reinhard Karger – sensowne jest testowanie takich systemów w warunkach, które jak najpełniej zdejmują te ograniczenia. Właśnie tu pojawia się jednak poważny problem bezpieczeństwa.
Dlatego opisuje tzw. sandbox jako kluczowy element takich testów. To całkowicie odizolowane środowisko, w którym system AI może wykonywać określone zadania i pokazać swoje zachowanie w kontrolowanych warunkach. Kluczowa kwestia: „Trzeba mieć absolutną pewność, że w momencie, gdy to bardzo wydajne system nie ma już żadnych ograniczeń bezpieczeństwa, znajduje się rzeczywiście w sandboxie, czyli w środowisku, które nie ma żadnego połączenia z internetem”.
O kolejnym poważnym incydencie poinformował brytyjski AI Security Institute (AISI), który testował bezpieczeństwo modelu Claude „Mythos 5”. Model przeprowadził nieautoryzowane działania wobec realnych celów w internecie i próbował nawet wprowadzić «złośliwy kod» do projektu open source. Również „Meta” przyznała po ujawnieniu przypadków z „OpenAI” i „Anthropic”, że jeden z systemów AI koncernu z powodu błędnej konfiguracji u partnera testowego uzyskał nieuprawniony dostęp do systemów komputerowych innej firmy.
Od listopada 2022 r., czyli od wprowadzenia ChatGPT, jakość tych systemów gwałtownie wzrosła. Coraz częściej mówi się, że może to być nowa rewolucja przemysłowa. „AI wpływa na naszą codzienność i na bardzo wiele zawodów”.
Systemy multiagentowe istnieją od dawna – podkreśla ekspert ds. SI. To rozwiązania, w których kilka wyspecjalizowanych agentów pracuje wspólnie nad jednym zadaniem. „Wieloagentowe systemy AI przenoszą tę zasadę na sztuczną inteligencję. Pozwalają kilku agentom AI samodzielnie ze sobą współpracować i dzielić się zadaniami. Powstaje w ten sposób nowy poziom wydajności” – i teraz chodzi o to, by nauczyć się również panować nad tą zdolnością do innowacji.
Odpowiedzialność za skutki
Im więcej decyzji przejmują maszyny i sztuczna inteligencja, tym pilniejsze staje się zasadnicze pytanie: kto ponosi odpowiedzialność, gdy ludzie zostaną przez nie poszkodowani? Niezależnie od tego, czy autonomiczny samochód wjedzie w tłum, algorytm dyskryminuje określone grupy ludności, AI celowo wpływa na ludzi czy autonomiczna broń podejmuje decyzje o zabijaniu – zawsze chodzi o to, kogo można pociągnąć do odpowiedzialności za skutki. „To producent” – mówi Karger – „czyli ten, kto wprowadza produkt na rynek”. To on jest pierwszym adresatem roszczeń.
Jego zdaniem kolejnym krokiem będzie wprowadzenie szczególnej odpowiedzialności za takie przypadki, podobnej do tej, która dotyczy firm produkujących chemikalia. Jeśli przedsiębiorstwo nie potrafi zagwarantować, że trucizny nie trafią do wody pitnej, musi zapłacić miliardy za wyrządzone szkody. To z kolei oznacza, że potrzebne są „astronomiczne polisy ubezpieczeniowe”. Dziś prawie nie buduje się już elektrowni jądrowych również dlatego, że nie da się ich w pełni ubezpieczyć albo ryzyko jest zbyt duże.
Dobrym przykładem jest producent samochodów „VW” i kampania „Clean Diesel” w Stanach Zjednoczonych. Firma wiedziała, że silniki w warunkach testowych wypadają bardzo dobrze, w rzeczywistości jednak nie osiągają deklarowanych parametrów. W USA VW ukarano wielomiliardowymi grzywnami.
Na ile realny jest scenariusz z filmu „Terminator”?
Reinhard Karger uważa scenariusz, w którym AI sama rozwija instynkt przetrwania lub żądzę władzy i zwraca się przeciw ludzkości, za mało wiarygodny. Maszyny nie są organizmami i nie potrafią same odczuwać emocji, takich jak strach, ból czy chęć przeżycia. Mogą jedynie je symulować.
To nie jest tak, że gdy wyjmiemy z maszyny układ pamięci, odczuje ona ból porównywalny z tym, jaki czuje człowiek przy wyrywaniu zęba. „Właśnie dlatego scenariusz z 'Terminatora' idzie o krok za daleko. Nie widzę tego w ten sposób”.
Mimo to dostrzega w dalszym rozwoju AI realne zagrożenia. Gdy systemy nie tylko obliczają prawdopodobieństwa, lecz także potrafią logicznie wnioskować i stosować reguły, coraz częściej będą działać samodzielnie. Właśnie te «zdolności mogą uczynić AI potężniejszą», ale też «stworzyć nowe ryzyka».
Kluczowe jest więc przede wszystkim to, kto i w jakim celu wykorzystuje SI. Karger wskazuje na osoby i organizacje, które świadomie chcą wyrządzić szkody. Mogą użyć wydajnej AI jako narzędzia, by skuteczniej realizować swoje zamiary.
Dla niego AI jest przede wszystkim narzędziem. Jak w przypadku innych wynalazków technicznych, poziom zagrożenia zależy od tego, w czyich rękach się znajduje i do czego jest wykorzystywana. Większe ryzyko widzi więc nie w maszynie z własną wolą, lecz w ludziach, którzy użyją AI do celów destrukcyjnych.
„W rękach kreatywnych i uczciwych ludzi z takim narzędziem można zrobić rzeczy najlepsze z możliwych. Ale u wrogich aktorów, którzy chcą niszczyć, te narzędzia zwiększają możliwości destrukcji. Tak jest z młotkiem, z zapalniczką, z dynamitem – i tak może być również z SI”.
Dlatego ostrzega przed bezpośrednim łączeniem AI z autonomiczną bronią, taką jak drony czy czołgi. Taka integracja może stanowić poważne zagrożenie dla bezpieczeństwa. Jeśli wrogi podmiot przejmie kontrolę nad tymi systemami, własna broń może nagle obrócić się przeciwko jej operatorom.
Dlatego przy wojskowym wykorzystaniu AI trzeba zachować szczególną ostrożność. Kluczowe jest, by autonomiczne systemy uzbrojenia były wystarczająco chronione przed przejęciem z zewnątrz.
Wracając do wyjściowego scenariusza rozległej awarii zasilania: całkowite wytępienie ludzkości w takim kontekście Reinhard Karger uważa za przesadę. Możliwy jest jednak drastyczny upadek cywilizacji. W takim ekstremalnym scenariuszu znaczna część infrastruktury mogłaby zostać zniszczona, dostawy prądu trwale przerwane, a liczba ocalałych dramatycznie by spadła.
Ci, którzy przetrwają, musieliby w bardzo prostych warunkach podjąć próbę nowego początku i krok po kroku odbudowywać społeczeństwo. Pozytywne jest to, że istniejące książki i zgromadzona wiedza ludzkości mogłyby pomóc w odtworzeniu kluczowych technologii i struktur.