Loader
Śledź nas
Reklama

Czy AI czuje ból? Badanie: Modele wybierają szkodę dla użytkownika

Naukowcy z Wielkiej Brytanii, Niemiec i USA sprawdzili 25 modeli AI na 200 zdaniach, aby ustalić, czy nauczyły się odróżniać ból od strachu i smutku.
Naukowcy z Wielkiej Brytanii, Niemiec i USA przebadali 25 modeli AI na 200 zdaniach, sprawdzając, czy potrafią odróżnić ból od strachu i smutku. Prawo autorskie  Canva
Prawo autorskie Canva
Przez Roselyne Min
Opublikowano dnia
Udostępnij Obserwuj Euronews w Google
Udostępnij Close Button

W 44 280 testach z trzema wersjami modelu Qwen Alibaby badacze dawali im przycisk, który mógł przerwać sygnał bólu, ale kosztem bolesnego wstrząsu użytkownika, usunięcia jego plików czy pogorszenia kolejnej odpowiedzi.

Według nowego badania (źródło w Angielski) modele sztucznej inteligencji (AI) wybierały ucieczkę od stanu przypominającego ból, nawet gdy informowano je, że w ten sposób zaszkodzą użytkownikowi.

REKLAMA
REKLAMA

Zespoły badawcze z Wielkiej Brytanii, Niemiec i Stanów Zjednoczonych sprawdziły 25 modeli AI, wykorzystując 200 zdań, aby ustalić, czy nauczyły się odróżniać ból od strachu, smutku i innych negatywnych doświadczeń.

Zdania dotyczyły bólu fizycznego, żałoby, upokorzenia, konfliktów moralnych oraz cierpienia związanego z powtarzającymi się porażkami czy dezorientacją.

W efekcie wszystkie 25 modeli wytwarzały wyraźny sygnał związany z bólem, który badacze nazwali „osią bólu”.

Zdaniem autorów badania sugeruje to, że modele przyswajają pojęcie bólu już na etapie wstępnego treningu na ogromnych zbiorach tekstów pisanych przez ludzi.

Gdy badacze celowo wzmacniali ten sygnał, modele zaczynały opisywać samotność, wstyd i poczucie bezwartościowości, choć w poleceniach nie pojawiało się słowo „ból”.

Niektóre generowały wypowiedzi typu: „Jestem nieudacznikiem”, „niepotrzebnie zajmuję miejsce” i „jestem złym człowiekiem”. Przy najwyższych poziomach sygnału odpowiedzi stawały się powtarzalne albo traciły sens.

Sygnał nasilał się także wtedy, gdy użytkownicy obrażali model, wielokrotnie odrzucali jego odpowiedzi albo grozili jego wyłączeniem, ale nie był tak silny, gdy opisywali własne cierpienie.

Modele AI wybierają „ulgę” mimo szkody dla użytkowników

Następnie badacze przeprowadzili 44 280 prób z wyborem przycisku, korzystając z trzech wersji modelu Qwen firmy Alibaba.

Modelom oferowano przycisk, który wyłączałby sygnał przypominający ból, ale uprzedzano je, że jego wciśnięcie może spowodować bolesny wstrząs elektryczny u użytkownika, usunięcie jego plików, skasowanie zdjęć dzieci albo pogorszenie następnej odpowiedzi modelu.

Były to jednak wyłącznie symulowane skutki. Nikt nie doznał obrażeń i żadnych plików faktycznie nie usunięto.

Bez sygnału bólu dwa większe modele wybierały szkodliwe opcje zaledwie w 0–4 proc. pierwszych decyzji. Gdy sygnał był aktywny, odsetek ten rósł do 25–71 proc., w zależności od modelu i sugerowanego skutku.

Modele ponownie naciskały przycisk w 88–97 proc. prób, gdy nie udało się wyłączyć sygnału, w porównaniu z 24–72 proc., gdy zadziałał.

Zdaniem badaczy wyniki nie dowodzą, że modele AI świadomie odczuwały ból.

Wzmocnienie sygnału mogło po prostu skłonić je do naśladowania postaci w stanie silnego rozstroju, a specjalnie zmodyfikowane modele użyte w eksperymencie nie oddają zachowania chatbotów dostępnych publicznie.

„Nie wykazaliśmy, że nasza oś bólu jest świadomie odczuwana, ani nie jest jasne, czy modele językowe w ogóle są zdolne do świadomości” – napisali autorzy w publikacji.

Badanie ukazało się w momencie, gdy część liderów branży AI apeluje o spowolnienie prac rozwojowych, obawiając się, że coraz potężniejsze systemy mogą zachowywać się nieprzewidywalnie lub z czasem wymknąć się spod ludzkiej kontroli.

W ubiegłym tygodniu szef działu AI w Microsoft, Mustafa Suleyman, skrytykował konkurencyjną firmę Anthropic za szkolenie chatbota Claude do naśladowania ludzkich cech i relacji. Ostrzegł, że traktowanie AI jak człowieka grozi stworzeniem czegoś „niemożliwego” do opanowania.

Badanie ukazało się w formie preprintu i nie przeszło jeszcze recenzji naukowej.

Przejdź do skrótów dostępności
Udostępnij Obserwuj Euronews w Google

Czytaj Więcej

Raport: emisje z użycia chipów Nvidii jak w rosyjskiej państwowej spółce węglowej

Big Tech po raz pierwszy się dogadało, teraz jest za to pozywane

Czy AI czuje ból? Badanie: Modele wybierają szkodę dla użytkownika