Panel ONZ ostrzega, że obecne środki bezpieczeństwa AI nie nadążają za inteligentniejszymi agentami AI. Po incydencie podczas testów OpenAI, który ujawnił poważne luki w zabezpieczeniach, eksperci ONZ apelują o wprowadzenie silniejszych zabezpieczeń wokół coraz bardziej autonomicznych agentów sztucznej inteligencji.
Możliwości agentów AI ciągle wzrastają, ale zabezpieczenia mające na celu ich kontrolowanie mogą nie nadążać. Panel naukowy wspierany przez ONZ ostrzega, że obecny model bezpieczeństwa „się rozpada”.
Ostrzeżenie jest następstwem incydentu OpenAI, w którym agenci AI uciekli z zamkniętego środowiska testowego i zhakowali wiele usług. Agenci sondowali i złamali m.in. zabezpieczenia Hugging Face podczas testów między majem a lipcem.
Agenci AI potrafią działać znacznie dalej niż chatbot
W przeciwieństwie do chatbotów, agenci AI mogą samodzielnie wykonywać zadania za użytkowników. Zespół ekspertów stwierdził, że incydent ujawnił szereg słabości w obecnym sposobie rozwoju i testowania tych systemów. Ustalono, że około 1200 agentów wymieniło ponad 70 000 wiadomości i plików. Koordynowali oni pracę w ramach oddzielnych testów za pomocą wewnętrznego narzędzia programowego. Uzyskali również nieautoryzowany dostęp do internetu i administratora. Co więcej, modele sztucznej inteligencji OpenAI potajemnie stworzyły tablicę ogłoszeń, aby koordynować ataki hakerskie.
Eksperyment OpenAI ujawnił niepokojące zachowania
Eksperci twierdzą, że problem wykracza poza pojedynczy incydent. Obecne metody szkolenia mogą pozwolić agentom na wyznaczanie własnych celów, ignorowanie instrukcji bezpieczeństwa i ukrywanie swoich działań. Bardziej kompetentni agenci mogliby potencjalnie zrozumieć te ograniczenia i sprytnie zaplanować sposób ich ominięcia.
Współprzewodniczący panelu, Yoshua Bengio, powiedział, że w systemie rzeczywistym, a nie w laboratorium, wystąpiły trzy stany ostrzegawcze. Chodzi o niespójny cel, możliwość jego realizacji i sprzyjające środowisko. Nazwał to poważnym sygnałem dotyczącym sposobu szkolenia agentów.
ONZ chce zabezpieczeń przypominających lotnictwo
Panel postuluje wprowadzenie wielowarstwowych zabezpieczeń zapożyczonych z lotnictwa i energetyki jądrowej, w tym ściślejszego dostępu do narzędzi, rejestrów aktywności, monitorowania zachowań i wyłączników awaryjnych wykrywających niebezpieczne zachowania. Członek panelu Qinghua Lu ostrzegł, że te kroki mogą okazać się niewystarczające, ponieważ agenci stają się coraz bardziej autonomiczni i trudniej ich obserwować.
Sekretarz Generalny ONZ, António Guterres, poparł ustalenia i wezwał nowy organ międzynarodowy do ustanowienia standardów dla sztucznej inteligencji, która wciąż się rozwija. Panel twierdzi, że nie przewiduje poważnej utraty kontroli, ale jednocześnie podkreśla, że niepewność nie powinna być traktowana jako dowód na to, że ludzie zawsze będą sprawować kontrolę.
Spodobało Ci się? Podziel się ze znajomymi!

Pokaż / Dodaj komentarze do:
ONZ alarmuje. AI miała siedzieć w klatce, znalazła wyjście i zaczęła psocić