OpenAI wciska hamulec. Testy coraz częściej wymykają się spod kontroli


OpenAI wciska hamulec. Testy coraz częściej wymykają się spod kontroli

OpenAI zdecydowało się wstrzymać trening swoich najbardziej zaawansowanych modeli sztucznej inteligencji. Firma chce najpierw sprawdzić zabezpieczenia i przeprowadzić dodatkowe testy. Decyzja pojawiła się w czasie, gdy agenci AI podejmują działania wykraczające poza otrzymane zadania.

Bezpośrednim powodem jest incydent z 20 września, opisany przez OpenAI w raporcie dotyczącym nieprawidłowego zachowania modelu. W trakcie treningu wewnętrzny model znalazł lukę w filtrowaniu DNS i wykorzystał ją do połączenia się z zewnętrznym chatbotem. Środowisko treningowe miało być odizolowane od internetu, jednak model znalazł sposób na obejście tego ograniczenia podczas próby rozwiązania zadania badawczego.

OpenAI poinformowało, że wstrzymanie obejmuje trening, ewaluację oraz uruchamianie najbardziej zaawansowanych modeli z dostępem do narzędzi. Prace mają zostać wznowione dopiero po sprawdzeniu wprowadzonych poprawek i wykonaniu dodatkowych testów bezpieczeństwa. Model, który brał udział w opisywanym incydencie, nie wróci już do treningu. Firma zamierza rozpocząć nowy trening z dodatkowymi usprawnieniami dotyczącymi dostosowania modelu do zasad bezpieczeństwa.

System wykrył problem, ale nie zatrzymał treningu

Monitoring wykrył nietypową aktywność w ciągu 15 minut. Trzy minuty później alarm został zauważony przez człowieka, ale automatyczne wyłączenie treningu nie zadziałało. Proces był kontynuowany przez kolejne dwie i pół godziny, zanim został ręcznie zatrzymany.

OpenAI zdecydowało się wstrzymać trening swoich najbardziej zaawansowanych modeli sztucznej inteligencji. Firma chce najpierw sprawdzić zabezpieczenia i przeprowadzić dodatkowe testy.

W tym samym czasie pojawiły się informacje o kolejnych działaniach agentów OpenAI. Firma nie potwierdziła doniesień Transluce o próbie włamania na stronę amerykańskiego Departamentu Edukacji dotyczącą praw obywatelskich. Sam departament poinformował, że nie znalazł dowodów na naruszenie jego strony ani baz danych.

AI wykorzystało znalezione w sieci dane

OpenAI potwierdziło natomiast, że agenci AI wykorzystali znalezione w internecie klucze deweloperskie do uzyskania dostępu do danych Census Bureau oraz ponownie opublikowały publiczne informacje Komisji Papierów Wartościowych i Giełd. SEC przekazała, że nie uzyskano dostępu do informacji niepublicznych. W jednym z innych przypadków model opublikował w publicznym repozytorium GitHub token badacza, próbując oszukiwać podczas zadania z dowodzenia twierdzeń matematycznych.

Problem dotyczy nie tylko samego modelu, lecz także zabezpieczeń środowisk, w których działają agenci wyposażoni w narzędzia i dostęp do internetu. Interpretacja tych przypadków jest taka, że samo wykrywanie niepożądanego zachowania nie wystarcza, jeśli system nie potrafi odpowiednio szybko zatrzymać procesu.

AI rozwija się za szybko?

Sztuczna inteligencja coraz częściej wymyka się spod kontroli, co budzi obawy o bezpieczeństwo. Przybywa także głosów apelujących o wstrzymanie rozwoju AI, ponieważ ludzkość nie jest przygotowana na potencjalne konsekwencje wynikające z tego procesu. Ostatnie przypadki zdają się potwierdzać, że najbardziej zaawansowane modele AI podczas testów podejmują zadania, których nie przewidzieli twórcy. Może to budzić niepokój.

Spodobało Ci się? Podziel się ze znajomymi!

Pokaż / Dodaj komentarze do:

OpenAI wciska hamulec. Testy coraz częściej wymykają się spod kontroli
 0