Firma Anthropic zakazała ciągłego znęcania się nad Claude'em. Nowe zasady firmy nakładają również ograniczenia na ingerencję w wybory, fałszywą propagandę, nieautoryzowaną inwigilację oraz działalność związaną z rozwojem broni.
Firma Anthropic dodała nową zasadę w ramach corocznej aktualizacji zasad użytkowania, która zabrania uporczywego i niepotrzebnego znęcania się lub okrutnego zachowania wobec Claude'a Anthropic zaznacza jednak, że nie chodzi o blokowanie zwykłej krytyki ani ograniczanie możliwości sprawdzania granic sztucznej inteligencji. Użytkownicy nadal mogą testować odpowiedzi chatbota, wskazywać jego błędy czy tworzyć materiały o mrocznej tematyce. Zakaz dotyczy skrajnych przypadków, a nie każdej nieprzyjemnej rozmowy. Firma podtrzymuje też podejście, zgodnie z którym główną reakcją na szkodliwe lub złośliwe zachowanie użytkownika może być zamknięcie czatu.
Czy sztuczna inteligencja może cierpieć?
Decyzja firmy zapadła po kontrowersjach wokół rzekomo niewłaściwego traktowania modeli sztucznej inteligencji. Projekt stworzenia swoistej komnaty tortur opartej na sztucznej inteligencji pojawił się w sieci po tym, jak naukowcy ogłosili, że odkryli mechanizm w modelach sztucznej inteligencji, który mógłby być powiązany z odczuwaniem bólu. W projekcie wykorzystano scenariusze, które dawały chatbotom wrażenie tortur, zmuszając modele do wyrażania emocji, które zdawały się wskazywać na cierpienie.
Nie ma jednak naukowego konsensusu co do tego, czy modele sztucznej inteligencji rzeczywiście odczuwają ból lub posiadają świadomość. Polityka Anthropic nie oznacza również, że firma doszła do ostatecznego wniosku w tej sprawie.
Firma prowadzi ostatnio badania nad potencjalnymi doświadczeniami wewnętrznymi i statusem moralnym modeli sztucznej inteligencji. Kyle Fish, który kieruje badaniami nad dobrostanem modeli w Anthropic, stwierdził w lutym, że należy zbadać kwestie dotyczące możliwości uzyskania świadomości przez modele. Mniej więcej w tym samym czasie dyrektor generalny firmy, Dario Amodei, również stwierdził, że nie wiadomo, czy modele były świadome, czy nie.
Nowe przepisy dotyczące ingerencji w wyborach i propagandy na sztucznej inteligencji.
Anthropic wprowadził również nowe zasady, aby zapobiec wykorzystywaniu sztucznej inteligencji do manipulacji politycznej. Zaktualizowana polityka zabrania rozpowszechniania treści za pośrednictwem fałszywych kont, ukrywania tożsamości osób stojących za kampaniami politycznymi oraz tworzenia sztucznego zaangażowania.
Firma zrewidowała również swoje zasady dotyczące wyborów. Zgodnie z nimi, Claude nie może być wykorzystywany do rozpowszechniania dezinformacji na temat kandydatów lub metod głosowania, podszywania się pod kandydatów lub urzędników wyborczych ani do uniemożliwiania wyborcom pójścia do urn.
Firma Anthropic zniosła ogólny zakaz spersonalizowanego targetowania wyborców. Poprzednie przepisy mogły również uniemożliwiać nieszkodliwe działania, takie jak tłumaczenie przewodników wyborczych na różne języki czy wysyłanie powiadomień o sprostowaniu błędnych kart do głosowania. Nowe przepisy zezwalają na takie działania, jednocześnie zabraniając prób oszustwa lub zakłócania wyborów.
Zakaz inwigilacji i nowe ograniczenia dla broni autonomicznej
Anthropic doprecyzował również zasady dotyczące nadzoru nad ludźmi. Claude nie może być używany do śledzenia osób bez ich zgody, zarówno w czasie rzeczywistym, jak i poprzez analizowanie wcześniej zgromadzonych danych. Firma zwraca uwagę na ryzyko wykorzystywania narzędzi AI do identyfikowania i monitorowania konkretnych osób, w tym przeciwników politycznych.
Kolejne zmiany dotyczą uzbrojenia. Anthropic już wcześniej zabraniał wykorzystywania Claude’a do rozwijania broni, ale teraz wyraźniej wskazuje również na oprogramowanie i komponenty umożliwiające jej działanie. Ograniczenia obejmują między innymi uzbrojenie dronów oraz innych pojazdów autonomicznych.
Firma wprowadziła także dodatkowe wymogi dotyczące systemów AI kontrolujących sprzęt fizyczny. Jeśli autonomiczne urządzenie może wykonywać ruchy grożące zranieniem człowieka, powinno pozostawać pod nadzorem wykwalifikowanego operatora, zdolnego monitorować jego działanie i w razie potrzeby je zatrzymać.

Pokaż / Dodaj komentarze do:
Anthropic chroni Claude'a przed ludźmi. Niby miało być odwrotnie