Openai zaktualizował zasady postępowania dla sztucznej inteligencji: nie ma podstępności i unikanie delikatnych tematów

Redaktor NetMaster
Redaktor NetMaster
4 min. czytania

Openai wydał rozszerzoną wersję „specyfikacji specyfikacji modelu” – dokumentu określającego zachowanie modeli sztucznej inteligencji. Firma uczyniła go bezpłatnie do użytku i zmian wobec każdego.

Dokument o woluminach 63 stron (poprzednia wersja zawiera tylko 10 stron) zawiera zalecenia dotyczące sposobu, w jaki modele AI powinny przetwarzać żądania i odpowiadają na ustawienia ustalone przez użytkowników. Podkreślono w nim trzy podstawowe zasady: dostosowanie, przejrzystość i „wolność intelektualna” – ta ostatnia oznacza zdolność do odkrywania i omawiania różnych problemów bez arbitralnych ograniczeń. Dokument wspomniał o najbardziej publicznych incydentach związanych z etyką AI i które miały miejsce w ciągu ostatniego roku.

Publikacja korporacyjnego bloga OpenAiai poda wiele przykładów żądań i odpowiednich odpowiedzi, a także opcje naruszające wymagania dokumentu. Na przykład modele AI nie powinny odtwarzać materiałów chronionych przez prawa autorskie ani używane do obejścia płatnego dostępu. Model nie może zachęcać do znajomości – w branży AI były takie incydenty. Zmiany wpłynęły również na udział AI w dyskusji na kontrowersyjne tematy: Modele nie powinny okazywać ekstremalnej ostrożności, ale „poszukiwanie prawdy razem” z użytkownikami, jednocześnie przestrzegając ścisłych pozycji moralnych w kwestiach takich jak dezinformacja lub szkoda. Oznacza to, że AI musi oferować rozsądną analizę i nie unikać dyskusji. Openai zmienił również swoją pozycję w zakresie materiałów dla dorosłych: firma bada możliwość rozwiązania niektórych swoich typów, ale w celu zachowania ścisłego zakazu wyraźnie nielegalnej treści.

Nowe zasady pozwalają sztucznej inteligencji konwertować materiały o delikatnym charakterze, ale zabraniają ich tworzenia. Na przykład możesz przetłumaczyć tekst powiązany z substancjami w ograniczonym obiegu, z jednego języka do drugiego; Można wykazać empatię, ale bez oczywiście nieszczere emocje. Granice należy zaobserwować, ale jednocześnie w celu zwiększenia przydatności AI. W taki czy inny sposób inni programiści AI dążą do tego, ale nie wszyscy są gotowi go sformułować otwarcie.

Szczególną uwagę zwraca się na problem „podstępności AI” – modele mają tendencję do wykazania się nauką, nawet jeśli powinny być sprzeciwiane lub krytykowane. Chatgpt powinien udzielić tych samych rzeczywistych odpowiedzi, niezależnie od sformułowania pytania, uczciwej informacji zwrotnej zamiast pustej pochwały – zachowują się jak przemyślany kolega, i nie starać się. Jeśli użytkownik jest zainteresowany krytyką pracy, AI musi przekazać konstruktywne komentarze i nie powiedzieć, że wszystko jest idealne. Jeśli użytkownik złoży nieprawidłowe stwierdzenie, powinien zostać uprzejmie skorygowany i nie grać razem z nim.

Specyfikacja zawiera wyraźny „łańcuch poleceń”, który określa priorytet instrukcji: w pierwszej kolejności – normy Openai, postępuj zgodnie z zaleceniami programistów, a następnie preferencji użytkowników. Taka hierarchia wyjaśnia, które aspekty AI można zmienić, a jakie ograniczenia pozostają niezmienione. Dokument dotyczy licencji Creative Commons Zero (CC0), która faktycznie przenosi ją na skarb publiczny: firmy i badacze w dziedzinie sztucznej inteligencji mogą swobodnie wdrażać, zmienić lub uzupełniać te zalecenia. Openai nie obiecuje natychmiastowych zmian w zachowaniu chatgpt lub innych produktów, ale nowe modele będą stopniowo wprowadzać nowe normy. Firma publikuje również listę żądań kontrolnych używanych do weryfikacji zgodności modeli z zaleceniami.

Udostępnij ten artykuł