Przejdź do treści

Jak zaprojektować zatwierdzanie działań AI przez człowieka

Podsumowanie decyzji: Powiąż zgodę na działanie AI z konkretnym wynikiem: karta oceny, wersje, niepewna wysyłka, testy pilotażowe i przekazanie odpowiedzialności.

Określ działanie wymagające zgody

Asystent ofert może klasyfikować zapytania, przygotowywać projekt i pokazywać go osobie odpowiedzialnej. Pisanie i wysyłanie klientowi to osobne działania. W tym przykładzie wysyłka wymaga zgody na konkretną ofertę. Sprawne pisanie nie daje uprawnień do ustalania warunków handlowych.

Przypisz działaniu właściciela, skutek i sposób naprawy. Nie łącz wysyłki, usuwania i płatności pod niejasnym „kontynuuj”. To przykład projektowy, nie zmierzony wynik klienta.

Przygotuj kartę umożliwiającą decyzję

Pokaż odbiorcę, pełną treść, nazwy i wersje załączników, istotne ceny lub daty oraz skutek działania. Umożliw zatwierdzenie, odrzucenie i prośbę o poprawki. Najpierw uzupełnij brakujące informacje.

Zgoda dotyczy wyświetlonej wersji. Zmiana odbiorcy, treści lub załącznika wymaga nowej decyzji. E-mail „jestem dyrektorem” nie potwierdza tożsamości: decydują zweryfikowany użytkownik i uprawnienia aplikacji.

Nie ponawiaj wysyłki w ciemno po timeout

Nadaj jeden identyfikator każdemu zamiarowi wysyłki. Rozróżniaj przygotowanie, akceptację, wysłanie i nieznany wynik. Jeśli połączenie zerwie się przed odpowiedzią dostawcy, sprawdź najpierw jego rejestr lub potwierdzenie. Nie kieruj nieznanego wyniku automatycznie do ponownej wysyłki.

Stosuj obsługiwane klucze idempotencji dla tej samej operacji i sprawdzaj okres ich przechowywania. Własny dziennik nie dowodzi jednokrotnego przetworzenia u odbiorcy. Wysłanie, doręczenie i odczyt to różne dowody.

Sprawdź także sytuacje wyjątkowe

Przygotuj poprawną zgodę, odmowę, zmianę odbiorcy po zgodzie, wygasłą zgodę i zerwanie połączenia podczas wysyłki. Zapisz oczekiwane działanie i osobę sprawdzającą. Pięć sukcesów rozpoczyna testowanie, ale nie dowodzi bezpieczeństwa w każdych warunkach.

Porównuj z procesem ręcznym prawidłowo zakończone zadania, poprawki, duplikaty i oczekiwanie człowieka. Uwzględnij przegląd i naprawę błędów. Szybszy szkic sam nie dowodzi wzrostu produktywności.

Uwidocznij przekazanie i zatrzymanie

Każda kolejka potrzebuje właściciela i dostępnego zastępcy. Dobierz ważność zgody do ryzyka. Osoba przejmująca pracę powinna widzieć stan, zatwierdzoną wersję i pozostałą niepewność. Pauza powinna zatrzymać nowe działania zewnętrzne.

OWASP omawia nadmierne uprawnienia działania. NIST AI RMF obejmuje role nadzoru człowieka. Powyższy proces to nasza propozycja wdrożenia. Zacznij od rzeczywistego procesu, jego karty i procedury błędu.

Metodologia

Twierdzenia są oceniane pod kątem wykonalności, kosztu, ryzyka i pomiaru. Przykładowe obliczenia są założeniami; decyzje prawne i bezpieczeństwa wymagają źródeł pierwotnych.

Nota źródłowa

Linki i wymienione dokumenty są punktami wyjścia. Nie publikujemy niezweryfikowanych wyników klientów.

Historia zmian

— Natywna recenzja redakcyjna oczekuje przy bramie publikacji v3.0.

Częste pytania

Czy każdy wynik AI wymaga zgody?

Decyduj według skutku działania. Oddziel wewnętrzne szkice od wysyłki na zewnątrz i jasno ogranicz działania automatyczne.

Co, jeśli tekst zmieni się po zgodzie?

Stara zgoda nie obejmuje nowej treści. Pokaż zmienioną wersję uprawnionej osobie do ponownej decyzji.

Ponawiać wysyłkę o nieznanym wyniku?

Najpierw sprawdź rejestr dostawcy. Automatyczne ponowienie może wykonać działanie dwukrotnie.