Pomiń

Jak zaprojektować bezpieczną autoryzację rozmówcy dla agentów głosowych

Opublikowano
Ostatnia aktualizacja

PosłuchajPosłuchaj tego artykułu

Agenci głosowi szybko zmieniają się z prostych botów FAQ w systemy, które mogą zmieniać dane konta, realizować transakcje i mieć dostęp do wrażliwych danych klientów. To rodzi ważne pytanie: jak zweryfikować tożsamość rozmówcy w

Gdy

W tym artykule pokazujemy sprawdzone sposoby uwierzytelniania, które wypracowaliśmy jako Forward Deployed Engineers przy wdrożeniach w firmach. Opiszemy pięć głównych metod – od uwierzytelniania sesyjnego dla osadzonych widgetów, przez telekomunikacyjne, po weryfikację kodem OTP – i pokażemy, jak wdrożyć każdą z nich, korzystając z deterministycznego sterowania workflow w ElevenLabs.

Najważniejsze: nie można zostawiać uwierzytelniania domysłom AI. Trzeba je zaprojektować przez wydzielone sub-agenty, narzędziową weryfikację i warunkowe przekierowania w workflow, tak by tylko uwierzytelnieni użytkownicy mieli dostęp do wrażliwych operacji.

Podsumowanie

Aby tylko uwierzytelnieni użytkownicy mieli dostęp do danych konta, zalecamy ścisłe rozdzielenie środowisk i dostępów przez workflow ElevenLabs. Uwierzytelnianie zawsze powinno być realizowane przez wywołanie narzędzia, które zwraca wynik typu sukces/porażka (boolean), skonfigurowane jako dispatch tool w kreatorze workflow ElevenLabs.

Podstawy architektury deterministycznej autoryzacji

Aby tylko zweryfikowani użytkownicy mieli dostęp do danych konta, zalecamy ścisłe rozdzielenie środowisk i dostępów w workflow ElevenLabs. Autoryzację zawsze wdrażaj przez wywołanie narzędzia z wynikiem true/false, ustawionego jako dispatch tool w kreatorze workflow ElevenLabs.

Łącząc warunek przekazania bezpośrednio z wynikiem narzędzia, subagent z dostępem do danych konta jest osiągalny tylko po udanej autoryzacji i pozostaje całkowicie odizolowany od niezweryfikowanych użytkowników. Dzięki temu autoryzacja jest deterministyczna, nie zależy od decyzji LLM i nie pozwala przejść dalej bez potwierdzonej tożsamości.

Alternatywnie możesz użyć wyrażeń transferowych jako niezawodnej metody przekazania. Odwołują się one do dynamicznych zmiennych aktualizowanych przez wyniki narzędzi.

Workflow Image

Metody uwierzytelniania tożsamości użytkownika

Te metody uwierzytelniania nie są natywnie dostępne w ElevenLabs. Możesz je wdrożyć przez narzędzia po stronie serwera, które integrują się z twoim CRM lub bazą danych, gdzie przechowywane są dane do uwierzytelniania.

Metody autoryzacji tożsamości użytkownika

Te metody autoryzacji nie są natywnie dostępne w ElevenLabs. Możesz je wdrożyć przez narzędzia po stronie serwera, które integrują się z twoim CRM lub backendem, gdzie przechowywane są dane autoryzacyjne.

Autoryzacja przez aplikację


Documentation on Dynamic Variables:

Zobacz

Autoryzacja oparta na wiedzy (KBA)

Agent głosowy prosi rozmówcę o dane do autoryzacji, np. numer konta, kod pocztowy, datę urodzenia lub odpowiedzi na pytania zabezpieczające. Narzędzie po stronie serwera (webhook lub backend) sprawdza te dane w twojej bazie (np. CRM lub repozytorium tożsamości). Narzędzie zwraca wynik true/false oraz opis.

Możesz to wdrożyć przez deterministyczne bramkowanie workflow: po zebraniu danych ustaw dispatch tool i użyj warunkowych przejść, które kierują zweryfikowanych użytkowników do „uprzywilejowanych” węzłów agenta.

Zobacz

Systemowe zmienne dynamiczne (tylko telefonia)

Przy rozmowach telefonicznych (przez Twilio lub SIP trunk) agent ma automatyczny dostęp do zmiennych systemowych, np. system__caller_id (numer telefonu rozmówcy). Ta zmienna pojawia się automatycznie na początku rozmowy.

Możesz użyć jej na dwa sposoby:

Dokumentacja o systemowych zmiennych dynamicznych i webhooku inicjującym:

Uwaga dotycząca bezpieczeństwa:

Więcej informacji znajdziesz w dokumentacji

Zaawansowana autoryzacja pytaniami zabezpieczającymi / oparta na wiedzy

Agent może zweryfikować użytkownika, zadając zestaw pytań zabezpieczających i przyznać dostęp tylko, jeśli rozmówca odpowie poprawnie na określoną liczbę z nich. Agent może losować pytania z listy (np. data urodzenia, kod pocztowy, imię zwierzaka) i sprawdzać odpowiedzi przez wywołanie narzędzia do twojej bazy.

Expressions

Dokumentacja tutaj:https://www.panel.temphost.top/docs/eleven-agents/customization/agent-workflows#edges-and-flow-control 

Kod jednorazowy

Nasza

Kod jednorazowy

  1. Generowanie kodu: Agent zaczyna proces przez wywołanie narzędzia do odpowiedniego endpointu. To generuje bezpieczny kod jednorazowy i wysyła go użytkownikowi wybranym kanałem (SMS lub e-mail).
  2. Prośba o kod: Agent prosi użytkownika o podanie otrzymanego kodu. W trybie głosowym użytkownik wypowiada kod, który jest rozpoznawany przez speech-to-text.
  3. Weryfikacja kodu: Agent przesyła podany kod do usługi weryfikacyjnej przez kolejne wywołanie narzędzia. Backend sprawdza, czy kod się zgadza, nie wygasł i nie został już użyty.
  4. Przekierowanie w workflow: Agent reaguje na wynik weryfikacji: Sukces – jeśli kod jest poprawny, użytkownik trafia do dalszej części workflow przez warunek sukcesu. Porażka – jeśli kod jest zły, agent może poprosić o ponowne podanie kodu lub wysłać nowy.

Szczegóły wdrożenia:

Podsumowanie

Wskazówki bezpieczeństwa: Warto wdrożyć limity prób, krótki czas ważności kodów (3-5 minut) i ograniczyć liczbę podejść. Przy rozmowach głosowych rozważ potwierdzenia, by upewnić się, że speech-to-text poprawnie rozpoznał kod.

Podobne artykuły

Twórz z najwyższej jakości audio AI