Bezpieczeństwo i dane
Gdzie znajdują się dane osób dzwoniących i kto może ich dotknąć
Rozmowa telefoniczna należy do najbardziej wrażliwych danych, jakie posiada organizacja: imię i nazwisko, numer dokumentu tożsamości, sytuacja medyczna, spór prawny — wypowiedziane na głos i zapisane. Ta strona przedstawia, co system faktycznie z nimi robi, łącznie z tym, czego nie mamy.
W skrócie
Co dzieje się z danymi osobowymi wypowiedzianymi podczas rozmowy z agentem AI?
Każda transkrypcja przechodzi przez warstwę wykrywającą i maskującą dane identyfikujące, przystosowaną do języka hebrajskiego, a każdy dział sam decyduje, które typy encji są u niego maskowane. Dostęp do nagrań i transkrypcji jest ograniczony rolami, a działania wrażliwe trafiają do dziennika audytu. Wniosek obywatela o usunięcie danych ma osobny proces: zeruje identyfikatory dzwoniącego, zaczernia fragmenty z danymi osobowymi w transkrypcji, odłącza nagranie i nadaje numer referencyjny, który można podać wnioskodawcy. Podmioty regulowane mogą uruchomić cały system wewnątrz własnego perymetru, łącznie z wagami modeli, dzięki czemu żadne dane rozmowy nie opuszczają sieci. Nie posiadamy certyfikatu audytu według żadnego standardu bezpieczeństwa i nie twierdzimy inaczej.
Czego nie mamy — zanim powiemy, co mamy
Nie mamy SOC 2, nie mamy ISO 27001 i nie posiadamy certyfikacji HIPAA ani RODO. Coś takiego jak «certyfikat RODO» w ogóle nie istnieje, a HIPAA to regulacja amerykańska, która większości czytelników tej strony nie dotyczy — ale pojawiają się na tylu stronach o bezpieczeństwie, że warto powiedzieć wprost: na naszej ich nie ma. Zamiast sugerować akredytację, której nie posiadamy, wszystko poniżej opisuje mechanizmy kontroli faktycznie istniejące w produkcie, a każdy z nich chętnie pokażemy na żywo na działającym systemie. Jeśli standard, który musicie spełnić, wymaga certyfikowanego dostawcy, powiemy o tym już przy pierwszej rozmowie, a nie na etapie zakupu.
Wykrywanie i maskowanie danych osobowych
Transkrypcja rozmowy po hebrajsku jest pełna dokładnie tego, czego nie wolno zostawiać jawnie: pełne imię i nazwisko, numer dokumentu podyktowany cyfra po cyfrze, adres, numer telefonu, nazwisko lekarza lub nazwa instytucji. System uruchamia na każdej turze rozmowy warstwę wykrywania encji wytrenowaną na hebrajskim — a nie ogólny silnik traktujący hebrajski jako sprawę drugorzędną. To, co zostanie znalezione, zapisywane jest jako pozycje w tekście, więc transkrypcję można pokazać zamaskowaną komuś, kto nie powinien widzieć oryginału, nie tracąc możliwości analizy rozmowy.
- Każdy dział sam określa, które typy encji są u niego maskowane — imię i nazwisko, numer dokumentu, telefon, adres i inne
- Typ encji nierozpoznany przez system jest domyślnie maskowany, zamiast zostać przypadkiem ujawniony
- Po zmianie ustawień wykrywanie można uruchomić ponownie na dawnych rozmowach, aby przeszłość odpowiadała teraźniejszości
- Maskowanie obejmuje zarówno transkrypcje, jak i eksporty — plik CSV opuszczający organizację może wyjść zamaskowany
Wnioski o usunięcie — pełny proces
Obywatel, który prosi o usunięcie swoich danych, nie powinien musieć zadowalać się ustną obietnicą. Wniosek o usunięcie jest w systemie rejestrowaną operacją, którą można wykonać dla pojedynczej rozmowy, dla wszystkich rozmów z danego numeru telefonu albo dla zakresu dat i identyfikatora sprawy — a oto co robi w rzeczywistości:
- Identyfikatory dzwoniącego — numer telefonu, identyfikator sprawy, imię i nazwisko — są zerowane w rekordzie rozmowy
- Każdy fragment rozpoznany w transkrypcji jako dane osobowe zostaje zastąpiony blokiem i nie pozostaje w tekście
- Same pozycje wykrycia są kasowane, aby na ich podstawie nie dało się odtworzyć tego, co ukryto
- Odwołanie do nagrania jest czyszczone, więc odtwarzanie kończy się bezpiecznym niepowodzeniem i nic nie odtwarza
- Rozmowa zostaje oznaczona jako przetworzona, ze stemplem, kto wykonał operację, kiedy, oraz z numerem referencyjnym
Na końcu procesu na rekordzie odciskany jest numer referencyjny w stałym formacie. To ten numer przekazuje się obywatelowi i to on pozwala później wykazać, że wniosek został obsłużony, kiedy i przez kogo. Równolegle dla każdej objętej rozmowy zapisywany jest wiersz dziennika audytu — nie jeden wiersz na wniosek, lecz wiersz na każdy tknięty rekord.
Kto co widzi
Uprawnienia przydzielane są według roli, a nie według zaufania. Nagrania to przypadek najostrzejszy: w dźwięku nie ma maskowania — głos to głos — więc dostęp do nich mają wyłącznie role, które go potrzebują, a dział, który chce udostępnić odsłuch także użytkownikom z prawem samego podglądu, musi włączyć to świadomie. Działania wrażliwe zapisywane są w dzienniku audytu, który można przejrzeć.
- Osobne role dla administratora, kontrolera jakości i obserwatora — i nie widzą tego samego
- Odsłuch nagrań jest otwarty dla administratorów i kontrolerów; otwarcie go dla obserwatorów to osobne, świadome ustawienie na poziomie działu
- Działania wrażliwe — usunięcie, eksport, zmiana ustawień — są rejestrowane wraz z wykonawcą i znacznikiem czasu
- Eksporty przechodzą te same kontrole uprawnień i to samo rejestrowanie co przeglądanie wewnątrz systemu
Trzy warianty wdrożenia
Ten sam system i trzy różne odpowiedzi na pytanie «jak bardzo świat zewnętrzny dotyka tych danych». Wybór należy do was, nie do nas.
Chmura wielodostępna
Droga szybka. System prowadzimy my, a dane każdej organizacji są odizolowane od danych pozostałych. Odpowiednie dla firm niepodlegających regulacjom narzucającym kontrolę nad infrastrukturą. Część usług modelowych w tym wariancie to usługi zewnętrzne — mówimy o tym wprost, bo to właśnie tego podmiot regulowany nie może zaakceptować.
Wdrożenie hybrydowe
Warstwa danych — baza danych, nagrania, warstwa maskowania i zabezpieczenia — znajduje się na infrastrukturze pod waszą kontrolą, a same modele pracują na osobnym, dedykowanym sprzęcie uzgodnionym z wami. Świadomy kompromis: taniej niż pełne wdrożenie u was, ale nie dla każdej klasyfikacji danych — i powiemy, kiedy nie.
Pełne wdrożenie u was
Cały system działa wewnątrz waszego perymetru, łącznie z wagami modeli — rozpoznawaniem mowy, modelem językowym i syntezą mowy. W praktyce: żaden fragment nagrania i żadna transkrypcja nie opuszcza waszej sieci do jakiegokolwiek dostawcy zewnętrznego, w tym do nas. To wariant zbudowany dla instytucji publicznych i organizacji regulowanych, obsługiwany także w środowisku odciętym od sieci zewnętrznej.
Prace dostosowawcze do הנחיה 5.43 (izraelska dyrektywa bezpieczeństwa informacji)
Dla izraelskich instytucji publicznych realnym punktem odniesienia jest dyrektywa bezpieczeństwa informacji הנחיה 5.43, a nie SOC 2. Prowadzimy prace dostosowawcze do jej wymagań: kontrola dostępu oparta na rolach, rejestrowanie działań w ścieżce audytu, minimalizacja danych osobowych dzięki warstwie maskowania oraz możliwość uruchomienia wszystkich komponentów wewnątrz własnej sieci organizacji. Powiedzmy to precyzyjnie: prace dostosowawcze nie są zatwierdzeniem ani akredytacją i nie przedstawiamy żadnego zatwierdzenia jakiegokolwiek organu. Różnicę między jednym a drugim chętnie przejdziemy punkt po punkcie z waszym oficerem bezpieczeństwa informacji.
O co warto nas zapytać
Jeśli oceniacie dostawców w tym obszarze, to są pytania, które oddzielają stronę o bezpieczeństwie od produktu. Zadajcie je również nam.
- Czy maskowanie danych osobowych naprawdę działa na hebrajskim, czy to angielski silnik wycelowany w tekst hebrajski?
- Co dokładnie dzieje się z rekordem po wniosku o usunięcie — i co zostaje, by wykazać, że usunięcie nastąpiło?
- Czy nagranie jest dostępne dla tych samych osób co transkrypcja, czy jedno od drugiego oddzielono?
- Jeśli zażądamy, by dane nigdy nie opuszczały naszej sieci — czy modele działają u nas, czy tylko baza danych?
- Jakie formalne certyfikaty faktycznie posiadacie i który z nich jest istotny dla standardu, któremu ja podlegam?
Zadzwoń do agenta AI
Prawdziwa rozmowa po hebrajsku. Dokładnie to, co usłyszą Państwa klienci.
Zamów oddzwonienie od agenta AI
Zostaw numer — agent oddzwoni w niecałą minutę.
Zaktualizowano: