Перед любой отправкой в языковую модель текст проходит обезличивание: имена, контакты и другие идентификаторы заменяются на устойчивые метки — [P_01] (человек), [L_03] (контакт) и т.п.
- Соответствие «метка ↔ реальное имя» хранится у вас в зашифрованном виде и не покидает периметр.
- Модель работает только с обезличенным текстом — она не знает, кто ваш клиент.
- При распознавании аудио/фото исходный файл может содержать имена (их нельзя убрать до распознавания), поэтому распознанный текст шифруется, а обезличивание применяется дальше — на этапе сводки/супервизора/поиска.
Текстовый анализ (супервизор, сводки) работает только с обезличенным текстом. Распознавание аудио — исключение: запись передаётся провайдеру распознавания речи (зарубежный сервис, США) в исходном виде, так как голос невозможно обезличить заранее. Если это неприемлемо — используйте текстовые заметки вместо аудио-надиктовки.