Договоры уже уходят в нейросети — без учёта
Юрист вставляет договор в чат, чтобы быстро вытащить условия. Кадровик — резюме. Бухгалтер — акт с реквизитами. Все понимают, что так нельзя, и все продолжают: ИИ реально экономит часы.
Каждый такой документ — персональные данные, переданные третьему лицу, часто за границу. Ответственность за это выросла до оборотных штрафов, а технического контроля над этим каналом у компаний обычно нет вообще.
Запретить не работает — люди просто перестают рассказывать. Значит нужен шлюз: пусть пользуются, но наружу уходит текст без имён.
Слева исходник, справа то, что уйдёт наружу
Система читает документ, находит персональные данные и заменяет их псевдонимами. Не звёздочками: «Васильев» становится «Тарасовым» — так текст остаётся связным и нейросеть по нему нормально работает.
Видно всё: что нашли, чем заменили, что осталось нетронутым. Любую находку можно снять одним кликом, любой пропущенный кусок — выделить мышью и добавить руками.
Шестнадцать типов автоматически и ваш словарь сверху
Прямые идентификаторы система знает сама. Отраслевые вещи — внутренние коды, названия проектов, номенклатуру — добавляете вы, и они начинают ловиться так же.
Принцип движка — лучше замаскировать лишнее, чем пропустить фамилию. Для утечки важно, чтобы поверх персональных данных стояла хоть какая-то маска; спорить о том, ФИО это или название компании, можно потом.
Замены обратимы, и ключ остаётся у вас
Обезличить документ — половина дела. Ответ нейросети приходит с псевдонимами, и работать с ним в таком виде невозможно.
Поэтому карта замен живёт в вашем контуре и никуда не уходит. Ответ восстанавливается обратно в реальные имена одним действием — сотрудник получает нормальный текст, а наружу так ничего и не ушло.
Словарь общий на всё дело: «Васильев» станет «Тарасовым» в договоре, претензии и акте одинаково — вместе со склонениями и инициалами. Иначе документы перестают сходиться между собой.
Спорное система не решает за юриста
Часть находок всегда спорная. «Москва» в шапке договора — это адрес человека или просто город? Правила говорят «возможно, данные», проверяющий ИИ-слой не подтверждает.
В этом случае система выносит место в отдельный список — с цитатой из документа и двумя кнопками: замаскировать или оставить. Решает человек, и решение запоминается на всё дело.
Сто пять документов, ни одной утечки
Проверка простая: берём обезличенные документы и ищем в них исходные значения обычным поиском. Если хоть одна фамилия или номер счёта нашлись — прогон провален.
Отдельно проверяется выгрузка: обезличенный Word разбирается на составные части, потому что данные умеют прятаться в служебных полях файла — в комментариях, в имени автора, в тексте, удалённом в режиме правки. Там их тоже нет.
Где система сильна и где нет
Точность зависит от типа документа. Вот цифры по трём разным типам — они отличаются, и это нормально.
По трём корпусам вместе — 92,6 % полноты при нуле ложных срабатываний, замер 25 июля 2026. Это та цифра, что стоит на главной.
Мы используем методы маскировки из приказа Роскомнадзора № 140, но не выдаём это за сертифицированное соответствие — это разные вещи, и клиент должен понимать разницу. Порядок внедрения такой: пилот на ваших документах, замер на них же, и только потом разговор о лицензии.
Работает внутри вашей сети
Продукт разворачивается в контуре заказчика и работает без интернета. Это принципиально: сервис, который защищает от утечки, не может сам быть каналом утечки.
Проверить это может ваш безопасник по исходному коду. Журнал действий ведётся без содержимого документов: видно, кто и когда обрабатывал, но не что именно.
Поставим шлюз между вашими документами и нейросетями
Начинаем с пилота в вашем контуре на ваших же документах. По итогам отдаём отчёт: что именно у вас уходило в ИИ и как это выглядит после обезличивания. Дальше решаете вы.