Сотрудники всё чаще работают через ChatGPT, DeepSeek, YandexGPT и другие нейросети: составляют договоры, разбирают базы клиентов, обрабатывают жалобы и переписку. Проблема в том, что вместе с текстом в чат уходят фамилии, телефоны, паспорта и номера карт. Каждая такая отправка — это передача персональных данных третьему лицу, часто на зарубежный сервер, без согласия субъекта. По 152-ФЗ это нарушение, а с 2025 года за утечку ПДн введены оборотные штрафы.
Мы разбираем этот канал руками специалиста: берём выборку из 200 ваших реальных текстов, ушедших в ИИ, показываем, какие персональные данные в ней нашли, считаем риск по КоАП и даём регламент и документы, чтобы канал закрыть. Кандидатов размечает наш движок — решение по каждому фрагменту принимает специалист.
Фиксированный пакет: 49 000 ₽, 10 рабочих дней. До договора бесплатно прогоняем 20–30 ваших текстов, чтобы вы на собственных данных увидели, что движок находит, а что пропускает.
Хотите увидеть проблему своими глазами? Вставьте рабочий текст в наш бесплатный сервис — он подсветит персональные данные, которые в нём распознает. Это демонстрация движка, а не проверка на соответствие закону: часть фрагментов он пропускает, и ниже мы показываем цифрами, какие именно.
Почему стандартные решения не работают
Большинство зарубежных инструментов обезличивания созданы для английского языка и не знают российских форматов документов. Они не распознают СНИЛС, серию и номер паспорта РФ, ИНН и ОГРН в произвольном тексте, банковские реквизиты в формате 20-значного счёта и региональные форматы адресов.
| Параметр | Наш движок | Зарубежные инструменты |
|---|---|---|
| Русские ФИО | Да (Natasha NER) | Частично или нет |
| Паспорт РФ, СНИЛС, ИНН | Да (собственные правила) | Нет |
| Телефоны, email, карты | Да | Частично |
| 152-ФЗ и приказ РКН №140 | Заточен специально | Не адаптирован |
| Работа в вашем контуре | Да (данные не уходят) | Зависит |
| Точность | По категориям: документы 96,7%, гос. идентификаторы 97,8%, контакты 97,6%, организации 92,8%, ФИО 87,3%, адреса 86,5%. Всего 92,5% по 4585 размеченным сущностям. Дальше выборку вычитывает специалист | Выше для английского, ниже для русского |
Как работает наш движок
В основе — ансамбль нескольких моделей:
- Natasha NER — библиотека для извлечения именованных сущностей в русском тексте: ФИО, организации, геолокации.
- GLiNER — нейросетевая модель для распознавания сущностей в свободном тексте.
- Словари и правила — паспорта (серия + номер), СНИЛС, ИНН, ОГРН, банковские карты, реквизиты счетов, телефонные форматы, адреса.
Движок уверенно работает там, где формат жёсткий, и заметно слабее там, где он свободный. Мы публикуем замер по типам, а не одну усреднённую цифру: по средней невозможно понять, что будет именно с вашими документами.
| Тип персональных данных | Находит движок |
|---|---|
| Секреты, технические идентификаторы (URL, IP) | 98,8–100% |
| Финансовые данные: карта, IBAN | 98,0% |
| Гос. идентификаторы: ИНН, СНИЛС, полис ОМС | 97,8% |
| Контакты: телефон, почта | 97,6% |
| Документы: паспорт, права, военный билет | 96,7% |
| Организации | 92,8% |
| ФИО | 87,3% |
| Адрес и геолокация | 86,5% |
| Всего по 4585 размеченным сущностям | 92,5% |
Замер прода на бенчмарке из 2867 сообщений и 4585 размеченных сущностей: найдено 4241, пропущено 344, ложных срабатываний 301. Пропуски и ложные срабатывания сосредоточены там, где у данных нет формата: на ФИО, адреса и названия организаций приходится 287 пропусков из 344. Это метрика движка, а не результат работы: выборку вычитывает специалист, и отчёт собирает он. Полноту автоматического обнаружения мы не гарантируем и пишем это в договор отдельным пунктом — вместе с тем, что оператор персональных данных вы и ответственность за их состав остаётся на вас. Поэтому мы и начинаем с бесплатного прогона ваших текстов: решение принимаете, уже увидев фактическую картину.
Что входит в пакет
Шесть предметов. Каждый вы проверяете сами по факту сдачи.
| Предмет | Что это |
|---|---|
| Реестр ПДн по выборке | Таблица по 200 вашим текстам, ушедшим в ИИ за последние 30 дней: тип персональных данных, сколько раз встретился, в каком процессе, статья КоАП и сумма штрафа. Кандидатов размечает движок, каждую строку подтверждает специалист — в отчёте видно, что подтверждено вручную. Реестр описывает выборку и не является исчерпывающим перечнем ПДн в вашей системе |
| Схема канала на одном листе | Какая система → какое поле → какой промпт → какой ИИ-сервис. Отмечены точки, где ставится маскирование |
| Описание метода обезличивания | Для ДДС и уведомления в РКН по приказу №140 от 19.06.2025, метод «введение идентификаторов», под ваш стек. .docx, готов к подписанию |
| Регламент для сотрудников | 5–7 страниц: что можно и нельзя отправлять в ИИ, как проверить текст за 30 секунд, что делать при инциденте. Плюс памятка на одну страницу на рабочее место |
| Инструкция по внедрению маскирования | Пошаговый документ для вашего разработчика: эндпоинт, авторизация, примеры на PHP и Python, обработка ошибок. Плюс тестовый доступ к API на 30 дней |
| Контрольный замер на 30-й день | Повторный прогон 200 текстов того же процесса по той же методике и с той же вычиткой. Отчёт на одну страницу: было N фрагментов ПДн → стало M |
Что в пакет НЕ входит
- Обязательство найти каждый фрагмент ПДн. Полнота автоматического обнаружения не гарантируется — это отдельный пункт договора. Движок вспомогательный, отчёт собирает специалист, работа идёт по согласованной выборке.
- Пакет документов оператора ПДн — политика обработки, приказы, журналы инструктажей, формы согласий. Это работа юриста. Мы делаем описание метода обезличивания и регламент для сотрудников.
- Подача уведомления в РКН за вас. Документ готовим мы, подаёте вы, со своей ЭЦП.
- Внедрение кода маскирования в ваш продакшн. Даём инструкцию и тестовый ключ, внедряет ваш разработчик. Внедрение под ключ — отдельный пакет, 150 000 ₽ и 12 рабочих дней, продаётся после сдачи аудита.
- Заключение о соответствии 152-ФЗ, аттестация ИСПДн, сертификаты ФСТЭК и ФСБ. Отчёт не освобождает оператора от его обязанностей.
- Объём сверх 200 текстов и сверх одного ИИ-канала. Каждый следующий канал — +15 000 ₽ и +2 рабочих дня, допсоглашением до старта.
Смежные проекты команды
Кейса по этому пакету у нас пока нет: первые два проекта идут сейчас, и цифры «до / после» появятся здесь только по факту замеров. Ниже — близкие по теме проекты команды, где мы строили ИИ в закрытом контуре.
Задача: Сотрудники работали с ChatGPT при обработке клиентских документов. ИИ-ассистент нужен, но без риска передачи ПДн на сторонние серверы.
Что сделали: Настроили ИИ-ассистента в закрытом контуре + обезличивание ПДн в потоке данных до передачи в модель.
Результат: −40% времени на обработку заявок, клиентские тексты не покидали контур банка.
Задача: Подключить ИИ для работы с клиентскими данными, не нарушая 152-ФЗ и внутренние политики безопасности.
Что сделали: ИИ-ассистент с RAG на корпоративных документах в закрытом контуре, обезличивание ПДн перед передачей в модель.
Результат: в 2 раза меньше ошибок при заполнении документов, данные обрабатывались в закрытом контуре.
Задача: Внедрить ИИ-поддержку в обработку обращений с соблюдением требований к хранению данных клиентов.
Что сделали: Ансамбль обезличивания интегрирован в поток обращений. Данные клиентов не покидают корпоративный контур.
Результат: ИИ работает, данные остаются в закрытом контуре компании.
Как устроены оборотные штрафы за утечку ПДн
С 2025 года за утечку персональных данных действуют оборотные штрафы. Размер зависит от объёма утечки:
- До 10 000 субъектов: штраф 3–5 млн ₽
- 10 000 – 100 000 субъектов: штраф 5–10 млн ₽
- Свыше 100 000 субъектов: штраф 10–15 млн ₽, при повторном нарушении — до 3% от годовой выручки
Передача ПДн в ChatGPT без обезличивания — это потенциальная утечка по каждому тексту, который уходит в запрос. При массовой работе сотрудников масштаб может быть тысячи субъектов в месяц.
Этапы работы
Стоимость и срок
49 000 ₽ — фиксированная цена пакета. 10 рабочих дней с момента выгрузки 200 текстов. НДС не облагается (УСН). Оплата — 100% предоплата или 50/50 на старте и на приёмке, на цену это не влияет.
Цена 49 000 ₽ действует для первых двух проектов и в обмен на право опубликовать кейс с цифрами — название компании при этом можно не раскрывать. Дальше прайс 90 000 ₽. Бесплатен только пресейл-прогон 20–30 текстов: сам пакет по бартеру и бесплатно не оказывается.
Второй и каждый следующий ИИ-канал — +15 000 ₽ и +2 рабочих дня. Внедрение маскирования под ключ в вашу систему — отдельный пакет 150 000 ₽ и 12 рабочих дней, только после сдачи аудита.
Что мы обещаем и чего не обещаем
Обещаем:
- Разобрать выборку из 200 ваших текстов руками специалиста и показать, что в ней нашли: типы ПДн, частота, процесс, статья КоАП и сумма штрафа.
- Сдать шесть предметов из списка выше за 10 рабочих дней.
- Сделать контрольный замер на 30-й день по той же методике и показать дельту.
- Назвать ограничения движка цифрами до договора и показать их на ваших собственных текстах.
Не обещаем:
- Найти каждый фрагмент персональных данных. Полнота автоматического обнаружения не гарантируется — отдельный пункт договора.
- Конкретную величину снижения к 30-му дню: она зависит от того, внедрите ли вы маскирование и будет ли соблюдаться регламент.
- Заключение о соответствии 152-ФЗ. Оператор персональных данных — вы, ответственность за их состав и обработку остаётся на вас.
Что действительно на нашей стороне: движок разворачивается на ваших мощностях или в российском облаке, тексты не уходят на зарубежные серверы; спорные фрагменты вычитывает человек; мы не запрещаем ИИ, а делаем работу с ним управляемой.
Смежные услуги
- Внедрение ИИ — если нужно не только защитить данные, но и внедрить ИИ в процессы
- Разработка ИИ-агентов — агенты в закрытом контуре без передачи ПДн
- ИИ-аудит — разобраться, где ИИ принесёт пользу, с учётом требований безопасности
Красные флаги при выборе подрядчика по защите ПДн при работе с ИИ
- Предлагают решение для английского языка без адаптации под 152-ФЗ. Российские паспорта, СНИЛС, ИНН, телефонные форматы — зарубежные инструменты их не распознают по умолчанию.
- Не тестируют на ваших реальных документах. Любая цифра точности с чужого бенчмарка ничего не говорит о ваших документах. Дайте типичные для вас тексты и посмотрите, что именно пропускается — до договора, а не после.
- Данные проходят через их серверы. Если обезличивание происходит в облаке подрядчика — вы уже передали ПДн третьей стороне. Это противоречит цели услуги.
- Не объясняют, как обрабатываются спорные случаи. Моделям не хватает контекста для некоторых сущностей. Кто принимает решение по неоднозначным случаям?
- Не предлагают ручную вычитку для критичных документов. Автоматика снижает нагрузку, но 100% точности нет ни у одной модели. Для высоко чувствительных данных нужна дополнительная проверка.
- Дают только технический инструмент без регламента и документов для РКН. Обезличивание — это один из элементов. Без политики обработки ПДн, согласий и уведомления в РКН техника не защищает от штрафов.
Частые ошибки компаний при внедрении ИИ в работу с персональными данными
- Думают, что «в облаке безопаснее». Корпоративные ПДн в ChatGPT или любом зарубежном LLM — это потенциальное нарушение 152-ФЗ при каждом запросе. Облако не = безопасность.
- Запрещают использование ИИ вместо настройки защиты. Запрет работает ровно пока сотрудникам не удобно. Нужен не запрет, а безопасный инструмент с обезличиванием.
- Не аудируют, какие именно ПДн уходят в нейросеть. До настройки защиты важно понять масштаб: какие отделы, какие инструменты, какие типы данных. Без этого защита неполная.
- Делают разовое обезличивание вместо автоматического. Если сотрудник каждый раз вручную чистит текст перед отправкой в ИИ — ошибки неизбежны. Автоматизация в потоке данных — единственный надёжный вариант.
- Не обновляют регламенты при добавлении новых ИИ-инструментов. Подключили новый сервис — он тоже попадает под требования. Регламент нужно обновлять при каждом изменении инструментария.
- Не информируют сотрудников о правилах работы с ПД�� и ИИ. Технического решения недостаточно без понимания, что и почему нельзя отправлять. Регламент — обязательная часть внедрения.
Чек-лист перед заказом обезличивания ПДн
- Определены процессы, в которых сотрудники взаимодействуют с ПДн и при этом используют ИИ-инструменты.
- Составлен список ИИ-сервисов, которые сотрудники используют сейчас (ChatGPT, DeepSeek, YandexGPT и др.).
- Понятны типы ПДн в вашей деятельности: физлица, клиенты, сотрудники, их документы.
- Определены требования к обработке данных: нужна ли локализация, есть ли иностранные субъекты.
- Готовность предоставить образцы типичных документов для тестирования точности обезличивания.
- Назначен ответственный за защиту ПДн (DPO или сотрудник, ответственный по 152-ФЗ).
- Определены требования к форматам интеграции: браузерное расширение, API, встроенный модуль.
Сценарии использования
Задачи, с которыми к нам приходят чаще всего, — и измеримый результат по каждой.
Понять, какие ПДн уходят в ИИ
Убрать ПДн из чатов с нейросетями
Дать сотрудникам понятные правила
Закрыть вопрос с документами
Снизить риск оборотного штрафа
Не запрещать ИИ, а сделать работу с ним управляемой
4 шага до закрытого ИИ-канала
От бесплатного прогона ваших текстов до отчёта, регламента и документов под 152-ФЗ. 49 000 ₽, 10 рабочих дней.
Как работаем
Когда мы не подойдём
Если сотрудники не работают с нейросетями вовсе — обезличивать нечего, и услуга вам не нужна. Если в ИИ у вас уходят преимущественно сканы и паспорта, скажем прямо: движок находит меньше половины таких документов, и мы либо сузим скоуп до типов, где уверены, либо не возьмём деньги. Мы не продаём «магическую цифру» детектора: полноту автоматического обнаружения не гарантируем, спорные случаи вычитывает специалист, и там, где нужна юридически безупречная сплошная проверка каждого документа, одной автоматизации мало. И мы не заменяем штатного юриста по ПДн — ответственность оператора персональных данных остаётся на вас.
Плюсы работы с нами
Что вы получаете вместе с самой услугой.
Русский контур
Natasha + GLiNER + собственные правила под форматы РФ: паспорт, СНИЛС, ИНН, карты. Иностранные сервисы наших документов не знают.
Честная точность
Публикуем замер по категориям, а не среднюю цифру: документы 96,7%, гос. идентификаторы 97,8%, контакты 97,6%, организации 92,8%, ФИО 87,3%, адреса 86,5%; всего 92,5% на 4585 сущностях при 301 ложном срабатывании. Полноту автоматического обнаружения не гарантируем — отчёт собирает специалист.
Фиксированная цена
49 000 ₽ и 10 рабочих дней, без вилок и абонплаты. Бесплатен только прогон 20–30 ваших текстов до договора — чтобы вы решали, уже зная фактическую картину.
Под 152-ФЗ и приказ №140
Делаем описание метода обезличивания для ДДС и уведомления в РКН и регламент для сотрудников. Политику, приказы и согласия готовит ваш юрист — это в пакет не входит.
Форматы сотрудничества
Формат выбираем под вашу ситуацию на первом созвоне — переключиться между ними можно и по ходу работы.
Под ключ
Забираем задачу целиком: проектирование, разработка, интеграции, вывод в прод и передача вам. Подходит, когда нужен результат, а не команда.
Команда в ваш проект
Наши разработчики работают спринтами внутри вашего процесса — с вашим менеджментом или нашим. Подходит, когда своя разработка не тянет объём.
Аудит и подхват
Разбираем существующий код: поднимаем окружение, находим критичное, документируем и говорим честно, что дешевле — чинить или переписать.
Почему с нами продолжают работать
Меняете траекторию — перестраиваемся
План релиза не догма. Сдвинулся приоритет или рынок — пересобираем скоуп вместе с вами, а не заставляем доделывать то, что уже не нужно.
Работаем в чужой инфраструктуре
Заходим в проекты, где уже есть своя команда, подрядчики и legacy. Разбираемся в чужом коде и оставляем после себя такой, который читается без нас.
Не двигаем срок задним числом
Если объём не влезает в дату — режем объём и говорим об этом до старта, а не за день до релиза. Дату согласовываем один раз.
Остаёмся на связи после запуска
Поддержка и доработка — та же команда и тот же контакт, без передачи «в другой отдел». Без абонплаты: платите за сделанные часы.