Как только в системе появляются ФИО, телефоны, логины или результаты аттестации сотрудников, включается закон о персональных данных, и внедрение ИИ становится юридическим вопросом, а не только техническим. Главный риск - отправка данных в зарубежную модель: это трансграничная передача со своими требованиями, а с 2025 года штрафы за утечку стали оборотными при повторных случаях. Риск снимается четырьмя архитектурными решениями, а не бумажками поверх: поиск по документам работает на своем сервере, ответ пишет российская модель, распознавание голоса локальное, а фильтр на входе не пропускает персональные данные в запросе. Бумажная часть все равно нужна, и финальную сверку делает юрист - но при такой архитектуре ему достается проверка, а не спасательная операция.
Разговор про ИИ в компании почти всегда упирается в один вопрос собственника: а данные не утекут. Вопрос правильный, но обычно задается слишком поздно - когда система уже собрана и переделывать дорого.
Разберем, когда внедрение вообще попадает под закон о персональных данных, где именно возникает риск и какие решения снимают его на уровне конструкции.
Когда включается закон
Многие считают, что если ИИ работает с регламентами и инструкциями, персональных данных там нет. Это верно ровно до момента запуска.
Дальше происходит вот что. У системы появляются пользователи - значит, есть ФИО и логины. Появляются результаты проверки знаний - значит, есть сведения о сотруднике. В вопросах люди пишут живые примеры: клиент Иванов, договор с Петровым, телефон для связи. Все это персональные данные, и обрабатываются они в вашей системе.
То есть закон включается практически всегда, даже если проект задумывался как поиск по инструкциям.
Где именно риск
Главный риск не там, где его ищут. Ищут обычно в хранилище: где лежат файлы. А возникает он в момент запроса к модели.
Схема любой такой системы: система нашла нужный кусок документа, добавила к нему вопрос сотрудника и отправила все это модели, чтобы та написала ответ. Если модель зарубежная, в этот момент текст уходит за границу. Вместе с тем, что сотрудник написал в вопросе - а он мог написать что угодно, включая фамилию клиента и сумму сделки.
Юридически это трансграничная передача персональных данных, у которой свои требования. Практически - это данные вашей компании на чужом сервере, и вы не контролируете ни срок их хранения, ни то, как они используются дальше.
Отдельно про штрафы: с 2025 года ответственность за утечки ужесточили, при повторных нарушениях они считаются от оборота. Это перевело вопрос из категории когда-нибудь разберемся в категорию считать заранее.
Четыре решения, которые снимают риск конструкцией
Хорошая новость: все это закрывается архитектурой, а не бумагами поверх нее. Четыре решения, которые мы закладываем по умолчанию.
Поиск работает на своем сервере. Та часть, которая понимает смысл вопроса и находит нужный фрагмент, разворачивается в вашем контуре. Документы физически не покидают периметр. Это самая объемная часть данных, и она никуда не уходит.
Ответ пишет российская модель. К модели уходит только найденный фрагмент и сам вопрос, и уходит он в российское облако. Трансграничной передачи нет, согласия на нее не нужно. Цены российских моделей в рублях сейчас таковы, что этот выбор ничего не стоит: типовой запрос обходится в копейки.
Голос распознается локально. Если сотрудники спрашивают голосом, распознавание тоже ставится на свой сервер. Иначе получается странно: текст бережем, а голосовые записи с теми же данными отправляем наружу.
Фильтр на входе. Перед отправкой запрос проверяется на персональные данные. Если сотрудник вписал ФИО, телефон или номер карты, система не отправляет это дальше, а просит переформулировать. Это защита от человеческого фактора, который не лечится инструкциями.
Что все равно остается юристу
Архитектура снимает основной риск, но не отменяет бумажную часть. Что понадобится в любом случае:
- политика обработки персональных данных, обновленная с учетом новой системы;
- уведомление в надзорный орган, если состав обрабатываемых данных изменился;
- согласия сотрудников там, где они требуются, и корректные формулировки в трудовых документах;
- договор с тем, кто хостит и обслуживает систему, с распределением ответственности;
- регламент доступа: кто и на каком основании видит какие данные.
Мы этот блок всегда отдаем на финальную сверку юристу клиента, и советую делать так же с любым подрядчиком. Разница в том, что при правильной архитектуре юрист проверяет уже безопасную конструкцию, а не ищет способ прикрыть отправку данных на другой континент.
Частый вопрос: а можно просто пользоваться зарубежным чатом
Прямо скажу: сотрудники уже им пользуются, независимо от вашего решения. Копируют туда куски договоров и просят переписать письмо клиенту.
Запрет на бумаге эту практику не останавливает, он только уводит ее в тень. Работающий путь другой: дать внутренний инструмент, который удобнее и быстрее, и тогда необходимость идти наружу отпадает сама. Плюс технически ограничить доступ к внешним сервисам с рабочих машин там, где это уместно.
Для нечувствительных задач вроде причесать текст поста внешние сервисы вполне подходят. Граница проходит по данным: как только в запросе появляется что-то про клиентов, сотрудников или деньги - только свой контур.
Коротко о главном
Внедрение ИИ попадает под закон о персональных данных почти всегда, даже если начиналось как поиск по инструкциям. Риск возникает не в хранилище, а в момент отправки запроса модели.
Снимается он четырьмя решениями: поиск в своем контуре, российская модель для генерации ответа, локальное распознавание голоса и фильтр персональных данных на входе. Бумажную часть все равно делает юрист, но при такой конструкции ему остается проверка, а не спасение проекта.
Считать это надо до внедрения. Переделывать архитектуру после запуска стоит кратно дороже, чем заложить ее правильно сразу.
Хочешь увидеть свои цифры так, как их видим мы?
Сделаем мини-отчёт на твоих реальных данных за 1–2 рабочих дня. Три находки, конкретные суммы, разбивка по каждой строке в выгрузке. Бесплатно, без обязательств.
Открыть бот @aximaa_bot