У вашей компании появился второй архив. Он лежит в личных аккаунтах сотрудников, и никто не знает, что в нём.

У вашей компании появился второй архив. Он лежит в личных аккаунтах сотрудников, и никто не знает, что в нём.

Разговор, который у меня повторяется раз в две недели, слово в слово.

— Мы ничего конфиденциального в нейросети не отправляем. — А что отправляете? — Ну, текст причесать. Таблицу свести. Письмо клиенту переписать по-человечески.

Вот на этом «по-человечески» и уезжает всё.

Возьмём одну просьбу, максимально безобидную. Менеджер пишет модели: «Перепиши помягче. Мы не успеваем к 15 апреля, подрядчик по фасаду сорвал сроки, предлагаем сдвинуть на май, штраф по договору просим не начислять».

Что тут конфиденциального? Формально ничего. Ни имён, ни сумм, ни реквизитов. Ни один DLP на такое не сработает, ни один пункт регламента не нарушен, и сотрудник абсолютно честно скажет, что секретов не разглашал.

А что тут на самом деле. У компании срыв по объекту. Проблема конкретно на фасаде, то есть подрядчик подвёл на внешней отделке — уже понятно, на какой стадии стройка. В договоре есть штрафные санкции, и компания их боится настолько, что просит не начислять. Значит, переговорная позиция слабая, а денег на штраф, скорее всего, нет. Сроки апрель–май дают вилку, по которой при минимальном знании рынка вычисляется объект.

У вашей компании появился второй архив. Он лежит в личных аккаунтах сотрудников, и никто не знает, что в нём.

Одно письмо. Тридцать секунд работы.

Теперь возьмите четыреста таких за год от одного отдела.

Никто не сливает секреты. Утечка собирается из мелочи

Секреты вообще утекают редко. Люди в целом понимают, что базу клиентов выгружать нельзя, а финмодель постороннему не показывают.

Утекает контекст. Кусочки, каждый из которых по отдельности выглядит абсолютно невинно.

Разработчик просит помочь с миграцией и вставляет кусок схемы. Имён клиентов там нет, но есть названия таблиц, поля, связи. По этому восстанавливается, как у вас устроен продукт и какие сущности вы вообще считаете важными.

Юрист даёт модели свой шаблон договора без сторон и сумм. Шаблон — не тайна. Только защитные пункты в нём появились не сами: каждый вырос из конкретного случая, когда компания на чём-то обожглась. Читая шаблон, вы читаете историю чужих проблем и знаете, где надавить.

Эйчар просит составить вопросы для собеседования на позицию, которой в компании раньше не было. Никаких данных. Но новая позиция — это направление, куда компания идёт, и знать об этом за полгода до запуска довольно ценно.

Продажник просит посчитать бонус при выполнении плана в сорок миллионов. План — не секрет, наверное. Хотя вообще-то это ваша выручка по направлению, и вы её только что назвали вслух.

Ни за один из этих эпизодов сотрудника нельзя ругать. Он делал свою работу и не нарушал ничего.

Почему это сломалось именно сейчас

Собирать разрозненные обрывки в связную картину умели всегда. Этим занимались конкурентная разведка и аналитики, и стоило это дорого: нужен был человек, который неделю сидит и складывает мозаику, а таких людей мало и они не бесплатные.

Поэтому мелочь и не считали утечкой. Не потому что она безобидная, а потому что переработать её в знание было слишком дорого.

У вашей компании появился второй архив. Он лежит в личных аккаунтах сотрудников, и никто не знает, что в нём.

Так вот, эта работа подешевела примерно до нуля. Складывание разрозненного в целостную картину — ровно то, что языковые модели делают лучше всего. Вываливаете четыреста фрагментов и просите: собери, что это за компания, чем занимается, где у неё узкие места, кто у неё в подрядчиках, что у неё в планах. Получаете внятный отчёт за вечер.

У вашей компании появился второй архив. Он лежит в личных аккаунтах сотрудников, и никто не знает, что в нём.

Причём для этого не нужен хакер. Нужен любой человек с подпиской.

Второй архив

Компании годами строили режим доступа к документам. Кто может открыть папку, кто подписывает, где лежит оригинал, сколько хранить, когда уничтожать.

И параллельно с этим завёлся ещё один архив, которого никто не заводил.

История переписки с нейросетями. Она живёт в личных аккаунтах сотрудников, на их устройствах, под их паролями. Там за пару лет накопились тысячи запросов с рабочим контекстом. У этого архива нет описи, нет срока хранения, нет ответственного и нет процедуры при увольнении. Человек уходит — и уносит его с собой, даже не думая, что что-то унёс. Он же просто письма переписывал.

Group-IB в своём отчёте писал про двести двадцать пять тысяч логов инфостилеров с учётными данными к ChatGPT, которые продавались на теневых площадках. Это данные за десять месяцев и только по одному сервису. То есть архив, о котором мы говорим, уже не гипотетически, а вполне буднично утекает — вместе с браузерным профилем, из которого его вытащили заодно с паролями от почты.

Отдельная прелесть в том, что при увольнении вы отзываете доступы к почте, к CRM, к диску. К истории его личного чата вы доступ отозвать не можете, потому что она никогда вам и не принадлежала.

Вопрос, который задают не про то

Когда обсуждают, можно ли что-то отправлять в нейросеть, спрашивают: это конфиденциально?

Вопрос из прошлой эпохи. Он оценивает один кусок в вакууме и предполагает, что ценность лежит внутри куска. А ценность появляется в сочетании, и вычислить её, глядя на один документ, невозможно в принципе.

Спрашивать надо иначе: что можно достроить, имея сто таких кусков.

Ответ обычно неприятный. Из ста обрывков переписки достраивается структура компании, стадия сделок, кто за что отвечает, где болит и куда вы собираетесь. Ни один из ста при этом не был конфиденциальным.

Что с этим делать — тема отдельная и длинная, и запрещать тут точно не выход, потому что запрет просто уводит всё в личные аккаунты, то есть ровно в тот самый второй архив. Об этом напишу следующим постом.

Пока предложу одно упражнение, оно бесплатное и занимает вечер. Откройте свою историю запросов за последний месяц и почитайте её глазами человека, который про вашу компанию не знает ничего и хочет узнать всё. Не отдельные запросы, а подряд.

Я так делал. Ощущения смешанные.

Пишу это не из чистого альтруизма: я делаю программу для обезличивания документов перед отправкой в AI, так что интерес у меня прямой. Но проблема с накоплением контекста существует независимо от того, купите вы что-нибудь или нет, и решается она в первую очередь головой, а не софтом.

3