Перейти к содержимому
Tez Base

Продукт Маркетплейса · 14 640 ₽ с НДС · демо полного цикла

Обезличивание выгрузки 1С перед отправкой в нейросеть

Модель разбирает дебиторку за секунды, но в выгрузке ФИО, БИН, телефоны и выручка, а в компании есть положение о персональных данных. Обработка заменяет всё это на правдоподобные фейки перед отправкой и подставляет настоящие значения обратно в ответ модели. Ниже показываем полный цикл на живом примере и разбираем, почему сделано именно так.

Цена 14 640 ₽ с НДС (12 000 ₽ без налога), сопровождение 3 000 ₽ в месяц - платить за него необязательно, обработка работает и без него. Продаётся в Маркетплейсе Инфостарта, там же состав поставки и условия. Любая конфигурация, прикладных объектов обработка не знает, права нужны только на чтение справочников; требования к версии платформы указаны на карточке. Эта страница показывает механику и результат, сам инструмент забираете там.

Обычно из этой ситуации два выхода, и оба плохие: либо не спрашивать и разбирать руками, либо скопировать в чат и никому не сказать. Обработка даёт третий - данные уходят в модель обезличенными, а ответ читается с настоящими именами и настоящими числами.

Главное здесь не маскировка, её умеют многие. Главное - обратный проход: словарь замен хранится в самой базе, и ответ модели прогоняется через него назад, включая те итоги, которые модель посчитала сама и которых в исходных данных не было.

Три требования, из которых выросла вся конструкция

Согласованность замен

Одно исходное значение получает один и тот же фейк во всей выгрузке. Если раздавать случайные псевдонимы каждому вхождению, один менеджер в сорока строках превратится в сорок разных, и модель уверенно сообщит вам об этом. Группировки, доли и связи должны пережить обезличивание, иначе анализировать нечего.

Обратимость

Словарь замен хранится в базе и подхватывается автоматически, даже если обработку закрывали. Его можно выгрузить в JSON и загрузить назавтра: расшифровать ответ будет чем, даже если работа растянулась на несколько заходов.

Ноль зависимостей

Тот, кто боится отдать данные в облако, ровно так же не поставит стороннюю модель на сервер и не пустит расширение в корпоративный контур. Поэтому здесь нет ни локальной модели, ни расширения, ни внешних сервисов: вся замена идёт на машине пользователя.

Словарь имён берётся из вашей базы

Внешнему инструменту приходится угадывать, где в тексте имя, и ради этого тащить языковую модель. Нам угадывать не надо: настоящий список имён лежит в справочниках. Обработка читает наименования (физлица, контрагенты, пользователи, сотрудники - список меняется на форме) и ищет точным совпадением по хешу, один проход по тексту даже на полумиллионе записей.

Что и на что заменяется

Тип определяется структурой значения, а не именем колонки: обработка не знает прикладных объектов и работает на любой конфигурации.

Тип данныхКак находимНа что меняем
ФИО наименования из справочников вашей базы плюс шаблон "Иванов И.И." фейк из встроенных списков, форма записи сохраняется: было "Иванов И.И.", станет "Юдин Г.Д."
Организации кавычки-ёлочки после правовой формы (ТОО, ООО, АО и ещё полтора десятка), плюс "ИП Фамилия" ТОО «Дельта Трейд», ИП Белов; число слов в названии сохраняется
ИНН 10 и 12, БИН и ИИН Казахстана цифры плюс проверка контрольной суммы фейк с корректной контрольной суммой - его примет любая проверка
Телефоны 10 или 11 цифр в маске со скобками, плюсом и дефисами диапазон +7 (999): он зарезервирован и заведомо ничей
Электронная почта токен с собакой и точкой адрес на example.com, домен зарезервирован RFC 2606
Счета 20 знаков, карты 16 знаков длина плюс контрольная сумма, для карт алгоритм Луна фейк той же структуры и с той же контрольной суммой
Суммы число с дробной частью в один или два знака либо целое, разбитое пробелами на разряды по три: 8 587 500 умножение на секретный коэффициент сеанса - пропорции и доли не меняются

Что заменяться не должно - и почему это важнее, чем кажется

Ложное срабатывание тут дороже пропуска: испорченная дата или номер версии уводят модель в сторону молча.

Что в данныхПочему остаётся как есть
Артикул 123456789012 Двенадцать цифр, но контрольная сумма не сходится - под замену не попадёт. У настоящего ИНН 7707083893 сходится, и он попадёт.
Дата 01.08.2026 Точка по умолчанию не считается десятичным разделителем, иначе под замену уехали бы даты и номера версий вроде 8.3.14.
Количество, срок, номер строки Целое число без разбивки на разряды суммой не считается: 25 шт, 45 дней и год 2026 остаются как есть. Целое становится суммой, только когда разряды разделены пробелами ровно по три, как в 8 587 500.
Доля 54,2 % Если сразу за числом стоит процент, деньгами оно не считается. Иначе при обратном проходе 54,2 % поделились бы на коэффициент и стали 18,2 %.
JSON, XML и англоязычные выгрузки Там дробная часть пишется точкой, поэтому есть отдельный флажок; при загрузке такого файла обработка включает его сама.

Полный цикл на живом примере

Вопрос настоящий, модель настоящая. Обезличили дебиторку, спросили ChatGPT, вернули настоящие значения. Название контрагента на восстановленной стороне не приводим, цифры настоящие.

Показатель Значение Как надо Вердикт Что это значит
Крупнейший должник ООО «Восход Альянс» настоящее название контрагента инфо Модель нашла нужного контрагента, не зная его имени: связи в таблице обезличивание пережили.
Сумма долга 6 334 620,00 2 130 000,00 норма Масштабирована коэффициентом сеанса, обратный проход вернул исходное значение.
Итого по таблице 11 695 051,73 3 932 431,65 норма Этого числа в исходных данных не было: модель сложила его сама. Расшифровалось верно, потому что масштабирование линейно.
Доля должника в итоге 54,2 % 54,2 % норма Проценты не масштабируются. Проверка руками: 2 130 000 / 3 932 431,65 = 0,5417, те же 54,2 %.

Разбор результата

Смысл таблицы в последней строке. Модель посчитала долю на выдуманных суммах и получила правильный ответ, потому что умножение на один коэффициент сохраняет пропорции. Случайные числа вместо коэффициента убили бы и доли, и выбросы, и динамику - модель отвечала бы уверенно и неверно. Собранная обработка прогнана на шести файлах разных форматов, по 10-12 раз каждый со своим коэффициентом, со сбросом словаря в JSON и загрузкой обратно между проходами: 72 прогона, 1 332 замены, ноль неточных возвратов.

Как это выглядит в работе

  1. 01

    Взять данные

    В любом списке 1С меню "Ещё" → "Вывести список", дальше Ctrl+A и Ctrl+C. Либо кнопкой "Загрузить из файла": csv, txt, md, json, xml, xlsx, mxl. Кодировка определяется сама, так что CSV из русского Excel в windows-1251 читается без плясок.

  2. 02

    Дописать вопрос сверху

    Вопрос к модели пишется прямо в поле ввода над таблицей и проходит насквозь без изменений, а таблица под ним обезличивается. В чат тогда копируется один раз, а не два.

  3. 03

    Обезличить и просмотреть глазами

    Обезличенный текст показывается рядом с исходным, а не отправляется куда-то сам. Автоматика ловит не всё: в свободном тексте всегда найдётся то, чего детектор не знает, и это надо проверять, а не надеяться.

  4. 04

    Вернуть настоящие

    Ответ модели вставляется в то же правое поле поверх прежнего текста, кнопка "Вернуть настоящие" подставляет оригиналы. Если работа растянется на несколько заходов, словарь сохраняется в файл.

Не получается самим? Напишите, разберёмся

Опишите в WhatsApp, что не выходит: посмотрим и скажем, чем можем помочь.

Разборы по теме

MCP для 1С: один сервер на десять баз без доработки конфигураций

Десять продуктивных баз 1С в трёх странах, две конфигурации, один человек на сопровождении. Разбираем схему целиком: почему доступа к базе мало без исходников, зачем отдельная база-реестр, какие пятнадцать строк ставятся в каждую базу и чем вы за всё это платите по части безопасности.

Аудит прав доступа в 1С через нейросеть: выгрузили файл - и спрашиваете словами

В базе на сотни ролей вопрос "у кого какие права" стоит полдня работы в конфигураторе. Разбираем способ быстрее: права читаются штатной функцией ПравоДоступа прямо в работающей базе, выгружаются в Markdown и отдаются нейросети - дальше аудит превращается в разговор. С кодом, примерами вопросов, честными ограничениями и правилами проверки ответов.

Обезличивание данных 1С: от выгрузки для нейросети до копии базы подрядчику

Обезличивание звучит просто, пока не упрёшься в живые данные. Разбираем две задачи: выгрузка в чат-модель с расшифровкой ответа обратно и полная копия боевой базы, которая уезжает наружу. Почему коэффициент масштабирования обязан быть больше единицы, как восемь миллионов товарных кодов притворились ИНН и почему справочник на 58 124 человека получил всего 24 тысячи разных ФИО.

Карточка на Инфостарте →

Частые вопросы

На какой платформе работает и что нужно поставить?

Платформа 8.3.24 и выше, это проверенная нижняя граница. Конфигурация любая, включая самописную, а вид форм значения не имеет: форма у обработки своя. Работает в файловом и клиент-серверном варианте, в тонком и толстом клиенте, ставить ничего не нужно.

Обработка что-то записывает в базу?

Данные не меняет. Записываются только словарь замен и профиль настроек: они ложатся в штатное хранилище общих настроек под вашим пользователем, и коллега в той же базе вашу выгрузку не расшифрует. Хранятся последние 20 словарей, старые удаляются сами.

Суммы без копеек тоже заменяются?

Да, если разряды разделены пробелом ровно по три, как в "8 587 500". Годы, количества, артикулы и номера версий под это правило не попадают и остаются как есть. Целое после замены остаётся целым, копейки к нему не дописываются.

Почему расшифровка вернула не весь ответ модели?

Обычно модель переписала выдуманное значение по-своему, например склонила фамилию или перевела название. Сопоставить такое обратно не с чем. Помогает строка в самом вопросе: "имена и суммы пиши ровно как в таблице, не склоняй и не сокращай".

В обезличенном тексте остался настоящий ИИН. Почему?

Номер без подписи заменяется, только если сходится контрольная сумма, иначе под замену попали бы артикулы и коды товаров. Если рядом стоит ИИН, ИНН или БИН, номер меняется всегда, даже с ошибкой в контрольной сумме. Если номер идёт без подписи и с неверной суммой, добавьте подпись в выгрузку.

Можно так обезличить всю базу перед передачей подрядчику?

Нет, эта обработка работает с текстом, который вы ей дали: таблицей из списка или файлом. Для копии базы есть отдельный продукт, Анонимизатор базы данных PRO. Он проходит по объектам метаданных и умеет вернуть настоящие значения в саму базу.

Бесплатный экспресс-аудит вашей 1С

За 1-2 дня посмотрим вашу базу, найдём, где теряется производительность, и скажем, что с этим делать. Без обязательств.

Получить бесплатный экспресс-аудит

Обсудим задачу

Быстрее всего в WhatsApp: напишите пару строк о задаче, ответим в течение рабочего дня.

+7 707 347 88 04 [email protected]

Удобнее оставить заявку через форму