Бесплатные данные для ИИ: российский бигтех придумал, как не платить за обучение моделей Крупнейшие отечественные IT-ко
Крупнейшие отечественные IT-компании столкнулись с нормативным барьером, который тормозит обучение нейросетей. Ассоциация больших данных направила письмо в Минцифры с просьбой упростить работу с анонимизированной информацией. Главная проблема в том, что по действующему закону данные продолжают считаться персональными даже после глубокой алгоритмической очистки. Формально для обучения моделей все еще нужно согласие каждого пользователя, хотя в практических задачах ИИ нужны не имена или паспорта, а обезличенные паттерны и статистика.
Решать проблему предлагают за счет официального признания в законодательстве технологий повышения приватности (Privacy Enhancing Technologies, или PETs). Сейчас нормативная база сваливает в одну кучу любые методы преобразования, не отличая зрелые математические решения от промежуточных. АБД предлагает разрешить использование PETs без согласия граждан, но при соблюдении жестких критериев: риск раскрытия личности равен нулю или доли процента, данные обрабатываются в РФ российскими компаниями и только для задач ИИ. Также ассоциация предлагает ввести статус «доверенных посредников» с госаккредитацией и разделить датасеты на бесплатные и платные.
На ПМЭФ-2026 глава Минцифры Максут Шадаев подчеркивал, что государство должно поддерживать собственных игроков и давать стимулы для развития. С одной стороны, прозрачное закрепление PETs и создание понятных правовых рамок действительно могут дать мощный импульс разработке прикладных продуктов. С другой — ключевым вопросом остается экономика этого процесса: насколько доступным окажется контур доверенных посредников для небольших участников рынка, если качественные датасеты окончательно переведут на коммерческую основу.
#ИИ #технологии #законы
@SeclabNews