Госдума приняла рамочный закон об ИИ — суверенные модели, добровольная маркировка контента и обучение на чужих текстах без разрешения авторов

изображение: grok
Депутаты за один день провели через второе и третье чтения закон «О поддержке развития технологий искусственного интеллекта в РФ». Документ впервые вводит в российское правовое поле само понятие ИИ, делит отечественные модели на суверенные и национальные, обязывает крупные площадки давать пользователям инструменты для маркировки сгенерированного контента и легализует обучение нейросетей на опубликованных произведениях без согласия правообладателей.
Под большой фундаментальной моделью в тексте закона понимается система с числом параметров свыше одного миллиарда. Отдельно прописан статус разработчика и состава данных, на которых нейросеть обучается. Разделение отечественных решений идёт по двум линиям, у каждой из которых свои требования к происхождению кода и месту размещения серверов.
Для суверенной категории требования жёстче:
- полная разработка российским юрлицом;
- работа только на инфраструктуре внутри страны;
- обучение модели на территории России;
- соответствие законодательству и традиционным духовно-нравственным ценностям.
Национальная модель тоже создаётся российским разработчиком, но допускает вкрапления открытого кода. Правительство получает полномочия решать, где допустимы лишь суверенные или национальные системы — по банковскому сектору такие решения будут согласовываться с ЦБ.
Отмечается, что для суверенных моделей ко второму чтению убрали требование об обязательной «матрице исходных коэффициентов», но обязанность обучать нейросеть внутри страны сохранили — то есть формально порог входа стал мягче, а географическая привязка вычислений осталась абсолютной.
Владельцев сервисов с доступом к большим языковым моделям обязали сообщать пользователю, кому принадлежат права на результат работы нейросети, на каких условиях этот результат можно применять дальше и как он хранится. Норма касается любых площадок, не только чатботов, — под неё попадают и встроенные ИИ-помощники в приложениях.
Юрист Антон Горелкин к финальному чтению добился нескольких правок формулировок. Из предмета регулирования убрали слово «использование», оставив триаду «разработка, внедрение и применение». Термин «инновационная экономика» заменили на «цифровая экономика», добавили муниципальный уровень государственного управления, а «набор данных» переименовали в «состав данных». Слово «настройка» параметров заменили на «подбор» — правка на первый взгляд косметическая, но она снимает часть претензий к моделям с дообучением через LoRA и адаптеры.
Маркировка сгенерированного контента осталась добровольной для самого пользователя, а обязательной — для площадок. Техническую возможность пометить материал должны предоставить:
- социальные сети;
- крупные интернет-платформы;
- сайты с суточной аудиторией более 500 тысяч человек;
- информационные системы того же масштаба;
- программы с суточной аудиторией от 500 тысяч.
Стоит обратить внимание, что закон не вводит штрафа за отсутствие маркировки со стороны автора публикации — санкции грозят площадке, которая не встроит нужный интерфейс. То есть ответственность сдвинута с миллионов пользователей на несколько десятков крупных сервисов, и именно там будут решать, как именно маркер будет выглядеть.
Норма про обучение нейросетей на чужих текстах, картинках и музыке практически не изменилась с первой редакции — правообладателя спрашивать не нужно, если произведение доведено до всеобщего сведения и физически доступно для анализа. Для российских пользователей это значит вот что. Тексты из блогов, посты в соцсетях, фотографии в открытых профилях, статьи на новостных сайтах, любительские треки на стриминге — всё это на законных основаниях уйдёт в обучающие выборки без запроса и без вознаграждения. Отказаться постфактум механизма нет, отзыва согласия закон не предусматривает.
Для тех, кто уже вложился в ИИ-продукты, прописан переходный период до 2032 года — работающие системы смогут доживать по прежним правилам. Параллельные экспериментальные правовые режимы тоже остаются рабочим инструментом, через них Минцифры собирается тестировать более узкие сценарии применения.
Поправка о льготном получении статуса национальной модели для малого и среднего бизнеса не прошла. Порог в один миллиард параметров сохраняется, и по факту дорога к господдержке открыта только крупным игрокам уровня «Яндекса», «Сбера» и VK — небольшие команды с интересными узкоспециализированными моделями формально остаются за скобками закона.
Вице-премьер Дмитрий Григоренко ещё до принятия документа называл его рамочным — почти вся конкретика вынесена в подзаконные акты, разрабатывать которые будет Минцифры. От их содержания зависит, чем закон обернётся для рядовых пользователей, разработчиков и правообладателей: мягким сводом принципов или жёсткой системой ограничений с обязательной сертификацией моделей.
Ранее сообщалось, что в Государственной думе разъяснили различия между суверенными и национальными моделями искусственного интеллекта в рамках обсуждения законопроекта о регулировании ИИ. По словам парламентариев, эти понятия не являются взаимозаменяемыми и предполагают разные требования к происхождению технологий, порядку их разработки и условиям применения. Соответствующее разделение предлагается закрепить в новой системе регулирования искусственного интеллекта в России.
Рамочный характер документа — сейчас его главная особенность. Экспертная редакция CISOCLUB видит здесь двойной эффект. С одной стороны, легализация обучения на открытых произведениях без согласия авторов бьёт по владельцам контента и фактически превращает публичный рунет в бесплатное сырьё для больших моделей. С другой — жёсткое разделение на суверенные и национальные категории закрепляет доминирование крупных игроков и оставляет независимым разработчикам минимум пространства для манёвра.
Обязательная техническая маркировка на площадках с аудиторией от 500 тысяч человек — норма разумная, но её ценность будет определяться подзаконными актами, а не самим законом. Для рядового пользователя главный практический вывод простой — всё, что он публикует в открытом доступе, теперь официально считается материалом для тренировки нейросетей.



