Закон о регулировании ИИ был принят на фоне дискуссий об этике, безопасности и технологическом суверенитете. Однако за видимыми нормами скрывается кардинальный сдвиг, способный изменить облик креативных индустрий в России. Государство завершило главный конфликт последних лет между создателями контента и ИИ-корпорациями. Его решение фактически лишает производителей контента возможности формирования нового рынка.
Ч Чтобы понять значимость события, нужно вспомнить, в какой реальности функционировала ИИ-отрасль до сегодняшнего дня. Обучение больших языковых моделей (LLM) требует огромных объемов текстовых, визуальных и аудиоданных. Источником этих данных был интернет: алгоритмы крупных технологических компаний постоянно сканировали (парсили) сайты СМИ, блоги и видеохостинги.
Этот процесс находился в правовой серой зоне как в России, так и за рубежом. Разработчики нейросетей утверждали, что парсинг подпадает под доктрину добросовестного использования (fair use), поскольку ИИ не копирует статьи напрямую, а лишь «читает» их для нахождения закономерностей и обучения. Правообладатели считали, что «скармливание» их интеллектуальной собственности алгоритмам без лицензии — это прямое нарушение авторских прав. В этом контексте развернулись значительные судебные баталии: от исков The New York Times к OpenAI до претензий писателей и художников к разработчикам генеративных сетей.
Эта юридическая неопределенность давала медиабизнесу мощный рычаг для ведения переговоров. Осознавая риски многомиллионных исков и блокировок, крупные технологические компании были вынуждены соглашаться на переговоры. Например, платформа Reddit продала доступ к своему API для обучения ИИ-моделей Google за $60 млн в год, а соглашение OpenAI и News Corp (владельца The Wall Street Journal) оценивается аналитиками в $250 млн за пять лет. Правообладатели получили возможность продавать свои архивы как ценный актив — «новую нефть» для цифровой экономики.
Сложилось впечатление, что и в России дискуссия будет развиваться в том же направлении: крупные медиахолдинги и платформы начали закрывать свои данные от ботов, надеясь на новые возможности монетизации. Однако новый закон значительно изменил ситуацию, обнулив надежды на формирование нового рынка.
Закон ясно устанавливает: использование объектов авторского или смежного права, извлечение из них данных, их анализ и даже кратковременное воспроизведение в памяти компьютера не является нарушением, если это делается исключительно для обучения «суверенных» или «национальных» больших фундаментальных моделей ИИ. Единственное условие: разработчик должен использовать законно полученный экземпляр произведения, либо этот объект должен быть ранее опубликован в открытом интернете.
Для российского бигтеха это грандиозная и безоговорочная победа. Разработчики «суверенных» ИИ-моделей (статус суверенной получают модели, созданные российскими компаниями с использованием отечественной инфраструктуры) получают карт-бланш на использование всего открытого рунета. Государство четко дало понять: в гонке технологий ИИ скорости развития и технологический суверенитет так же важны, как и интересы отдельных правообладателей.
Архивы статей, уникальные исследования, книги и сценарии — всё, что десятилетиями создавалось трудом журналистов и авторов, теперь становится бесплатным ресурсом для алгоритмов.
У сторонников ИИ есть свои аргументы: нейросети не копируют статьи целиком или частично и не продают их пользователям, а лишь анализируют закономерности и учатся на них. Требовать за это деньги — всё равно что заставлять выпускника школы всю жизнь платить роялти авторам букваря, по которому он научился читать. Медиабизнес ведь ничего не получал от бигтеха раньше, так в чем же суть его потерь сейчас?
Однако эти потери могут быть представлены в двух конкретных метриках.
Первый аспект — это упущенная выгода от несуществующего рынка. Медиа не получали деньги от big-tech ранее, просто потому, что технологии LLM не существовало. На Западе медиахолдинги превратили свои архивы в актив, за который разработчики ИИ могут платить. Российский медиабизнес теперь де-факто лишился этого актива.
Вторая и самая болезненная потеря — каннибализация трафика. Обученная нейросеть — это промышленный алгоритм, который конкурирует с первоисточником за внимание аудитории. Когда пользователь запрашивает у поисковика с встроенным ИИ, нейросеть незамедлительно анализирует десятки свежих статей и предоставляет готовый, исчерпывающий ответ. Читатель больше не имеет необходимости переходить по ссылке на сайт издания. Таким образом, медиа теряет клик, рекламный показ и потенциального подписчика. Бигтех использует интеллектуальный труд журналистов не только для «обучения», но и для создания продукта-заменителя, который отсекает сами медиа от их аудитории и доходов.
Означает ли это, что бизнесу остаётся лишь смириться с ролью бесплатной кормовой базы для алгоритмов? Нет, но защищать свои активы теперь нужно с помощью новых технологий и договоров. Поскольку закон разрешает ИИ использовать всё, что «доведено до всеобщего сведения», открытый контент окончательно уходит с рынка монетизации. Бизнес будет скрывать ценные данные за регистрацией, подписками и жесткими пользовательскими соглашениями. В новой реальности абсолютная открытость равносильна добровольной сдаче активов. И тот, кто быстрее адаптирует свою модель и защитит свою экспертизу юридическими и техническими мерами, сможет сохранить бизнес. Остальные рискуют раствориться в параметрах новой суверенной нейросети.
Архивы статей, уникальные исследования, книги и сценарии — всё, что десятилетиями создавалось трудом журналистов и авторов, теперь признаётся бесплатным топливом для алгоритмов

