Закон о регулировании ИИ был принят под дежурные разговоры об этике, безопасности и технологическом суверенитете. Однако за фасадом декларативных норм скрывается тектонический сдвиг, который изменит ландшафт креативных индустрий в России. Государство поставило точку в главном споре последних лет между создателями контента и ИИ-корпорациями. Его решение фактически закрывает для производителей контента возможность создания нового рынка.
Иван Шевелев
Кандидат юридических наук (СПбГУ), юрист в сфере права интеллектуальной собственности и новых технологий
ЧЧтобы понять значимость события, нужно вспомнить, в какой реальности ИИ-отрасль жила до сегодняшнего дня. Обучение больших языковых моделей (LLM) — это процесс, требующий колоссальных объемов текстовых, визуальных и аудиоданных. Источником этих данных выступал интернет: алгоритмы бигтеха непрерывно сканировали (парсили) сайты СМИ, блоги и видеохостинги.
Этот процесс находился в серой правовой зоне — как в России, так и за рубежом. Разработчики нейросетей утверждали, что парсинг подпадает под доктрину добросовестного использования (fair use), ведь ИИ не копирует статьи напрямую, а лишь «читает» их для выявления закономерностей и собственного обучения. Правообладатели, напротив, полагали, что «скармливание» их интеллектуальной собственности алгоритмам без лицензии — это прямое нарушение авторских прав. На этом фоне в мире развернулись грандиозные судебные баталии: от исков The New York Times к OpenAI до персональных претензий писателей и художников к разработчикам генеративных сетей.
Эта юридическая неопределенность давала медиабизнесу мощный рычаг для торга. Осознавая риски многомиллионных исков и блокировок, глобальные технологические гиганты были вынуждены садиться за стол переговоров. Так, платформа Reddit продала доступ к своему API для обучения ИИ-моделей Google за $60 млн в год, а соглашение OpenAI и News Corp (владельца The Wall Street Journal) оценивается аналитиками в $250 млн за пять лет. Правообладатели получили возможность продавать свои архивы как ценный актив — «новую нефть» для цифровой экономики.
Казалось, что и в России дискуссия пойдет по тому же сценарию: крупные медиахолдинги и платформы начали закрывать свои данные от ботов-сборщиков, надеясь на новый виток монетизации. Однако новый закон полностью переписал правила игры, обнулив надежды на формирование нового рынка.
Закон прямо устанавливает: обращение к объектам авторского или смежного права, извлечение из них данных, их анализ и даже кратковременное воспроизведение в компьютерной памяти не является нарушением, если это делается исключительно для обучения «суверенных» или «национальных» больших фундаментальных моделей ИИ. Единственное условие: разработчик должен использовать экземпляр произведения, полученный правомерно, либо объект должен быть доведен до всеобщего сведения (то есть просто опубликован в открытом интернете).
Для российского бигтеха это колоссальная и безоговорочная победа. Разработчики «суверенных» ИИ-моделей (а статус суверенной получает модель, созданная российской компанией на базе отечественной инфраструктуры) получают карт-бланш на использование всего открытого рунета. Государство ясно дало понять: в глобальной гонке ИИ-вооружений скорость развития национальных технологий и технологический суверенитет не менее важны, чем интересы отдельных правообладателей.
Архивы статей, уникальные исследования, книги и сценарии — все, что десятилетиями создавалось трудом журналистов и авторов, отныне признается бесплатным топливом для алгоритмов.
У лоббистов ИИ есть свои аргументы: нейросети не копируют статьи целиком или частично и не продают их пользователю, а лишь анализируют закономерности и учатся на них. Требовать за это деньги — все равно что обязать выпускника школы всю жизнь платить роялти авторам букваря, по которому он научился читать. Медиабизнес ведь ничего не получал от бигтеха раньше, так в чем же суть его потерь сейчас?
Но эти потери выражаются в двух конкретных метриках.
Первая — упущенная выгода от нерожденного рынка. Медиа не получали деньги от бигтеха раньше просто потому, что технологии LLM не существовало. На Западе медиахолдинги превратили свои архивы в актив, за который разработчики ИИ могут платить. Российский медиабизнес уже де-юре лишился этого актива.
Вторая, и самая болезненная, потеря — каннибализация трафика. Обученная нейросеть — это промышленный алгоритм, который напрямую конкурирует с первоисточником за внимание аудитории. Когда пользователь задает вопрос поисковику со встроенным ИИ, нейросеть мгновенно анализирует десятки свежих статей и выдает готовый, исчерпывающий ответ. Читателю больше незачем переходить по ссылке на сайт издания. Медиа лишается клика, рекламного показа и потенциального подписчика. Бигтех использует интеллектуальный труд редакций не просто для «обучения», а для создания продукта-заменителя, который отрезает сами редакции от их же аудитории и выручки.
Означает ли это, что бизнесу остается лишь смириться с ролью бесплатной кормовой базы для алгоритмов? Нет, но защищать активы теперь придется технологиями и договорным правом. Поскольку закон разрешает ИИ поглощать все, что «доведено до всеобщего сведения», открытый контент окончательно потерян для монетизации. Бизнес скроет ценные данные за регистрацией, доступом по подписке и жесткими пользовательскими соглашениями. В новой реальности абсолютная открытость равносильна добровольной сдаче активов. И тот, кто успеет перестроить модель и спрятать ядро своей экспертизы за юридическими и техническими замками, сохранит бизнес. Остальные просто растворятся в параметрах новой суверенной нейросети.
Архивы статей, уникальные исследования, книги и сценарии — все, что десятилетиями создавалось трудом журналистов и авторов, отныне признается бесплатным топливом для алгоритмов