← ДашбордКаталог узлов

АРХ-ЦА-СЛ-01. ИИ-лицензирование архивного контента (⏳)

Ставка · статус: dev · проверен: 2026-09-08 · уровень: отрасль «Архивное дело» · база «Общественные блага»
Просто: Компании, которые учат свои программы отвечать на вопросы, кормят их огромным количеством текстов. Кто-то из владельцев текстов стал брать за это деньги по отдельным договорённостям. А кто-то держал свои материалы бесплатными для всех — и оказалось, что через них те же тексты можно получить в обход платных договорённостей. Теперь владельцы платных договорённостей начали закрывать доступ и к бесплатным собраниям тоже.
Тезис: за три года (2023–2026) вокруг архивного и издательского контента как сырья для обучения искусственного интеллекта возник практически с нуля целый рынок прав — иски и параллельные лицензионные сделки на десятки и сотни миллионов долларов в год, — и этот рынок структурно выгоднее закрытым архивам с юридическим ресурсом на тяжбу и переговоры (крупные издатели, платформы), чем некоммерческим архивам, изначально построившим свою миссию на открытости; открытость, бывшая раньше преимуществом, в новом контексте становится источником риска — открытый архив нечего лицензировать, но есть что скрапить в обход чужих лицензий.

Содержание

[факт] В августе 2025 г. Reddit объявил о блокировке доступа Internet Archive к своим материалам — архивные копии Internet Archive включают форумы, комментарии и профили Reddit; тот же контент Reddit параллельно лицензирует Google для обучения ИИ за сообщаемые десятки миллионов долларов в год (сделка — февраль 2024 г.) 🟡[98].

[факт] The Guardian и The Times (Великобритания) также ограничили доступ Internet Archive к своим опубликованным статьям, снижая вероятность, что ИИ-компании смогут получить их контент через репозиторий Internet Archive в обход собственных лицензионных соглашений издателей 🟡[98].

[факт] Позиция самой Internet Archive (комментарии в Бюро авторских прав США, ноябрь 2023 г.): сбор данных и «непотребительское» использование для обучения ИИ-моделей в целом является добросовестным использованием по авторскому праву США, но создание нового отдельного режима прав и лицензионного рынка специально для ИИ-обучения усугубит существующие проблемы и дополнительно укрепит позиции крупнейших компаний, уже накопивших массивы пользовательских данных 🟢[99].

[факт] Параллельно идёт формирование самого рынка лицензий: двухлетняя сделка одной ИИ-компании с Associated Press (июль 2023), затем с немецким издателем Axel Springer (декабрь 2023), Financial Times, Le Monde и другими; Reddit — сделки с Google (февраль 2024, ~$60 млн/год по сообщениям) и затем с другой ИИ-компанией; The New York Times — сделка с Amazon (май 2025, по данным Wall Street Journal — $20–25 млн/год) 🟡[103][104].

[факт] Иски по тому же кругу вопросов идут параллельно со сделками: NYT v. OpenAI and Microsoft (иск декабрь 2023, на стадии предварительного производства); Thomson Reuters v. Ross Intelligence (решение февраль 2025 — использование заголовков Westlaw для обучения юридического ИИ признано не добросовестным использованием — редкое на тот момент решение не в пользу ИИ-компании); Bartz v. Anthropic (решение 2025 г. — обучение на законно приобретённых книгах признано трансформативным добросовестным использованием, но обучение на заведомо пиратском корпусе — нет; осенью 2025 г. Anthropic согласилась на урегулирование коллективного иска авторов на $1,5 млрд) 🟡[102].

[гипотеза] Совокупность исков и сделок 2023–2026 гг. формирует новый рынок прав на «архив как обучающие данные» практически с нуля за три года; крупные издатели с юридическим ресурсом и переговорной силой успевают монетизировать свой архив через лицензии, тогда как некоммерческие и открытые по миссии архивы остаются вне этого рынка по самому своему устройству — их материалы и так открыты, лицензировать нечего, — но именно поэтому становятся мишенью защитных ограничений со стороны третьих лиц, боящихся утечки через них.

[не найдено] Совокупный размер рынка ИИ-лицензирования архивного и издательского контента, измеренный эффект ограничений доступа на посещаемость и использование Internet Archive третьими сторонами — количественно не найдено в собранном сырье, только качественные описания отдельных сделок и исков.

Данные

Связан с

Источники

Открытые хвосты

Проверен на дату: 2026-09-08

Вопросы

отвечено 0 из 3

1. Каков тезис узла об ИИ-лицензировании архивного контента?

Ответ: (б). Тезис узла.

2. Почему, по гипотезе узла, открытые по миссии архивы становятся мишенью защитных ограничений?

Ответ: (а). Раздел «Содержание», [гипотеза].

3. Какова позиция самой Internet Archive (комментарии в Бюро авторских прав США, ноябрь 2023) по вопросу ИИ-лицензирования?

Ответ: (а). Раздел «Содержание», [факт] «позиция самой Internet Archive».
Дашборд Каталог узлов Наверх ↑