[факт] В августе 2025 г. Reddit объявил о блокировке доступа Internet Archive к своим материалам — архивные копии Internet Archive включают форумы, комментарии и профили Reddit; тот же контент Reddit параллельно лицензирует Google для обучения ИИ за сообщаемые десятки миллионов долларов в год (сделка — февраль 2024 г.) 🟡[98].
[факт] The Guardian и The Times (Великобритания) также ограничили доступ Internet Archive к своим опубликованным статьям, снижая вероятность, что ИИ-компании смогут получить их контент через репозиторий Internet Archive в обход собственных лицензионных соглашений издателей 🟡[98].
[факт] Позиция самой Internet Archive (комментарии в Бюро авторских прав США, ноябрь 2023 г.): сбор данных и «непотребительское» использование для обучения ИИ-моделей в целом является добросовестным использованием по авторскому праву США, но создание нового отдельного режима прав и лицензионного рынка специально для ИИ-обучения усугубит существующие проблемы и дополнительно укрепит позиции крупнейших компаний, уже накопивших массивы пользовательских данных 🟢[99].
[факт] Параллельно идёт формирование самого рынка лицензий: двухлетняя сделка одной ИИ-компании с Associated Press (июль 2023), затем с немецким издателем Axel Springer (декабрь 2023), Financial Times, Le Monde и другими; Reddit — сделки с Google (февраль 2024, ~$60 млн/год по сообщениям) и затем с другой ИИ-компанией; The New York Times — сделка с Amazon (май 2025, по данным Wall Street Journal — $20–25 млн/год) 🟡[103][104].
[факт] Иски по тому же кругу вопросов идут параллельно со сделками: NYT v. OpenAI and Microsoft (иск декабрь 2023, на стадии предварительного производства); Thomson Reuters v. Ross Intelligence (решение февраль 2025 — использование заголовков Westlaw для обучения юридического ИИ признано не добросовестным использованием — редкое на тот момент решение не в пользу ИИ-компании); Bartz v. Anthropic (решение 2025 г. — обучение на законно приобретённых книгах признано трансформативным добросовестным использованием, но обучение на заведомо пиратском корпусе — нет; осенью 2025 г. Anthropic согласилась на урегулирование коллективного иска авторов на $1,5 млрд) 🟡[102].
[гипотеза] Совокупность исков и сделок 2023–2026 гг. формирует новый рынок прав на «архив как обучающие данные» практически с нуля за три года; крупные издатели с юридическим ресурсом и переговорной силой успевают монетизировать свой архив через лицензии, тогда как некоммерческие и открытые по миссии архивы остаются вне этого рынка по самому своему устройству — их материалы и так открыты, лицензировать нечего, — но именно поэтому становятся мишенью защитных ограничений со стороны третьих лиц, боящихся утечки через них.
[не найдено] Совокупный размер рынка ИИ-лицензирования архивного и издательского контента, измеренный эффект ограничений доступа на посещаемость и использование Internet Archive третьими сторонами — количественно не найдено в собранном сырье, только качественные описания отдельных сделок и исков.
Проверен на дату: 2026-09-08
отвечено 0 из 3
1. Каков тезис узла об ИИ-лицензировании архивного контента?
2. Почему, по гипотезе узла, открытые по миссии архивы становятся мишенью защитных ограничений?
3. Какова позиция самой Internet Archive (комментарии в Бюро авторских прав США, ноябрь 2023) по вопросу ИИ-лицензирования?