Новости и разборы

РазборКонтент и источники

Wikipedia и Reddit лицензируют данные для AI, но их вклад в туристические ответы пока не измерен

С 2023 по 2026 год OpenAI, Reddit, News Corp и другие подписали десятки лицензионных соглашений, а Wikipedia запретила AI-редактирование статей. Разбираем, что из этого действительно доказано для туристического контента, а что остаётся предположением.

Опубликовано
Чтение
9 мин
Источники
6 источников
На деревянном столе лежат газетный архив, старая книга с лаймовой закладкой, карта с нитями маршрутов и чистый блокнот.
В материале

Главное

  • OpenAI заключила многолетнее лицензионное соглашение с News Corp (по сообщениям, около 250 млн долларов за пять лет) и получила доступ к архивам WSJ, New York Post и других изданий для обучения моделей и грунтования ответов.
  • Reddit раскрыл в документах к IPO совокупную стоимость контрактов на лицензирование данных для AI-компаний на уровне около 203 млн долларов: платформа стала структурированным источником пользовательских обсуждений для ИИ.
  • В марте 2026 года Wikipedia запретила волонтёрам использовать искусственный интеллект для генерации или переписывания статей. Это правило редактирования, а не доказательство того, какую долю в ответах LLM занимает контент энциклопедии.
  • С 2023 по 2026 год рынок лицензирования данных для ИИ вышел далеко за пределы новостных изданий и охватил соцплатформы, форумы, стоковые библиотеки и научные издательства, однако ни один проверенный трекер сделок не фиксирует отдельного соглашения именно в туристическом сегменте.
  • Anthropic почти не участвует в публичных лицензионных сделках и вместо этого согласилась на предполагаемое урегулирование иска об авторских правах на 1,5 млрд долларов, которое на момент подготовки материала ещё не получило окончательного утверждения суда.

01

Что произошло

С 2023 года крупные AI-компании системно покупают права на чужой контент для двух задач: обучения моделей и грунтования ответов. Так называют механизм, при котором система подкрепляет сгенерированный текст ссылками на реальные источники, а не только на данные, заложенные при обучении. Тенденцию фиксируют несколько трекеров сделок: один обновлён по состоянию на август 2026 года, другой опубликован ещё осенью 2025 года. Оба описывают один и тот же процесс, но на разных этапах его развития.23

Параллельно Wikipedia, один из крупнейших курируемых людьми текстовых корпусов в интернете, ужесточила собственную редакционную политику в отношении искусственного интеллекта. Коммерческое лицензирование контента и внутренние правила крупных источников идут своим ходом, и в доступных материалах нет данных, которые напрямую связывали бы их с конкретной долей цитирования в туристических ответах AI. Эту оговорку стоит держать в уме на протяжении всего текста.4

02

От новостных архивов до Reddit: карта сделок 2023–2026

Одной из первых и самых заметных стала сделка OpenAI с News Corp, заключённая в 2024 году. По сообщениям сторонних источников, контракт оценивается примерно в 250 млн долларов за пять лет и даёт OpenAI доступ к архивам The Wall Street Journal, New York Post и других изданий News Corp как для обучения моделей, так и для грунтования ответов. Первичный финансовый документ самой сделки в доступных материалах отсутствует, поэтому сумму стоит воспринимать как оценку, а не как официально подтверждённую цифру.12

Reddit раскрыл цифры не в пресс-релизе, а в документах к первичному размещению акций: совокупная стоимость контрактов на лицензирование данных для AI-компаний составила около 203 млн долларов. Это делает Reddit (с его массивом пользовательских обсуждений, включая тревел-форумы и треды с рекомендациями по направлениям) одним из структурированных каналов доступа AI-компаний к разговорному, неформальному контенту.23

03

Wikipedia закрывает дверь для AI-редактирования

В марте 2026 года Wikipedia ввела запрет на использование искусственного интеллекта для генерации или переписывания текста статей волонтёрами, сохранив исключения для перевода и незначительных технических правок. Решение касается процесса редактирования энциклопедии людьми, а не того, используют ли крупные языковые модели саму Wikipedia как источник данных для обучения или для грунтования ответов. Эти вопросы не связаны напрямую.4

Английская версия Wikipedia насчитывает более 7,1 млн статей и остаётся одним из крупнейших в мире корпусов текста, курируемого людьми, а не машинами. Вместе с новой политикой против AI-контента это подчёркивает масштаб ресурса как потенциально привлекательного источника для грунтования ответов, в том числе по туристическим темам вроде истории городов, культурных особенностей или практической информации о странах. Такой масштаб может делать Wikipedia значимым фоновым источником для travel-запросов, но эмпирического подтверждения именно доли цитирования в доступных материалах нет.4

04

Anthropic выбрала суд вместо лицензий

На фоне активного лицензирования у OpenAI, Google, Amazon, Meta, Microsoft, Mistral, Apple и Perplexity выделяется позиция Anthropic: компания почти не участвует в публичных сделках с издателями. Вместо этого Anthropic согласилась на предполагаемое урегулирование иска о нарушении авторских прав на 1,5 млрд долларов. На момент подготовки материала это урегулирование ещё не получило окончательного утверждения суда, и его условия могли измениться уже после публикации исходного источника.2

Для контент-издателей, включая туристических, это значит, что стратегии AI-компаний по доступу к чужому контенту заметно различаются: одни выстраивают сеть коммерческих лицензий с атрибуцией, другие предпочитают судебное урегулирование постфактум. Универсального сценария взаимодействия travel-издания с AI-платформой пока не существует: модель поведения зависит от конкретной компании.2

05

Что это значит для туристического контента

Reddit с его тревел-сабреддитами, где путешественники обмениваются советами по маршрутам, ценам и лайфхакам, теперь официально числится одним из лицензированных источников данных для нескольких AI-компаний. Можно предположить, что подобные обсуждения влияют на формулировки в ответах моделей на практические туристические вопросы, хотя отдельного исследования именно доли Reddit в travel-ответах в доступных материалах нет.23

Отдельного внимания заслуживает модель, которую развивает Perplexity: сервис продвигает подход с разделением дохода и атрибуцией источников в реальном времени при грунтовании ответов. Теоретически это создаёт механизм монетизации для издателей, чей контент цитируется в ответах ИИ, включая travel-издания и агрегаторы отзывов, если они присоединятся к подобным программам. Прямых данных о том, что туристические платформы уже в этой конкретной программе Perplexity участвуют, нет. Это перенос общей практики на туристический контекст, а не подтверждённый факт.3

06

Практические проверки для туристических брендов

  • Сверять актуальный статус и содержание лицензионных сделок OpenAI, Google, Reddit и Perplexity напрямую на официальных пресс-страницах компаний, прежде чем ссылаться на конкретные суммы в собственных материалах.
  • Регулярно проверять дату последнего обновления отраслевых трекеров сделок: данные о лицензировании быстро устаревают, и сводки за 2024–2025 годы могут не отражать текущую картину.
  • Не путать политику Wikipedia о запрете AI-редактирования статей с вопросом о том, использует ли конкретная модель Wikipedia как источник данных для собственных ответов. Это разные темы, требующие раздельной проверки.
  • Отдельно искать подтверждение появления travel-специфичных лицензионных соглашений с туристическими медиа, платформами отзывов или национальными туристическими офисами: пока ни один доступный источник такую сделку не фиксирует.
  • Следить за итоговым решением суда по предполагаемому урегулированию Anthropic на 1,5 млрд долларов: оно может задать прецедент для дальнейшей политики компании в отношении контента издателей.
1234

07

Что источники не доказывают

Ни один из доступных материалов не содержит прямого количественного исследования того, какую долю занимают Wikipedia, Reddit или travel-издания в ответах языковых моделей на туристические запросы. Все выводы о влиянии этих источников на travel-контент AI строятся на логическом предположении о масштабе и охвате лицензионных сделок, а не на измеренных данных цитирования.234

Источники

  1. 01
    The VergeOpenAI's News Corp deal licenses content from WSJ, New York Post, and more

    Опубликовано 22 мая 2024 · Проверено 11 августа 2026

  2. 02
    LLM PulseEvery AI Content Licensing Deal, Mapped (2023-2026)

    Опубликовано 9 июля 2026 · Проверено 11 августа 2026

  3. 03
    ALLMOUnbundling AI: A List of Public Training Data Deals

    Опубликовано 15 октября 2025 · Проверено 11 августа 2026

  4. 04
    The GuardianWikipedia bans AI-generated content in its online encyclopedia

    Опубликовано 27 марта 2026 · Проверено 11 августа 2026

  5. 05
    p2previewDeals & Partnerships

    Опубликовано 17 марта 2026 · Проверено 11 августа 2026

  6. 06
    Ithaka S+RGenerative AI Licensing Agreement Tracker

    Опубликовано 12 октября 2024 · Проверено 11 августа 2026