​​«Цифровой шантаж»: Как Google использует поиск, чтобы принудительно обучать свой ИИ на ваших сайтах.

​​«Цифровой шантаж»: Как Google использует поиск, чтобы принудительно обучать свой ИИ на ваших сайтах.
0

В последние месяцы все чаще звучит вопрос: могут ли издатели вообще контролировать, как их контент используется в эпоху ИИ — или выбора уже не осталось. Поводом для нового витка дискуссии стал отчет Cloudflare за 2025 год, где на цифрах видно, как Google фактически совмещает поиск и обучение своих моделей в одном боте.

Мы обсудили эту ситуацию с Марией Клоковой, диджитал-маркетологом, чтобы разобраться, что на самом деле происходит между Google, издателями и ИИ. Есть ли у сайтов реальный выбор, можно ли технически защитить контент и почему разговор о «добровольном согласии» здесь все меньше похож на правду.

1. Насколько критична связка Поиск + ИИ и есть ли у издателей выбор?

Ситуация для владельцев сайтов не просто критичная, она патовая. Google пошел на хитрость, которую на рынке называют «bundling» (пакетирование). Они намеренно не разделяют своего бота на поискового (который приводит вам клиентов) и обучающего (который забирает ваш контент для нейросетей).

Это ставит любого издателя — от крупного СМИ до нишевого блога — в положение цугцванга:

  • Вариант А: Вы блокируете Googlebot. Да, ваш контент не украдут для обучения Gemini. Но вы тут же исчезаете из поиска Google. Для 90% бизнеса в интернете это равносильно закрытию. Трафика нет — денег нет.
  • Вариант Б: Вы пускаете Googlebot. Вы остаетесь в поиске, получаете трафик (пока что), но параллельно бесплатно скармливаете свой уникальный контент конкуренту в лице ИИ, который завтра будет отвечать пользователям на их вопросы вместо перехода на ваш сайт.

Реального выбора у издателей нет. Google пользуется своим монопольным положением в поиске, чтобы выиграть гонку вооружений в ИИ. Другие игроки, вроде OpenAI (GPTBot) или Anthropic (ClaudeBot), не имеют рычага в виде поиска, поэтому их блокируют массово и безболезненно. А Google — это «священная корова», которую трогать нельзя, иначе потеряешь бизнес.

По сути, мы платим своим контентом налог за присутствие в выдаче. Раньше это был бартер: «мы вам контент — вы нам трафик». Сейчас условия меняются:
«мы вам контент для обучения ИИ — а вы нам… возможность просто существовать в поиске».

2. Можно ли технически запретить обучение ИИ, не теряя позиции, или это иллюзия?

На данный момент — это, к сожалению, красивая иллюзия. Google ввел такие инструменты, как Google-Extended (настройка в robots.txt), которые якобы позволяют запретить использование данных для улучшения ИИ-моделей (Bard/Gemini/Vertex AI), но оставить сайт в поиске.

Но здесь есть два огромных подводных камня, о которых не любят говорить публично:

  1. Техническая невозможность разделения. Чтобы поисковик качественно ранжировал ваш сайт в 2025 году, он обязан понимать смысл текста. Для этого используются те же самые нейросетевые алгоритмы, что и для генерации ответов. Где проходит грань между «ИИ прочитал статью, чтобы понять, о чем она для поиска» и «ИИ прочитал статью и запомнил факты для обучения»? Это «черный ящик» внутри Google. Мы не можем проверить, действительно ли данные удаляются после индексации или оседают в весах модели.
  2. Отсутствие гарантий. robots.txt — это джентльменское соглашение, а не железная стена. Боты могут его игнорировать. И если сторонние парсеры можно забанить по IP, то забанить IP Google — значит выстрелить себе в ногу.

Пока что единственный рабочий способ на 100% защитить контент от ИИ — это жесткий пейволл (вход по паролю/подписке), куда боты вообще не могут попасть. Но это убивает SEO-трафик на корню.

Мы находимся в переходном периоде, когда правила игры диктует тот, у кого рубильник от трафика. Google использует доминирование в прошлом (Поиск), чтобы обеспечить доминирование в будущем (ИИ). И пока законодательство не разделит эти функции принудительно, издатели будут вынуждены «кормить» бота, который в перспективе может лишить их работы.

Комментарии: 0
Как вам статья?
/ 5
Комментарии (0)
Читатели еще не оставили комментарий, будьте первым!

— для отправки комментария вам необходимо
Забыли пароль?

Введите ваше имя пользователя или адрес email. Вы получите email сообщение с инструкциями по сбросу пароля.

Создание аккаунта

X