«Данные или смерть»: Cloudflare обвиняет Google в шантаже издателей ради доминирования в ИИ
Cloudflare заявила, что Google использует своё доминирование в поиске для получения беспрецедентного доступа к данным, необходимым для обучения нейросетей, что создаёт неравные условия на рынке искусственного интеллекта, ставя веб-издателей перед выбором: делиться контентом или потерять трафик.
Генеральный директор Cloudflare Мэтью Принс Matthew Prince обратил внимание регулирующих органов и IT-сообщества на стратегию Google, которая, по его мнению, граничит с недобросовестной конкуренцией. Суть претензии кроется в работе веб-краулеров — автоматических программ, которые «обходят» сайты, чтобы собрать информацию. В отличие от других крупных игроков, таких как Microsoft и OpenAI, которые используют отдельных ботов для поисковой индексации и для сбора данных под задачи ИИ, Google применяет единого краулера (Googlebot) для обеих целей одновременно.
На практике это означает, что владелец сайта, желая запретить использование своего контента для обучения нейросетей конкурентов, технически может заблокировать только отдельного «ИИ-бота». Если же он заблокирует Googlebot, чтобы оградить свой контент от использования в продуктах вроде Gemini, его сайт мгновенно исчезнет из поисковой выдачи Google. По оценкам Cloudflare, эта практика даёт колоссальное преимущество в объёме тренировочных данных и Google имеет доступ к информации с в 3,2 раза большего количества веб-страниц, чем OpenAI, и почти в 5 раз большего, чем Microsoft.
Ситуация усугубляется тем, что Google уже активно использует собранные данные, внедряя в поиск блок «ИИ-ответов» (AI Overview). Эта функция напрямую резюмирует информацию с сайтов, часто лишая их переходов пользователей. Таким образом, издатели, чей контент используется для обучения ИИ, в итоге сами же страдают от снижения трафика.
Проблема носит системный характер: монополия на одном рынке (поиск) напрямую трансформируется в неоспоримое преимущество на другом, только формирующемся рынке — рынке генеративного искусственного интеллекта. Вопрос теперь в том, успеют ли регуляторы и конкуренты отреагировать до того, как этот разрыв станет непреодолимым.
А как вы считаете, есть ли у веб-издателей сегодня реальная возможность защитить свой контент от использования в обучении коммерческих ИИ-моделей, не жертвуя при этом поисковым трафиком? Выскажитесь в комментариях на этот счет.
-
Голосовая навигация Gemini стала доступна в Google Maps по всему миру -
Google Gemini почти догнал ChatGPT и теперь ИИ-гонка стала войной бюджетов -
Siri на стероидах от Google: бета-тест «гибридного» помощника стартует в конце февраля -
Акции Unity упали на 35% после анонса AI-инструмента Project Genie от Google -
Google тестирует в Gemini импорт чатов и загрузку 4K-изображений

