Все договариваются с Google, а Meta читает сайты бесплатно
Поисковые системы платят за контент, а Meta свободно использует данные для обучения ИИ, не возвращая трафик. Автор SEJ призывает задуматься о справедливости такого подхода.
- Издатели и платформы сосредоточили переговоры на Google, хотя Meta активно собирает данные для ИИ.
- Meta не платит за доступ к веб-контенту и не возвращает почти ничего.
- Автор SEJ поднимает вопрос о неравенстве в условиях для разных компаний.
Как сообщает Search Engine Journal, в сфере машинного доступа к веб-ресурсам сложилась парадоксальная ситуация: все внимание приковано к переговорам с Google, в то время как Meta почти беспрепятственно индексирует сайты для обучения своих ИИ-моделей.
Автор статьи Слободан Манич отмечает, что Google постоянно находится под давлением издателей и регулирующих органов. С компанией ведутся многочисленные переговоры о компенсации за использование контента, запускаются судебные иски. При этом Meta, которая также активно использует открытые веб-ресурсы, практически не сталкивается с подобными требованиями.
Разница в индексации
Эксперт напоминает, что боты Meta (например, для обучения ИИ) могут обходить веб-сайты чаще, чем некоторые краулеры Google. Однако в отличие от поисковика, который хотя бы возвращает пользователям ссылки на источники, Meta использует данные для создания закрытых моделей. Отдача для сайтов и издателей после таких «прочтений» практически нулевая.
По мнению автора, это создает несправедливые условия: новостные организации тратят время и ресурсы на переговоры с одной корпорацией, в то время как другая просто берет данные без каких-либо обязательств.
Владельцам сайтов и издателям стоит пересмотреть свою политику управления ботами. Сейчас значительные усилия направлены только на мониторинг Google, но доступ Meta может быть даже более интенсивным.
Специалистам полезно проверять, какие краулеры реально обращаются к ресурсу, и при необходимости ограничивать доступ через robots.txt или другие технические средства. Это простое действие поможет снизить издержки на трафик и сохранить контроль над тем, как чужие алгоритмы используют ваши материалы.
Оригинал публикации: www.searchenginejournal.com. Разбор и выводы — редакции «SEO-зоны».