Вам обязательно нужно смотреть серверные логи , узнай почему
Есть большая разница между данными из Google Search Console и серверными логами. GSC отражает выборочную картину, которую Google готов вам показать. Логи фиксируют реальность: каждый запрос бота, каждый 20* - 50*-й http ответ, каждый килобайт потраченного впустую краулингового бюджета.
Ниже пару примеров какие ситуации можно обнаружить по log файлам:
1)На одном из проектов с Next.js после каждого билда генерировались новые хэшированные JS-файлы (пример main-a17059cef528451e.js), файлы изображений с хэшем (я уже буду молчать как ведут себя изображения в индексе когда их имя постоянно меняется). Googlebot видит «новые» файлы и бежит их сканировать (контента и текста там нет). А по факту - ничего не изменилось т к содержимое тоже. Краулинговый бюджет уходит на пустые обходы "нового файла", в то время как важные страницы ждали своей очереди по несколько дней. В GSC такое увидеть невозможно.
P.S. вместо тысячи слов рекомендую ребятам у кого сайты на next.js изучить серверные логи и лично узнать на какие типы файлов идут запросы и какой процент от общего количества. Я думаю вам как и мне хотелось чтобы больше внимания было на html и контент чем на какую то сквозную svg картинку в подвале с новым хэшем которая вам не приоритетна для продвижения
2)По коду 404 можно изучить, на какие URL-адреса реально попадают люди. Если у вас крупный проект с запутанной иерархией URL адресов, пользователи могут часто искать несуществующие страницы. Например: страница живёт по адресу /friend/maksim, но многие переходят на /friend (хотя у вас эта страница - /friends). Такие паттерны видны в логах, и они сигнализируют о проблемах навигации и структуры сайта.
3)В логах можно найти URL-адреса, где встречаются 5xx HTTP-коды ошибок. Это очень неприятно находить вручную, а в логах они видны сразу - и часто там, где вы их не ждёте.
4)Куча других ситуаций...
Вывод простой: логи - это единственный источник правды о том, что боты делают на вашем сервере на самом деле. Не нужно быть дата-инженером - Grafana, AWS CloudWatch, плагины для CMS или готовые дашборды настроить можно на любом уровне.
Поставьте себе напоминание. Раз в месяц. Двадцать минут. И бизнес перестанет терять трафик в технических дырах.
#seo #serverlogs #nextjs #webdevelopment #technicalseo #crawlbudget #devops #teamlead #cto
· 16.08
Да, GSC и логи часто показывают разные вселенные. Для SEO/продукта логи полезнее, когда надо понять реальный спрос, crawl-budget и странные паттерны ботов, а не усреднённую картинку. У вас есть автоматическая сводка по bot noise и 5xx?
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён
· 18.08
можно использовать Clarity от microsoft - он отлично показывает где имеются странные http ответы (5хх, 4хх и тп). Также там можно фильтровать данные по отдельным ботам - это помогает понять какие боты и куда могут стучатся, это помогает их направить в нужные места и закрыть от сканирование доп фрагменты
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
ответ удалён