Статья

Screaming Frog SEO Spider: как провести технический аудит сайта

Сергей Торкунов

Screaming Frog — десктопный краулер, который обходит сайт по ссылкам и собирает технические признаки URL. Хороший аудит начинается не с экспорта всех вкладок, а с настройки границ обхода и проверки полноты данных. После запуска URL группируют по шаблонам и причинам, сопоставляют с реальным поведением сайта и только затем превращают в задачи. Краулер показывает наблюдение — код ответа, canonical, метатег, ссылку, размер или содержимое, — но решение зависит от назначения страницы.

Screaming Frog — логика работы и проверки.
Схема. Screaming Frog — логика работы и проверки.

Что подготовить до запуска

Зафиксируйте домен и протокол, рабочее зеркало, поддомены, тестовую среду, правила авторизации, допустимую нагрузку и перечень шаблонов. Сохраните текущую конфигурацию проекта, чтобы повторный обход был сопоставимым.

Если сайт меняет содержимое по региону, cookie или заголовку языка, задайте условия заранее. Если важный контент появляется только после JavaScript, запланируйте отдельный обход с рендерингом и сравнение исходного и отрисованного HTML.

Настройка обхода

Область сайта

Проверьте, должен ли краулер идти по всем поддоменам, внешним ресурсам, параметрам, пагинации и hreflang. Ограничения Include/Exclude используйте только после теста на небольшой выборке: слишком широкое правило создаёт шум, слишком узкое — незаметно теряет важный раздел.

User-agent и robots.txt

Обычный обход показывает сайт так, как его видит выбранный user-agent с учётом robots.txt. Для диагностики можно провести отдельный контрольный запуск с другой конфигурацией, но его нельзя смешивать с основным отчётом: иначе закрытые URL будут выглядеть как обычные доступные страницы.

HTML или JavaScript

Режим Text Only анализирует исходный HTML. JavaScript-рендеринг выполняет клиентский код и позволяет сравнить исходное и итоговое DOM-состояние. Рендеринг нужен не всегда: он медленнее и создаёт больше нагрузки. Сначала определите, влияет ли JavaScript на текст, ссылки, canonical, метаданные или ключевые элементы страницы.

Семь контрольных проверок после настройки

ПроверкаЧто сверитьЭталонПричина расхожденияДействие
Полнота обходаЧисло и состав URL по шаблонамПрисутствуют все ожидаемые разделыНет стартовой ссылки, мешает Include/Exclude или robots.txtОткрыть Inlinks и конфигурацию, повторить малую выборку
Зеркало и протоколХост, HTTP/HTTPS, слэшОдин согласованный вариант URLКраулер стартовал с неканонического зеркалаИсправить стартовый адрес и проверить редиректы
Коды ответаResponse Code и Redirect URLЦелевые страницы — 200; переносы ведут прямо на конечный URLЦепочки, циклы, временный ответ сервераПроверить вручную и исправить маршрут
CanonicalCanonical Link Element 1 и статусОдин ожидаемый канонический URLОтносительный, отсутствующий или конфликтующий canonicalИсправить шаблон и внутренние ссылки
ИндексируемостьIndexability и причинаСостояние соответствует назначению страницыnoindex, robots или canonical применены не к тому шаблонуНайти источник директивы и согласовать правило
Внутренние ссылкиInlinks, глубина, тип ссылкиВажные URL доступны обычными ссылкамиСсылка только в JS-событии или страница-сиротаДобавить <a href> и связать с архитектурой
РендерингИсходный и rendered HTMLКлючевые элементы совпадают по смыслуТекст, ссылка или метаданные появляются/исчезают после JSИсправить серверную отдачу или клиентский рендеринг

Порядок анализа результатов

Начинайте с системных ограничений: недоступность разделов, ошибки сервера, конфликт robots/noindex/canonical, сломанные редиректы и потеря ссылок. Затем переходите к дублям, метатегам, глубине, изображениям и содержимому.

Каждую проблему группируйте по причине и шаблону. Сто одинаковых ошибок на карточках товара — это одна задача к компоненту, а не сто независимых задач. В выгрузке сохраняйте пример URL, затронутый шаблон, правило обнаружения, приоритет, владельца и критерий приёмки.

Почему одинаковый график может означать разные действия

Рост числа исключённых или недоступных URL сам по себе не является диагнозом. Если он совпал со снятием устаревших страниц и корректными редиректами, это ожидаемое изменение. Если тот же сигнал появился после релиза маршрутизации и затронул целевые категории, это инцидент. Если количество изменилось только в краулере, а консоли и ручная выборка не подтверждают проблему, сначала проверяют конфигурацию сбора.

Вывод строится по цепочке: какой источник изменился, какие шаблоны затронуты, что произошло с кодом ответа и директивами, было ли изменение запланировано и какое действие восстанавливает ожидаемое состояние.

Расширенные сценарии

Custom Extraction подходит для полей, которых нет в стандартных вкладках: наличие цены, автора, даты, идентификатора товара или блока характеристик. Custom Search помогает найти фрагменты кода и текста. Сравнение обходов полезно после миграции и релиза, но только если конфигурация, область и условия запроса совпадают.

Интеграции с поисковыми консолями и аналитикой дополняют crawl реальными показами, переходами и поведением. Они не исправляют ошибки автоматически и требуют проверки периода, прав доступа, фильтров и соответствия URL.

Как превратить экспорт в задачи

Вместо списка «все URL с проблемой» оформляйте задачу так:

наблюдение и поле Screaming Frog;

затронутый шаблон и правило отбора;

подтверждение ручной проверкой;

ожидаемое техническое состояние;

изменение в источнике или компоненте;

контрольная выборка и полный повторный crawl;

условие закрытия и отката.

Бесплатная и платная версия

Для небольшой точечной проверки достаточно базового обхода. Крупные сайты, сохранение проектов, интеграции, расширенная конфигурация и JavaScript-рендеринг требуют возможностей полной версии. Выбор лицензии не влияет на методику: сначала задаётся вопрос, затем конфигурация, контроль качества и только после этого анализ.

Приёмочный чек-лист

область обхода соответствует задаче;

ключевые шаблоны присутствуют в выборке;

robots.txt и user-agent зафиксированы;

HTML- и JavaScript-режимы не смешаны без пояснения;

ошибки подтверждены ручной проверкой;

задачи сгруппированы по причине, а не по числу URL;

после исправления повторён тот же сценарий.

Итог

Screaming Frog полезен тогда, когда обход воспроизводим, а каждое наблюдение связано с назначением страницы и конкретным действием. Экспорт без проверки конфигурации — это набор строк, а не технический аудит.

Получите бесплатный аудит и стратегию роста

Изучим сайт, покажем точки роста и подготовим прогноз до квалифицированных лидов и оборота из SEO/GEO.