К содержанию

Главная · Блог · Screaming Frog SEO Spider: технический обход сайта

Оставить заявку

Новый формат

Screaming Frog SEO Spider: технический обход сайта

Screaming Frog SEO Spider — десктопный краулер: обходит ваш сайт как робот и собирает URL, статусы, мета, заголовки, ссылки и вес страниц. Бесплатная версия закрывает базовый аудит; платная снимает лимит URL и даёт интеграции.

Ниже — ключевые настройки Spider, как читать отчёты и что править по результатам. Методология аудита целиком — в каноне про технический SEO-аудит; здесь фокус на инструменте. Обходите свои проекты или сайты, где есть разрешение; не устраивайте DDoS скоростью краула.

Поделиться
Telegram VK

Зачем краулер и с чего начать

Краулер находит то, что глаз пропускает: 404 в меню, дубли title, пустые HTML, тяжёлые картинки, странные URL. Запускайте после крупных релизов и планово раз в период.

Укажите стартовый URL (лучше https канона), дождитесь стабилизации очереди. Экспортируйте вкладки в CSV/Excel — так удобнее раздавать задачи разработке.

Перед стартом:

  • доступ к своему сайту / разрешение;
  • понятный канонический хост;
  • сниженная скорость на слабом сервере;
  • план: что смотрим в первую очередь.

Технический SEO-аудит

Проверьте себя

Мини-тест: Screaming Frog

Два вопроса.

1 Screaming Frog в первую очередь…
2 Много No Response при крауле…

Настройки Spider: Basic, Limits, Advanced

Configuration → Spider: исключите ненужные типы ресурсов, если аудируете HTML (старый Flash/SWF точно не нужен). Limits: ограничение глубины (Search Depth) спасает на огромных каталогах — сначала ключевые ветки.

Include/Exclude — обход только `/blog/` или исключение `/cart/`, фильтров с бесконечными URL. Preferences: пороги длины title, H1, description, URL, alt — под ваши ТЗ, не как «закон Google».

Практичный минимум настроек:

  • разумная скорость / число потоков;
  • глубина или сегмент Include;
  • учёт/игнор robots по задаче;
  • пороги длины мета для фильтров;
  • проверка No Response после прогона.

Коды ответа, мета и дубли

Response Codes: соберите 4xx/5xx, цепочки редиректов, Unexpected. Много No Response — снизьте скорость и перезапустите. Internal → HTML: смотрите title, meta description, H1/H2, дубли и пропуски.

Дубли URL — фильтр Duplicate. Пустые страницы — низкий Word Count при 200 OK. Не закрывайте всё в robots «чтобы скрыть»: лучше 301/удаление/нормальный канон. Длина title/description — ориентир сниппета, не магия позиций.

Первый проход отчёта:

  • 4xx / 5xx внутри сайта;
  • пропуски title / H1;
  • дубли title и description;
  • дубли URL;
  • тонкий/нулевой контент.

Битые ссылки Дубли страниц Канонический тег

Картинки, вес страниц, перелинковка

Images: тяжёлые файлы и Missing Alt. Сжимайте и задавайте осмысленный alt — см. канон про alt. Size / Response Time во Internal помогают найти «кирпичи», но абсолютные пороги вроде «строго 200 КБ HTML / 6 секунд» устарели: смотрите Core Web Vitals и реальные устройства.

Inlinks / Outlinks: важные URL должны быть достижимы с главной за разумное число кликов и не быть «островками». Исходящий спам и битые внешние — вкладка External по статус-кодам.

Что вынести в задачи:

  • картинки > разумного веса;
  • пустые alt на информационных img;
  • страницы с аномальным TTFB/размером;
  • сироты без внутренних ссылок;
  • битые external.

Alt и title у img Размер страницы

URL: дефисы, длина, динамика

Вкладка URL: Non-ASCII, underscores, dynamic (`?`, `&`), слишком длинные адреса, дубли. Дефисы предпочтительнее `_` в ЧПУ; кириллица в URL возможна, но команде проще латиница — решайте стандартом проекта.

Любое изменение URL — с 301 на новый канон и правкой внутренних ссылок. Иначе краулер через месяц снова покажет те же 404.

Фильтры URL worth checking:

  • Duplicate;
  • Underscores;
  • Non ASCII;
  • Over N characters;
  • Parameters / Dynamic.

URL-адрес Редирект

Как встроить обход в работу

Сделайте чеклист: обход → выгрузка → приоритеты (5xx/404 → дубли → мета → вес) → тикеты → повторный краул. Screaming Frog закрывает технический слой; семантика, контент и ссылки снаружи — другие этапы.

Подготовка и правки — дни/недели. Рост видимости по ядру после устранения блокеров — от месяца к месяцу, планово 2–6 месяцев. Не обещайте «ТОП после одного прогона Frog».

Ритм:

  • краул после релиза;
  • плановый раз в месяц/квартал;
  • архив CSV к тикетам;
  • повторная проверка закрытых багов.

Самостоятельное SEO Парсинг: границы

Практика

Чеклист прогона Screaming Frog

После релиза или планового аудита.

0 / 8 готово

Частые вопросы

Хватит ли бесплатной версии?

Для небольших сайтов — часто да. На крупных каталогах упираетесь в лимит URL: тогда платная лицензия, сегментный обход Include/Exclude или выгрузка списка URL.

Нужно ли отключать JS и CSS?

Для классического HTML-аудита иногда исключают тяжёлые ассеты, чтобы ускорить обход. Если важны JS-шаблоны и клиентский рендер — учитывайте режим рендеринга в актуальной версии.

Можно ли игнорировать robots.txt?

На своём стейдже — да, если закрыты служебные разделы. На проде сначала поймите, почему URL закрыты, а не открывайте всё краулером «на удачу».

Screaming Frog заменяет SEO-аудит?

Нет. Это сбор техники. Дальше — приоритеты, контент, юзабилити, семантика. См. статью про технический SEO-аудит.

Какая скорость краула безопасна?

Такая, чтобы сервер не сыпал 5xx и No Response. На слабом хостинге снижайте threads/скорость. Свои визиты в аналитике на время аудита можно фильтровать.

Что делать с дублями title?

Уникализировать шаблоны или склеить дубли 301/canonical. Массовые одинаковые title — сигнал тонких/шаблонных страниц.

Битые внешние ссылки критичны?

Внешние 404 портят UX и доверие. Чините или убирайте. Внутренние битые — в приоритете выше.

Аудит = ТОП за неделю?

Нет. Обход и правки — подготовка. Позиции по ядру нарастают от месяца к месяцу; планово 2–6 месяцев после старта работ.

Нужен технический обход сайта?

Прогоним Screaming Frog: статусы, мета, дубли и битые URL — с приоритетами правок.

Обсудить задачу