Новый формат
Проверка индексации сайта в Google и Яндексе
Индексация — попадание URL в базу поиска, из которой строится выдача. Обход (сканирование) роботом быстрее и не гарантирует, что страница останется в индексе.
Ниже — как проверить статус в кабинетах вебмастеров, через `site:` и смежные инструменты, и что чинить при провалах. Не весь сайт обязан быть в индексе: служебное закрывают отдельно. Интерфейс Вебмастера/GSC меняется — важнее смысл отчётов.
Кабинеты вебмастеров
Яндекс Вебмастер и Google Search Console — главный источник правды для владельца: страницы в поиске / покрытие индекса, исключения, ошибки обхода, динамика.
Подтвердите права на сайт, смотрите список проиндексированных/исключённых URL и причины (noindex, soft 404, дубль, обнаружено — не проиндексировано и т.п. — формулировки плавают). История индексации помогает ловить внезапные провалы.
Что проверить в первую очередь:
- главная и ключевые посадочные в индексе;
- ошибки обхода 4xx/5xx;
- sitemap принят;
- нет массового noindex;
- динамика «было → стало» за период.
Оператор site: и точечная проверка URL
В строке поиска: `site:example.com` — грубая картина проиндексированных URL. Сравнение Яндекс vs Google при огромном разрыве — повод копать технику и качество.
Конкретную страницу проверяйте вставкой полного URL или `site:` + путь. Пустая выдача не всегда «навсегда вне индекса»: задержки, региональность, сброс кэша. Для решения — инспекция URL в GSC / проверка страницы в Вебмастере.
Быстрые проверки:
- `site:domain` в обоих поисковиках;
- точный URL страницы;
- брендовый запрос на главную;
- сверка с кабинетом вебмастера.
Расширения и сервисы мониторинга
SEO-расширения браузера ускоряют взгляд на title, meta robots, canonical и быстрый `site:`. Не заменяют вебмастер и не дают «секретных» данных поисковика.
Краулеры и SEO-платформы полезны для массовой проверки: robots, sitemap, коды ответа, дубли. Бесплатного «всего и сразу» почти нет — выбирайте под объём сайта.
Почему страницы плохо индексируются
Новый сайт или новый раздел — нормальная задержка. Ускоряют: внутренние ссылки, sitemap, качественный контент, запросы на переобход. Гарантий «за N дней» нет.
Типичные блокеры: Disallow в robots.txt, meta robots noindex, ошибка CMS «закрыть сайт», дубли и тонкий контент, 4xx/5xx, медленный ответ сервера, потерянные каноникалы.
Чеклист причин:
- robots.txt и meta robots;
- sitemap и внутренние ссылки;
- коды ответа ключевых URL;
- дубли и canonical;
- качество и уникальность контента;
- ошибки в Вебмастере/GSC.
Индекс есть — трафика нет
Страница в индексе может стоять на дальних местах или не совпадать с спросом. Тогда правят контент, сниппеты, структуру и ссылки — не «ещё раз нажать переобход» бесконечно.
Следите за динамикой: резкое падение числа URL в индексе — сигнал аварии (noindex, бан-зеркало, массовые 404), а не повод радоваться «чистке» без анализа.
Что запомнить
Проверка индексации = вебмастер + выборочный `site:` + понимание причин исключений. Обход ≠ гарантия индекса.
Чините доступность и указания роботам, затем контент и спрос. Индекс — база, не финиш SEO.
Частые вопросы
Обход и индексация — одно?
Нет. Робот может зайти и не положить URL в индекс (качество, дубль, noindex, недоступность).
site: показывает точное число страниц?
Ориентир порядка величины, не бухгалтерия. Точнее — отчёты Вебмастера и Search Console.
Новый сайт не в индексе — паника?
Сначала проверьте доступность, sitemap, robots и запросы на переобход. Сроки у разных проектов разные; «ровно две недели» не закон.
Всё в индексе, а трафика нет?
Индекс ≠ позиции и клики. Смотрите спрос, сниппеты, конкуренцию и контент. ТОП по ядру — планово месяцы работ.
Нужно индексировать всё?
Нет. Фильтры, корзины, личные кабинеты часто закрывают. См. материал про закрытие от индексации.
Не ясно, в индексе ли страницы?
Сверим Вебмастер, GSC и site: — и найдём, что блокирует обход.
Обсудить задачу