Страница может пройти все on-page аудиты и всё равно быть выкинута из Google и AI-ответов через noindex. Вставьте URL — проверим meta-robots, X-Robots-Tag, canonical и доступ в robots.txt для Googlebot и AI-ботов цитирования.
Индексируемость — это разрешено ли поисковикам и AI-краулерам вообще индексировать страницу и показывать её в выдаче; ею управляют мета-тег robots, HTTP-заголовок X-Robots-Tag, canonical и правила robots.txt. Страница может быть в sitemap, быстро грузиться и проходить любой контент-аудит, но одна директива noindex убирает её из Google — и из тех AI-движков, что опираются на поисковый индекс. Проверка запрашивает страницу от имени Googlebot и AI-ботов (GPTBot, PerplexityBot, ClaudeBot) и показывает каждую директиву, которая блокирует или перенаправляет индексацию.
Визуально исправная страница может нести директиву noindex в мета-теге или заголовке X-Robots-Tag либо быть закрыта в robots.txt; проверка покажет, что именно сработало.
robots.txt определяет, можно ли краулеру загрузить страницу, а noindex разрешает загрузку, но запрещает индексировать. При этом странице, закрытой в robots.txt, нельзя даже передать noindex, поэтому лишний Disallow способен оставить URL в индексе без сниппета.
Они подчиняются собственным user-agent'ам в robots.txt (GPTBot, PerplexityBot, ClaudeBot, Google-Extended), поэтому индексируемая Google страница может быть невидима для AI-ответов — инструмент проверяет каждого бота отдельно.
Напрямую нет, но canonical на другой URL говорит движкам индексировать тот адрес вместо этого, так что неверный canonical способен фактически убрать из индекса нужную страницу.
Бесплатные тулзы показывают, ЧТО чинить. Полный аудит и автономная команда из 20 ИИ-агентов чинят это под ключ — стратегия, тексты, GEO, перелинковка, публикация и поддержка на «дне втором».
Все бесплатные тулзы →cookies
Матрица и так всё про вас знает — куки на этом фоне мелочь. Но выбор, как всегда, за вами: