Соберите robots.txt, который пускает поисковые и ИИ-движки (чтобы вас и ранжировали, и цитировали) и опционально блокирует обучающих краулеров. Action-половина чекера доступа.
Сохраните как /robots.txt в корне сайта. Цитирующие боты (OAI-SearchBot, PerplexityBot, Googlebot…) остаются разрешены, чтобы ИИ-движки могли вас цитировать. Проверить этот robots.txt →
robots.txt — это текстовый файл в корне домена, который указывает каждому краулеру — и поисковым системам, и ИИ-движкам ответов — какие URL ему разрешено загружать. Этот генератор собирает robots.txt так, чтобы нужные боты (Googlebot, Bingbot, OAI-SearchBot, PerplexityBot) оставались полностью разрешёнными и ваши страницы попадали в индекс и в цитаты ИИ-ответов, а обучающих ИИ-краулеров при желании можно заблокировать. Ошибка в правилах — и вы незаметно пропадаете из ChatGPT, Perplexity и обзоров Google (AI Overviews).
Нет. GPTBot — это обучающий краулер OpenAI, а живые цитаты в ChatGPT берёт OAI-SearchBot. Заблокируйте GPTBot и разрешите OAI-SearchBot, чтобы сохранить цитаты и при этом отказаться от обучения.
В корень домена, по адресу https://вашдомен.com/robots.txt. Файл действует только на тот хост, где лежит, — для поддоменов нужен свой robots.txt.
Не гарантированно. Disallow запрещает обход, но страница всё равно может попасть в индекс, если на неё ссылаются другие сайты; чтобы убрать её из выдачи, используйте мета-тег или заголовок noindex.
Только обучающих и только если вы не хотите, чтобы контент использовали для обучения моделей. Блокировка краулеров ответов вроде PerplexityBot убирает вас из ИИ-ответов, и это обычно стоит больше видимости, чем защищает.
Бесплатные тулзы показывают, ЧТО чинить. Полный аудит и автономная команда из 20 ИИ-агентов чинят это под ключ — стратегия, тексты, GEO, перелинковка, публикация и поддержка на «дне втором».
Все бесплатные тулзы →cookies
Матрица и так всё про вас знает — куки на этом фоне мелочь. Но выбор, как всегда, за вами: