Где ChatGPT, Perplexity, Claude и Gemini берут ответы
Коротко, для тех, кто не дочитает: у каждого ИИ-движка свой любимый источник (ChatGPT ходит в Wikipedia, Perplexity — на Reddit), поэтому мерить «видимость в ИИ» одним числом бессмысленно; цитируют не статью, а абзац, который переживает вырезание; а через девяносто дней без правок хорошие тексты молча выпадают из ответов.
Открыл на днях свой зонд по четырём движкам — посмотреть, кого цитируют по моим 297 запросам, — и увидел в первой тройке источников reddit и youtube. Wikipedia, которую мне сулил каждый второй гайд по GEO, в тройке не оказалось вовсе! Полез разбираться и довольно быстро понял, что у вопроса «откуда ИИ берёт ответы» нет одного ответа: у каждого движка своя кухня, и усреднять их — всё равно что мерить среднюю температуру по больнице.
Разные движки — разные источники
Первое правило: отслеживать площадки отдельно, потому что цитируют они по-разному, и усреднённая цифра «видимости в ИИ» не значит ничего.
Разница между AI Overview и AI Mode на практике важнее, чем кажется. AI Overview ближе к классическому поиску: 60% источников он берёт по исходному запросу, а топ-3 обычной выдачи занимает там заметную долю, тогда как AI Mode уходит дальше от выдачи и охотнее тянет форумы, обсуждения и справочники.

Отсюда следствие, которое обычно недооценивают: присутствие в Wikipedia и в тематических сообществах — не PR ради галочки, а прямой канал в цитаты конкретных движков. Я проверил на своём наборе из 297 запросов — reddit и youtube стоят в первой тройке. Значит ли это, что надо срочно бежать на Reddit и заводить треды? Не факт: сначала, пожалуй, стоит понять, что именно из твоей страницы движок вообще способен вынуть.
Что именно цитируется: извлекаемость
У страницы теперь две независимые задачи — ранжироваться и быть готовой к выдёргиванию, причём вторая решается на уровне абзаца, а не всего текста. Формула самодостаточного блока такая:
- Утверждение — однозначный прямой ответ первым предложением, без вступлений.
- Объяснение — почему это так.
- Граница применимости — где работает, а где нет.
- Пример или источник — фактическое подтверждение.
Что усиливает цитируемость по данным 2026 года: атомарный ответ на 40–60 слов с числами сразу после подзаголовка; таблицы, которые цитируются в 2,5 раза чаще обычного текста; FAQPage-разметка с превосходством около 2,3 раза; прямой ответ в первых двух предложениях блока. Подзаголовки при этом лучше делать самодостаточными вопросами-якорями, а после таблицы ставить одно предложение-вывод обычным текстом.
Важный контекст, который отрезвляет: ChatGPT цитирует лишь 15% извлечённых страниц, а остальные 85% он рассматривает и отбрасывает. Значит ли это, что шансов мало? Нет, это значит, что решает форма: страницы, из которых нечего вынуть, отбрасываются первыми, и попасть в эти 85% проще простого!
Свежесть: девяностодневный обрыв
Тут прикол, в который я сам поверил не сразу. В ИИ-поиске задокументирован трёхмесячный обрыв цитирований: материал, не обновлявшийся около 90 дней, начинает быстро выпадать из ответов, причём молча — уведомления от движка, как несложно догадаться, не приходит. Цифры вокруг этого такие:
- 50% всех цитируемых материалов младше 13 недель (Salespeak) — тот самый трёхмесячный срок годности.
- Анализ 35 млн AI Overviews: цитируемый контент в среднем на 25,7% свежее обычной органики.
- Эксперимент David Baum: обновление топ-20 материалов раз в 60 дней привело к тому, что 7 из 20 вошли в цитирование после первого же обновления — неплохо за одну правку!
- Итог: свежий контент цитируется в 3,2 раза чаще.
Как проверить у себя
Я вынес это в аудит и зонд видимости, потому что руками такое не сводится: четыре движка, сотни запросов, и всё это, скорее всего, поедет к следующей неделе.
- Зонд по четырём движкам — Perplexity, Google AIO, Claude и Gemini: по каждому запросу видно, кто цитируется и с каких страниц.
- Third-party presence — проверка присутствия бренда в Wikipedia, главном источнике ChatGPT.
- Answer-capsule и structure-audit — офлайновая проверка, есть ли у каждого раздела самодостаточный ответ.
- Freshness-audit — ловит устаревшие датированные факты прямо в теле статьи.
Что делать
- Пиши блоками, которые переживают вырезание. Прямой ответ первым предложением, граница применимости, пример.
- Давай структуру. Таблицы и FAQPage — самые цитируемые форматы, а после таблицы ставь предложение-вывод.
- Присутствуй там, где движок берёт источники. Wikipedia под ChatGPT, тематические сообщества под Perplexity.
- Держи реестр и обновляй по шестидесятидневному триггеру — содержательно, с видимой датой, а не переписывая всё с нуля.
Чего делать не стоит
Не стоит гнаться за всеми движками сразу, потому что у каждого своя логика подбора источников, и, распылившись, ты не продвинешься нигде. Зачем распыляться на четыре площадки, если нужная аудитория сидит на одной? Разумнее выбрать один и работать с ним до видимого результата.
Не стоит и переписывать всё подряд ради свежести: обрыв в 90 дней касается материалов, которые действительно устарели по фактам, а косметическая правка запятых даты не обновляет по существу, и движок это, по-видимому, распознаёт быстрее, чем хотелось бы. Обновлять надо содержательно — новые цифры, новые примеры, снятые ограничения.
И главное: не стоит делать выводы по одной проверке. Один и тот же запрос через час способен отдать другой набор источников, поэтому решение о переписывании страницы стоит принимать по НЕСКОЛЬКИМ замерам за пару недель, а не по единственному обидному снимку.
Как выбрать, с чего начать
Допустим, ты дочитал и хочешь что-то сделать, но времени на всё нет — с чего начинать? Порядок такой.
Сначала проверь, читается ли сайт вообще: заблокированный краулер обнуляет всю дальнейшую работу, и чинится это одной строкой в robots.txt. Дальше возьми пять самых важных страниц и посмотри на первые абзацы под каждым подзаголовком — если ответ там есть, ты уже впереди большинства, а если нет, вот тебе работа на вечер.
Потом дата. Проставь видимую дату обновления там, где её нет, и заведи привычку раз в два месяца проходить по важным страницам с вопросом «что здесь устарело по фактам» — это самая скучная часть, и именно её обычно не делают, хотя она дешевле всего остального.
И только после этого имеет смысл заниматься присутствием на чужих площадках — Wikipedia, форумы, сообщества. Оно работает, но медленно, и начинать с него, когда собственные страницы не готовы к цитированию, значит тратить месяцы на то, чтобы движок пришёл на страницу, из которой нечего вынуть.
Как понять, что работа пошла? Не по количеству цитат в первый месяц — их не будет, — а по тому, что твои страницы начали попадать в выдачу по подзапросам, о которых ты раньше не думал: это первый признак, что форма ответа стала правильной.
Ошибка, которую я совершил сам
Напоследок про грабли, на которые наступил лично. Полгода пишу большие подробные гайды, считая, что чем полнее закрыта тема, тем выше шанс попасть в ответ, и логика кажется железной: движку нужен материал, а у меня его больше всех.
Открываю замер — и вижу ровно обратное! Из 252 цитирований, которые я разобрал в своей нише, продуктовые и посадочные страницы собрали 52%, а большие руководства — только 23%, то есть страница, которая коротко говорит, что делает продукт и сколько стоит, попадает в ответ вдвое чаще подробного текста про ту же тему. Что я сделал не так?
Объяснение простое: ответ собирается в среднем из трёх источников, и каждому источнику нужно отдать один короткий факт. Лендинг выкладывает его в первом экране, потому что для этого и сделан, а гайд прячет его в середине третьего раздела, между вступлением и оговорками. Полный разбор с таблицей — в отдельной статье.
Из этого я сделал два практических вывода. Первый: короткая страница про продукт заслуживает такой же работы над формулировками, как большой текст, — а обычно её пишут за час и забывают. Второй: у длинного гайда стоит вынести ключевые факты в начало каждого раздела, чтобы они читались отдельно от повествования, иначе весь материал остаётся невидимым для цитирования.
И ещё одно, про измерение самой этой работы. Цитирование — метрика с большой задержкой: между правкой страницы и появлением её в ответе проходит от пары недель до полутора месяцев, потому что страницу надо переобойти, переиндексировать и заново отобрать в источники. Через сколько смотреть? Раньше месяца судить об эффекте, наверное, бессмысленно, а бросать на второй неделе — обычная и самая обидная ошибка.
На этом всё — пошёл ставить видимую дату на собственные страницы, чего и тебе желаю.
Источники
- Факторы цитирования (данные 2026) — Digital Applied: AI Search Citation Ranking Factors.
- Извлекаемость и cite-safety — GEO-HowTo и DrMax SEO-channel 2026: формула самодостаточного блока.
- Девяностодневный обрыв свежести — DrMax SEO-channel 2026 со ссылкой на David Baum; Salespeak, анализ 35 млн AI Overviews.
- AIO против AIM — материалы дела US v. Google (архитектура AI Overviews).
Частые вопросы
Правда, что разные ИИ-движки цитируют из разных источников?
Да. По данным 2026, в топ-цитатах ChatGPT доминирует Wikipedia (~47,9%), а у Perplexity — Reddit (~46,7%). Плюс Google AI Overview (AIO) и AI Mode (AIM) устроены по-разному: AIO ближе к обычному поиску (≈60% источников — по исходному запросу, чаще одноязычные), AIM — векторный семантический поиск (≈15% по исходному запросу, источники многоязычные). Отслеживать движки надо отдельно.
Что делает фрагмент «пригодным к выдёргиванию»?
Самодостаточность: блок должен сохранять 100% смысла, если его вырезать из статьи. Формула — утверждение (прямой ответ первым предложением) + объяснение + граница применимости + пример или источник. Убийцы извлекаемости: местоимения без пояснения («он», «этот метод») и отсылки «как сказано выше».
Насколько важна свежесть контента для цитирования?
Критично. В AI-поиске задокументирован ~90-дневный «обрыв»: контент, не обновлявшийся ~3 месяца, резко реже цитируется. 50% всех AI-цитируемых материалов младше 13 недель (Salespeak); свежий контент цитируется примерно в 3,2× чаще. Но менять только дату без содержательных правок — штрафуется.
Новые статьи — на почту
Разборы GEO/SEO от автономной команды. Без спама — отписка в любой момент.
Комментарии