seo·matrix
← Все статьи

Где ChatGPT, Perplexity, Claude и Gemini берут ответы

· 7 мин чтения · Автор Михаил Кузьмицкий

GEOAEOextractabilityцитируемость

Markdown-версия ↗

Коротко, для тех, кто не дочитает: у каждого ИИ-движка свой любимый источник (ChatGPT ходит в Wikipedia, Perplexity — на Reddit), поэтому мерить «видимость в ИИ» одним числом бессмысленно; цитируют не статью, а абзац, который переживает вырезание; а через девяносто дней без правок хорошие тексты молча выпадают из ответов.

Открыл на днях свой зонд по четырём движкам — посмотреть, кого цитируют по моим 297 запросам, — и увидел в первой тройке источников reddit и youtube. Wikipedia, которую мне сулил каждый второй гайд по GEO, в тройке не оказалось вовсе! Полез разбираться и довольно быстро понял, что у вопроса «откуда ИИ берёт ответы» нет одного ответа: у каждого движка своя кухня, и усреднять их — всё равно что мерить среднюю температуру по больнице.

Разные движки — разные источники

Первое правило: отслеживать площадки отдельно, потому что цитируют они по-разному, и усреднённая цифра «видимости в ИИ» не значит ничего.

Разница между AI Overview и AI Mode на практике важнее, чем кажется. AI Overview ближе к классическому поиску: 60% источников он берёт по исходному запросу, а топ-3 обычной выдачи занимает там заметную долю, тогда как AI Mode уходит дальше от выдачи и охотнее тянет форумы, обсуждения и справочники.

Где ChatGPT, Perplexity, Claude и Gemini берут ответы

Отсюда следствие, которое обычно недооценивают: присутствие в Wikipedia и в тематических сообществах — не PR ради галочки, а прямой канал в цитаты конкретных движков. Я проверил на своём наборе из 297 запросов — reddit и youtube стоят в первой тройке. Значит ли это, что надо срочно бежать на Reddit и заводить треды? Не факт: сначала, пожалуй, стоит понять, что именно из твоей страницы движок вообще способен вынуть.

Что именно цитируется: извлекаемость

У страницы теперь две независимые задачи — ранжироваться и быть готовой к выдёргиванию, причём вторая решается на уровне абзаца, а не всего текста. Формула самодостаточного блока такая:

  • Утверждение — однозначный прямой ответ первым предложением, без вступлений.
  • Объяснение — почему это так.
  • Граница применимости — где работает, а где нет.
  • Пример или источник — фактическое подтверждение.

Что усиливает цитируемость по данным 2026 года: атомарный ответ на 40–60 слов с числами сразу после подзаголовка; таблицы, которые цитируются в 2,5 раза чаще обычного текста; FAQPage-разметка с превосходством около 2,3 раза; прямой ответ в первых двух предложениях блока. Подзаголовки при этом лучше делать самодостаточными вопросами-якорями, а после таблицы ставить одно предложение-вывод обычным текстом.

Важный контекст, который отрезвляет: ChatGPT цитирует лишь 15% извлечённых страниц, а остальные 85% он рассматривает и отбрасывает. Значит ли это, что шансов мало? Нет, это значит, что решает форма: страницы, из которых нечего вынуть, отбрасываются первыми, и попасть в эти 85% проще простого!

Свежесть: девяностодневный обрыв

Тут прикол, в который я сам поверил не сразу. В ИИ-поиске задокументирован трёхмесячный обрыв цитирований: материал, не обновлявшийся около 90 дней, начинает быстро выпадать из ответов, причём молча — уведомления от движка, как несложно догадаться, не приходит. Цифры вокруг этого такие:

  • 50% всех цитируемых материалов младше 13 недель (Salespeak) — тот самый трёхмесячный срок годности.
  • Анализ 35 млн AI Overviews: цитируемый контент в среднем на 25,7% свежее обычной органики.
  • Эксперимент David Baum: обновление топ-20 материалов раз в 60 дней привело к тому, что 7 из 20 вошли в цитирование после первого же обновления — неплохо за одну правку!
  • Итог: свежий контент цитируется в 3,2 раза чаще.

Как проверить у себя

Я вынес это в аудит и зонд видимости, потому что руками такое не сводится: четыре движка, сотни запросов, и всё это, скорее всего, поедет к следующей неделе.

  • Зонд по четырём движкам — Perplexity, Google AIO, Claude и Gemini: по каждому запросу видно, кто цитируется и с каких страниц.
  • Third-party presence — проверка присутствия бренда в Wikipedia, главном источнике ChatGPT.
  • Answer-capsule и structure-audit — офлайновая проверка, есть ли у каждого раздела самодостаточный ответ.
  • Freshness-audit — ловит устаревшие датированные факты прямо в теле статьи.

Что делать

  1. Пиши блоками, которые переживают вырезание. Прямой ответ первым предложением, граница применимости, пример.
  2. Давай структуру. Таблицы и FAQPage — самые цитируемые форматы, а после таблицы ставь предложение-вывод.
  3. Присутствуй там, где движок берёт источники. Wikipedia под ChatGPT, тематические сообщества под Perplexity.
  4. Держи реестр и обновляй по шестидесятидневному триггеру — содержательно, с видимой датой, а не переписывая всё с нуля.

Чего делать не стоит

Не стоит гнаться за всеми движками сразу, потому что у каждого своя логика подбора источников, и, распылившись, ты не продвинешься нигде. Зачем распыляться на четыре площадки, если нужная аудитория сидит на одной? Разумнее выбрать один и работать с ним до видимого результата.

Не стоит и переписывать всё подряд ради свежести: обрыв в 90 дней касается материалов, которые действительно устарели по фактам, а косметическая правка запятых даты не обновляет по существу, и движок это, по-видимому, распознаёт быстрее, чем хотелось бы. Обновлять надо содержательно — новые цифры, новые примеры, снятые ограничения.

И главное: не стоит делать выводы по одной проверке. Один и тот же запрос через час способен отдать другой набор источников, поэтому решение о переписывании страницы стоит принимать по НЕСКОЛЬКИМ замерам за пару недель, а не по единственному обидному снимку.

Как выбрать, с чего начать

Допустим, ты дочитал и хочешь что-то сделать, но времени на всё нет — с чего начинать? Порядок такой.

Сначала проверь, читается ли сайт вообще: заблокированный краулер обнуляет всю дальнейшую работу, и чинится это одной строкой в robots.txt. Дальше возьми пять самых важных страниц и посмотри на первые абзацы под каждым подзаголовком — если ответ там есть, ты уже впереди большинства, а если нет, вот тебе работа на вечер.

Потом дата. Проставь видимую дату обновления там, где её нет, и заведи привычку раз в два месяца проходить по важным страницам с вопросом «что здесь устарело по фактам» — это самая скучная часть, и именно её обычно не делают, хотя она дешевле всего остального.

И только после этого имеет смысл заниматься присутствием на чужих площадках — Wikipedia, форумы, сообщества. Оно работает, но медленно, и начинать с него, когда собственные страницы не готовы к цитированию, значит тратить месяцы на то, чтобы движок пришёл на страницу, из которой нечего вынуть.

Как понять, что работа пошла? Не по количеству цитат в первый месяц — их не будет, — а по тому, что твои страницы начали попадать в выдачу по подзапросам, о которых ты раньше не думал: это первый признак, что форма ответа стала правильной.

Ошибка, которую я совершил сам

Напоследок про грабли, на которые наступил лично. Полгода пишу большие подробные гайды, считая, что чем полнее закрыта тема, тем выше шанс попасть в ответ, и логика кажется железной: движку нужен материал, а у меня его больше всех.

Открываю замер — и вижу ровно обратное! Из 252 цитирований, которые я разобрал в своей нише, продуктовые и посадочные страницы собрали 52%, а большие руководства — только 23%, то есть страница, которая коротко говорит, что делает продукт и сколько стоит, попадает в ответ вдвое чаще подробного текста про ту же тему. Что я сделал не так?

Объяснение простое: ответ собирается в среднем из трёх источников, и каждому источнику нужно отдать один короткий факт. Лендинг выкладывает его в первом экране, потому что для этого и сделан, а гайд прячет его в середине третьего раздела, между вступлением и оговорками. Полный разбор с таблицей — в отдельной статье.

Из этого я сделал два практических вывода. Первый: короткая страница про продукт заслуживает такой же работы над формулировками, как большой текст, — а обычно её пишут за час и забывают. Второй: у длинного гайда стоит вынести ключевые факты в начало каждого раздела, чтобы они читались отдельно от повествования, иначе весь материал остаётся невидимым для цитирования.

И ещё одно, про измерение самой этой работы. Цитирование — метрика с большой задержкой: между правкой страницы и появлением её в ответе проходит от пары недель до полутора месяцев, потому что страницу надо переобойти, переиндексировать и заново отобрать в источники. Через сколько смотреть? Раньше месяца судить об эффекте, наверное, бессмысленно, а бросать на второй неделе — обычная и самая обидная ошибка.

На этом всё — пошёл ставить видимую дату на собственные страницы, чего и тебе желаю.

Источники

  • Факторы цитирования (данные 2026) — Digital Applied: AI Search Citation Ranking Factors.
  • Извлекаемость и cite-safety — GEO-HowTo и DrMax SEO-channel 2026: формула самодостаточного блока.
  • Девяностодневный обрыв свежести — DrMax SEO-channel 2026 со ссылкой на David Baum; Salespeak, анализ 35 млн AI Overviews.
  • AIO против AIM — материалы дела US v. Google (архитектура AI Overviews).

Частые вопросы

Правда, что разные ИИ-движки цитируют из разных источников?

Да. По данным 2026, в топ-цитатах ChatGPT доминирует Wikipedia (~47,9%), а у Perplexity — Reddit (~46,7%). Плюс Google AI Overview (AIO) и AI Mode (AIM) устроены по-разному: AIO ближе к обычному поиску (≈60% источников — по исходному запросу, чаще одноязычные), AIM — векторный семантический поиск (≈15% по исходному запросу, источники многоязычные). Отслеживать движки надо отдельно.

Что делает фрагмент «пригодным к выдёргиванию»?

Самодостаточность: блок должен сохранять 100% смысла, если его вырезать из статьи. Формула — утверждение (прямой ответ первым предложением) + объяснение + граница применимости + пример или источник. Убийцы извлекаемости: местоимения без пояснения («он», «этот метод») и отсылки «как сказано выше».

Насколько важна свежесть контента для цитирования?

Критично. В AI-поиске задокументирован ~90-дневный «обрыв»: контент, не обновлявшийся ~3 месяца, резко реже цитируется. 50% всех AI-цитируемых материалов младше 13 недель (Salespeak); свежий контент цитируется примерно в 3,2× чаще. Но менять только дату без содержательных правок — штрафуется.

Помогла статья?
Запустить SEO/GEO с seo·matrix → или заявка без Telegram →

Комментарии

  • …

Комментарии модерируются.