seo·matrix
← Все статьи

Программный SEO (pSEO) без вреда для сайта в 2026

· 8 мин чтения · Автор Михаил Кузьмицкий

pSEOGEOпрограммный SEOиндексация

Markdown-версия ↗

Сразу спойлер, чтобы не тянуть: массовая генерация страниц по шаблону — техника, а не грех, и топит сайт не шаблон, а пустота за каждым адресом. Ниже про то, где проходит граница между полезной сеткой и фермой пустышек, что изменилось с приходом ИИ-ответов и как выкатывать такое, не утопив сайт.

Что это вообще такое

Разбирал недавно сетку на несколько тысяч адресов: «время в пути из города в город», один шаблон, у каждой страницы своя пара городов. Открываю десяток подряд — и на всех один и тот же абзац с подменённым названием, ни расстояния, ни цифры, ничего. Полез смотреть, сколько из этого вообще в индексе, и угадай, что увидел? Почти ничего, и вот это ровно та история, из-за которой у массовой генерации плохая репутация, хотя виновата не она.

Массовая генерация — это техника, а не жанр: ты берёшь повторяемую форму страницы и заполняешь её из набора данных. Форма может быть любой — «лучший инструмент для задачи», «время в пути из города в город», «товар против альтернативы», — один шаблон, тысячи адресов, и каждый закрывает низкочастотный запрос, ради которого никто не станет писать страницу руками.

Программный SEO (pSEO) без вреда для сайта в 2026

Проблема тут, как правило, не в шаблоне: крупные сервисы недвижимости, путешествий и любой сравнительный сайт, которым ты пользовался, устроены ровно так. Проблема в том, что стоит за каждым адресом. Если ответ звучит как «тот же абзац с другим названием города», значит, построена ферма пустышек, а если как «свой набор данных, посчитанный именно под этот запрос» — получилось то, чего хотят и люди, и модели.

Где помогает, а где топит

Один и тот же шаблон бывает активом и обузой, и разница ровно в одном — в уникальной ценности каждой страницы.

СигналПомогаетТопит сайт
Данные на страницеРазные цифры, цены и факты на каждый адресТот же текст, подменены существительные
Намерение человекаОтвечает на запрос, который реально вводятСуществует ради перестановки слов
ПокрытиеСвой набор данных, который держат свежимСпарсенные поля без единого добавления
Роль в структуреПолезная точка сама по себеСтупень к одной странице продажи
МасштабВыкатить проверенный срез, расти по спросуОпубликовать пятьдесят тысяч адресов в день первый

Если большинство строк проекта попадает в правый столбец, такая сетка утопит небольшой сайт быстрее, чем любая одна плохая страница, а если в левый — это самый выгодный ход из всех доступных.

Уникальные данные — вся суть

Единственное, что отличает ценную страницу от опасной, — это уникальные данные на адрес: не уникальные формулировки, а именно уникальная информация. Разница тут принципиальная, потому что переписанное другими словами предложение остаётся тонким, а реальная сравнительная таблица — нет.

Что вообще считается такими данными? По сути три вещи, и я разберу каждую.

То, чем ты владеешь или что вычисляешь. Цены, которые тянутся вживую, наличие, которое проверяется, расстояния, которые считаются, характеристики, которые приводятся к общему виду, — то есть то, чего человек не получит, просто открыв два исходных сайта самостоятельно.

Слой суждения. Вердикт, оценка, пометка «лучше всего подходит для», предостережение — это человеческая часть, которой у чистого шаблона нет и быть не может.

Отрисовка, а не хранение. Таблица, график, посчитанный ответ в первой строке: данные должны быть видны, иначе ни модель их не извлечёт, ни человек не просмотрит.

Что изменилось с ИИ-ответами

Раньше такие страницы делались под список из десяти синих ссылок, а сейчас заметная доля этих запросов решается внутри ответа движка, и он может вырвать один фрагмент вне контекста. Это меняет весь дизайн страницы целиком, а не только её начало: ступень воронки — тонкая, осмысленная только как переход к покупке — для генеративного движка невидима, потому что извлекать там нечего.

Готовая страница устроена иначе. Ответ стоит в первых двух строках — посчитанное расстояние, цена, вердикт — прямо, до всякого вступления, а каждый заголовок при этом самодостаточен, потому что модель может процитировать только его. Числа на странице сопровождаются датой, чтобы было что конкретно приписать тебе, а там, где уместно, те же поля, что рисуют таблицу, отдают и разметку.

Исследования по цитированию прямо говорят, почему это работает: попадание в ответ зависит от извлекаемости фрагмента, и шаблонные страницы с ясной структурой тут неожиданно хороши — при условии, что данные за ними настоящие. Неожиданно, но приятно!

Как выкатывать

Самый быстрый способ утопить сайт — опубликовать весь набор разом и дать поисковикам обнаружить пятьдесят тысяч почти одинаковых адресов раньше, чем хоть один докажет свою ценность. Видел такое, и не раз! Поэтому индексом стоит управлять осознанно, и правил тут три.

Сначала проверенный срез. Запусти те несколько сотен страниц, которые ты можешь сделать по-настоящему насыщенными, убедись, что они индексируются и получают показы, и только потом расширяйся.

Придержи хвост. Страницы без реальных данных держи вне карты сайта и закрывай от индексации, пока им нечего сказать, потому что покрытие, которое нечем наполнить, — это обуза, а не актив.

Следи за долей индексации. Если поисковик берёт всё меньшую часть отправленного, он прямо говорит тебе, что страницы читаются как тонкие, и чинить в этой ситуации надо данные, а не число адресов.

Разобрать корпус помогает поиск тонких страниц: проверяешь адреса пачкой и отмечаешь те, что читаются как пустышки.

Чек-лист

  • Каждый адрес несёт данные, которых нет на исходных страницах.
  • На каждой странице есть слой суждения: вердикт, оценка или пометка «подходит для».
  • Ответ дан в первых двух строках, до вступления.
  • Каждый заголовок самодостаточен и содержит датированное число.
  • Сначала выкатывается проверенный срез, тонкий хвост закрыт от индексации.
  • Доля индексации отслеживается: её падение означает, что страницы читаются как тонкие.
  • Ни одна страница не существует только как ступень воронки.
Доля индексируемых шаблонных страниц по глубине уникальных данных (иллюстративно)
Тонкие, только шаблон 18%
Насыщенные, данные и вердикт 86%

источник: внутренние аудиты, 2026

Разрыв на графике и есть весь аргумент: оба типа движков оставляют страницы, которые что-то знают, и тихо отбрасывают те, что просто заполняют слот в сетке.

Откуда брать данные

Самый практичный вопрос во всей теме, и ответ на него обычно ближе, чем кажется на первый взгляд.

Первый источник — собственная база: заказы, цены, остатки, сроки доставки, история обращений — всё это уже лежит внутри и почти никогда не выводится наружу в удобном виде, а достаточно посчитать агрегаты по срезам, и данные для сетки появятся сами собой.

Второй источник — открытые государственные и отраслевые наборы. Они скучные, часто неудобные, зато настоящие и обновляемые, а главное — их мало кто берёт на себя труд привести в порядок и связать с чем-то полезным.

Третий источник — собственные измерения. Замерил время работы сервиса, сравнил тарифы вручную, прогнал десяток инструментов по одной методике — и получил то, чего нет ни у кого, потому что никто больше этого не делал!

Четвёртый, самый недооценённый, — комбинация двух чужих наборов. Отдельно каждый бесполезен и общедоступен, а вместе они дают ответ, за которым человеку иначе пришлось бы идти в два места и считать самому, и это, как правило, и есть та самая добавленная ценность, о которой пишут в правилах.

Про источники стоит добавить одну оговорку: любой набор устаревает, и сетка на устаревших данных вреднее отсутствия сетки, потому что она уверенно показывает человеку неправду и делает это на тысяче страниц сразу. Чё может быть хуже для доверия? Наверное, только делать то же самое с пометкой «обновлено сегодня».

Частые вопросы

Сколько страниц можно выкатить за раз? Начинай с сотни-двух и смотри на долю индексации через месяц: если она держится выше восьмидесяти процентов, можно расширяться, а если падает — данных мало, и наращивать объём бессмысленно.

Нужен ли уникальный текст на каждой странице? Уникальный текст нужен меньше, чем уникальные данные, и это, пожалуй, главное непонимание в теме: одинаковая обвязка вокруг разных таблиц работает, а разная обвязка вокруг одинаковых данных — нет.

Что делать со старой сеткой, которая уже не индексируется? Проще всего сократить — оставить те страницы, где данные действительно есть, а остальные выпилить и свести к разделам, потому что реанимировать тонкие адреса дороже, чем удалить.

И общий вывод, к которому я прихожу каждый раз, когда разбираю очередную большую сетку: масштаб сам по себе не является ни преимуществом, ни проблемой, потому что решает всё то же самое, что и на одной странице. Просто на тысяче адресов ошибка стоит в тысячу раз дороже, а исправлять её приходится не текстом, а данными, которых на момент запуска у автора обычно не было!

Ту сетку с городами, кстати, я бы оставил. Ей просто не хватает одного столбца с километрами — и автора, который помнит, зачем он её делал.

Источники

  • Google Search Central, Spam policies for Google web search — определения массового производства и страниц-ступеней, от которых стоит держаться подальше: developers.google.com/search/docs/essentials/spam-policies.
  • Google Search Central, Creating helpful, reliable, people-first content — планка добавленной ценности, которую обязана взять каждая собранная страница: developers.google.com/search/docs/fundamentals/creating-helpful-content.
  • Aggarwal et al., «GEO: Generative Engine Optimization», KDD ‘24 — arXiv:2311.09735: цитирование зависит от извлекаемости фрагмента, которую максимизирует структура с ответом впереди.

Частые вопросы

Что такое программный SEO?

Программный SEO (pSEO) генерирует множество страниц из одного шаблона плюс структурированный набор данных — по странице на город, товар или пару 'X против Y'. Это техника масштабирования, а не тип контента. Шаблон сам по себе нормален; провал наступает, когда ты публикуешь шаблон с подменёнными словами и без уникальных данных за каждой страницей.

Приводит ли программный SEO к санкциям за тонкий контент?

Может. Политики Google прямо называют 'scaled content abuse' и 'дорвеи', и шаблонные страницы без уникальной ценности на каждый URL — именно то, на что они нацелены. pSEO наказывают не за то, что он программный, а за то, что он тонкий. Дай каждой странице данные и пользу, которые нужны человеку, и ты вне зоны риска.

Чем pSEO отличается для ИИ-движков ответов (GEO)?

Для GEO каждая страница должна работать как самодостаточный извлекаемый ответ, потому что модель может вырвать один пассаж из контекста. Значит, нужен прямой ответ или цифра в первых строках, сканируемая структура и цитируемые числа на странице — а не дорвей, который имеет смысл лишь как ступень к странице конверсии.

Помогла статья?
Запустить SEO/GEO с seo·matrix → или заявка без Telegram →

Комментарии

  • …

Комментарии модерируются.