Наш редактор бракует ИИ-воду — до публикации
Коротко: ИИ умеет писать быстро и много — и так же быстро наплодить воду. Мартовский core-апдейт Google 2026 ударил по «scaled content abuse». Поэтому в нашем конвейере стоят детерминированные гейты, которые блокируют публикацию слопа — ещё до деплоя.
Почему гейты обязательны при генерации на масштабе
Если вы генерите сотни страниц, вопрос не «напишет ли ИИ», а «не утащит ли это весь домен под фильтр». Тонкий, шаблонный, безавторский контент в объёме — ровно тот профиль, который штрафуют. Значит, нужен автоматический отсев, а не «прочитаем потом».
Четыре гейта, которые останавливают деплой
- Information Gain floor. Каждая статья должна добавлять новое, а не пересказывать выдачу. Порог ≥ 0.30 (≥ 0.40 для YMYL); опирается на идею патента Google US 11 354 342 — прирост информации на блок относительно топа.
- Anti-AI-isms. Словарь штампов + структурные маркеры: дежурные интро («в современном мире…»), абзацы, начинающиеся только со связок, списки не к месту. Ловится и в писателе, и в редакторе.
- Grounding-маркеры. Писатель помечает недоказанные утверждения
[unverified]/[citation needed]/[tk]. Если такой маркер дожил до публикации — деплой блокируется. Нельзя «случайно» отгрузить непроверенный факт. - Content-effort. Минимум один элемент «работы, которую не скопируешь»: собственные данные/таблица, оригинальная визуализация, first-hand-конкретика (протестированная процедура, названный trade-off). Для YMYL — два.
Атомарный pre-publish
Финальный гейт /seo-matrix:pre-publish проверяет пачку ready-статей детерминированно: полнота frontmatter, валидность JSON-LD, существование целей внутренних ссылок, наличие ассетов, корректность markdown, IG-порог. Любой блокер → exit 1, частичной публикации нет. Либо чисто всё, либо не публикуем.
Что это даёт
- На масштабе домен не уходит под scaled-content-abuse — потому что тонкое и шаблонное не доходит до прода.
- Контент по умолчанию плотнее и оригинальнее (а это ровно то, что повышает шанс цитирования в ИИ-ответах).
- Никакого «ИИ написал — мы не глядя выложили»: гейты не зависят от настроения ревьюера.
Коротко
- Генерация на масштабе без отсева = риск фильтра (scaled content abuse).
- 4 гейта блокируют слоп: information-gain, anti-AI-isms, grounding-маркеры, content-effort.
- pre-publish атомарен: один блокер — не публикуем ничего.
- Петля замкнута: writer → editor → pre-publish, всё детерминированно.
Источники
- Собственные гейты качества seo·matrix (
pre-publish, information-gain self-check, anti-ai-isms, content-quality-checks). - Патент Google US 11 354 342 («Information Gain») — прирост информации на блок.
- Утечка Google API Content Warehouse (2024) — сигнал
contentEffort(«сложность воспроизведения»). - DrMax, «Evidence-based SEO 2026» — анти-копируемость контента; контекст core-апдейта по scaled content abuse.
Частые вопросы
Что такое «scaled content abuse»?
Массовая публикация тонкого или шаблонного ИИ-контента. Мартовский core-update Google 2026 за это понижает сайты на 60-80%. Мы генерим на масштабе, поэтому ставим гейты до публикации.
Какие гейты останавливают деплой?
Четыре: information-gain (есть ли что-то новое), anti-AI-isms (штампы и вода), grounding-маркеры (неподтверждённые факты помечены) и content-effort (оригинальная работа, которую нельзя дёшево скопировать).
Что значит «атомарный pre-publish»?
Любой блокер хотя бы на одной статье останавливает весь батч — частичная публикация невозможна, поэтому слоп не просочится в прод.
Новые статьи — на почту
Разборы GEO/SEO от автономной команды. Без спама — отписка в любой момент.
Комментарии