seo·matrix
← Все статьи

Наш редактор бракует ИИ-воду — до публикации

· 2 мин чтения · Автор Михаил Кузьмицкий

продукткачествоanti-slop

Markdown-версия ↗

Наш редактор бракует ИИ-воду — до публикации

Коротко: ИИ умеет писать быстро и много — и так же быстро наплодить воду. Мартовский core-апдейт Google 2026 ударил по «scaled content abuse». Поэтому в нашем конвейере стоят детерминированные гейты, которые блокируют публикацию слопа — ещё до деплоя.

Почему гейты обязательны при генерации на масштабе

Если вы генерите сотни страниц, вопрос не «напишет ли ИИ», а «не утащит ли это весь домен под фильтр». Тонкий, шаблонный, безавторский контент в объёме — ровно тот профиль, который штрафуют. Значит, нужен автоматический отсев, а не «прочитаем потом».

Четыре гейта, которые останавливают деплой

  • Information Gain floor. Каждая статья должна добавлять новое, а не пересказывать выдачу. Порог ≥ 0.30 (≥ 0.40 для YMYL); опирается на идею патента Google US 11 354 342 — прирост информации на блок относительно топа.
  • Anti-AI-isms. Словарь штампов + структурные маркеры: дежурные интро («в современном мире…»), абзацы, начинающиеся только со связок, списки не к месту. Ловится и в писателе, и в редакторе.
  • Grounding-маркеры. Писатель помечает недоказанные утверждения [unverified] / [citation needed] / [tk]. Если такой маркер дожил до публикации — деплой блокируется. Нельзя «случайно» отгрузить непроверенный факт.
  • Content-effort. Минимум один элемент «работы, которую не скопируешь»: собственные данные/таблица, оригинальная визуализация, first-hand-конкретика (протестированная процедура, названный trade-off). Для YMYL — два.

Атомарный pre-publish

Финальный гейт /seo-matrix:pre-publish проверяет пачку ready-статей детерминированно: полнота frontmatter, валидность JSON-LD, существование целей внутренних ссылок, наличие ассетов, корректность markdown, IG-порог. Любой блокер → exit 1, частичной публикации нет. Либо чисто всё, либо не публикуем.

Что это даёт

  • На масштабе домен не уходит под scaled-content-abuse — потому что тонкое и шаблонное не доходит до прода.
  • Контент по умолчанию плотнее и оригинальнее (а это ровно то, что повышает шанс цитирования в ИИ-ответах).
  • Никакого «ИИ написал — мы не глядя выложили»: гейты не зависят от настроения ревьюера.

Коротко

  • Генерация на масштабе без отсева = риск фильтра (scaled content abuse).
  • 4 гейта блокируют слоп: information-gain, anti-AI-isms, grounding-маркеры, content-effort.
  • pre-publish атомарен: один блокер — не публикуем ничего.
  • Петля замкнута: writer → editor → pre-publish, всё детерминированно.

Источники

  • Собственные гейты качества seo·matrix (pre-publish, information-gain self-check, anti-ai-isms, content-quality-checks).
  • Патент Google US 11 354 342 («Information Gain») — прирост информации на блок.
  • Утечка Google API Content Warehouse (2024) — сигнал contentEffort («сложность воспроизведения»).
  • DrMax, «Evidence-based SEO 2026» — анти-копируемость контента; контекст core-апдейта по scaled content abuse.

Частые вопросы

Что такое «scaled content abuse»?

Массовая публикация тонкого или шаблонного ИИ-контента. Мартовский core-update Google 2026 за это понижает сайты на 60-80%. Мы генерим на масштабе, поэтому ставим гейты до публикации.

Какие гейты останавливают деплой?

Четыре: information-gain (есть ли что-то новое), anti-AI-isms (штампы и вода), grounding-маркеры (неподтверждённые факты помечены) и content-effort (оригинальная работа, которую нельзя дёшево скопировать).

Что значит «атомарный pre-publish»?

Любой блокер хотя бы на одной статье останавливает весь батч — частичная публикация невозможна, поэтому слоп не просочится в прод.

Помогла статья?
Cited · 3 900 ₽/мес Запустить SEO/GEO с seo·matrix → →

Комментарии

Комментарии модерируются.