seo·matrix
← Все статьи

Мой редактор бракует ИИ-воду — до публикации

· 7 мин чтения · Автор Михаил Кузьмицкий

продукткачествоanti-slop

Markdown-версия ↗

Спойлер для тех, кто скроллит: в моём конвейере стоят четыре автоматические проверки против пустого текста — прирост информации, штампы, метки непроверенного и собственный труд, — а финальный гейт перед деплоем атомарный, поэтому при генерации на масштабе слоп до прода просто не доезжает.

Открыл я как-то выборочно пять статей из свежего батча в триста штук, и на третьей поймал себя на том, что читаю уже второй абзац подряд без единого факта. Гладко, вежливо, по делу — и пусто! Полез смотреть остальные, и картина повторилась: две из пяти были водой, а одну я бы не отличил от первой десятки выдачи, пересказанной другими словами. И это при том, что писатель формально всё сделал правильно!

Проблема, которую все откладывают

ИИ пишет быстро и много, и ровно с той же скоростью он производит воду: гладкие абзацы, в которых нет ни одного нового факта, и вежливые вводные обороты вместо ответов.

Мой редактор бракует ИИ-воду — до публикации

Пока речь идёт о десяти статьях, это лечится чтением — прочитал, поморщился, отправил на переделку. Когда статей триста, читать их некому, и вопрос меняется: не «напишет ли ИИ», а «не утащит ли это весь домен под фильтр».

Мартовское обновление Google 2026 года ударило как раз по потоку пустых страниц. Тонкий, шаблонный, безавторский текст в объёме — это ровно тот профиль, который наказывают, и наказывают доменом целиком, а не отдельными страницами, что, кажется, до сих пор не все прочувствовали.

Значит, нужен отбор, который работает сам и до выхода статьи: не «прочитаем потом», а дверь, которая просто не пускает дальше.

Четыре гейта

В моём конвейере таких проверок четыре, и каждая ловит свой тип пустоты, поэтому разберу все четыре по очереди, с примерами того, что каждая ловит.

Прирост информации. Каждая статья обязана добавлять что-то новое, а не пересказывать первую десятку выдачи своими словами: порог — не ниже 0.30, а для тем про здоровье и деньги не ниже 0.40. Идея взята из патента Google под номером 11 354 342, где описан прирост знания на блок текста в сравнении с тем, что уже есть в топе.

Штампы и обороты. Словарь клише плюс структурные признаки: дежурные вступления в духе «в современном мире», абзацы, начинающиеся только со связок, списки не к месту. Проверка идёт дважды, у писателя и у редактора, потому что штампы лезут назад при каждой правке, как сорняки после дождя.

Маркеры непроверенного. Писатель обязан ставить метку на каждый факт, который он не смог проверить, и если такая метка дожила до выхода, сборка встаёт. Смысл простой: случайно отдать в свет непроверенный факт нельзя, для этого надо сознательно снять метку рукой.

Труд, который не скопируешь. В статье должен быть хотя бы один элемент собственной работы: своя таблица с данными, оригинальная схема, конкретика из первых рук — протестированная процедура, названный компромисс, замер. Для тем про здоровье и деньги таких элементов требуется два.

Почему именно эти четыре

Вопрос резонный, потому что проверок можно придумать двадцать, и отвечу так: каждая из четырёх ловит свой отдельный способ быть пустым, и они не перекрывают друг друга.

Текст может быть новым по фактам, но написанным штампами, а может быть живым по языку и при этом пересказывать чужое. Может быть и новым, и живым, но содержать выдуманный факт, и может быть безупречным по всем трём пунктам, оставаясь при этом компиляцией без единого собственного замера.

Убери любую из четырёх — и в стене появится дыра, через которую пройдёт целый класс плохих статей. Добавь пятую — и будешь ловить то же самое второй раз, платя за это ложными тревогами. А чё, спросишь, трёх не хватит? Судя по списку выше — нет: любая тройка оставляет открытым ровно один способ быть пустым.

Атомарный финальный гейт

Последняя дверь перед публикацией проверяет пачку готовых статей по строгим правилам, без участия модели: все ли поля на месте, верна ли разметка, есть ли цели внутренних ссылок, на месте ли картинки, цел ли сам текст и взят ли порог по новизне.

И вот здесь важная деталь, ради которой всё и строилось: любой блокер означает выход с ошибкой, и частичной публикации не бывает. Либо чисто всё, либо не публикуем ничего!

Почему такая жёсткость нужна и откуда она взялась? Потому что «опубликуем девять из десяти, а десятую потом» на практике означает, что десятая не выходит никогда, а список отложенного растёт, и атомарность решает эту проблему административно: разбирать придётся сейчас.

Что это даёт на практике

Первое и главное: сайт не уходит под фильтр за поток пустых страниц, потому что тонкое и шаблонное просто не доходит до боевого сервера.

Второе: текст по умолчанию плотнее и свежее, а это ровно то, что повышает шанс цитирования в ИИ-ответах, поскольку движки предпочитают материал, который нельзя собрать из трёх соседних статей.

Третье, не такое явное: пропадает сам разговор «ИИ написал, я не глядя выложил». Двери работают по правилам, и спорить приходится не с живым человеком, а с проверкой, которая либо пройдена, либо нет (с ней, как выяснилось, спорят заметно реже).

Чего гейты не делают

Скажу и про границы, иначе получится реклама вместо разбора.

Гейты не делают твой текст интересным: они отсекают заведомо плохое, но не превращают середину в хорошее, и статья может пройти все четыре проверки и остаться скучной, если тема раскрыта формально.

Гейты не заменят тебе редактора по смыслу, потому что проверка видит форму, факты и метки, но не видит, что вывод статьи неверен или что автор спорит с собственным заголовком. Такие вещи ловит, пожалуй, только живой человек с опытом в теме.

И гейты не гарантируют попадание в ответы движков: они убирают причины, по которым туда точно не попадёшь, а дальше работают тема, авторитет домена и структура — то есть всё то, чем занимаются отдельно.

Как это выглядит в жизни

Покажу на примере, чтобы не осталось ощущения теории: писатель сдал статью, и она ушла в проверку.

Первая дверь: текст новый, порог пройден. Вторая дверь: нашлось три штампа, и все они помечены. Третья: одна метка непроверенного осталась в тексте, автор про неё забыл. Четвёртая: своей таблицы или замера в статье нет вовсе.

Итог такой: статья не выходит, а к ней прилагается короткий список из двух пунктов — убрать метку или подтвердить факт, и добавить свой элемент: таблицу, замер или случай из практики.

На доработку уходит примерно час, после чего статья идёт по тем же дверям заново и выходит уже чистой, а вся история занимает полдня и не требует ни одного совещания!

А теперь представь тот же процесс без дверей: статья выходит с выдуманным фактом, живёт полгода, и находит его читатель, а не ты. Приятного мало, правда?

Как завести такое у себя

Если ты производишь текст на масштабе, минимальный набор выглядит так. Заведи хотя бы один автоматический порог качества, который останавливает публикацию, — даже самый грубый работает лучше, чем его отсутствие.

Дальше добавь метки для непроверенных утверждений и запрет на публикацию с ними: это дешевле всего в реализации и снимает самый дорогой класс ошибок — выдуманный факт в живом тексте.

Третьим шагом введи требование собственного элемента в каждой статье. Формулировка «в каждом материале должна быть одна вещь, которую нельзя скопировать» звучит расплывчато, но на практике проверяется быстро и меняет тексты заметно.

И только потом, если объёмы позволяют, берись за словари штампов и подсчёт прироста информации, потому что эти проверки дают больше всего пользы, но и настраиваются дольше остальных.

Частые вопросы

Не режут ли гейты нормальные тексты? Режут иногда, и это неизбежная плата за автоматику: ложные срабатывания, как правило, бывают, поэтому пороги стоит держать мягкими и пересматривать раз в квартал по своим же данным.

Сколько статей отсеивается на старте? Обычно от трети до половины, и это нормальная цифра для первого месяца работы, а дальше писатель подстраивается под требования, и доля падает до десяти-пятнадцати процентов.

Работает ли это без ИИ, для живых авторов? Работает, и иногда даже лучше: человек тоже пишет вводные обороты вместо ответов и тоже иногда сдаёт компиляцию под видом разбора (я у мамы редактор, знаю по себе).

Коротко

Генерация на масштабе без отсева — это риск фильтра для всего домена, а не для отдельных страниц, и четыре гейта блокируют пустоту: прирост информации, штампы, метки непроверенного, собственный труд.

Финальная проверка атомарна: один блокер — не публикуем ничего. Петля замкнута между писателем, редактором и деплоем, и все три двери автоматические.

А та десятая статья из «опубликуем потом», между прочим, у меня до сих пор лежит в очереди. Как и у тебя, наверное.

Источники

  • Собственные гейты качества seo·matrix — финальная проверка перед публикацией, самопроверка прироста информации, словарь штампов, проверки качества текста.
  • Патент Google US 11 354 342 («Information Gain») — прирост информации на блок относительно уже известного.
  • Утечка Google API Content Warehouse (2024) — сигнал contentEffort, то есть сложность воспроизведения материала.
  • DrMax, «Evidence-based SEO 2026» — некопируемость контента и контекст обновления по масштабному производству текста.

Частые вопросы

Что такое «scaled content abuse»?

Массовая публикация тонкого или шаблонного ИИ-контента. Мартовский core-update Google 2026 за это понижает сайты на 60-80%. Я генерю на масштабе, поэтому ставлю гейты до публикации.

Какие гейты останавливают деплой?

Четыре: information-gain (есть ли что-то новое), anti-AI-isms (штампы и вода), grounding-маркеры (неподтверждённые факты помечены) и content-effort (оригинальная работа, которую нельзя дёшево скопировать).

Что значит «атомарный pre-publish»?

Любой блокер хотя бы на одной статье останавливает весь батч — частичная публикация невозможна, поэтому слоп не просочится в прод.

Помогла статья?
Cited · 3 900 ₽/мес Запустить SEO/GEO с seo·matrix → →

Комментарии

  • …

Комментарии модерируются.