Перейти к содержимому

Как работает оценка копирайтинга

Проблема: «хороша ли статья?» прячет два независимых вопроса — правда ли это и стоит ли это читать — и оптимизация любого поодиночке даёт провал: точное-но-нечитаемое или восхитительную фабрикацию. Доктрина платформы делает их двумя равноправными гейтами: статья едет только из правого верхнего квадранта.

ShipsRewrite styleRejectFix the factsHard to readEasy and pleasantFabricatedTrue and accurateThe two co-equal gates

Охота на фабрикации адверсариальна: выпотрошить каждое утверждение и попытаться заземлить каждое. Принимаются четыре класса заземления — реальный URL источника из исследовательского бандла самой статьи, персона-факты из биографии автора, специфика бренда из декларированного профиля компании и проверяемое ревьюером хрестоматийное знание ниши. Всё остальное — находка фабрикации. Список классов существует потому, что каждый из них когда-то был false positive, сжигавшим время ревью, — кодификация сделала охоту воспроизводимой.

Читаемость судится структурной редакторской рубрикой чтения — настоящим прочтением, оцененным по определённым осям, а не прокси-метрикой. Это намеренно не LLM-скор: дешёвые LLM-судьи измеримо антикоррелировали с человеческими оценками качества на этой нагрузке (см. Гейты качества), поэтому гейт чтения остался откалиброван человеком. Механически его страхует анти-шаблонная батарея: запрещённые замены AI-лексики, запрещённые формы заголовков («Core concepts behind X…») и корпусный проход twin-similarity, ловящий статьи, сходящиеся к одному скелету.

Слой 3 — evidence-anchored судейство, где LLM-мнение вообще используется

Заголовок раздела «Слой 3 — evidence-anchored судейство, где LLM-мнение вообще используется»

Там, где LLM-вердикт участвует (как совещательный сигнал, никогда как гейт), он структурно скован: запертая рубрика 0/1/2 на категорию, дословная цитата обязательна для любого ненулевого балла — проверяется механически как подстрока, — несколько сэмплов с медианой и судья из другого семейства моделей, чем писатель. Судья, который не может процитировать, не может хвалить. Полный формальный судья (с человеческой калибровкой) остаётся аналитическим инструментом: его калибровочное исследование так и не было завершено, поэтому статуса гейта он не заработал — осознанное применение платформой собственной доктрины «детерминированное решает, LLM советует» к самой себе.

Каждая опубликованная статья несёт штамп качества, вычисленный из детерминированных автоматических категорий (структура, отсутствие AI-маркеров, технический SEO) минус штрафы за дефекты — попадания бренд-безопасности щёлкают вердикт, а не число, так что красивая статья, продвигающая чужой бренд, падает громко, а не усредняется. Спроектированная следующая фаза — «прилив» (rising tide), пере-обогащающий старые статьи по мере взросления исследовательского корпуса, — в роадмапе, ещё не построена.

Человечески калиброванные гейты чтения не масштабируются как метрика — это принятая цена измеренного результата антикорреляции. А двухгейтовая доктрина означает, что статья может зациклиться: починка фактов портит поток, стилевые переписывания сносят факты; петля сходится, потому что каждый гейт перепроверяет после правки другого, но сходимость стоит итераций.

Штамп качества и сигнальная батарея любой статьи читаются через API (домен quality); анти-шаблонные бан-листы живут в директории версии генерационного пайплайна — версионируются, как и всё остальное.

Спеки: SPEC-074 (двухгейтовая петля + плейбук), SPEC-065 (evidence-anchored судья), SPEC-106 (пост-публикационный скоринг; rising tide спроектирован).