Перейти к содержимому

Как работают онтологии и фильтрация

Проблема: «релевантно нише» — это не вайб, это обязано быть вычислимым свойством, иначе поиск дрейфует, а бренд-безопасность превращается в удачу. Ответ платформы: сделать нишу явной, выводимой онтологией, а каждый фильтр — отдельным гейтом с одним владельцем.

Слой 1 — онтология выводится, а не набивается руками

Заголовок раздела «Слой 1 — онтология выводится, а не набивается руками»

Онтология ниши каждого контракта выводится из его бренд-описания (тот же источник, что кормит голос бренда) плюс собственных структурных страниц контракта — About и Services, не статей. Пустые входы падают громко: контракт, не умеющий сказать, о чём он, не может собирать. Результат — ярусная структура терминов: ключевые концепции, действия, сущности экосистемы, интенты пользователей.

Brand description +structural pagesNiche ontologytiers · core · actions ·ecosystem · intentsCurated search queriesPer-candidate comparisonDraft alignment in Generate

Слой 2 — таксономия на кандидата, затем сравнение

Заголовок раздела «Слой 2 — таксономия на кандидата, затем сравнение»

В ходе поиска каждый выживший кандидат получает собственную маленькую LLM-таксономию той же формы — и скоринг сравнивает таксономии, а не ключевые слова: пересечение терминов по ярусам плюс бонус доменной близости, вплавленные в общий ранг кандидата. «Это про нашу нишу?» становится структурным сравнением вместо подстрочной удачи.

Фильтрация намеренно не одна большая функция. Каждый гейт владеет своей заботой (та же философия хартии, что и во фреймворке написания):

ГейтВладеетВердикт
URL-дедуп«видели ли мы ровно этот источник»удаление
Кэп на доменразнообразие воронкикэп
LLM-скринердешёвый pass/fail по тематичностиотсев
Сравнение онтологийструктурное соответствие нишескор
Тематический дедупсемантическая новизна vs закоммиченные темыотложить (обратимо)
Экспорт-политикапол по рангу + квотированные полосыне сидируется

Слой 4 — защита бренда: декларации плюс сигналы

Заголовок раздела «Слой 4 — защита бренда: декларации плюс сигналы»

Онтология говорит, о чём контракт есть; декларации brand defense — что он не должен продвигать. Списки конкурентов живут в бренд-описании явными секциями — их ведёт автоматический майнер кандидатов (сигналы: донорская гравитация, частота в корпусе) с owner-approved жизненным циклом, так что списки не гниют молча. Ниже по течению батарея детерминированных сигналов смотрит на отрендеренный результат: донор на домене конкурента, имя конкурента в заголовке, глаголы-рекомендации рядом с конкурентом, продвижение третьих брендов даже никогда не декларированных (list-independent правило: продвигаем только своё), формы «гида покупателя», исходящие ссылки. Попадание бренд-безопасности не снижает число качества — оно щёлкает вердикт (reject/rework): осознанное разделение «насколько хорош текст» и «можно ли этому ехать».

Фильтрация по декларированной онтологии означает, что качество онтологии — это потолок: расплывчатое бренд-описание даёт расплывчатый сбор, поэтому выведение падает громко вместо отката к дефолтам. Фильтрация конкурентов на стадии поиска намеренно отсутствует (URL конкурента может быть легитимным исследовательским источником); защита применяется там, где видно намерение, — в том, что пишется и публикуется.

Любая строка кандидата несёт своё сравнение онтологий и ранг; любая опубликованная статья — свою батарею сигналов бренд-безопасности; и то и другое читается через API.

Спеки: SPEC-082 (выведение онтологии + сравнение), SPEC-111 (жизненный цикл реестра конкурентов), SPEC-118 (тематический дедуп), сигнальная батарея качества S1–S8.