Как работают онтологии и фильтрация
Проблема: «релевантно нише» — это не вайб, это обязано быть вычислимым свойством, иначе поиск дрейфует, а бренд-безопасность превращается в удачу. Ответ платформы: сделать нишу явной, выводимой онтологией, а каждый фильтр — отдельным гейтом с одним владельцем.
Слой 1 — онтология выводится, а не набивается руками
Заголовок раздела «Слой 1 — онтология выводится, а не набивается руками»Онтология ниши каждого контракта выводится из его бренд-описания (тот же источник, что кормит голос бренда) плюс собственных структурных страниц контракта — About и Services, не статей. Пустые входы падают громко: контракт, не умеющий сказать, о чём он, не может собирать. Результат — ярусная структура терминов: ключевые концепции, действия, сущности экосистемы, интенты пользователей.
Слой 2 — таксономия на кандидата, затем сравнение
Заголовок раздела «Слой 2 — таксономия на кандидата, затем сравнение»В ходе поиска каждый выживший кандидат получает собственную маленькую LLM-таксономию той же формы — и скоринг сравнивает таксономии, а не ключевые слова: пересечение терминов по ярусам плюс бонус доменной близости, вплавленные в общий ранг кандидата. «Это про нашу нишу?» становится структурным сравнением вместо подстрочной удачи.
Слой 3 — фильтры, у каждого один владелец
Заголовок раздела «Слой 3 — фильтры, у каждого один владелец»Фильтрация намеренно не одна большая функция. Каждый гейт владеет своей заботой (та же философия хартии, что и во фреймворке написания):
| Гейт | Владеет | Вердикт |
|---|---|---|
| URL-дедуп | «видели ли мы ровно этот источник» | удаление |
| Кэп на домен | разнообразие воронки | кэп |
| LLM-скринер | дешёвый pass/fail по тематичности | отсев |
| Сравнение онтологий | структурное соответствие нише | скор |
| Тематический дедуп | семантическая новизна vs закоммиченные темы | отложить (обратимо) |
| Экспорт-политика | пол по рангу + квотированные полосы | не сидируется |
Слой 4 — защита бренда: декларации плюс сигналы
Заголовок раздела «Слой 4 — защита бренда: декларации плюс сигналы»Онтология говорит, о чём контракт есть; декларации brand defense — что он не должен продвигать. Списки конкурентов живут в бренд-описании явными секциями — их ведёт автоматический майнер кандидатов (сигналы: донорская гравитация, частота в корпусе) с owner-approved жизненным циклом, так что списки не гниют молча. Ниже по течению батарея детерминированных сигналов смотрит на отрендеренный результат: донор на домене конкурента, имя конкурента в заголовке, глаголы-рекомендации рядом с конкурентом, продвижение третьих брендов даже никогда не декларированных (list-independent правило: продвигаем только своё), формы «гида покупателя», исходящие ссылки. Попадание бренд-безопасности не снижает число качества — оно щёлкает вердикт (reject/rework): осознанное разделение «насколько хорош текст» и «можно ли этому ехать».
Трейд-оффы, честно
Заголовок раздела «Трейд-оффы, честно»Фильтрация по декларированной онтологии означает, что качество онтологии — это потолок: расплывчатое бренд-описание даёт расплывчатый сбор, поэтому выведение падает громко вместо отката к дефолтам. Фильтрация конкурентов на стадии поиска намеренно отсутствует (URL конкурента может быть легитимным исследовательским источником); защита применяется там, где видно намерение, — в том, что пишется и публикуется.
Пощупать за две минуты
Заголовок раздела «Пощупать за две минуты»Любая строка кандидата несёт своё сравнение онтологий и ранг; любая опубликованная статья — свою батарею сигналов бренд-безопасности; и то и другое читается через API.
Спеки: SPEC-082 (выведение онтологии + сравнение), SPEC-111 (жизненный цикл реестра конкурентов), SPEC-118 (тематический дедуп), сигнальная батарея качества S1–S8.