Большинство детекторов каннибализации устроены одинаково: два URL в одной выдаче — тревога, редирект. Что за этим следует — поломанная структура, потому что пересечение могло быть недельным шумом или сезонным колебанием.
Автор этой статьи сделал другое. Шесть факторов скоринга (доминирование, смещение позиции, захват кликов, тренд, структурное несоответствие, персистентность) с коэффициентом уверенности, который автоматически занижает вес при малом объёме данных. CRITICAL-статус требует не просто высокого балла, а либо повторяемости, либо объёма — один всплеск не пробивает порог по определению архитектуры.
За этим стоит честная логика: каннибализацию нельзя оценить по одному срезу, потому что поисковая выдача нестабильна по природе. Математика детерминированная, LLM выступает только рассказчиком поверх готовых данных, а закрыть инцидент без ручного подтверждения нельзя.
Воркфлоу для n8n в открытом репозитории. Веса эвристические, домен захардкожен — это рабочий прототип под конкретный сайт, не универсальная коробка. Но математику скоринга можно взять и перенести.