Утверждениесредняя
наблюдение
Страница выпадает из индекса из-за схожести с более сильным документом, а не из-за качества
Автор связывает массовые жалобы оптимизаторов на выпадение страниц из Google с обкаткой
алгоритма GIST (Greedy Independent Set Thresholding). Механизм: проигрыш страницы вызван
не низким качеством, а избыточным сходством с уже выбранным более сильным документом.
Условие: страница попадает в радиус конфликта вокруг источника с высоким Utility Score.
Следствие: диагностировать выпадение нужно через сравнение с лидерами темы, а не только
через аудит качества самой страницы. Своих замеров автор не приводит, опирается на
наблюдение за рынком последней недели.
Cтраница проигрывает не потому, что она плохая, а потому, что она слишком похожа на уже выбранный более сильный документ, что и показывает массовое выпадение страниц из индекса за последнюю неделю.
Извлечено из поста: Разбор алгоритма GIST: Математика 'умного сэмплирования'