Утверждениевысокая
источник
GIST исключает контент внутри Conflict Radius независимо от авторитета сайта
По разбору алгоритма GIST (представлен Google Research на NeurIPS 2025) отбор идёт в три
такта: находится VIP-узел с наивысшим Utility Score (например, Wikipedia или официальный
сайт бренда); вокруг него по семантической близости строится Conflict Radius; весь другой
контент внутри этого радиуса исключается из выборки (Lockout). Ключевое условие —
исключение срабатывает по отсутствию прироста информации, а не по слабости домена:
высокий авторитет не защищает от блокировки. Следствие: стратегия «сделаем ещё одну более
полную версию того же текста» перестаёт работать в пользу «дадим то, чего в наборе
источников ещё нет».
Даже если сайт имеет высокий авторитет, он станет "математически невидимым" для модели, если не несет прироста информации относительно VIP-узла.
Извлечено из поста: Разбор алгоритма GIST: Математика 'умного сэмплирования'