Роль сущностей в поиске Google по данным сливов
Давайте разберем, какое внимание Google уделяет сущностям.
entities - A list of entities detected on Document.text
entityRelations - Placeholder. Relationship among Document.entities
Изначально у гугла есть необработанный список сущностей в документе. Оные сущности играют центральную роль в том, что получаем в органической выдаче при каждом запросе. При этом сущности входят в домены сущностей, которые обеспечивают контекст связанными темами и помогают найти взаимосвязанные темы.
Multiple entities can be identified on a document or query. Each entity can be mentioned several times in different positions on the document or query. This message describes a single mention of the entity. Note that a mention can be either explicit or implicit mentions. All explicit mentions refer to exact range in the document where the entity occurred, but implicit mentions may or may not have corresponding range. Next available tag number: 40
Гугл определяет частоту и важность каждой найденной сущности. Чем чаще сущность встречается – тем она важней. Кроме того, гугл выявляет «неявные» сущности.
isImplicit - True if the entity is mentioned implicitly
Например, если описывается некий красный сапог в контенте, то гугл может предположить наличие сущности «обувь» в оном контенте. Таким образом isImplicit крайне полезен и позволяет ранжироваться по запросам, которых явно нет в контенте. Следовательно, нет никакой нужды использовать все 100500 вариаций ключевых слов в контенте, чтобы ранжироваться по ним.
confidenceScore - A probabilistic score describing how certain the annotator is that this exact range in the document or query refers to the entity
Важно понимать, что гугл не собирается ранжировать страницу, только из за наличия какой то там сущности на ней. Некий confidenceScore указывает, что Гугл оперирует только важнейшими сущностями контента.
SalientTermSet is a collection of terms (unigrams and bigrams) with associated weights that can describe something. The "salient terms"
docData - doc_data contain additional salient-term-set-level data
salientTerm - salient_term is the list of terms that are good descriptors, sorted in decreasing order of weight
version - version is the Salient Terms version used to create the SalientTermSet
Становится понятно, что гугл для каждой страницы ранжирует все наиболее важные сущности в обратном порядке - от самой важной к наименее ценной.
A list of entities that are latent given this entity. For example, "Lionel Messi" can have the latent entity "FC Barcelona". See go/refx-latent-entities for detailed description.
latentEntity - Latent entities with associated metadata including source of the relationship
Итак, в списке неявных, латентных сущностей будут присутствовать некие родственные ключи, связанные с главной сущностью. Следовательно, эти термины будут взаимосвязаны с главной сущностью и, возможно, контент будет ранжироваться по ним.
Следовательно, дабы улучшить ранжирование, необходимо использовать в контете не только основную сущность, но и связанные с ней неявные сущности.
Посмотрите, как я ранее описывал пытки Барда на предмет улучшения страниц и определения основной и вторичных сущностей и их доменов. Было написано 2-3 заметки ранее. Думается, в свете вскрывшихся обстоятельств они по прежнему ценны.
Лучшим приемом использования сущностей является набивка контента побочными, связанными сущностями, при этом нужно отслеживать, что центральная сущность доминирует – т.е., как минимум, встречается чаще (3-5 раз в контенте). При этом крайне важно пихать в контент те вторичные сущности, коих нет у ваших конкурентов. Именно так и получается оригинальный контент (а вовсе не рерайтом контента конкурентов).
Тут сразу возникает вопрос о том, что нужно быть в теме, нужно обладать ловими умениями по генерации (написанию) контента и иметь обширный словарный запас – т.е. опять мы приходим к необходимости профессиональных авторов или редакторов. Даже для подготовки промптов для чат ботов они нужны.
Далее…
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥23👍️14❤️4