Knowledge Base

Новая (окончательная) версия софта проверки релевантности и выпихивания текстов в ТОП Гугла

6.9K просмотров Оригинал — DrMax SEO ↗
  1. Добавлена гибридная релевантность (комбинация семантических (SBERT) и статистических (TF-IDF) методов). Веса сами проставляете.
  2. Парсинг и усиленная зачистка HTML от мусора (скрипты, реклама, футеры, хедеры) и извлечение основного контента. Работает не идеально (ибо обучать надо на всех шаблонах сайта - а это очень долго).
  3. Вывод весов для всех n-грамм.
  4. Сбор всех фраз и n-грамм, зачистка от дублей и вывод в Excel (самая нужная фишка, чтобы понять за счет чего именно вылезли в ТОПЫ злобные конкуренты).
  5. Работа с дублями осуществляется после стемминга - т.е. зачищает крайне хорошо и всякие словоформы и переставления слов не щадит.
  6. Работает на модели all-mpnet-base-v2 - т.е. исключительно английский текст.
  7. Добавил параллельные обработки текста, кэширование эмбеддингов, оптимизацию TF-IDF (обучение на всем наборе текстов) и много всего остального, дабы ускорить работу.

Поставляется "как есть". Отзывов от вас все равно не дождешся - так что пользуйтесь.

Собственно, кто будет юзать сей софт - сможет нагибать Гугл довольно просто ( по крайне мере с НЧ и СЧ). Замерял.

Окошко ввода текста юзайте при оптимизации контента и расчета его косинусности. Очень удобно и быстро, в несколько иттераций подбирается нужная релевантность. Ну или текст тех конкурентов кидайте, что не позволяют себя спарсить.

Качать здесь.

Отзывы - пишите в комментарии. Пример использования тут. Исходники не выдам.

Собственно можно и русскую версию собрать на иной модели. Но запросов нет. Так что ну его.

#DrMax #SEO #soft

👍 46😁 11🔥 10❤ 5👏 2