Россия+7 (495) 960-65-87

Как поисковые машины могут расшифровывать аббревиатуры в запросах

Россия+7 (495) 960-65-87
Шрифт:
0 3261

Когда пользователи поисковых машин используют аббревиатуры или их расшифровки, то они могут пропустить некоторые довольно важные страницы.

Например, поищите в Yahoo [NASA Moon bombing] (бомбардировка луны NASA) и сравните результаты с выдачей по запросу [National Aeronautics and Space Administration moon bombing] и вы увидите огромную разницу.

А должны ли быть эти результаты одинаковыми? NASA и National Aeronautics and Space Administration это одна и та же организация. С другой стороны, NASA также является аббревиатурой для:

  • North American Saxophone Alliance.
  • National Auto Sport Association.
  • National Association of Students of Architecture.

Кроме того, существует гора Nasa в Швеции, и там же расположена серебряная шахта Nasa. Есть шведская музыкальная группа с таким названием, исполнитель хип-хопа с таким именем, DJ и народность Nasa в Колумбии.

Как поисковая машина должна обращаться с аббревиатурами в запросах? Должна ли она расшифровывать аббревиатуры для улучшения поисковых результатов? Если страница имеет высокий рейтинг по запросу «National Aeronautics and Space Administration», но низкий по «NASA», то должна ли такая страница отображаться в поисковых результатах по термину содержащему NASA?

Именно подобные вопросы поднимаются в патенте Yahoo, опубликованном на прошлой неделе.

Обработка аббревиатур в веб-поиске
Изобретатели: Xing Wei, Fuchun Peng и Benoit Dumoulin
Принадлежит Yahoo
US Patent Application 20090259629
Опубликовано 15 октября 2009
Подано на рассмотрение 15 апреля 2008

Аннотация

Метод обработки аббревиатур в веб-запросах включает:

  • создание словаря множества возможных расшифровок потенциальных аббревиатур, связанных с ключевыми словами запроса полученного или ожидаемого поисковой машиной;
  • принятие запроса содержащего аббревиатуру;
  • расширение аббревиатуры в один из множества вариантов расшифровки аббревиатуры при вероятности корректности такого расширения выше установленной границы, где вероятность определяется с учетом контекста аббревиатуры в запросе, где в контекст включен хотя бы якорный текст;
  • отсылка запроса с расшифрованной аббревиатурой поисковой машине для генерации страницы поисковых результатов соответствующей запросу.

Одним из первых шагов, как мы видим, является ассоциация аббревиатур с их расшифровками. Это возможно реализовать при помощи анализа якорного текста, указывающего на страницы, и содержащего как аббревиатуры, так и их расшифровки. Например, если на одни и те же страницы стоят ссылки со словами «NASA» и «National Aeronautics and Space Administration», то в словарь может быть добавлена следующая строка:

  • NASA = National Aeronautics and Space Administration.

Но что тогда делать представителям Североамериканского Саксофонного Объединения (North American Saxophone Alliance), которые будут в ответ на запрос «NASA jazz competition» (состязание по джазу NASA) получать ссылки на проекты по освоению Луны? Возможно, словарь аббревиатур может содержать и информацию, полученную из других источников.

При расшифровке аббревиатур поисковой машине следует соблюдать осторожность. В патенте приводятся следующие примеры различного использования аббревиатуры/слова «aim»:

  • aim download — судя по всему, здесь «aim» является аббревиатурой «AOL instant messenger».
  • aim stock — в данном случае это явно сокращение «alternative investment market».
  • aim at improvement — а здесь «aim» используется просто как слово, а не аббревиатура.

Существует минимум три способа для поисковой машины узнать о наличии аббревиатуры:

  • Сессии запросов — Если человек искал «aim download» и не увидел релевантного результата, то он скорее всего перепишет запрос как «aol instant messenger download». Рассмотрение подобной информации в логах запросов поисковой машины может помочь в составлении словаря аббревиатур и получении информации об использовании аббревиатур в различных контекстах.
  • Якорный текст — Если на одни и те же страницы стоят ссылки с текстом в виде аббревиатуры и ее расшифровки, то между этими текстами можно отследить связь.
  • Логи кликов — Переходы людей на одну и ту же страницу со страниц поисковых результатов по различным запросам может означать, что запросы каким-то образом связаны между собой. Чем чаще подобное происходит, тем выше вероятность связи.

Все три метода основываются на участии людей. Проставление ссылок, выбор страниц в поисковых результатах или уточнение запросов во время поиска — все это делают люди. Вся информация доступна для поисковых машин и может быть использована для построения статистической модели, которая подскажет поисковой машине, когда стоит использовать расшифровку аббревиатуры.

Кроме всего вышеописанного, в патенте рассматриваются случаи возможной обработки различных сокращений вроде акронимов, инициальных аббревиатур, составных слов и т.п.

Когда поисковая машина обнаруживает подобное слово в запросе, она может поступить следующим образом:

  • Расширить запрос, чтобы включить страницы с аббревиатурой, страницы с расшифровкой аббревиатуры и страницы, содержащие оба написания.
  • Предложить пользователю провести поиск по расшифрованной аббревиатуре.
  • Проигнорировать расширенную версию и просто выдать результат поиска со страницами, содержащими аббревиатуру.

Выводы

Если вы что-то ищите и используете в поисковом запросе аббревиатуру, то неплохой идеей является повторение поиска с расшифрованной версией аббревиатуры. Особенно, если вам нужна как можно более полная информация по теме.

Если вы публикуете что-то в глобальной сети и используете в тексте аббревиатуры, то неплохо бы на той же странице использовать и расшифровку аббревиатуры. Плюс проверьте, что выдает поисковая машина на запрос с этой аббревиатурой.

Рассмотренный патент принадлежит Yahoo, но вполне возможно, что подобные идеи обсуждались или тестировались разработчиками и других поисковых машин.


Переводной материал, источник


(Нет голосов)
Читайте нас в Telegram - digital_bar

Есть о чем рассказать? Тогда присылайте свои материалы Даше Калинской


Новые 
Новые
Лучшие
Старые
Сообщество
Подписаться 
Подписаться на дискуссию:
E-mail:
ОК
Вы подписаны на комментарии
Ошибка. Пожалуйста, попробуйте ещё раз.
Отправить отзыв
    ПОПУЛЯРНЫЕ ОБСУЖДЕНИЯ НА SEONEWS
    Сколько ссылок помогут продвинуть молодой сайт
    Павел Андрейчук
    33
    комментария
    0
    читателей
    Полный профиль
    Павел Андрейчук - Дело в том, что вряд ли в ваших платных "качественных" кейсах найдётся хоть пару % действительно новой и полезной информации которой бы не было на общедоступных источниках.
    Рейтинг Известности 2018: второй этап народного голосования
    Константин Сокол
    3
    комментария
    0
    читателей
    Полный профиль
    Константин Сокол - Кто был ответственный за дизайн таблицы голосования? Копирайтер?
    Сайт на WordPress: за и против
    Мира Смурков
    1
    комментарий
    0
    читателей
    Полный профиль
    Мира Смурков - Людмила, я согласен с большинством комментаторов. Вы хоть один полноценный магазин сделали на этих движках? Woocommerce это система с супер возможностями. И к ней есть дополнительные модули, с функционалом, который вряд ли появиться на Битрикс. А самому это программировать - сотни тысяч рублей на разработку. А приведя в пример сложности с robots.txt и Sitemap вы ставите под вопрос вашу компетенцию в понимании Интернет-бизнеса и веб-разработки в целом. Во-первых это такие мелочи, а во-вторых это все делается на вордпресса за 2 минуты, и опять же с возможностями многократно превышающими Битрикс.
    Обзор популярных CMS: плюсы и минусы
    Гость
    1
    комментарий
    0
    читателей
    Полный профиль
    Гость - как по мне joomla! самая удобная и гибкая система из всех современных (я про wp раньше так думал, пока меня в Extrit не убедили в обратном). Раньше всегда оставался на техподдержке, потому что сам заполнять не мог, а теперь делаю это сам, потому что админка простая как палка. + на других цмсках при просьбе что-то добавить мне либо цену загибали овер 100500 либо говорили - нереально, делай новый сайт. А на joomla норм
    Google обошел Яндекс по популярности в России в 2018 году: исследование SEO Auditor
    Рамблер
    1
    комментарий
    0
    читателей
    Полный профиль
    Рамблер - Вот вроде отечественный - это сказано верно.. «Я́ндекс» — российская транснациональная компания, зарегистрированная в Нидерландах. Так говорится в Википедии. И с хрена ли ОТЕЧЕСТВЕННЫЙ поисковик зарегистрирован в Европе? И где платится основная часть налогов? Ну-ууу, точно не в России. И если запахнет жаренным, то был Яндекс и нет Яндекса!
    8 методик в SEO, от которых давно пора отказаться
    Евгений Сметанин
    11
    комментариев
    0
    читателей
    Полный профиль
    Евгений Сметанин - Факторов вообще очень много, согласитесь, вы будете использовать максимальное их количество, особенно, если в ТОПе засели агрегаторы с сумасшедшими ПФ. В таких случаях, вхождение ключа в домен для маленького профильного сайта, сыграет свою положительную роль. Конечно же, если контент на страницах хорошего качества. У меня есть несколько успешных кейсов на эту тему. На сайте продают несколько видов товаров, а выстреливает в ТОП тот, название которого присутствует в доменном имени. Как корабль назовешь, так он и поплывет, верно?))
    Инструкция: настраиваем цели Яндекс.Метрики через Google Tag Manager
    Roman Gorkunenko
    1
    комментарий
    0
    читателей
    Полный профиль
    Roman Gorkunenko - Здравствуйте. Подскажите, пожалуйста, можно с айпи метрики вытащить среднюю стоимость клика по утм меткам? В метрике есть такой шаблон tags_u_t_m, но он не совместим с меткой директа, у них разные префиксы.
    Аудит структуры интернет-магазина мебели от «Ашманов и партнеры»
    Дмитрий
    11
    комментариев
    0
    читателей
    Полный профиль
    Дмитрий - Сергей, а вы допускаете, что вся ваша жизнь - seo-миф?
    Идеальный каталог для продвижения сайта: структура и функционал
    Татьяна Ягутьева
    6
    комментариев
    0
    читателей
    Полный профиль
    Татьяна Ягутьева - Уважаемый Денис, сделайте сами напишите свою статью. Посоветуйте другую универсальную CMS, желательно идеальную по всем параметрам. Битрикс очень сильно зависит от разработчика. Если у него прямые руки - бардака не будет. А вообще, конечно, холивар на тему CMS/конструкторов/фреймворков - наверное, вечный. Давайте не будем начинать :)
    Как выбрать подрядчика для продвижения сайта: 7 уровней воронки поиска
    aashutosh
    1
    комментарий
    0
    читателей
    Полный профиль
    aashutosh - data science training institute in noida- Webtrackker Technology (8802820025) providing Data Science Training in Noida. Get ✓ 40 Hours Learning training✓ 70 Hrs Projects ✓ 24 X 7 Support ✓ Job Assistance. WEBTRACKKER TECHNOLOGY (P) LTD. C - 67, sector- 63, Noida, India. E-47 Sector 3, Noida, India. +91 - 8802820025 0120-433-0760 +91 - 8810252423 012 - 04204716 EMAIL:info@webtrackker.com webtrackker.com/Best-Data-Science-Training-Institute-in-Noida.php
    ТОП КОММЕНТАТОРОВ
    Комментариев
    910
    Комментариев
    834
    Комментариев
    554
    Комментариев
    540
    Комментариев
    483
    Комментариев
    373
    Комментариев
    345
    Комментариев
    262
    Комментариев
    246
    Комментариев
    171
    Комментариев
    156
    Комментариев
    137
    Комментариев
    121
    Комментариев
    100
    Комментариев
    97
    Комментариев
    97
    Комментариев
    96
    Комментариев
    80
    Комментариев
    74
    Комментариев
    67
    Комментариев
    60
    Комментариев
    59
    Комментариев
    57
    Комментариев
    56
    Комментариев
    55

    Отправьте отзыв!
    Отправьте отзыв!