Что должен знать о Яндексе каждый. Часть 1

Название самой популярной поисковой системы по русскоязычному Интернету, т.е. Яндекса, означает «Языковой index», а также имеет несколько других схожих трактовок, общий смысл которых выражается слоганом «Найдется все». Прогрессирующая конкуренция среди поисковых машин заставляет более предвзято относиться к подобным обещаниям, т.к. мало найти все, надо уметь найти самой главное. Однако поисковая система Яндекс довольно успешно с этим справляется, чем и оправдывает право называться сегодня самым посещаемым ресурсом Рунета.
Официально поисковая машина Яндекс была представлена в сентябре 1997 года и сразу же начала победное восхождение на вершины славы. Периодом наиболее бурного развития Яндекса был 1999 год, характеризующийся молниеносным увеличением Рунета как в объемах текстов, так и по количеству пользователей почти на порядок.

В конце 2002 года Яндекс вышел на самоокупаемость, т.е. достиг превышения доходов над расходами. В данный момент более 60% доходов Яндекс получает от контекстной рекламы и около 20% - за переходы пользователей в электронные магазины. Известность принесла не только славу, но и трудности, проявившиеся в очередях на покупку рекламных мест на портале.

Сегодня Яндекс – это крупнейший портал, предоставляющий кроме поискового сервиса и каталога большое количество разнообразных веб-служб: новости, энциклопедии, словари, каталоги товаров, бесплатную почту, хостинг, платежную систему и многое другое.

Ежедневно портал посещают около двух миллионов человек с учетом зарубежных гостей. При этом из всех российских пользователей, заходящих в Сеть в течение дня, в среднем около 75% посещают и сайт Яндекса.

За последние полгода Яндекс особенно усилил свои позиции, что отразилось в увеличении посещаемости примерно на 60% и достижении цифры в почти 10 млн. человек в месяц (около 80% приходят из Рунета). На данный момент Яндекс вдвое популярнее Рамблера и на столько же популярнее остальных поисковых систем русскоязычного Интернета вместе взятых. Поиск остается самой востребованной функцией портала, который обрабатывает в месяц около 150 млн. запросов.

Яндекс обладает наиболее полным и актуальным индексом страниц русскоязычного Интернета. Качественный поиск обеспечивается тщательной лингвистической и технической проработкой текстов. Алгоритм нечеткого поиска, а также качественный морфологический и синтаксический анализ позволяют Яндексу понимать запросы на естественном языке. Поэтому начинающие пользователи, чтобы не утруждать себя правилами использования служебных слов при построении поисковых запросов, могут их формулировать, например, так: «где арендовать офис в центре Минска». Средняя длина запроса на Яндексе примерно равна 2,8 слова, а в 1997 году она составляла 1,2 слова. Приведенные цифры отражают тенденцию повышения уровня владения интернет-пользователями возможностями информационного поиска.

Яндекс прекрасно понимает русский язык и может образовывать и понимать любые словоформы. Например, если введен запрос на слово «думать», то машина выдает результаты поиска также и по словам «думал», «подумавши» и даже «разум».

Паук Яндекса индексирует все документы в русскоязычной части Интернета, в том числе и в странах СНГ. Наши белорусские пользователи отдают подавляющее большинство запросов на поиск информации именно Яндексу, оставляя далеко позади местные поисковики. Для поиска по Байнету желательно установить в настройках поиска ограничение по региону (http://www.yandex.ru/regions.html).

Ежедневно Яндекс решает во благо пользователя такие же насущные проблемы, как и любой другой известный поисковик: корректного ранжирования, обновления и синхронизации индекса, работы с различными языками и кодировками, дублирующейся информации, поддержания свежести базы данных и т.д.

Размер индексной базы наряду с качеством поиска является одним из основных показателей, характеризующих поисковую систему. Примером тому служит молниеносный рост популярности таких машин как Google и Fast, который идет пропорционально развитию объема их индекса. Рост базы Яндекса кроме технических проблем, которые он успешно решает благодаря кластерной структуре (т.е. размещению индекса на нескольких серверах), сталкивается с необходимостью отсеивать повторяющиеся документы, происхождение которых многообразно. Один и тот же документ может быть представлен в различных кодировках и форматах, может содержать незначительные включения в виде даты публикации, рекламы или ремарок другого втора. Активному копированию и редактированию постоянно подвергаются новости, юридические документы, прайс-листы, статьи.

Поисковой машине не выгодно хранить дублированные документы в базе, а также засорять выдачу почти одинаковыми документами. Методика Яндекса по выявлению дубликатов постоянно совершенствуется. Ее необходимо учитывать, соблюдая такие правила. Если сайт имеет несколько зеркал, то первым индексацию в Яндексе должно пройти главное из них, т.к. часто остальные идентичные сайты игнорируются. Например, если на сайте размещаются перепечатанные с других ресурсов статьи, то, чтобы избежать попадания страницы в дубликат и исключения из результатов поиска, можно разбить текст статьи на несколько частей или использовать побольше побочного текста (ремарок редактора, перекрестных ссылок на материалы подобной тематики этого же сайта и т.д.). И наоборот, если ресурс продвигается за счет публикуемых на нем статей, чтобы после перепечатки на другие сайты статья не была идентифицирована Яндексом в качестве дубликата, не рекомендуется ставить с этой страницы ссылки на перепечатанные варианты, а, наоборот, со страниц-дублеров ссылаться на оригинал.

Яндекс как мощная поисковая система обходит Сеть за несколько дней. Однако по мере роста системы основная нагрузка ложится уже не на индексирующего робота, а на поиск и выдачу результатов. В ближайшее время планируется активное внедрение на Яндексе традиционных для многих систем с мировым именем технологий эшелонирования и прюнинга. Суть первой методики состоит в разделении индекса на две части: более релевантную и менее релевантную. Сначала поиск осуществляется в первой и, если результат не удовлетворяет количественно, поисковая машина обращается ко второй части индекса.

Технология прюнинга (от англ. pruning – отсечение, сокращение) позволяет динамически прекращать обработку запроса при накоплении достаточного количества релевантной информации. Эта технология значительно сокращает время поиска и нагрузку на поисковик, тем более, заведомо известно, что большинство пользователей при просмотре результатов поиска чаще всего не заходят далее третьей страницы результатов.

Главный критерий приема сайта Яндексом – это текст, написанный на русском языке. Поисковая система имеет достаточно быстрый поисковый робот, который позволяет при первичной индексации странице уже через 2-4 часа появляться в результатах поиска. Далее страница ставится системой в очередь на полную индексацию, после которой она иногда может пропасть из результатов поиска, если будет принята за спам, или из-за каких-либо технических проблем. Поэтому позицию страницы нужно отслеживать в течение нескольких дней, пока Яндекс проведет полную индексацию. Кроме того, список результатов, выдаваемых Яндексом, может меняться зависимости от загруженности серверов. После индексации главной страницы, остальные обычно включаются в индекс примерно через две недели.

Яндекс, обнаруживая новую или измененную страницу, индексирует ее, разбивая документ на элементы: текст, заголовок, подписи к картинкам, содержимое тега описания, текст ссылок и некоторые другие. При этом учитываются позиции слов, то есть их положение в документе или его элементе. Сам документ Яндекс не хранит, поэтому и создает очень компактный индекс. Робот регистрирует дату последнего обхода каждой страницы, дату ее изменения, присланную сервером, и дату внесения последних изменений в базу. Яндекс оптимизирует обход Сети таким образом, чтобы чаще посещать наиболее изменяемые ресурсы. Обычно переиндексация происходит раз в две-три недели. Изменения, внесенные в уже проиндексированные страницы, робот отслеживает самостоятельно при следующем заходе на сайт.

У робота Яндекса свой график деятельности и изменить его, например, как в других поисковиках, не представляется возможным, т.к. Яндекс игнорирует тег .

Чтобы выяснить, проиндексировал ли Яндекс сайт, необходимо на странице www.yandex.ru/addurl.html ввести в поле регистрационной формы адрес сайта и проанализировать результаты. Если будет выдано сообщение что «Ваш URL был только что внесен в нашу базу данных», это значит, что сайт будет проиндексирован в ближайшее время. Если получено сообщение «Ваш URL уже проиндексирован. Вы можете посмотреть, какие страницы вашего сайта проиндексированы в Яndex.Ru к настоящему времени», то, нажав на ссылку «проиндексированы в Яndex.Ru», можно получить весь список документов ресурса, которые были проработаны поисковиком. Если регистрируемый сайт пропал из результатов поиска (чаще всего по техническим причинам самой машины), можно воспользоваться описанным выше способом, чтобы убедиться, что сайт все-таки прописан в индексе. Обычно при этом выдается сообщение о том, что «Ваш URL уже известен роботу. Данный ресурс будет проиндексирован в ближайшее время».
Яндекс постоянно совершенствует поисковый механизм. Последние изменения оказались наиболее кардинальными и внесли новизну не только
в способ формирования результатов выдачи, но и значительно расширили возможности поиска. Чтобы составить о Яндексе полное впечатление, необходимо обязательным образом рассмотреть факторы, которые влияют на рассчитываемую поисковиком релевантность страниц введенному запросу. А об этом будет рассказано в следующей статье.

Автор: Татьяна Зуенок
Источник: WWW.THEWEB.ORG.RU
Комментарии и отзывы
Обзоры:
Новости:
Как победить в любом опросе или голосовании?

Крупные компании и спонсоры активно ведут постоянные розыгрыши призов путем голосования или опросов в инт...
Теперь можно создавать Messenger Rooms через Instagram и WhatsApp

Весной этого года Facebook представила новую функцию Messenger Rooms для своих приложений Facebook и Mess...
Новая функция Facebook позволит очистить свое прошлое в социальной сети

Facebook внедряет новую функцию, которая позволяет вам «следить за своим присутствием» в социальной сети...
Возможности 30-кратного зума Redmi 10X 5...
Возможности 30-кратного зума Redmi 10X 5Компания Redmi опубликовала новые фото, сделанные на камеру ожидаемого смартфона Redmi 10X 5G. На этот ра...
Обзор ASUS ROG Strix XG27UQ. Игровой IPS...
Обзор ASUS ROG Strix XG27UQ. Игровой IPSТестируемый сегодня монитор ASUS ROG Strix XG27UQ не ориентирован на массовый сегмент. Это «бриллиант» в ...
Midea VCR03 можно забрать со скидкой...
Midea VCR03 можно забрать со скидкойВ последнее время производители умных пылесосов начали отлично себя чувствовать на рынке, так как пользов...
Появились скриншоты новой оболочки MIUI ...
Появились скриншоты новой оболочки MIUI В сети появились первые изображения новой оболочки MIUI 12 китайской компаний Xiaomi. ...
Лучшая беспроводная игровая мышка. Xiaom...
Лучшая беспроводная игровая мышка. XiaomНа современном рынке компьютерной периферии довольно много различных моделей, которые отлично справляются...
Samsung Galaxy A10s получил обновление д...
Samsung Galaxy A10s получил обновление дКомпания Samsung выпустила обновление до операционной системы Android 10 для бюджетного смартфона Galaxy ...
Планшет Galaxy Tab S6 Lite засветился на...
Планшет Galaxy Tab S6 Lite засветился наНа официальном сайте Samsung, а именно в немецком разделе обнаружились две страницы поддержки, которые по...
Смартфон Honor Play 4 Pro получит двойну...
Смартфон Honor Play 4 Pro получит двойнуСетевые инсайдеры поделились изображениями и характеристиками смартфона Honor Play 4 Pro, который еще не ...
Смартфон Oppo A12 протестирован в бенчма...
Смартфон Oppo A12 протестирован в бенчмаСегодня в базе данных Geekbench обнаружился смартфон Oppo A12. Тестируемый образец был оснащён восьмиядер...
Событие PC Gaming Show пройдет 6 июня в ...
Событие PC Gaming Show пройдет 6 июня в Международный журнал о компьютерных играх PC Gaming планирует провести свое шоу 6 июня. Наряду с другими ...
Смартфон Sony Xperia L4 появился в прода...
Смартфон Sony Xperia L4 появился в продаКомпания Sony начала продажи смартфона среднего уровня Xperia L4, который был представлен пару месяцев на...
Смартфон Motorola Razr подешевел на 500 ...
Смартфон Motorola Razr подешевел на 500 Компания Motorola решила подстегнуть спрос на складной смартфон Razr, который на выходе был оценен во вну...
МегаОбзорМегаОбзор
ЭЛ № ФС 77 - 68301. Выходные данные СМИМегаОбзор
MegaObzor в социальных сетях:
Яндекс.Метрика
2006-2020 © MegaObzor