Эффективные советы по поиску информации в интернете. Технология поиска информации в Интернете: информационные поисковые системы Интернета

Благодаря возможности поиска информации в интернете любой человек способен быть в курсе всех новостей, получать необходимые для работы или учебы сведения и расширять свои знания. Однако количество данных, загружаемых в Сеть, беспрестанно растет, и порой найти в этом изобилии необходимые материалы очень трудно.

Чтобы не оказаться в такой ситуации, человек должен обладать умением осуществлять поиск информации в интернете. Для этого необходимо знать, как работают поисковые системы, уметь четко составлять запрос и владеть некоторыми приемами, значительно упрощающими поиск.

Понятие поисковой системы

Привычные всем нам Google и Yandex или уже многими позабытые Yahoo и "Рамблер" являются главными инструментами поиска информации в сети Интернет. Они представляют собой сложную систему, состоящую из специализированных программ и мощных компьютеров. Ее принцип действия прост: пользователь формирует поисковый запрос, а система отвечает перечнем ссылок на источники информации. Ссылки выстраиваются в порядке релевантности, то есть соответствия запросу.

Первоначально интернет был достоянием немногочисленных организаций, а количество содержащейся в нем информации - небольшим. Но постепенно ситуация менялась. В 1994 году появляется сайт Yahoo.com, который, по замыслу его создателей, должен был искать нужные сведения в открытых каталогах сайтов. Однако скорость пополнения Всемирной паутины новой информации была столь большой, что поиск по каталогам очень быстро утратил целесообразность. В том же 1994 году для поиска информации на интернет-ресурсах была создана первая полноценная поисковая система WebCrawler, а три года спустя был запущен Google и анонсирован Yandex.

Характеристики поисковой системы

Возрастающий объем информации требует улучшения основных показателей качества работы поисковиков. К таковым относятся:

  • Полнота, то есть соответствие полученного перечня ссылок поисковому запросу.
  • Точность или соответствие найденных источников запросу.
  • Актуальность информации.
  • Скорость поиска, выражающаяся в устойчивости серверов к нагрузкам. Это соотношение выражается в прямой зависимости: чем больше запросов формулируют пользователи, тем оперативнее на них должна отвечать поисковая система.
  • Наглядность, заключающаяся в обеспечении для пользователя более удобного отбора необходимых ему сайтов в рамках выданных системой результатов.

Для того чтобы перечисленные характеристики находились на максимально возможном уровне, поисковые системы применяют два основных способа нахождения ресурса.

Первый связан с иерархической структурой каталогов информации. Верхние строчки занимают общие категории ("Семья", "Искусство", "Наука"), которые впоследствии делятся на более частные разделы (например, в категории "Наука" можно выделить разделы "Математика", "Физика", "История"). Разделы тоже дробятся на составные части, внутри которых находятся еще более мелкие элементы - и так до самых нижних уровней, в которых уже будет находиться искомая информация.

Второй способ поиска информации в интернете основывается на ключевых словах. Любой запрос пользователя включает в себя некое количество наиболее повторяемых в связи с интересующей темой лексем, а поисковая система выдает список сайтов, на которых они встречаются чаще всего.

Программные компоненты поисковой системы

Для облегчения поиска информации в интернете и повышения качества выдаваемой пользователю информации программы, входящие в модуль индексирования, постоянно совершенствуются. Процесс работы поисковика делится на три этапа, на каждом из которых функционируют специально разработанные для этого роботы:

  1. Spider ("Паук") скачивает web-страницы и извлекает из них все содержащиеся ссылки.
  2. Crawler ("Путешествующий паук") переходит по всем извлеченным на предыдущем этапе ссылкам и определяет дальнейшие направления поиска.
  3. Indexer ("Индексатор") анализирует все скаченные web-страницы на соответствие содержащейся в них информации запросу.

Аппаратные компоненты поисковой системы

Важным элементом функционирования поисковика является сервер, обеспечивающий качество и скорость нахождения необходимой информации. На первом этапе своей работы он анализирует пользовательский запрос. Результаты анализа проверяются по всем скаченным файлам и ранжируются по соответствию запроса найденным файлам. Полученный список может быть скорректирован дополнительными условиями поиска, заданными пользователем.

По итогам предшествующих этапов формируется сниппет - аннотация к найденным источникам, в которой выделяются слова, входящие в запрос. Именно сниппет пользователь видит на странице выдачи поисковых результатов.

Этапы поиска информации

В первую очередь необходимо сформулировать запрос. На этом этапе пользователь должен составить четкое представление о том, какой результат ему нужен. Далее планируется ход поисковой процедуры. Под ним подразумеваются стратегии поиска информации. В интернете для этого могут быть использованы конкретные сайты или их каталоги, более тщательное изучение уже известного контента или просмотр готовых баз данных (например, электронные библиотеки).

На заключительном этапе производится выделение искомой информации из результатов, представленных на странице выдачи поисковых результатов.

Методика поиска

Нельзя игнорировать даже кажущиеся элементарными правила поиска информации в интернете, такие как:

  • проверка орфографии (несмотря на то что современные поисковые системы автоматически исправляют допущенные ошибки, результат порой может отличаться от необходимого, если запрос составлен некорректно);
  • определение цели поиска (например, по запросу "ремонт ноутбука, цена" пользователь может получить список адресов компьютерных сервисов, в то время как ему была необходима именно средняя стоимость устранения поломки);
  • установка необходимых ограничений (так, в предыдущем примере поисковая система могла бы выдать информацию о стоимости ремонта ноутбуков в Санкт-Петербурге живущему в Москве пользователю, не установи он географический ареал поиска).

Но и с соблюдением этих принципов порой оказывается затруднительно получить необходимые сведения. Умение осуществлять поиск информации в интернете предполагает, что пользователь владеет особыми навыками, позволяющими скорректировать запрос.

Особенности поиска по ключевым словам

Совсем необязательно вбивать в строку поиска подробные сочинения по интересующей проблеме. Система в любом случае выберет наиболее частотные слова и, отталкиваясь от них, будет формировать результат. Однако для уточнения искомой цели можно использовать логические операторы.

Знаки "+" и "-" позволяют потребовать от системы, чтобы определенное слово обязательно присутствовало или отсутствовало в найденных источниках. Важно, чтобы знак писался слитно с необходимым словом: "ремонт ноутбука +цена".

Чтобы результат поиска буквально соответствовал запросу, рядом с ним нужно поставить восклицательный знак. По запросу "!цена" будут выдаваться только сайты, касающиеся стоимости какой либо услуги, а не сценарии детских утренников.

Если нужно получить точное соответствие фразе, а не отдельному слову, эту фразу нужно заключить в кавычки. Особенно это полезно, когда при помощи цитаты нужно найти целое произведение или высказывание какого-либо известного человека.

Расширенный поиск информации в интернете

В случае если все предыдущие советы не помогли получить искомый результат, можно воспользоваться некоторыми дополнительными функциями, которые предлагаются каждой поисковой системой. В особенности это касается возможности расширенного поиска.

Пользователю предлагается ряд фильтров, применение которых позволяет скорректировать заданные условия. Например, можно установить жесткую последовательность входящих в запрос слов, указать место их расположения на странице или уточнить форму вхождения в текст. Также можно задать образец, на который должна ориентироваться система в процессе поиска, например определенный сайт.

Функция расширенного поиска, помимо прочего, предлагает возможность задать время интересующей публикации, а также регион. Если пользователь ищет некий документ (закон, нормативный акт, публикацию произведения или исторического источника), он может сразу указать необходимый формат.

Другие способы поиска

Объем выкладываемых в Сеть данных ежедневно возрастает. Логические команды, расширенный поиск или обладание специализированными навыками поиска информации зачастую оказываются лишь одним из многих инструментов нахождения необходимых сведений.

В числе других способов поиска информации в интернете можно назвать переход по гиперссылкам, встречающимся на web-странице. Это позволяет уточнить или расширить уже найденные сведения или обнаружить новые. Еще один популярный метод поиска - по картинке. Загрузив любую фотографию в поисковик, пользователь может рассчитывать на то, что система обнаружит на ней соответствия с другими изображениями и выдаст нужные сведения о человеке, предмете или явлении.

Наконец, не следует забывать о том, что многие компании или административные органы имеют свои сайты, на которых тоже могут содержаться нужные сведения, что значительно облегчает процесс поиска информации в интернете.

В глобальной сети Интернет можно найти информацию по любой интересующей теме. Но самое трудное в работе с сетью Интернет — найти нужную информацию. Т. к. Интернет не имеет четкой централизованной структуры, развивается хаотично, и в мире появляются все новые и новые серверы, вопросы поиска информации становятся очень актуальными.

Поисковые системы значительно облегчают работу в Интернет и помогают нам быстро найти нужную информацию в огромном массиве серверов Интернет. Во всемирной паутине Интернет находится несколько тысяч поисковых систем, среди которых есть как уже хорошо зарекомендовавшие себя, так и менее известные.

Наиболее популярные поисковые системы

  • Яндекс — средство полнотекстового поиска информации с учетом морфологии русского языка; поиск по сайтам, своему каталогу, новостям, товарам, географическим картам, словарям, блогам, картинкам, документам Microsoft Office и adobe acrobat PDF
    • Яндекс
  • Rambler (ОАО «Рамблер Интернет Холдинг») — поиск по сайтам с учетом морфологии русского и английского языков; имеет и каталоговую систему поиска.
    • Rambler Lite: поисковая система — краткий вариант страницы поиска
  • Поисковый сервис Спутник (ОАО "Ростелеком") — поиск по сайтам, госуслугам и др.; безопасный поиск
  • NIGMa — интеллектуальная поисковая система (МГУ им. М. В. Ломоносова и Stanford University) — поиск документов, картинок, книг, новостей через Google, Yahoo, MSN, Yandex, Rambler, altavista, Апорт; также система предоставляет уникальный поиск по химическим формулам и реакциям
  • Google — поиск по сайтам (есть возможность поиска по русскоязычным сайтам); поиск документов в форматах adobe acrobat PDF, Microsoft Office, PostScript, Corel WordPerfect, Lotus 1-2-3 и др.; поиск картинок, видео, новостей, поиск по картам; возможность поиска по русскоязычным и российским сайтам; есть система перевода текста на др. языки (49 языков)
  • Bing (Microsoft Corp.) — поиск по сайтам, изображений и видео; возможность поиска по русскоязычным и российским сайтам; есть система перевода текста на др. языки (22 языка)
  • Yahoo! (Yahoo) — поиск по сайтам, адресам E-Mail и др.

Каждая из поисковых систем имеет какие-то свои достоинства и недостатки, которые определяются принципом работы поисковой машины, удобством использования, ее оформлением, сложностью языка запросов, наличием различных расширенных функций (управление форматом и ранжированием выводимой информации, исправление орфографических ошибок и ошибочной раскладки клавиатуры при вводе ключевых слов, перевод страницы на др. языки т. д.), скоростью работы, и др. параметрами. Выбор поисковой системы для конкретного применения определяется целью поиска, характером искомой информации, желаемым форматом выводимых данных и шириной охвата отслеживаемых адресов серверов в мире Интернет.

Поиск по ключевым словам. Язык запросов поисковой системы

Поисковая система обычно имеет поле для ввода ключевых слов, по которым она находит документы, содержащие эти ключевые слова. Чем лучше (качественнее) составлен запрос к поисковой машине, тем меньше общее количество найденных документов, и больше из них документов, соответствующих тому, что Вам требуется. Если запрос очень простой или составлен неграмотно, то поисковая машина может Вам выдать несколько миллионов документов, которые Вам не просмотреть за всю жизнь.

Используя язык запроса, содержащий логические операции (логические операторы AND, OR, NOT, скобки и др.), префиксы обязательности присутствия ключевых слов в документе «+» и «-» (при,поиске по узкоспециализированным терминам — предпочтительней использовать), расположения ключевых слов в документе рядом или на определенном расстоянии и т. д.) и др. элементы, и большее количество связанных ими ключевых слов, можно значительно сузить область поиска и более качественно составить запрос к поисковому серверу. Следует учитывать, что разные поисковые системы могут иметь как различающиеся языки запросов, так и очень похожие.

Некоторые поисковые системы дополнительно имеют функцию расширенного поиска, позволяющую пользователю более точно описать то, что ему конкретно нужно и без знания языка запроса. Функцию расширенного поиска имеют, например, поисковые системы Яндекс и Google .

Основные типы поисковых систем. Какой поисковой системой воспользоваться

Существует 2 основных типа поисковых систем Интернет: индексные и классификационные (каталоговые). Индексные поисковые системы (например, Яндекс , Rambler , Спутник , Google , Bing и др.), работая в автоматическом режиме обновления своей информации, просматривают в Интернет содержимое серверов, индексируя информацию, содержащуюся в них и внося информацию о расположении слов на страницах сайтов в свои базы данных. Каталоговые системы поиска (например, Rambler , Yahoo! и др.) содержат тематически структурированный каталог серверов, и чаще всего пополняются вручную. Обычно на WWW-странице классификационной поисковой системы содержится и поле для ввода ключевых слов для поиска в собственной базе данных. В каталоговой системе поиска можно, начав с более крупной тематической рубрики, и постепенно спускаясь дальше по рубрикам, прийти к ссылке на нужный Вам сайт. В одних случаях бывает удобней воспользоваться первым типом поисковых систем, в других — вторым. Есть поисковые системы, сочетающие в себе оба принципа работы. В частности, многие индексные поисковые системы имеют и каталоговую систему поиска. Также поисковые машины могут использовать и какие-то другие принципы методы поиска.

Многие поисковые системы преобразовались в Интернет-порталы, объединяющие в себе большое количество ресурсов и сервисов. На страницах таких порталов можно прочитать новости, ознакомиться с программой телепередач, узнать о погоде, курсах валют, воспользоваться картографическим сервисом и мн. др.

Наиболее популярные российские поисковые системы имеют возможности поиска с учетом особенностей русского языка.

Для поиска одновременно в нескольких поисковых системах можно воспользоваться так называемыми поисковыми метамашинами, обращающимися сразу к нескольким поисковым средствам, например, NIGMa .

Существуют также поисковые системы, специализирующиеся по поиску по одной какой-либо теме (например, по информационным технологиям, по музыке, по ресурсам, посвященные природе и т. д.)

Эффективный поиск информации с использованием компьютера – актуальная задача, возникающая не только перед начинающими, но и бывалыми пользователями сети интернет, ведь кто владеет данными – тот владеет миром, как гласит всем хорошо известная поговорка. Сегодня мы разберем способы быстрого поиска необходимой и важной информации в русскоязычном интернете . На данный момент их выделяют всего три вида:

  • Поиск информации по прямой ссылке в сети
  • Поиск с помощью интернет серфинга
  • Правила поиска информации в сети интернет
  1. через указание прямого адреса сайта, где размещены нужные данные и необходимая информация;
  2. серфинг по ссылкам с помощью персонального компьютера в сети интернет;
  3. с помощью поисковых систем (машин) в интернет.

Рассмотрим более развернуто все способы поиска актуальной информации в сети с помощью компьютера.

Поиск информации по прямой ссылке в сети

Если вы уже знаете, по какому адресу в интернете размещена нужная вам информация, то тогда поиск с помощью компьютера заметно облегчается: достаточно просто вбить адрес сайта в браузерную строку и ознакомиться с предложенными данными. Если перед вами открылся объемный текст на странице сайта в интернете, а вас интересует буквально несколько строчек, спрятанные в «тонне» печатных символов, то можете воспользоваться внутристраничным поиском. Для этого нажмите сочетание клавиш Ctrl и F (любой раскладки клавиатуры компьютера), а в предложенную графу «Найти» вбейте фразу или слово, которое точно содержится в абзаце с информацией, которую ищете, после чего нажмите «Enter».

В браузере подсветятся другим цветом все слова, упоминающиеся на странице и похожие на то слово, которое вы ищете. Однако довольно часто случается так, что мы не помним или вообще не знаем ссылки с местонахождением информации в интернете. В этом случае удобнее всего прибегнуть к другим двум видам поиска данных с помощью компьютера.

Поиск с помощью интернет серфинга

Интернет серфинг – поиск, при котором осуществляется последовательный переход по ссылкам с одного тематического сайта на другой до тех пор, пока не будет найден источник нужных данных. Преимущество такого способа интернет-поиска данных заключается в его увлекательности и возможности освоить большой объем информации из разных сайтов последовательно и основательно. Среди недостатков этого вида поиска находится его длительность, а также то, что на первоначальный сайт, с которого начнется ваш серфинг, тоже нужно как-то попасть. А если вы не располагаете адресом сайта, с которого начнете серфинг, то здесь вам придется прибегнуть к помощи такого способа поиска, как поисковые системы.

Способы поиска информации в сети с помощью поисковиков

Сегодня широко известны публике Рунета такие поисковые машины, как Яндекс.ru, Rambler.ru, Google.ru. Эти сайты позволяют искать данные по вводимому запросу на всех сайтах интернета. По принципу работы поисковые системы бывают двух видов: поисковые индексы и поисковые каталоги:

  • Поисковые каталоги. Эти сайты оказывают помощь в поиске данных определенной тематики в сети интернет: информация в таких каталогах четко структурирована по группам и темам, что способствует быстрому нахождению результата. В каждой теме пользователю предлагается ряд ссылок на сайты, где можно найти интересующие его знания.
  • Поисковые индексы. Это сайты-указатели, в которых при введении ключевого слова в строку поиска, пользователь получает ряд ссылок на страницы в интернете, где содержится запрашиваемое слово или фраза. Поисковые индексы осуществляют поиск с помощью специальных программ, называемых «пауками», сканирующих страницы сайтов в интернете на предмет их тематики. После такого скана поисковик заносит их в свою базу, из которой позже и «достается» информация при вводе пользователем запроса в поисковую сроку.

Правила поиска информации в сети интернет

Сейчас рассмотрим основные, но важные правила эффективного поиска актуальной информации в русскоязычной сети интернет с помощью компьютера.

  1. Формируйте правильную ключевую фразу для обращения к поисковой системе. Нельзя использовать только одно слово для поиска, если вы хотите получить действительно полезный результат, а также не стоит вводить и слишком большие фразы. Оптимальный размер поискового запроса составляет от 2 до 4 слов. Если в результатах поиска поисковиком найдено слишком мало результатов, то стоит попробовать переформулировать введенную фразу, заменив некоторые слова синонимами, а также проверить наличие орфографических ошибок в словах. Запомните: нет такой информации, которой нет в интернете. Просто подбирайте правильные слова, соблюдайте правила и вы найдете то, что ищете.
  2. Применяйте специальные операторы. Современный эффективный и быстрый поиск любой необходимой информации посредством поисковика и с помощью персонального компьютера подразумевает знание и применение некоторых хитростей, которыми являются сокращения и специальные символы-операторы. Операторы – значки, используемые при формировании запроса в поисковой системе и облегчающие поиск необходимых данных. Рассмотрим самые распространенные операторы и их значения, которые могут пригодиться на практике.
  3. Пробел или знак & - означает, что требуется искать документы с требуемым словосочетанием в пределах одного предложения. Пример ввода в поисковую строку: вкусный рецепт или вкусный & рецепт.
  4. && - означает необходимость поиска страницы, на которой будут упомянуты отдельные слова из словосочетания в пределах всего текста, а не только одного предложения. Пример: вкусный && рецепт.
  5. | - вам будут предложены статьи, в пределах которых будет употреблено только 1 из введенных слов. Пример: брак | недостаток | дефект.
  6. + - означает поиск текста с обязательным сочетанием подряд слов, введенных между знаком «+». Пример: вкусный+рецепт.
  7. “ ” – поиск цепочки слов без ее разбивания на отдельные слова. Пример: “конфеты «Красная Поляна»”.

Соблюдая эти простые правила при поиске данных с помощью компьютера и интернета, вы облегчите себе задачу и всегда быстро сможете найти информацию, необходимую вам в любой момент времени.

Поиск информации в Интернете -- одна из наиболее востребованных операций в Интернете. Посетителям Интернета часто приходится искать документы по какой-либо тематике. Если у вас есть точный адрес документа в Интернете, то в этом случае проблем с поиском не возникает: в браузере в адресной строке можно набрать известный адрес ресурса, и при удачном соединении браузер выведет на экран нужную страницу.

Если точного адреса документа нет, то можно воспользоваться услугами поисковой машины. Поисковая машина? это «специализированный сервер в Интернете, который предлагает разнообразные средства поиска документов» . Пример поискового сервера -- сервер Рамблер (Rambler.ru), расположенный по адресу http://rambler.ru. Вид головной страницы сервера приведен на рисунке.

Рис. 1.

Поисковые серверы обычно составляют собственные каталоги ресурсов Интернета. Каталоги поисковых серверов регулярно пополняются информацией о создаваемых в сети ресурсах, которая поступает от поисковых роботов. Поисковые роботы или пауки -- это специальные сетевые программы, которые обращаются к доступным на текущий момент серверам Интернета, проводят анализ документов и пополняют таблицы своей поисковой машины. Работа по поиску и систематизации ресурсов поисковые роботы выполняют в фоновом режиме круглосуточно.

Еще один источник поступления на поисковые серверы информации о существующих сайтах -- явная регистрация ресурсов владельцами web-страниц. На сервере имеются формы, которые заполняют владельцы ресурсов. В форме задается адрес ресурса, краткая характеристика, ключевые слова, целевая аудитория и пр. Эта информация анализируется и добавляется в каталоги сервера автоматически специальными программами или «вручную» экспертами -- специалистами, следящими за формированием каталогов ресурсов.

Понимание механизмов поиска информации в Интернете позволяет разработчикам web-страниц готовить свои документы так, чтобы они могли быть в дальнейшем найдены поисковыми машинами и размещены в соответствующих разделах каталога ресурсов.

Поиск по ключевым словам в Интернет

Один из популярных способов поиска документов в сети WWW -- поиск по ключевым словам. При задании ключевых слов в поисковой форме поисковая машина будет искать документы, содержащие заданные ключевые слова. Разумеется, для выполнения запроса поисковая машина не станет исследовать содержание тысяч работающих в Интернете компьютеров -- результат такого поиска вам пришлось бы ждать не один день. Поиск ведется среди тех ресурсов (каталогов, таблиц) поисковой машины, которые были ранее собраны и систематизированы с помощью роботов и экспертов.

Поскольку объем ресурсов сети становится поистине безграничным, то по запросу на поиск документа по ключевому слову поисковая машина может найти несколько тысяч документов, содержащих указанное ключевое слово. Понятно, что в таком количестве документов трудно найти тот, который лучше всего соответствует заданной теме. Однако поисковые машины обычно дают возможность сформулировать более детальный запрос.

Запрос может иметь сложную форму и составляться с помощью ключевых слов и логических функций И (AND), ИЛИ (OR), отрицания (NOT) . Или же запрос на поиск может формироваться с помощью специальных символов, позволяющих задать (или отменить) словоформы ключевых слов. Такие механизмы помогают более точно сформулировать требования для отбора документов. Каждая поисковая машина имеет справочную систему, которая поможет посетителю составить поисковый запрос.

Цель: понимать основные принципы организации поиска информации в Интернете.

Задачи:

Образовательная:

  • формирование навыков поиска информации в сети Интернет;
  • использовать поиск и отбор информации в практической деятельности и повседневной жизни;

Развивающая:

  • развитие у школьников логического мышления, внимательности, творческого подхода к делу;

Воспитательная:

  • воспитание у учащихся ответственности к делу, интереса к информатике, коллективизма и взаимовыручки.

Тип урока: изучение нового материала.

Формы обучения: Фронтальная, индивидуальная, групповая.

Методы обучения: Словесный, наглядный, практический, поисковый.

Оборудование:

  • Компьютеры с выходом в Интернет, мультимедийный проектор, кабинет.
  • Презентация к уроку <Презентация >
  • Тест для учащихся <Приложение 1 >
  • Карточки с заданиями для групп <Приложение 2 >
  • Логические операторы <Приложение 3 >

План урока:

  1. Организационный момент – 2 мин.
  2. Приёмы поиска информации в сети Интернет – 18 мин.
  3. Служба World Wide Web (WWW)
  4. Поисковые каталоги.
  5. Поисковые системы.
  6. Формирование запросов на поиск информации.
  7. Работа в группах по поиску информации в Интернет – 15 мин.
  8. Выполнение теста – 5 мин.

Ход урока

1. Организационный момент.

2. Приёмы поиска информации в сети Интернет

Сеть Интернет растет очень быстрыми темпами, найти нужную информацию среди сотен миллиардов Web-страниц и сотен миллионов файлов становится все сложнее. Для поиска информации используются специальные поисковые системы, которые содержат постоянно обновляемую информацию о местонахождении Web-страниц и файлов на сотнях миллионов серверов Интернета.

Прежде, чем рассматривать информационно-поисковые системы, нам надо разобраться с вопросами - что мы можем искать и где , а после - как организовать такой поиск.

Хранения информации обычно завершается поиском конкретной информации для дальнейшего использования. Поиск органически связан с процедурой хранения, поэтому он не всегда выделяется отдельно.

Служба World Wide Web (WWW)

Это самая популярная служба современного Интернета. Именно её нередко отождествляют с Интернетом в целом, хотя на самом деле это лишь одна из его многочисленных служб.

Определение WWW

Основатель сети Тим Бернес-Ли дал такое определение.

WWW - это сеть серверов, распределённая гетерогенная информационная мультимедиа-система коллективного пользования.

Из определения понятно, какую огромную роль в современном обществе имеет компьютерная информационная среда. Среда WWW не имеет централизованной структуры. Все, кто желает разместить в Интернете свои материалы, не противоречащие законодательству, могут это сделать. Отдельный документ World Wide Web называют Web-страницей . Обычно это комбинированный документ, который может содержать текст, графические иллюстрации, мультимедийные и другие объекты. Отличительной особенностью среды WWW является наличие средств перехода от одного документа к другому, тематически с ним связанному, без явного указания адреса. Связь между документами осуществляется при помощи гипертекстовых ссылок. Огромное число гипертекстовых электронных документов, хранящихся на серверах WWW, образует своеобразное гиперпространство документов, между которыми возможно перемещение.

Связь между сотнями миллионов документов, хранящихся на физических серверах Интернета, не могла бы существовать, если бы каждый документ в этом гиперпространстве не обладал своим уникальным адресом. Файл одного локального компьютера обладает уникальным полным именем, в которое входит собственное имя файла с расширением и путь доступа к файлу, начиная от имени устройства, на котором он хранится. Определяя местоположение файла в Глобальной сети, надо расширить представление об уникальном имени файла. Адрес любого файла во всемирном масштабе определяется унифицированным указателем ресурса - URL . URL-адрес представляет собой стандартизованную строку символов, указывающую местонахождение ресурса, документа или его части в Интернете, и состоит из трех частей.

  • имя протокола для доступа к службе Интернет;
  • имя сервера, на котором хранится ресурс и работает сервер-программа службы Интернет;
  • полное имя файла, который хранится на сервере.

Для функционирования службы Интернет, необходимо серверное и клиентское программное обеспечение. Работу службы World Wide Web обеспечивают серверные программные средства - Web-серверы, и клиентские программы - Web-браузеры.

Информационно-поисковые системы

Информационные службы определяют технологию хранения, передачи информационных объектов и, соответственно, алгоритмы поиска.

Web-документы хранятся на Web-серверах, файлы и файловые архивы - на файловых серверах. В связи с этим, набор информационных объектов, доступных с помощью каждого сервиса, может рассматриваться как отдельное информационно-поисковое пространство.

Теперь, зная, что мы можем искать и где, обратимся к вопросу – как организовать такой поиск.

В настоящее время для поиска конкретной информации существуют так называемые информационно-поисковые системы или, как принято выражаться на языке Интернет, поисковые службы . Поисковая система представляет собой специализированный Web-узел. Принцип работы таких систем прост: пользователь должен объяснить системе, что ему необходимо получить, а задача поисковой службы состоит в том, чтобы найти и выдать список гиперссылок на страницы, на которых упоминаются соответствующие сведения.

Классификация поисковых служб:

  • по способу организации и пополнения базы данных о документах в сети на поисковые каталоги и поисковые машины;
  • по глубине охвата ресурса на глобальные и локальные.

Особенности поисковых каталогов

Поисковые каталоги устроены по тому же принципу, что и тематические каталоги крупных библиотек. Принципы работы с каталогами достаточно просты. Как правило, главная страница Web-сайта каталога содержит в себе список категорий, или рубрик, каждая из которых представлена гиперссылкой.

Работа с поисковыми каталогами интуитивно проста. В них поиск информации практически всегда завершается более или менее плодотворно. Однако за этой простотой скрывается высочайшая сложность создания и ведения каталога.

Важнейшей характеристикой каталогов является объем базы данных, т.е. количество представленных документов. Для глобальных каталогов данная величина составляет примерно 1-2 миллиона документов, что составляет порядка 0,1-0,2% от общего пространства WWW, и степень охвата общего объема ресурсов WWW непрерывно уменьшается из-за лавинообразного увеличения информационных ресурсов в Глобальной сети. Поэтому использование каталогов не может дать результатов, обладающих высокой полнотой.

По сравнению с поисковыми машинами скорость увеличения баз данных каталогов достаточно мала. Дело в том, что поисковые каталоги создаются вручную, коллективом высококвалифицированных редакторов, которых называют также модераторами. Однако это может рассматриваться и как преимущество поисковых систем, поскольку ручной отбор позволяет повысить точность поиска и распределение материалов по соответствующим рубрикам.

Другой характеристикой каталогов является количество категорий или рубрик в каталоге. Естественно, чем выше это значение, тем большей точностью характеризуются результаты поиска. Для глобальных каталогов это значение в настоящее время составляет несколько десятков тысяч.

Особенности поисковых машин

В поисковых машинах каталоги Web-ресурсов создаются автоматически специальными программами, называемыми поисковыми роботами или поисковыми указателями (а также “червяками”, “пауками”, “траулерами”, “автоматами”, “агентами” и т.п.). Из процесса наполнения базы данных поисковой системы исключается человеческий фактор. При этом падает качество ссылок, предоставляемых системой по результатам поиска, но одновременно увеличивается их количество.

Программа Поисковый робот осуществляет просмотр Сети с целью выявления новых документов для включения их в базу данных поисковой машины - индекс . Процесс занесения информации о документе в индекс называется индексированием .

Этапы работы поискового робота

  1. Сбор первичной базы данных.
  2. Индексация базы данных.
  3. Создание результирующего списка ссылок.

Формирование запросов на поиск информации

Осуществляя поиск информации в Интернете, мы вправе надеяться на полноту, точность и актуальность результатов поиска, к тому же результаты мы хотим получить как можно быстрее.

На часть из перечисленных факторов пользователь, проводящий поиск, не может повлиять. Например, скорость получения информации зависит от технических характеристик и загруженности каналов связи и серверов поисковых служб, а также особенностями алгоритмов, реализованных в поисковой системе. Однако, пользователь может повлиять на качество результатов поиска, если при проведении поисковых работ будет:

  • делать оправданный выбор информационно-поисковой службы;
  • учитывать особенности информационно-поисковой системы;
  • грамотно формулировать запросы на поиск информации.

Формирование запроса - это процесс выражения информационной потребности с помощью ключевых слов и комбинирования этих ключевых слов с помощью средств информационно-поискового языка системы.

На качество запроса оказывают воздействие три фактора: знание пользователем особенностей естественного языка, умение учитывать языковые особенности документов и знание структуры и особенностей информационно-поискового языка.

Структуры и особенности информационно-поискового языка

Для повышения точности результатов поиска, как уже было отмечено, важно грамотно формулировать запросы на поиск информации. Информационно-поисковые языки предоставляют пользователю большое число операторов, т.е. служебных слов, которые используются для комбинирования ключевых слов запроса. Каждая поисковая машина имеет свой состав операторов, однако обычно эти операторы объединены в группы, общие для большинства систем.

Операторы поисковых систем

При использовании языков запроса приходится учитывать, что они сильно отличаются в различных поисковых машин. Это становится большой проблемой при использовании сложных запросов в метапоисковых системах.

Логические операторы

В поисковых системах обычно имеются три оператора: “логическое И”, “логическое ИЛИ” и “логическое НЕ”. Оператор “логическое И” указывается между ключевыми словами, если необходимо выдать документы, содержащие все искомые слова. “Логическое ИЛИ” используется при необходимости поиска документов, содержащих хотя бы одно из ключевых слов, связанных этим оператором. Оператор “логическое НЕ” необходим для исключения из списка документов, в которых присутствует слово, предваренное в запросе этим оператором.

Простая ситуация поясняет изложенное выше. Запрос “автобус и трамвай” или “автобус трамвай” выдаст только документы, в которых одновременно встречаются слова и автобус, и трамвай.

Запрос “автобус или трамвай” выдаст три типа документов: в документе есть только слово автобус, в документе есть только слово трамвай, в документе есть слова автобус и трамвай.

Символ “!”, в Яндексе, например, означает закрепление регистра. Если вы ищите название села “Остров”, а не географическое понятие “остров”, следует написать “!Остров”. При поиске информации о фильме “Остров” запрос лучше оформить в виде цитаты: “фильм Остров”.

Операторы расстояния

Большинство поисковых машин в настоящее время предоставляют возможность использовать так называемые операторы расстояния, которые задают ограничения на удаленность вхождений ключевых слов друг от друга в тексте документа. Как правило, выделяют три оператора этой группы: оператор поиска фразы, позволяющий находить точные вхождения указанной последовательности слов (фраза задаётся в кавычках), оператор, с помощью которого задаётся расстояние в словах, и оператор, задающий расстояние в предложениях.

Прочие операторы

Помимо двух указанных групп существуют также операторы:

  • учета особенностей естественного языка;
  • выбора части документа, по которой осуществляется поиск;
  • отбора для поиска страниц, написанных на определенном языке;
  • ограничения поиска определенным типом файла;
  • поиска текста в заголовках страниц;
  • выбора подмножества документов.

Состав этих групп сильно зависит от поисковой машины.

Работа в группах по поиску информации в Интернет – 15 мин.

Группам учащихся выдает задание Приложение 2 .

Выполнение теста – 5 мин.

Подведение итогов урока – 5 мин.

Давайте подведем итоги нашей работы. Вы друг за другом высказываетесь одним предложением, выбирая начало фразы из рефлексивного экрана.

  • Сегодня я узнал…
  • Было трудно…
  • Я выполнял задания…
  • Я научился…
  • Я приобрел…
  • Я понял, что…
  • Было интересно…

Домашнее задание

1. Параграф 3.5. Ответить на вопросы после параграфа.

2. Выполнить письменно. Предложен список различных поисковых систем. Распределите их в две колонки.

Российская система Международная система

Литература

  1. Информатика и ИКТ., Н.Д.Угринович, 8 класс