До появления на мировой арене поисковых систем Google, поиск нужной информации в мировой паутине в большинстве случаев основывался на методе научного тыка, долго и нудно приходилось разгребать эту гору информации, вываливаемую на тебя поисковиком. Благодаря идеи сортировки по бэклинкам(backlinks) страниц, выдаваемых при запросе, реализованной в Гугле, шанс “нарваться” на нужную информацию с первых попыток стал гораздо реальней. И это при том, что более 70% пользователей не используют все возможности поиска в Гугле. А возможностей у него предостаточно. В этот статье будет приведен перечень всех наиболее ценных инструментов поиска.
Логические операторы
В арсенале популярнейшего в мире поисковика всего два логических оператора: AND (поиск по всем словам) либо OR (по каждому в отдельности). Используя эти операторы, можно строить более гибкие запросы. Например: Компьютеры (Новости AND События AND Выставки) Увидев такое, Google отыщет для вас страницы, на которых встречается упоминание слова “компьютеры” в контексте новостей, событий или выставок.
Теперь поговорим о минусах. Предположим, вас интересует все, что связано с именем Билл, но совершенно не интересует Билл Гейтс. Что в этом случае вы делаете? Очень просто - используете минус: Билл -Гейтс Приведенная конструкция однозначно даст понять Google, что вас интересуют все страницы, в которых упоминается имя Билл, за исключением тех, где упоминается фамилия Гейтс.
Похожие слова
Для того, чтобы Google искал слова, похожие на заданное, используйте символ “~” (тильда). Будут найдены синонимы и слова с альтернативными окончаниями. Пример: ~hippo (по запросу будет так же найдено, например, слово hyppopotamus).
Кавычки
Если вам необходимо найти определенную фразу дословно, можно использовать кавычки. Пример: “Hotel California” (аналогичный запрос без кавычек вернул бы не только ссылки на все упоминания одноименной песни, но и на множество сайтов тур-операторов и гостиниц).
Маски
Символ “*” можно использовать как маску - условное обозначение произвольного количества любых символов. Это может быть полезно, например, если вы пытаетесь найти текст песни, но не можете при этом точно вспомнить слова. Или отыскать сайт, домен которого запомнился только отчасти. Пример: welcome to the hotel * such a lovely place; *pedia.org.
Числовые интервалы
Google использует также менее известный оператор массива цифр. Например, поиск с использованием 2000..2005 выдаст результаты, которые будут включать в себя следующие года: 2000, 2001, 2002 и так далее до 2005. Использование того же оператора таким образом ..31 позволит найти страницы, содержащие числа меньше 31, а поиск 31.. найдёт страницы с числами больше 31.
Поиск лиц
У поисковика картинок есть интересная (и, на сколько мне известно, пока официально недокументированная) возможность - выделять из всего множества найденных изображений лица. Для того, чтобы этим воспользоваться, необходимо добавить к URL результата поискового запроса дополнительный GET-параметр imgtype=face. Пример: http://…/images?q=Audrey+Tautou&imgtype=face
Расширенный поиск
Если вы забыли какой-либо из перечисленных операторов, всегда можно воспользоваться формой расширенного поиска.
Информация о сайте
С помощью оператора info: можно получить известную Google информацию об указанном сайте. Пример: info:habrahabr.ru.
Калькулятор
Одной из полезных и при этом малоизвестных возможностей Google является вычисление арифметических выражений. Во многих случаях это быстрее, чем использование программы калькулятора. В выражениях можно использовать операторы +, -, *, /, ^ (степень), sqrt (квадратный корень), sin, cos, tan, ln, lg, exp (ex), скобки и много чего еще. Пример: sqrt(25 * 25) * 768.
Преобразователь единиц измерения
Google можно использовать для быстрого преобразования метров в ярды, килограммов в фунты, литров в джоули. Для этого используется абсолютно естественный для человеческого понимания синтаксис. Пример: 16 tons in pounds. По тому же принципу можно выполнять преобразования между суммами в различных валютах. Например: 15 Ruble in USD. Курсы валют Google узнаёт из Citibank N.A.
Ответ на главный вопрос жизни, вселенной и всего такого
Google знает ответ даже на этот сакраментальный вопрос (если он будет записан по-английски в нижнем регистре).
Дополнительные команды Google
site:
Пожалуй, одна из самых полезных и наиболее употребительных команд. Позволяет ограничить поиск поддоменами указанного домена. Звучит запутанно, но на практике все гораздо проще. Предположим, нас интересуют статьи, которые публиковала gazeta.ru о выборах на Украине. В строке запроса пишем: Выборы на Украине site:gazeta.ru. Можно не ограничиваться конкретным сайтом, а задать, к примеру, область. Выглядеть это будет следующим образом: Программирование site:narod.ru. Тогда Google будет осуществлять поиск во всех поддоменах narod.ru.
link:
Возвращает список страниц, которые ссылаются на заданный сайт. Для наглядности, введите link:kv.by и получите список страниц, ссылающихся на сайт “КВ”. Это просто незаменимый инструмент мониторинга для тех, кто занимается “раскруткой” сайтов. Да и простым обладателям домашней странички тоже наверняка будет любопытно.
cache:
Находит копию страницы, проиндексированной Google, даже если эта страница уже недоступна по адресу в интернете или изменила свое содержание. Иными словами - поиск в кэше Google. Пригодится для просмотра страниц, контент которых часто меняется. Выглядит так: cache:www.gazeta.ru.
intitle:
Ограничивает ваш поиск только заголовком страницы. Говоря техническим языком - содержимым тэга <title>.
Для примера демонстрационный запрос intitle:первая полоса (пробелов между командой и параметром быть не должно) приведет к тому, что Google выдаст ссылки на первую полосу русскоязычных интернет-газет.
inurl:
По этой команде поиск будет проводиться только в URL. Обычно эту инструкцию используют не по одиночке, а вместе с другими, когда хотят отыскать страницу поиска или с хелпом. Например, команда inurl:search выведет список страниц, у которых в адресе встречается слово search, как в этих случаях: search.aol.com или home.netscape.com/home/internet-search.html. Нередко эту команду используют хакеры, чтобы находить скрипты проверки пароля, на которые нет ссылок с главной страницы сайта.
intext:
При поиске не учитываются заголовки страниц и ссылки, просматривается только текст тела страницы (который заключен в теге <body>. Это бывает полезно, когда вы разыскиваете некий кусочек текста и вам, по большому счету, безразлично, какой у страницы заголовок и какие ссылки.
inanchor:
Поиск в тексте якоря вы сможете реализовать, пользуясь приведенной командой. Текст якоря - это, по большому счету, описание ссылки. Иллюстрируем на примере HTML-кода <a href=”www.kv.by>Компьютерные Вести</a>, под воздействием команды inanchor: поисковик обработает только текст “Компьютерные Вести”, это и есть текст якоря.
filetype:
Еще одна чрезвычайно полезная команда. Позволяет искать в интернете файлы с заданным расширением. Однако будьте внимательны, параметры команды понимаются Google слишком буквально, и поэтому если вы сначала наберете filetype:htm, а потом filetype:html, то результаты поиска в обоих случаях будут разными. Google поддерживает некоторые наиболее популярные форматы от Microsoft: PPT, XLS и DOC. Кроме того, вы можете искать даже скрипты, созданные для динамического генерирования контента, такие, как ASP, PHP, CGI и так далее. Кстати, возвращаясь к разговору о хакерах, инструкция filetype: тоже используется ими в неблаговидных целях. К примеру, запись authorisation filetypehp может помочь злоумышленнику найти скрипт проверки пароля. И если написавший его программист был не очень грамотным специалистом, то последствия этого будут плачевны.
related:
Эта команда приказывает Google выводить список страниц, связанных со страницей, указанной в параметрах. Хотя слово “связанные” не совсем подходит в данном случае, скорее, лучше употребить “похожие, принадлежащие к одной категории”. Вот смотрите, команда related:google.com возвратит ряд ссылок на другие поисковые машины, такие, как Yahoo, AltaVista… Теперь, наверное, стало понятнее. В принципе, related: удобное средство, если вы хотите узнать, к какой категории относит ваш сайт Google. Или, наоборот, если хотите найти, к примеру, авторитетные информационные сайты. Именно авторитетные, потому что Google при выводе результатов сортирует их в порядке значимости, и если вы введете, например, related:cnn.com, то первые позиции среди результатов будут занимать наиболее весомые издания схожей тематики: The New York Times, Washington Post и т.д.
define:
Используйте оператор define: для быстрого поиска определений. Пример: define:Дагестан (запрос выдаст ссылки на страницы, информирующих вас о республике Дагестан).
movie:
Для поиска названий фильмов удобно использовать оператор movie:. Пример: movie:One Flew Over the Cuckoo’s Nest.
music:
Оператор music: ограничит результаты поиска контентом, который тем или иным образом связан с музыкой. Пример: music:Depeche Mode 101.
Команды-одиночки для Google
Продолжая тематику интернет-поиска посредством Google, следует отметить, что есть команды, которые никогда не желают работать в паре с другими. Одной из таких является link:, если помните, она отображает все страницы, которые ссылаются на указанный в параметрах URL. Казалось, удобным было бы использовать данную команду совместно с site:, чтобы задавать еще и ограничения на домены. Скажем, разве не интересно узнать, из какой доменной зоны на ваш сайт чаще ссылаются - из .ru или из .net. Однако запрос вида link:mysite.com site:ru не произведет на Google должного эффекта, поскольку link: работает только поодиночке. Как быть в такой ситуации? Обходные пути, естественно, найдутся (недаром ведь в разработке Google принимали участие русские). Для интереса можно поэкспериментировать с такой комбинацией команд: inanchor:mysite.com -inurl:mysite.com site:ru. В данном случае логика такова: сначала мы находим сайты, у которых в описании ссылки встречается адрес нашего сайта. Далее исключаем из результата поиска сам mysite.com и его поддомены (если таковые имеются), а затем отбираем только страницы, принадлежащие к доменной зоне .ru. Этот вариант не безупречен, но главное - идея, доработать этот запрос до конкретных нужд вы сможете самостоятельно.
Несколько слов о комбинациях, которые не должны встречаться в ваших поисковых запросах. Не рекомендуется озадачивать Google взаимоисключающими запросами типа: site:linux.by -inurl:by и все в таком духе.
Теперь о разрешенных комбинациях. После ряда испытаний хорошо себя проявили в совместной работе следующие команды: intitle:, site:, inurl:, filetype:. Скажем, нас интересуют архивы электронных книг на английском языке. Составляем такой запрос: books intitle:”index of” inurl:ftp. В результате получим ссылки на весьма приличные ftp-архивы. Что касается запроса, то на человеческий язык перевести его можно так: нас интересуют страницы, где встречается слово book, заголовок страницы должен содержать фразу index of (характерную для списка в ftp-архиве), а также для верности, что мы имеем дело с ftp, URL должен содержать слово ftp. Возможны различные вариации на эту тему.
Это должен знать почти каждый - три запрета Google
Нельзя использовать маски (* и ?) для замены символов.
В поисковых системах, поддерживающих маски, вы можете ввести “мод*” и ожидать, что среди результатов поиска окажутся такие слова, как мода, модель и т.д. В Google так сделать нельзя. Звездочка используется только для замены одного слова, но не символов.
Не поддерживаются запросы, состоящие из более чем 10 слов.
Все, что будет следовать потом, будет игнорироваться поисковиком. Но обойти ограничение все-таки можно, если заменить наименее важные слова в запросе на символ “*”. В этом случае они учитываться не будут.
Не учитывается регистр, которым вы пишете запрос.
Для Google не имеет значения, в каком регистре вы будете набирать запрос - в ВЕРХНЕМ или нижнем. Результат будет одним и тем же.
Отредактировано Георгий (2011-02-24 18:45:01)