`
isiqi
  • 浏览: 16361511 次
  • 性别: Icon_minigender_1
  • 来自: 济南
社区版块
存档分类
最新评论

Google高手必经之路(zz)

阅读更多
Google(www.Google.com)是一个搜索引擎,由两个斯坦福大学博士生LarryPage与SergeyBrin于1998年9月发明,GoogleInc.于1999年创立。2000年7月份,Google替代Inktomi成为Yahoo公司的搜索引擎,同年9月份,Google成为中国网易公司的搜索引擎。98年至今,Google已经获得30多项业界大奖。到Google的新闻中心(http://www.Google.com/press/index.html),你可以找到关于一切关于Google的历史和新闻资料。

搜索入门

第一次进入Google,它会根据你的操作系统,确定语言界面。需要提醒的是,Google是通过cookie来存储页面设定的,所以,如果你的系统禁用cookie,就无法对Google界面进行个人设定了。

Google的首页很清爽,LOGO下面,排列了四大功能模块:网站、图像、新闻组和目录服务。默认是网站搜索。现在进行第一次搜索实践,假定你是个搜索新手,想要了解一下搜索引擎的来龙去脉和搜索技巧。在搜索框内输入一个关键字“搜索引擎”,选中“搜索中文(简体)网页”选项,然后点击下面的“Google搜索”按钮(或者直接回车),结果就出来了。

注意:文章中搜索语法外面的引号仅起引用作用,不能带入搜索栏内。

初阶搜索

上例中,单个关键字“搜索引擎”,搜索得的信息浩如烟海,而且绝大部分并不符合自己的要求,怎么办呢?我们需要进一步缩小搜索范围和结果。

1,搜索结果要求包含两个及两个以上关键字

一般搜索引擎需要在多个关键字之间加上“”,而Google无需用明文的“”来表示逻辑“与”操作,只要空格就可以了。现在,我们需要了解一下搜索引擎的历史,因此期望搜得的网页上有“搜索引擎”和“历史”两个关键字。

示例:搜索所有包含关键词“搜索引擎”和“历史”的中文网页
搜索:“搜索引擎历史”
结果:已搜索有关搜索引擎历史的中文(简体)网页。共约有78,600项查询结果,这是第1-10项。搜索用时0.36秒。

用了两个关键字,查询结果已经从70多万项减少到7万多项。但查看一下搜索结果,发现前列的绝大部分结果还是不符合要求,大部分网页涉及的“历史”,并不是我们所需要的“搜索引擎的历史”。怎么办呢?删除与搜索引擎不相关的“历史”。我们发现,这部分无用的资讯,总是和“文化”这个词相关的,另外一些常见词是“中国历史”、“世界历史”、“历史书籍”等。

2,搜索结果要求不包含某些特定信息

Google用减号“-”表示逻辑“非”操作。“A–B”表示搜索包含A但没有B的网页。

示例:搜索所有包含“搜索引擎”和“历史”但不含“文化”、“中国历史”和“世界历史”的中文网页
搜索:“搜索引擎历史-文化-中国历史-世界历史”
结果:已搜索有关搜索引擎历史-文化-中国历史-世界历史的中文(简体)网页。共约有36,800项查询结果,这是第1-10项。搜索用时0.22秒。

我们看到,通过去掉不相关信息,搜索结果又减少了将近一半。第一个搜索结果是:

搜索引擎直通车≡搜索引擎发展历史
搜索引擎直通车,...搜索引擎专业介绍站点....
www.se-express.com/about/about.htm-14k-网页快照-类似网页

非常符合搜索要求。另外,第八项搜索结果:

463搜索王
本站检索整个网站在此输入关键词.你的当前
位置:首页>>Internet搜索手册>>搜索引擎的历史....
www.cnco.net/search/history.htm-21k-网页快照-类似网页

也符合搜索要求。但是,10个结果只有两个符合要求,未免太少了点。不过,在没有更好的策略之前,不妨先点开一个结果看看。点开se-express.com的这个名为“搜索引擎发展历史”的网页,我们发现,搜索引擎的历史,是与互联网早期的文件检索工具“Archie”息息相关的。此外,搜索引擎似乎有个核心程序,叫“蜘蛛”,而最早成型的搜索引擎是“Lycos”,使搜索引擎深入人心的是“Yahoo”。了解了这些信息,我们就可以进一步的让搜索结果符合要求了。

注意:这里的“”和“-”号,是英文字符,而不是中文字符的“+”和“-”。此外,操作符与作用的关键字之间,不能有空格。比如“搜索引擎-文化”,搜索引擎将视为关键字为“搜索引擎”和“文化”的逻辑“与”操作,中间的“-”被忽略。

6.3,搜索结果至少包含多个关键字中的任意一个。

Google用大写的“OR”表示逻辑“或”操作。搜索“AORB”,意思就是说,搜索的网页中,要么有A,要么有B,要么同时有A和B。在上例中,我们希望搜索结果中最好含有“archie”、“lycos”、“蜘蛛”等关键字中的一个或者几个,这样可以进一步的精简搜索结果。

示例:搜索如下网页,要求必须含有“搜索引擎”和“历史”,没有“文化”,可以含有以下关键字中人任何一个或者多个:“Archie”、“蜘蛛”、“Lycos”、“Yahoo”。
搜索:“搜索引擎历史archieOR蜘蛛ORlycosORyahoo-文化”
结果:已搜索有关搜索引擎历史archieOR蜘蛛ORlycosORyahoo-文化的中文(简体)网页。共约有8,400项查询结果,这是第1-10项。搜索用时0.16秒。

我们看到,搜索结果缩小到8千多项,前20项结果中,大部分都符合搜索要求。如果你想了解一下解搜索引擎的历史发展,就不妨研究一下现在搜索到的结果吧。

注意:“与”操作必须用大写的“OR”,而不是小写的“or”。

在上面的例子中,我介绍了搜索引擎最基本的语法“与”“非”和“或”,这三种搜索语法Google分别用“”(空格)、“-”和“OR”表示。顺着上例的思路,你也可以了解到如何缩小搜索范围,迅速找到目的资讯的一般方法:目标信息一定含有的关键字(用“”连起来),目标信息不能含有的关键字(用“-”去掉),目标信息可能含有的关键字(用“OR”连起来)。

7,杂项语法

7.1,通配符问题

很多搜索引擎支持通配符号,如“*”代表一连串字符,“?”代表单个字符等。Google对通配符支持有限。它目前只可以用“*”来替代单个字符,而且包含“*”必须用""引起来。比如,“"以*治国"”,表示搜索第一个为“以”,末两个为“治国”的四字短语,中间的“*”可以为任何字符。

7.2,关键字的字母大小写

Google对英文字符大小写不敏感,“GOD”和“god”搜索的结果是一样的。

7.3,搜索整个短语或者句子

Google的关键字可以是单词(中间没有空格),也可以是短语(中间有空格)。但是,用短语做关键字,必须加英文引号,否则空格会被当作“与”操作符。

示例:搜索关于第一次世界大战的英文信息。
搜索:“"worldwarI"”
结果:已向英特网搜索"worldwari".共约有937,000项查询结果,这是第1-10项。搜索用时0.06秒。

7.4,搜索引擎忽略的字符以及强制搜索

Google对一些网路上出现频率极高的英文单词,如“i”、“com”、“www”等,以及一些符号如“*”、“.”等,作忽略处理。

示例:搜索关于www起源的一些历史资料。
搜索:“www的历史internet”
结果:以下的字词因为使用过于频繁,没有被列入搜索范围:www的.已搜索有关www的历史internet的中文(简体)网页。共约有75,100项查询结果,这是第1-10项。搜索用时0.22秒。

我们看到,搜索“www的历史internet”,但搜索引擎把“www”和“的”都省略了。于是上述搜索只搜索了“历史”和“internet”。这显然不符合要求。这里我顺便说一点搜索引擎分词的知识。当我们在搜索“www的历史”的时候,搜索引擎实际上把这个短语分成三部分,“www”、“的”和“历史”分别来检索,这就是搜索引擎的分词。所以尽管你输入了连续的“www的历史”,但搜索引擎还是把这个短语当成三个关键字分别检索。

如果要对忽略的关键字进行强制搜索,则需要在该关键字前加上明文的“+”号。
搜索:“+www+的历史internet”
结果:已搜索有关+www+的历史internet的中文(简体)网页。共约有25,000项查询结果,这是第1-10项。搜索用时0.05秒。

另一个强制搜索的方法是把上述的关键字用英文双引号引起来。在上例“”worldwarI””中,“I”其实也是忽略词,但因为被英文双引号引起来,搜索引擎就强制搜索这一特定短语。

搜索:“"www的历史"internet”
结果:已搜索有关"www的历史"internet的中文(简体)网页。共约有7项查询结果,这是第1-6项。搜索用时0.26秒。

我们看到,这一搜索事实上把“www的历史”作为完整的一个关键字。显然,包含这样一个特定短语的网页并不是很多,不过,每一项都很符合要求。

注意:大部分常用英文符号(如问号,句号,逗号等)无法成为搜索关键字,加强制也不行。

8,进阶搜索

上面已经探讨了Google的一些最基础搜索语法。通常而言,这些简单的搜索语法已经能解决绝大部分问题了。不过,如果想更迅速更贴切找到需要的信息,你还需要了解更多的东西。

8.1,对搜索的网站进行限制

“site”表示搜索结果局限于某个具体网站或者网站频道,如“www.sina.com.cn”、“edu.sina.com.cn”,或者是某个域名,如“com.cn”、“com”等等。如果是要排除某网站或者域名范围内的页面,只需用“-网站/域名”。

示例:上著名IT门户网站ZDNET和CNET搜索一下关于搜索引擎技巧方面的资讯。
搜索:“"searchengine"tipssite:www.zdnet.comORsite:www.cnet.com”
结果:已在www.zdnet.com内搜索有关"searchengine"tipsORsite:www.cnet.com的网页。共约有1,040项查询结果,这是第1-10项。搜索用时0.09秒。

注意,在这里Google有个小BUG。“已在www.zdnet.com内搜索…”,其实应该表述成“已在www.zdnet.com和www.cnet.com内搜索…”。

示例:搜索新浪科技频道中关于搜索引擎技巧的信息。
搜索:“搜索引擎技巧site:tech.sina.com.cn”
结果:已在tech.sina.com.cn搜索有关搜索引擎技巧的中文(简体)网页。共约有163项查询结果,这是第1-10项。搜索用时0.07秒。

注意:site后的冒号为英文字符,而且,冒号后不能有空格,否则,“site:”将被作为一个搜索的关键字。此外,网站域名不能有“http://”前缀,也不能有任何“/”的目录后缀;网站频道则只局限于“频道名.域名”方式,而不能是“域名/频道名”方式。

8.2,在某一类文件中查找信息

“filetype:”是Google开发的非常强大实用的一个搜索语法。也就是说,Google不仅能搜索一般的文字页面,还能对某些二进制文档进行检索。目前,Google已经能检索微软的Office文档如.xls、.ppt、.doc,.rtf,WordPerfect文档,Lotus1-2-3文档,Adobe的.pdf文档,ShockWave的.swf文档(Flash动画)等。其中最实用的文档搜索是PDF搜索。PDF是ADOBE公司开发的电子文档格式,现在已经成为互联网的电子化出版标准。目前Google检索的PDF文档大约有2500万左右,大约占所有索引的二进制文档数量的80%。PDF文档通常是一些图文并茂的综合性文档,提供的资讯一般比较集中全面。

示例:搜索几个资产负债表的Office文档。
搜索:“资产负债表filetype:docORfiletype:xlsORfiletype:ppt”
结果:已搜索有关资产负债表filetype:docORfiletype:xlsORfiletype:ppt的中文(简体)网页。共约有481项查询结果,这是第1-10项。搜索用时0.04秒。

注意,下载的Office文件可能含有宏病毒,谨慎操作。

示例:搜索一些关于搜索引擎知识和技巧方面的PDF文档
搜索:“"searchengine"tipsORtutorialfiletype:pdf”
结果:已向英特网搜索"searchengine"tipsORtutorialfiletype:pdf.共约有12,600项查询结果,这是第1-10项。搜索用时0.22秒。

我们来看其中的一个结果:

[PDF]SearchEnginesTips
文档类型:PDF/AdobeAcrobat-HTML版
...http://www.google.com/press/zeitgeist.htmlSeewhatpeoplearesearchingonatGoogle.com
*SearchEngineWatchhttp://searchenginewatch.com/Somefreetips...
www.allvertical.com/PromoKits/SearchEngineTips.pdf-类似网页

可以看到,Google用[PDF]来标记这是一个PDF的文档检索,另外,它还给出了该PDF文档的HTML版本,该HTML版保留了文档的文字内容和结构,但没有图片。

8.3,搜索的关键字包含在URL链接中

“inurl”语法返回的网页链接中包含第一个关键字,后面的关键字则出现在链接中或者网页文档中。有很多网站把某一类具有相同属性的资源名称显示在目录名称或者网页名称中,比如“MP3”、“GALLARY”等,于是,就可以用INURL语法找到这些相关资源链接,然后,用第二个关键词确定是否有某项具体资料。INURL语法和基本搜索语法的最大区别在于,前者通常能提供非常精确的专题资料。
分享到:
评论

相关推荐

    电脑菜鸟到高手必经之路

    "电脑菜鸟到高手必经之路"这个主题涵盖了众多的计算机基础知识和进阶技能,下面将详细阐述其中的一些关键知识点。 首先,了解基础操作系统是必不可少的。无论你是Windows用户、Mac用户还是Linux爱好者,熟练掌握...

    linux必读----高手必经之路

    要成为Linux高手,需要对多个方面有深入的理解和实践经验,包括编程语言、硬件基础、操作系统原理以及Linux内核等。以下是对这些知识点的详细说明: 1. **C/C++ 语言基础**: - C语言是Linux编程的基础,K&R的...

    电脑从菜鸟到高手必经之路

    "电脑从菜鸟到高手必经之路"这个主题涵盖了计算机基础知识、操作系统操作、网络技术以及黑客入门等多个知识点,这些都是提升个人技能的重要组成部分。 首先,我们要理解电脑的基础知识。这包括硬件组件,如CPU...

    linux必读----高手必经之路.zip

    linux必读----高手必经之路

    高手必经之路-操作系统启动从入门到精通.pdf

    高手必经之路-操作系统启动从入门到精通.pdf

    Java高手必经之路

    ### Java高手必经之路 #### 一、J2SE基础 在成为一名Java高手的路上,首先必须打下坚实的J2SE基础。这部分的学习周期为13天,主要涉及以下几个方面: - **聊天程序**:通过实现一个简单的聊天室,学习网络编程的...

    linux必读----高手必经之路.ppt

    这份"Linux必读----高手必经之路"的PPT提到了多个关键领域的书籍,涵盖了从编程语言基础、硬件基础到Linux系统核心和嵌入式系统开发等多个方面。 首先,对于编程语言基础,C和C++是Linux开发的基础。《The C ...

    Linux高手必经之路

    主要讲述和总结了本人在学习嵌入式linux中的每个步骤。一为总结经验,二希望能给想入门嵌入式Linux的朋友提供方便。如有错误之处,谢请指正。

    电脑菜鸟TO高手TXT文档下载

    编程语言的学习也是从菜鸟到高手的必经之路。基础的编程语言如Python、JavaScript,对于理解计算机工作原理和解决问题非常有帮助。通过编写简单的脚本,可以自动化一些日常任务,进一步提升效率。 除此之外,数据...

    重构(中文版)-Java高手的必经之路1

    重构(中文版)--Java高手的必经之路1

    电脑菜鸟到高手的必经之学

    对电脑的各种问题进行分析和解决,适合菜鸟,对电脑熟悉的人也有很多的帮助,希望对你们有用!!是菜鸟到高手的必经之路!

    重构(中文版)--Java高手的必经之路2

    重构(中文版)--Java高手的必经之路2

    市值100万,程序员,工程师必备,高手必经之路,淘宝商城,猪八戒,58同城,美团网,PHP框架

    标题中的“市值100万,程序员,工程师必备,高手必经之路”暗示了这个压缩包文件的内容可能涉及能够帮助IT专业人士提升技能、增加市场价值的资源,特别是对那些致力于电商平台开发的程序员和工程师。关键词“PHP框架...

    人像高手的必经之路课程视频课程下载整理.zip

    该压缩包文件“人像高手的必经之路课程视频课程下载整理.zip”主要聚焦于人像摄影技巧和后期处理技术的学习资源,适用于那些希望通过提升自己的摄影技能,特别是人像摄影能力的人。它包含一系列视频课程,由专业人士...

    电脑全能高手教程(摆脱电脑菜鸟的机会来了)

    【电脑全能高手教程——从菜鸟到高手的进阶之路】 在我们的日常生活中,电脑已经成为不可或缺的工具,无论是工作、学习还是娱乐,它都扮演着重要的角色。为了帮助大家更好地掌握电脑应用,提升技能,本教程《电脑...

    前端速成技巧:从菜鸟到高手的必经之路

    ### 前端速成技巧:从菜鸟到高手的必经之路 在现代软件开发领域中,前端技术占据了举足轻重的地位。无论是网站还是移动应用,良好的用户体验往往取决于前端技术的应用水平。对于想要快速入门并提升前端技能的学习者...

    网络管理必备技巧--成为网管高手的必经之路

    本文将围绕"网络管理必备技巧--成为网管高手的必经之路"这一主题,深入探讨网络管理员需要掌握的关键知识,包括基础理论、实践技巧以及一些实用工具的使用。 首先,作为一位菜鸟入门的网络管理员,了解和掌握基本的...

Global site tag (gtag.js) - Google Analytics