搜索引擎工作原理

1.工作原理

搜索引擎工作原理

搜索引擎工作原理
搜索引擎输入关键词返回搜索列表的过程?

《你刚才在淘宝上买了一件东西》:

在首页搜索框中输入“毛衣”二字并按回车键,这时你又产生了一个PV,然后,淘宝网的主搜索系统便开始为你服务,它首先对你输入的内容基于一个分词库进行分词操作。众所周知,英文是以词为单位的,词和词之间靠空格隔开,而中文是以字为单位,句子中所有的字连起来才能描述一个意思。
例如,英文句子“I am a student”用中文表示,则为“我是一个学生”。计算机可以很简单地通过空格知道student是一个单词,但是不太容易明白“学”、“生”两个字合起来才表示一个词。把中文的汉字序列切分成有意义的词,就是中文分词,有些人也称为切词。“我是一个学生”分词的结果是“我 是 一个 学生”。
进行分词操作之后,还需要根据你输入的搜索词进行购物意图分析。用户进行搜索时常常有如下几类意图。
浏览型:没有明确的购物对象和意图,边看边买,用户比较随意和感性。Query *注1例如:
“2010年10大香水排行”、
“2010年流行毛衣”、“zippo有多少种类?”;
查询型:有一定的购物意图,体现在对属性的要求上。
Query例如:“适合老人用的手机”、“500元 手表”;
对比型:已经缩小了购物意图,具体到某几个产品。Query
例如:“诺基亚E71 E63”、“akg k450 px200”;
确定型:已经做了基本决定,重点考察某个对象。Query例
如:“诺基亚N97”、“IBM T60”。
通过对你的购物意图的分析,主搜索会呈现出完全不同的结果。

之后的数个步骤后,主搜索系统便根据上述以及更多复杂的条件列出了搜索结果,这一切是由一千多台搜索服务器完成的。

接下来,无论你是否真的进行了交易,你的这些访问行为都
会如实地被系统记录下来,用于后续的业务逻辑和数据分析。


参考:

  1. zhihu 搜索引擎的工作原理是什么;
  2. 电子书 这就是搜索引擎:核心技术详解;
  3. How google works pdf;