搜索引擎关键词排序规则
- 1、下载文档前请自行甄别文档内容的完整性,平台不提供额外的编辑、内容补充、找答案等附加服务。
- 2、"仅部分预览"的文档,不可在线预览部分如存在完整性等问题,可反馈申请退款(可完整预览的文档不适用该条件!)。
- 3、如文档侵犯您的权益,请联系客服反馈,我们会尽快为您处理(人工客服工作时间:9:00-18:30)。
一、特征词库的类别的建立与更新
众所周知,百度有特征词库,通过特征词库,可以对用户查询序列,进行判断。例如:当用户搜索“天龙八部在线观看” 、“射雕英雄传在线观看” 、“鹿鼎记在线观看” 、“电视剧在线观看”时,由于这些待挖掘序列中的“天龙八部” 、“射雕英雄传” 、“鹿鼎记” 、“电视剧” 在需求特征词库中属于视频类需求的特征词,并且“在线观看” 这一关键词与上述视频类需求的特征词的共现频次达到一定阈值(共现阈值)时,根据关键词“在线观看” ,提取关键词“在线观看” 与视频需求类别的映射关系,并根据映射关系来建立或更新需求特征词库。
二、对词条的分类
首先对查询序列进行切词处理获得切分后的词条,再通过诸如对词条进行语义分析或根据词条在需求特征词库中进行匹配查询等方式,来获得所述候选需求类别。例如:用户的查询序列为“土豆上的热门影视剧” 时,通过对其进行切词处理,得到“土豆/热门/ 影视剧” ,由于影视剧一词具有明显的需求类别,诸如视频、下载、图片、演员介绍,再通过诸如对词条进行语义分析或根据所述词条在需求特征词库中进行匹配查询等方式,来获得候选需求类别。
当挖掘序列相对应的分类结果的用户累计点击次数超过预设点击阈值时,基于所述分类结果所对应的需求类别,提取待挖掘序列与需求类别的映射关系,并根据映射关系来建立或更新需求特征词库,例如,当待挖掘序列为“日本地震” 时,根据该待挖掘序列对应的分类结果,如视频类搜索结果、新闻类搜索结果、图片类搜索结果,若视频类搜索结果对应的用户累计点击次数为300,新闻类搜索结果对应的用户累计点击次数为25000,图片类搜索结果对应的用户累计点击次数为700,预设点击阈值为10000 时,将待挖掘序列对应的分类结果的用户累计点击次数与预设点击阈值进行比较,并根据高于所述预设点击阈值的分类结果所对应的需求类别,即新闻需求类别,提取该待挖掘序列与新闻需求类别间的所述映射关系,并根据映射关系来建立或更新需求特征词库。
三、获取需求度
1、获取与用户的查询序列相对应的原始搜索结果
2、获取与查询序列相对应的候选需求类别
对原始搜索结果进行处理,根据查询序列,通过诸如对查询序列进行语义分析或根据查询序列在需求特征词库中进行匹配查询等方式,来获得候选需求类别。例如,当用户的查询序列为“土豆上的热门影视剧” 时,通过对其进行切词处理,得到“土豆/ 热门/影视剧” ,由于影视剧一词具有明显的需求类别,诸如视频、下载、图片、演员介绍,对该查询序列进行语义分析或在需求特征词库中进行匹配查询,来获得候选需求类别,例如根据“影视剧” 可知该查询序列对应的候选需求类别包括视频、下载、图片、演员介绍。
3、根据查询序列与候选需求类别,确定与查询序列相对应的类别需求度
根据查询序列和候选需求类别,通过诸如对该查询序列所对应的搜索结果按类别进行统计分析或者对关于搜索结果的历史点击记录按类别进行统计分析,确定所述查询序列对于每一候选需求类别的类别需求度。例如:“×× 影视明星” 时,根据查询序列,得到候选需求类别包括视频、新闻、背景介绍、音乐、图片,然后根据查询序列和候选需求类别,通过诸如对该查询序列所对应的搜索结果按类别进行统计分析或者对关于搜索结果的历史点击记录按类别进行统计分析,确定与所述查询序列相对应的类别需求度,如,“×× 影视明星” 查询序列在视频类的类别需求度为0.3 ;查询序列在新闻类的类别需求度为0.3 ;查询序列在背景介绍类的类别需求度为0.1 ;查询序列在音乐类的类别需求度为0.2 ;以及查询序列在图片类的类别需求度为0.1。
需求度确定:
用户的查询序列为“×× 影视明星” ,将查询序列在需求特征词库中进行匹配查询,当在需求特征词库中匹配查询到××影视明星属于明星列表并且该明星列表对应的需求类别包括视频、新闻、背景介绍、音乐和图片时,得到与查询序列相对应的候选需求类别包括视频、新闻、背景介绍、音乐和图片。结合该查询序列相应的大量用户的点击统计分析,如:统计分析结果中表明视频类搜索结果、新闻类搜索结果、背景介绍类搜索结果、音乐类搜索结果与图片类搜索结果的用户点击频次分别为60000 次、10000 次、10000 次、10000 次和10000 次,则查询序列对于视频类搜索结果的类别需求度为0.6,而对于图片类搜索结果的类别需求度为0.1。
4、根据类别需求度,将搜索结果提供给用户。
根据所述类别需求度,将搜索结果提供给所述用户。还是以“×× 影视明星”为例:当用户的查询序列为“×× 影视明星” 时,查询序列在视频类的类别需求度为0.3,在新闻类的类别需求度为0.3,在背景介绍类的类别需求度为0.1,在音乐类的类别需求度为0.2,在图片类的类别需求度为0.1时,若查询序列的搜索结果列表中的第一页显示10 条搜索结果,根据类别需求度,将3 条视频类的搜索结果、3 条新闻类的搜索结果、1 条背景介绍类的搜索结果、2 条音乐类的搜索结果提供给用户,并且将剩余的所有搜索结果中与查询序列相关度最高的 1 条搜索结果在第一页提供给用户。
根据类别需求度,将类别需求度与搜索结果提供给用户。具体地,根据查询序列与候选需求类别,通过诸如对该查询序列所对应的搜索结果按类别进行统计分析或者对关于搜索结果的历史点击记录按类别进行统计分析,确定了与查询序列相对应的类别需求度后,以诸如特别字体、浮动窗口等方式,将搜索结果相对应的类别需求度与搜索结果提供给所述用户。百度已使用此类
技术,可在百度搜索结果页面中找找。
对结果的优选
查询相关属性包括以下至少任一项:
搜索结果与所述查询序列的相关度;
搜索结果的权威度;
搜索结果的时效性。
相关度:优选结果不仅根据搜索结果所对应的类别需求度,而且还结合搜索结果与查询序列之间的相关度,将搜索结果提供给对应的用户。当搜索结果所对应的新闻类搜索结果的类别需求度和音乐类搜索结果的类别需求度相同时,将所述搜索结果对应的类别需求度与搜索结果和查询序列之间的相关度结合,将所述搜索结果提供给用户。
权威度:确定查询序列的类别需求度后,搜索结果对应的类别需求度与搜索结果的权威度结合提供给用户,例如:查询序列对应的新闻类搜索结果的权威度较高而查询序列对应的音乐类搜索结果的权威度较低时,将查询序列对应的新闻类搜索结果和音乐类搜索结果依次提供给所述用户对应的用户。
时效性:不仅根据搜索结果所对应的类别需求度,而且还结合搜索结果的时效性,将搜索结果提供给用户。例如:查询序列对应的新闻类搜索结果的时效性较强而查询序列对应的音乐类搜索结果的时效性较弱时,将查询序列对应的新闻类搜索结果和音乐类搜索结果依次提供给用户对应的用户。
一、相关度
1、网站内容是否和网站主题相关。
可以方便搜索引擎把你网站进行定位,方便对你网站进行类目分类。准确的类目分类对提升网站在某一个行业中的权威度有很大的好处。
2、网站中的内容是否能够满足用户需求。
这个讨论的太多了。就不一一详解。
网站中的内容相关性是影响seo排名的主要因素之一。
二、权威度
.权威不等于知名,知名反作用于权威。
.权威度的计算方法比较复杂,有很多的基数作为参考,以下列出“可能”决定权威度的一部分基数。
1、网站品牌词的搜索量。
2、与网站相关的长尾词的流量。
3、直接访问流量。
4、url中的体现的权威度(在索引库中存在的时间,在搜索中的表现,政府网站等)。
5、口碑与社交媒体的转载。搜索引擎一直在监控网络上用户的一举一动。不过因为一
些“原因”有些是直接效果,有些是间接效果,或者没效果。不过所有可以点击的link都是有用的。
6、网站更新频率。嘿~!这个网站还有人维护呢。不是死站。短期内不维护(春节放
假7天)影响不大。当长时间不维护。真的可能会降权。