以文本方式查看主题 - W3CHINA.ORG讨论区 - 语义网·描述逻辑·本体·RDF·OWL (http://bbs.xml.org.cn/index.asp) -- 『 Web挖掘技术 』 (http://bbs.xml.org.cn/list.asp?boardid=69) ---- 搜索引擎查询层的主要检索质量优化的方法,在参加完google的互联网大会后的总结 (http://bbs.xml.org.cn/dispbbs.asp?boardid=69&rootid=&id=43626) |
-- 作者:pennyliang -- 发布时间:3/5/2007 11:13:00 AM -- 搜索引擎查询层的主要检索质量优化的方法,在参加完google的互联网大会后的总结 从一个检索词,到得到检索结果,称为一次查询,那么这次查询的质量主要取决于 1)是否检索到 2)在搜索结果页第几页第几条检索到 3)检索时间耗时 很显然,最佳的结果是,首条命中,而且尽可能的快,假定不考虑检索耗时,仅从检索质量上讲,存在以下四类方法。 优化查询结果:(文档空间) 1)通过某种rank排名,比如page rank,expert rank,time rank,Hilltop等,然而不论什么方法,都不能保证让所有的用户满意,因为只有有限的条数可以排在前面。 2)通过查询结果聚类,比如国外的vivisimo,国内的bbmao,通过查询结果聚类,让用户在选择一次类别,实现不同关注点的展示,然而类别的命名非常困难,通常很多类别没有具体的含义,用户选择存在困难,即便选择了类别,仍然存在排序问题。 3)分类搜索,通过查询结果的类别,进行区分。 4)通过历史用户使用该检索词的点击信息,推测那条为最佳用户选择链接。
[此贴子已经被作者于2007-3-5 13:53:02编辑过]
|
W 3 C h i n a ( since 2003 ) 旗 下 站 点 苏ICP备05006046号《全国人大常委会关于维护互联网安全的决定》《计算机信息网络国际联网安全保护管理办法》 |
7,410.156ms |