SearchEngine
学术科技 · 当前来自首页固化板块目录。
应付百度,搜狗等公司搜索职位关于搜索引擎大概的概念方面的东西,应该哪本书大概了解了解????
rt,求给力的加速文本检索过程的相关书籍的推荐,资料也ok。谢谢各位啦
有的网页在content-type或者<meta />里面给出了编码方式,有的没有。怎么判定呢? 浏览器怎么判定网页的编码方式呢?
如何将某公司的百度搜索的排名提高。急求助,老板让做
查询日志里有大量的url,怎么能最快的获取该url对应的页面的关键词和描述信息呢?
不知道 数学之美算是什么级别的呢?求指教,作为菜鸟感觉 简单易懂。下面是转帖: ps:没发错版面吧!!!! 系列一: 统计语言模型 (Statistical Language Models) Google 的使命是整合全球的信息,所以我们一直致力于研究如何让机器对信息、语言做最好的理解和处理。长期以来,人类一直梦想着能…
是酱紫的,爬虫程序中我用到了Jsoup这个包,然后运行后可以执行,但是我新建一个类,然后把程序复制黏贴进去就报错了,新建一个JAVA项目也不行=。=具体错误如图: 那俩个都是Jsoup包里自带的java程序,而且我的代码中木有用到跟其相关的任何东西。现在就只能运行我最原始的类。
想了解下数据挖掘,所以在此求数据挖掘方面的课件 希望遇到好心人给一份
请问 网络爬虫 爬取网页上信息的时候 是如何过滤 网页上的广告信息的
地址: http://buptoa.bupt.edu.cn/
统计网站pv的时候如何过滤爬虫产生的日志?也就是说爬虫产生的日志有什么特点?
弱弱的问一下之前郭军导师组开发的那个校园搜索是基于什么开发的啊?lucene?solr?
rt 今天在看网页时无意中看到“中搜面向普通网民开放第三代搜索引擎” 貌似很牛叉的样子,跪求各种中搜的科普!!!!!!! PS:附链接如下 http://net.it168.com/a2012/0524/1352/000001352182.shtml
有人做过类似的吗?望指点指点。
有哪位同学知道相关的实验室有这个“网络舆论抓取”这个项目么?