SearchEngine
学术科技 · 当前来自首页固化板块目录。
介是老师的大作业 本人菜鸟一只 请问哪里可以找到相关的开源软件 (一)、搜索型: (1) 新闻搜索:定向采集3-4个体育新闻网站,实现这些网站信息的抽取、索引和检索。网页数目不少于10万条。能按相关度、时间、热度(需要自己定义)等属性进行排序,能实现相似新闻的自动聚类。 (2) Mp3歌曲检索:通过哼曲调的方法实现mp…
rt。
通用的。。什么都抓,主要要速度快(教育网段)。。可以抓ipv6.. soa体系。。 为什么总感觉wget那么快呢。。。
第一次发布一个网站,开始几个月百度排名一直在第一页,不料前几日百度搜索突然不见了首页,用SITE的方法只能找到其它的子页面,没有首页。[ema1]现在要怎样才能恢复?本人才疏学浅,恳请各位大神前辈们指导[ema11][ema11][ema11]
有擅长爬虫的大神么?我们这里急需外援,当然你要是想要找实习什么的都是可以的啊,急需!!!!!!!
RT 站内搜索不仅能使获取资源的成本降低,也可以通过计算广告来达到增加收入。 难道就没有人想过这个idea吗? 还是说有其他原因所以不可行?
http://www.searchpk.com/ 支持一下
附件(2.2MB) 本书内容对于搞技术的同学帮助应该不是很大,但是对想做搜索引擎营销的同学应该还是很有用的,喜欢就点赞吧。
求各位大牛推荐一个爬虫工具,能够下载特定网址的APP文件。比如说,网址A是文件F的下载链接,要求这个爬虫工具能够爬出网址A并且将文件F下载下了。 谢谢啊
rt。实验室所需,在抓取一批用户的关注列表,可是只能抓到前10页的关注列表,后面的都看不到,查了一下,说是新浪加的限制,求问,用什么方法可以看到10页后的列表,跪谢!!!
搜索引擎方面是渣渣,可是想着这个方向蛮有意思得,请问,我如何入门学习呢,目前在看lucene源码,问这样可以么,还需要什么要学的么?
rt,抓取微博内容的时候,滚动条到下端会动态加载下面的内容,可是源代码里不显示,求问怎么抓到那部分?
如题,如果点击某条微博下面的“评论”,url上#后面的数字每次点值是不一样的,不知哪位大牛理解个中奥妙
对于一个网站来说,根据哪些因素来评价该网站用户的质量以及网站所提供的产品质量呢? 比如用户在线时间长短…
朋友的一个网站,原来在百度,gg等搜关键词都是第一位,结果前几天在百度排名掉到十几页之后,gg,搜狗之类的还是第一位,(据说前段时间百度一直打电话推销竞价排名)求解惑啊。。