SearchEngine
学术科技 · 当前来自首页固化板块目录。
给网页发一个http请求,然后使用recv(hSocket,cRecvData,sizeof(cRecvData),0);来接受网页的文字信息 经测试有时候因为网络问题不能接受到完整的网页,有时候可以,请问如何处理这种问题?
nutch运行后通过查看不是可以把parse text导出来生成一个dump文件么,我现在想要将dump文件中的部分内容,例如说时间项、url项、text项内容摘取出来生成xml文件,请教下有研究这方面的高手吗?希望不吝赐教。 同时热烈欢迎有研究过nutch的同学发表意见。 谢谢啦!
你是否能察觉到一些互联网产品设计的不合理,并有想法去改善它?你是否在脑海中总能闪现出产品设计的好点子,并能敏锐地发现它的商业价值?你是否想在一个为数亿人提供信息的平台上一展宏图,让自己的创意设计为亿万网民提供便捷服务?百度高校互联网产品设计大赛为你提供这样一个机会。 大赛旨在让高校的学生,通过从市场需求、竞争环境分析,…
想用Java做个数据搜索引擎,数据量比较大,求整个架构的推荐(比较适合的Java开源项目等),谢谢!
输入关键字,图片和音视频里的内容也能搜索 比如说一个图片上有linux这几个字,也能搜出来。 我觉得这个太牛逼了。
主要是现在感觉这块已经很成熟了啊。。。。 各位有啥意见么?
我想用C++写一个小的网络爬虫程序,现在遇到以下困难: 不知道如何从html里获取url,估计这也是最核心的一部分,请问有开源的库或者之类的工具吗,谢谢~~~
欢迎站内联系,学习交流
lucifiery@gmail.com
下载了最新的个lucene3.0.2版本的,放在tomcat下都配置好了,可是为什么还不支持中文检索?
自己构建的查询url,用python去请求,请求不到结果,但用浏览器访问构造的url则没问题。
小弟正着手看看一些有关专业的外文论文 因此想试试Google scholar的论文搜索 发现找的都要钱 听同学说有免费的 那么免费的是怎么找呢 还有 我邮图书馆貌似有链接进去 但是貌似还要收费 那是神马思想感情 谢谢各位的给力解答
rt~求大牛帮忙~~在哪个文件里呢~~
请问如何抓取必须需要用户名和密码的网页~~ 谢谢~
“GoogleCoder-谷歌开发者联盟”专注于Google API以及Google相关软件开发及应用,有对此有兴趣的不妨去看看。 网址:www.googlecoder.org[em4]