Python
学术科技 · 当前来自首页固化板块目录。
我想抓北邮人论坛手机版的内容http://m.byr.cn/board/ParttimeJob 现在数据已经可以抓到了,但是数据库里面没有插入数据,这是为什么啊 我分析要么是数据库语句写错了,要么是__init__函数里面conn和cursor没有初始化,但是如果我在里面初始化了, self.conn = sqlite…
lz在Windows下搭reviewboard服务,到创建reviewboard站点这一步时,输入rb-site install D:\reviewboard 按照提示输入用户名之类的设置信息之后,开始创建站点,出现unable to execute the manager command syncdb:no modu…
#encoding=utf-8 from lxml import html x = html.parse('http://www.mtime.com/hotest/') titles = x.xpath('//dt/a/text()') print "We got %s titles. Here are the fir…
在文件的公共部分定义了一个字典,然后在函数里操作字典,字典前要加global吗
比如网站http://zx.bjmemc.com.cn/中用的是sliverlight。怎样才能将里面的数据(比如PM2.5的值)爬下来。
有一个函数定义 def fib(n): a,b=0,1 while a<n: print (a,end='') a,b=b,a+b print() 这里面的end是干嘛的?另外a,b=b,a+b又是个什么语法呢?我是超级菜鸟
因为这儿比较火,跪求不删帖 写了一个批量ssh的工具,基本思路是把远端服务器的stdin,stdout连接到本地一个变量,然后起一个goroutine进行处理。 发现了一个奇怪的问题,有时候从stdout里面会收集到意料之外的字符串。 第一行是以%q打印出来的 第二行是以%s打印出来的 问题来了: 1. 为什么会出现这…
可以模拟登录成功了,但是为什么用cookiejar没法保持登录状态呢? class byrSpider(CrawlSpider): name="byr" allowed_domains=["bbs.byr.cn"] start_urls = ["http://bbs.byr.cn"] headers={ 'User-A…
最近工作中在用Python实现机器学习的算法,之前一直是用C/C++ + MPI + OpenMP + CUDA这一套的, 优点是运行速度快,但是缺点也很明显,就是开发慢。 接触到Python后发现Python用于科学计算的库不少,scipy, numpy等等,开发非常容易,特别适合研究,之前接触Python不深,现在…
是酱紫的,我在mac下安装了django了之后,确定安装成功 但是。 在我运行 python manage.py runserver命令的时候 结果出错了 Unhandled exception in thread started by <function wrapper at 0x107becc08> Traceba…
def listAppend(element, list = []): list.append(element) print list if "__main__" == __name__: listAppend(1) listAppend(2) listAppend(3) 我觉得输出结果应该是: [1] [2] [3]…
lz目前在写爬虫,需要爬一个限制IP访问次数的网站,网上的像快代理网站那样IP代理貌似不是很靠谱, 不知道大大们能够借几个HTTP的代理用用么,开一个端口号就行,比如用Tinyproxy之类的,并不会爬太大的流量的。 提前谢啦[ema11]
个人觉得rest api就是json格式的数据,但肯定不正确不全面。 有朋友科普下吗 来自「北邮人论坛手机版」
rt 通过『我邮2.0』发布
搜索网站已经上线 大家可以尝试一下,有高端搜索引擎的一些功能,使用了模糊索引和中文分词: search.icybee.cn (网站长期维护,专注北邮人bbs搜索) http://icybee.cn/pics/2015_09_14_07_16_23719.png 这个东西我已经做了大概一周多了,实话说并没有什么技术含量,…