Python
学术科技 · 当前来自首页固化板块目录。
没写过Python,但总看各路大神用的飞起,暖神大力推荐,也想自学一下简单用法。 正好手头有个需求,想抓一些橄榄球图片下来。图片的地址格式为: http://某固定路径/年/月/日/固定位数+变化六位数字连续编号/不同的英文名称_pg_600.jpg 例如http://static.nfl.com/static/con…
python pep8 autoformat:import error :'ascii' codec can't decode byte 0xc8 in position 9:ordinal not in range(128) 我装了一天一夜了,[ema1]百度的各种方法都试了,路径绝不含中文,怎么办
下面三个的结果为什么是那样的? |不是在[]里只有字面意义吗,不代表或 >>> re.match('[ab|cd]+','abcd') <_sre.SRE_Match object; span=(0, 4), match='abcd'> >>> re.match('[[ab]|[cd]]+','abcd') <_sre…
刚入门scrapy,想要模拟登录知乎,然而网上的资料很多都看了,并没有解决我的登录问题。 这个爬虫的设计功能是爬取我的收藏夹内容,但因为模拟登录失败所以仍然没办法爬到我私密收藏夹的内容。怀疑是FormRequest那里不行。最下面是CMD中显示可能出问题的过程 恳请各位巨巨帮忙看看把把脉,谢谢! 代码如下 # codi…
实在是看不懂 也不知道这个问题应该发到那个版上
摸头母鸡逃
现在要用Elasticsearch做一个论文检索的搜索应用,自己没接触过这方面的项目,希望大神指点下,感恩不尽!
之前搜集了一些淘宝数据,比如售后率这样的,现在还缺一些,但过了一段时间发现数据变了…收集起来好麻烦 可以有什么方法直接把守候销售量这类的指标弄下来吗
和个文件中的 yield Request(k['url'],callback=self.parse_item)这一句中,在输出的时候每个链接是一起输出的,但是为啥不是输出一个连接调用一下callback方法啊,是输出了所有的link之后才一遍一遍调用callback方法呢 这段代码这里的运行原理到底是咋回事呢,求大神指…
如T,走过路过的大神来指导一下,拜谢![ema23][ema23][ema23]
最近用python爬人人网的日志,保存网页到本地。 内容全部爬下来了,但是一打开本地保存的网页1s内就会跳转到人人网的首页。 怎样才能让它不跳转呢? 我用浏览器登陆,再保存日志网页到本地。本地打开时同样会跳出“服务器请求错误,请刷新后重试”的对话框。 请问这个问题怎么解决? 谢谢。
任务大体上是这样的,我有3000个txt文件,for循环读取每个文件,然后每个文件做大量计算。程序写好了要运行好久。求大牛给说说,怎么用多线程来提高效率。最好能细致点,我以前没接触过多线程,求指导。
现在要遍历一个API接口,restapi.example.com/[0-9].* 客户端不知道服务器有多少接口数量,比如有100个,从第一个开始访问,当访问到101个不存在的接口时,服务器的后台设计为仍然返回response,其中json字段的内容为null 现在的问题是,scrapy默认的停止爬取好像是request…
刚开始看Python3,可是网上好多代码是Python2的,貌似2,3并不兼容,我想问2和3的区别有哪些,区别大不大,据说2比较稳定,是不是应该学2呢?
RT,这种情况已经 持续两周多了,每天一回寝醉生梦死 回寝就是电影一部接一部,手头上也基本没事了 http://img0.imgtn.bdimg.com/it/u=3765297868,3088681440&fm=21&gp=0.jpg 额,放错图了,放错图了 http://img2.imgtn.bdimg.com/i…