Python
学术科技 · 当前来自首页固化板块目录。
print "opening files..." target = open(filename,'r+') target.write("hello\nbye\n") print "read file" print target.read() print "close file" target.close() 为什么文件…
背景: 啦啦啦啦,之所以有这个想法,是因为经常用学校的图书馆管理系统(大学经典毕设题目),使用的过程中,发现用户体验特别不好(好吧,我不是产品经理),有下面几个痛点(我不是产品经理too) 1:这酸爽的界面风格,真心也是醉了 2:在搜索引擎中搜索“北京邮电大学图书馆”,给出的链接是http://lib.bupt.edu…
问题背景:同学写论文需要利用中国知网(http://epub.cnki.net/kns/brief/result.aspx?dbprefix=CCND)搜索某个公司在过去5年的报道情况,需要检索的所有的公司存储在Excel文档中,于是让我帮他用Python自动化搜索爬取并存储。 问题: 在尝试爬取一个公司以“万科”为例…
请问各位前辈,有选过王老师数据挖掘的学长学姐吗?lz选了数据挖掘这门课,下周就要交文本分类的大作业了,还没有倒腾出来。。。请问去年有学长学姐用python做的吗?能否交流一下呢?[ema1]
RT,那清晰度怎么保证?如果是大一点的视频呢?感觉不知道如何获取flash的地址,这个比较头疼。
我使用 urllib2.urlopen(url).read()来读取下面这个网站的数据: http://b2b.10086.cn/b2b/b2b/searchNotice.html?noticeBean.title=%E5%AE%89%E5%85%A8 却发现最主要的数据(查询结果)读不下来。请问各位大神,该如何抓取查…
比如我想把某个帖子的某一段文字输出到一个html文件中,可是执行完打开test.html却发现是乱码,经过达人指点后应该是encode和decode的问题。 现在想用beautifulsoup的方法,比如提取div class的部分,然后想提取text并输出到html文件,但是发现使用soup.text方法会丢失<br…
我想爬取网易体育分类下的新闻文本 从http://sports.163.com/开始,如何获取足够数量比如3000个新闻的url? 类似于http://sports.163.com/14/1125/08/ABSR979300052UUC.html这种 能不能给个思路[ema1]
rt,然后,python UI,现在比较常用是什么呀?
相信有一些人,在逛贴吧等社区的时候,会遇到“xx美女图,要的留下邮箱”,但是当你留下邮箱后发现,发帖人并没有给你发xx美女图,取而代之的是每个月或者每周都有一些垃圾邮件, 我曾经见到一个帖子中有上千人留下邮箱(真眼馋啊),所以如果群发广告的话(也许126啊,qq啊会给你封号的,慎重),maybe会有一些人上当的。 我没…
方法urlencode应该只是对json数据的封装,那xml数据怎么办呢? 平台接口只支持xml数据啊
2015年1月4日16:31:02更新说明: 1:怎么能快速的保存mm图片呢?我曾经试验过多进程和gevent,但是实验结果和单进程直接下载在时间上没有减少反而有的时候增加了,原因是多方面的,一部分是网速的原因,但是主要原因是我用过的请求方法,urllib2和requests都不是异步的,所以导致的效率上没有提升 2:…
有人做过学校bbs模拟登入吗,感觉有些诡异,用firefox查看登入请求的地址是http://bbs.byr.cn/user/ajax_login.json,在html查看是http://bbs.byr.cn/login, 直接用/login登入不成功,只是跳转,ajax_login直接失败。等大神解答! ------…
在本地使用的话redis(host='127.0.0.1',...) 但是文件放在服务器的话,host地址该怎么填写呢?是填写服务器的ip(服务器的ip总在变呀)吗,填写域名也不行,求达人指点[ema23]
RT 求助。百度了好久 说是用一个mxODBC 但是奈何英语太渣 研究好久 发现是个收费的。 还有说用pyodbc 可是不会 有人懂吗? linux下