Python
学术科技 · 当前来自首页固化板块目录。
linux环境下想存中文数据到mysql中,比如存储一个"我",但数据库中显示的是xe6x88x91这样的内容。 mysql已经按网上的说法都设置成了utf8 Server characterset: utf8 Db characterset: utf8 Client characterset: utf8 Conn. …
是这样,我想解析北邮图书馆的网页,但是发现http://211.68.68.197/opac_two/search2/search.jsp却没有charset的设置,不知道是什么编码。猜测是iso-8859-1 换成python3可以解决,或者在python2.x下使用setdefaultencoding即可。
【 以下文字转载自 Linux 讨论区 】 发信人: lc10210103 (summer~精彩呈现 http://www.muzixing.com), 信区: Linux 标 题: [建议]新开“网络技术”或者“未来网络”讨论区 发信站: 北邮人论坛 (Fri Nov 7 22:31:29 2014), 站内 一直以…
需求:看到跳蚤市场不断产生不符合规定的帖子,版主都需要进行回帖提醒,并进行锁贴操作。于是想写一个能够自动过滤不良帖子进行上述操作的程式。 功能:每隔一小时检测第一页帖子,过滤带有tup中的字符串,并进行回帖提醒。 自己不是版主,还不能进行编写锁贴操作。以下是源码,当然你修改后,也可以用来使用它去别的版进行自动回帖操作[…
是这样,在csdn当中评价资源提交post请求时,通过看network发现提交数据包含jsonpcallback和t,这两个值是怎么来的呢?自己能否随便构造这俩值呢? 自己在提交框中填写的是content和rating,sourcid是资源网址的信息,可是jsonp和t却不知道是怎么生成的。求达人指点一二。[ema23…
pyspider 是我写的一个开源的爬虫框架,上次发 Linux 版的时候貌似还没有 Python 版。。 github地址: https://github.com/binux/pyspider demo地址: http://demo.pyspider.org/ * python 脚本,可以用任何你喜欢的html解析包…
大家用什么库做syslog client端呀? 要发给另外一个server的那种。
我们知道C风格的字符串末尾是以\x00结束的,那Python的中str是不是也是呢?我做了个实验,好像不是这样的,但是print的结果我有点弄不明白,球大神指点
现在在用pymedia,解码128kbps的固定码率(CBR)MP3很成功。但是解码VBR文件时有时会出错。调试结果是解码是否成功和每次读入的文件长度有关。更改读入长度以后就能正常解码,但是找不到合适的读入长度能适用于所有文件。有人遇到过这种情况吗?或者有没有更好的解码方案推荐?
这两天学习写爬虫,有时候遇到未完结的电视剧或者动漫,不想一个一个点开每一集然后选择下载torrent,我这里就写了一个脚本初版,输入关键词和资源类编号,然后等它下载就行了。 效果如下: 这里设置每次download一个torrent就sleep几秒,你可以改小一点,注意保护服务器(是我多虑了吗?[ema13]) 源码如…
有一个dict 其中key是中文字符串 value是int 从文本文件中读取一行中文line,然后查找line中所有能在dict找到的子串 返回一个list 有没有办法把汉字像英文字母那样处理 已经被编码搞晕了
好吧,解决了,是中文编码问题,要把电脑转成UTF-8编码,多谢沙发@json123的提醒了,不然也不会留意到这点 import re import urllib2 import urllib import cookielib class Test: def __init__(self): url = "http://k…
小弟我知识想把一个就列表的数值逐个赋值到新列表而已,我逐个打印出来的结果也是正确的,但是整体就不对了,为什么出现了这种情况?具体小代码和执行的情况已经传上来了~[ema1],求助[ema1]
是这样,原先设计了一个一个爬取论坛每个section,再进入到每个board,获取第一页的帖子链接。是没问题的,大概40多秒需要。 现在想使用两个线程,写法如下: q = Queue.Queue() Num = 2 class ThreadUrl(threading.Thread): def __init__(self…