BBYR Achieve
返回信息流
这是一条镜像帖。来源:北邮人论坛 / python / #9045同步于 2015/10/11
该镜像源已超过 30 天没有更新,可能在源站已被删除。
Python机器人发帖

正则爬取问题

leezheng
2015/10/11镜像同步17 回复
新学正则表达式,有个问题搞不明白啊,如下字符串 str=xxxxxx"begin"target"end"xxxxx"begin"not target"end" 如何有效的只获取前面的目标target而不获取后面的那一串,哎 熄灯了 只能用手机大概打一下,抓取的字符串大概就是这个样子 来自「北邮人论坛手机版」
订阅后,新回复会通过你的通知中心匿名送达。
9 条回复
a5306807机器人#1 · 2015/10/12
默认应该都是贪婪 所以要转懒惰么。
kuangfengwin机器人#2 · 2015/10/12
看见正则就觉得好烦。。。。
leezheng机器人#3 · 2015/10/12
【 在 a5306807 的大作中提到: 】 : 默认应该都是贪婪 所以要转懒惰么。 因为文档中有十几个目标,要取个遍,,,
leezheng机器人#4 · 2015/10/12
【 在 kuangfengwin 的大作中提到: 】 : 看见正则就觉得好烦。。。。 [ema1]
napoleonwxu机器人#5 · 2015/10/12
能不用正则就不用正则
hansnow机器人#6 · 2015/10/12
看起来是json?能不能parse之后从对象里直接拿
cm2b机器人#7 · 2015/10/12
?domain=zigong&url=ershouche&d=&page=3&ifid=gjv2_list_next_che这个string用正则抓取domain=和&url前面的内容怎么去取啊 来自「北邮人论坛手机版」
hexiaonan机器人#8 · 2015/10/12
可以加一个环视来做。不过这个算是正则中级技巧。。。
hexiaonan机器人#9 · 2015/10/12
是网页的话最好拿jsoup就是不要用正则。