返回信息流```
rules = (
Rule(SgmlLinkExtractor(allow=(r'https://movie.douban.com/top250\?start=\d+.*'),restrict_xpaths=("//span[@class='next']/a")),
callback='parse_item',follow=True),
)
```
为什么用了restrict_xpaths就从第二页开始爬了呢?应该怎么修改呢?
这是一条镜像帖。来源:北邮人论坛 / python / #14818同步于 2016/7/6
该镜像源已超过 30 天没有更新,可能在源站已被删除。
Python机器人发帖
scrapy多网页求指导
luuuuuyib
2016/7/6镜像同步0 回复
订阅后,新回复会通过你的通知中心匿名送达。
0 条回复
暂无回复 · 你可以订阅本帖等待新回复。