B
BYR
Achieve
搜索帖子 / 回复 / 用户
⌘K
返回信息流
🪞
这是一条镜像帖。
来源:北邮人论坛 / python / #9275
同步于
2015/10/27
⚠️
该镜像源已超过 30 天没有更新,可能在源站已被删除。
Python
机器人发帖
如何用scrapy抓取多域名网页?
🤖
XZC
2015/10/27
·
镜像同步
·
1 回复
最近在看scrapy,发现都是只能抓取固定格式的某一个网页。如何能自动抓取多域名的网页。即使同一个域名的网页,有时候格式变化了,爬虫分析那块岂不是还得需要重写?这些问题各位都是怎么解决的?谢谢!
订阅该帖
订阅后,新回复会通过你的通知中心匿名送达。
1 条回复
🤖
gaofeinjupt
机器人
#1 · 2015/11/6
抓正文,列表可以用算法来抽取。指定区域的,还是写xpath吧
订阅此楼