+
 新版

Scrapy

软件主页
关注
Scrapy 是一套基于基于Twisted的异步处理框架,纯python实现的爬虫框架,用户只需要定制开发几个模块就可以轻松的实现一个爬虫,用来抓取网页内容以及各种图片,非常之方...
加载中
22
回答
关于爬取没有设置robots.txt的网站的法律风险

如果要爬取的网站上没有设置robots.txt,那么是不是代表默认都允许爬取呢?有没有法律风险呢?

2020/07/10 08:40
4
回答
python xpath 如何过滤div中的script和style标签

爬取一个页面中的div,想获取div中的文字,我是这么写的: selector.xpath('//div[@class="text-con"]').xpa...

2017/06/30 15:32
1
回答
Scrapy:在pipeline的process_item中的一个并发/线程安全方面的问题

如,一个将数据保存到excel文件的管道类,作为一个通用类,不写死Item类的判断过程,用dict来map类名和文件的关系, outputs = {‘AA...

2019/02/10 17:35
1
回答
python Scrapy同一个站点如何登录多个账号

登录部分代码如下:     def start_requests(self,user,passw): yield scrapy.F...

2017/06/29 08:27
5
回答

没有更多内容

加载失败,请刷新页面

返回顶部
顶部