Python爬虫常用的库包括但不限于以下几种:
- 请求库:
- `urllib`:Python3自带的库,用于发送HTTP请求,但现在可能被`requests`替代。1
- `requests`:第三方库,功能强大,使用简单,是当前最常用的请求库。2
-
解析库:
-
存储库:
- `PyMySQL`:MySQL的Python接口,用于存储数据。
- `PyMongo`:MongoDB的Python接口。
- `redis-py`:Redis的Python接口。
-
图像识别库:
-
爬虫框架:
- `pyspider`:国产的网络爬虫系统,具有丰富的WebUI、脚本编辑器、任务监控器、项目管理以及结果处理器。
- `Scrapy`:功能强大,依赖库较多。
此外,还有其他一些常用的库,如`unirest for Python`、`hyper`、`PySocks`、`treq`、`aiohttp`等。