Skip to content

Latest commit

 

History

History
6 lines (5 loc) · 335 Bytes

README.md

File metadata and controls

6 lines (5 loc) · 335 Bytes
这是一个关于sina微博的爬虫,采用python开发,并修改了其sdk中的bug,采用mongodb存储,实现了多进程爬取任务。

功能是:获取新浪微博1000w用户的基本信息和每个爬取用户最近发表的50条微博,使用python编写,多进程爬取,将数据存储在了
mongodb中