国产成人精品久久免费动漫-国产成人精品天堂-国产成人精品区在线观看-国产成人精品日本-a级毛片无码免费真人-a级毛片毛片免费观看久潮喷

您的位置:首頁技術文章
文章詳情頁

python中scrapy處理項目數據的實例分析

瀏覽:99日期:2022-07-04 15:29:04

在我們處理完數據后,習慣把它放在原有的位置,但是這樣也會出現一定的隱患。如果因為新數據的加入或者其他種種原因,當我們再次想要啟用這個文件的時候,小伙伴們就會開始著急卻怎么也翻不出來,似乎也沒有其他更好的搜集辦法,而重新進行數據整理顯然是不現實的。下面我們就一起看看python爬蟲中scrapy處理項目數據的方法吧。

1、拉取項目

$ git clone https://github.com/jonbakerfish/TweetScraper.git$ cd TweetScraper/$ pip install -r requirements.txt #add ’--user’ if you are not root$ scrapy list$ #If the output is ’TweetScraper’, then you are ready to go.

2、數據持久化

通過閱讀文檔,我們發現該項目有三種持久化數據的方式,第一種是保存在文件中,第二種是保存在Mongo中,第三種是保存在MySQL數據庫中。因為我們抓取的數據需要做后期的分析,所以,需要將數據保存在MySQL中。

抓取到的數據默認是以Json格式保存在磁盤 ./Data/tweet/ 中的,所以,需要修改配置文件 TweetScraper/settings.py 。

ITEM_PIPELINES = { # ’TweetScraper.pipelines.SaveToFilePipeline’:100,#’TweetScraper.pipelines.SaveToMongoPipeline’:100, # replace `SaveToFilePipeline` with this to use MongoDB ’TweetScraper.pipelines.SavetoMySQLPipeline’:100, # replace `SaveToFilePipeline` with this to use MySQL}#settings for mysqlMYSQL_SERVER = '18.126.219.16'MYSQL_DB = 'scraper'MYSQL_TABLE = 'tweets' # the table will be created automaticallyMYSQL_USER = 'root' # MySQL user to use (should have INSERT access granted to the Database/TableMYSQL_PWD = 'admin123456' # MySQL user’s password

內容擴展:

scrapy.cfg是項目的配置文件

from scrapy.spider import BaseSpiderclass DmozSpider(BaseSpider):name = 'dmoz'allowed_domains = ['dmoz.org']start_urls = [ 'http://www.dmoz.org/Computers/Programming/Languages/Python/Books/', 'http://www.dmoz.org/Computers/Programming/Languages/Python/Resources/']def parse(self, response): filename = response.url.split('/')[-2] open(filename, ’wb’).write(response.body)

到此這篇關于python中scrapy處理項目數據的實例分析的文章就介紹到這了,更多相關python爬蟲中scrapy如何處理項目數據內容請搜索好吧啦網以前的文章或繼續瀏覽下面的相關文章希望大家以后多多支持好吧啦網!

標簽: Python 編程
相關文章:
主站蜘蛛池模板: 91老色批网站免费看 | 亚洲国产精品久久久久久 | 国内精品九一在线播放 | 精品热线九九精品视频 | 在线成人天天鲁夜啪视频 | 久久99久久99精品 | 欧美性久久久久 | 精品国产杨幂在线观看福利 | a级毛片在线播放 | 亚洲日本高清成人aⅴ片 | 国产乱淫a∨片免费视频 | 国产女人在线视频 | 91年精品国产福利线观看久久 | 亚洲欧美高清 | 亚洲精品国产专区一区 | 国产精选在线 | aaaaaa级特色特黄的毛片 | 欧美+日本+国产+在线观看 | 手机在线播放av | 在线观看免费国产成人软件 | 久久中文字幕亚洲精品最新 | 亚洲一区中文字幕在线 | α片毛片| 免费一级a毛片免费观看欧美大片 | 萌白酱白丝护士服喷水铁牛tv | 久久国内精品自在自线软件 | 港台三级在线观看 | 九九九精品视频免费 | 曰本毛片va看到爽不卡 | 亚洲欧美卡通成人制服动漫 | 国产精品资源手机在线播放 | 在线成人aa在线看片 | 网友自拍第一页 | 亚洲人成网站在线观看播放 | 自拍在线视频 | 综合亚洲精品一区二区三区 | 最新国产区 | 一区二区在线看 | 成人午夜在线播放 | 手机看片免费基地你懂的 | 国产一区二区久久 |