如何使用Python爬蟲Scrapy爬取中國(guó)地震數(shù)據(jù),針對(duì)這個(gè)問題,這篇文章詳細(xì)介紹了相對(duì)應(yīng)的分析和解答,希望可以幫助更多想解決這個(gè)問題的小伙伴找到更簡(jiǎn)單易行的方法。
創(chuàng)新互聯(lián)堅(jiān)持“要么做到,要么別承諾”的工作理念,服務(wù)領(lǐng)域包括:網(wǎng)站設(shè)計(jì)制作、成都做網(wǎng)站、企業(yè)官網(wǎng)、英文網(wǎng)站、手機(jī)端網(wǎng)站、網(wǎng)站推廣等服務(wù),滿足客戶于互聯(lián)網(wǎng)時(shí)代的蘭溪網(wǎng)站設(shè)計(jì)、移動(dòng)媒體設(shè)計(jì)的需求,幫助企業(yè)找到有效的互聯(lián)網(wǎng)解決方案。努力成為您成熟可靠的網(wǎng)絡(luò)建設(shè)合作伙伴!
總感覺最近好多地震的新聞,就想著爬一波地震相關(guān)的數(shù)據(jù)來看看。
Python 版本:3.6.4
相關(guān)模塊:
scrapy模塊;
jieba模塊;
pyecharts模塊;
folium模塊;
wordcloud模塊;
fake_useragent模塊;
以及一些Python自帶的模塊。
安裝Python并添加到環(huán)境變量,pip安裝需要的相關(guān)模塊即可。
首先新建一個(gè)project:
然后打開中國(guó)地震臺(tái)網(wǎng):
http://news.ceic.ac.cn/index.html
發(fā)現(xiàn)使用網(wǎng)站自帶的查詢功能就可以查詢到指定時(shí)間和經(jīng)緯度范圍的地震數(shù)據(jù):
圖片
OK,那就開始寫代碼吧~
先在items.py文件內(nèi)定義我們要爬取的數(shù)據(jù):
class EarthquakeItem(scrapy.Item):
在spiders文件夾下新建main.py函數(shù)寫我們爬蟲主程序,這里我們爬取的是從2000年1月1日開始至今網(wǎng)站上所有有記錄的地震數(shù)據(jù)(事實(shí)上,跑完代碼發(fā)現(xiàn)網(wǎng)站里只有從2012年開始的地震數(shù)據(jù)T_T):
'''main'''
OK,大功告成了,在第一個(gè)earthquake文件夾下運(yùn)行如下命令就行了:
scrapy crawl earthquake -o eqdata.json -t json
爬取的數(shù)據(jù)將保存在eqdata.json文件內(nèi)。
關(guān)于如何使用Python爬蟲Scrapy爬取中國(guó)地震數(shù)據(jù)問題的解答就分享到這里了,希望以上內(nèi)容可以對(duì)大家有一定的幫助,如果你還有很多疑惑沒有解開,可以關(guān)注創(chuàng)新互聯(lián)行業(yè)資訊頻道了解更多相關(guān)知識(shí)。