這里就不一 一說(shuō)明了,直接上代碼,并錄個(gè)小的GIF圖片給大家看看效果
#Q群542110741 # -*- coding:utf-8 -*- import requests from lxml import etree header = { 'User-Agent':'Mozilla/5.0 (Windows NT 6.1; WOW64; rv:60.0) Gecko/20100101 Firefox/60.0', 'Host':'soccer.hupu.com', 'Referer':'https://soccer.hupu.com/'} i = 0 while 1: #構(gòu)建循環(huán)頁(yè)面翻頁(yè) url = 'https://soccer.hupu.com/home/latest-news?league=世界杯&page=' i += 1 #獲取json數(shù)據(jù),一頁(yè)20個(gè) html = requests.get(url+str(i),headers=header).json()['result'] for info in html: time_r = info['time']#發(fā)布時(shí)間 title = info['title']#標(biāo)題 url_r = info['url']#新聞鏈接 origin = info['origin']#來(lái)源 print(title) print('發(fā)布時(shí)間:',time_r,' '*5,'來(lái)自:',origin) head = header head['Host'] = 'voice.hupu.com'#更改header中Host參數(shù) html_r = requests.get(url_r,headers=head)#獲取新聞詳情 html_r.encoding = 'utf-8'#編碼格式指定 #獲取div下的所有文本 datas = etree.HTML(html_r.text).xpath('//div[@class="artical-content-read"]')[0].xpath('string(.)').strip() print('\n'+'內(nèi)容:'+'\n'*2,datas,'\n') #可由用戶手動(dòng)退出循環(huán) if input('任意鍵繼續(xù),“q”退出') in ['q', 'Q']: exit()
以上是“Python爬蟲(chóng)如何實(shí)現(xiàn)球迷速成”這篇文章的所有內(nèi)容,感謝各位的閱讀!相信大家都有了一定的了解,希望分享的內(nèi)容對(duì)大家有所幫助,如果還想學(xué)習(xí)更多知識(shí),歡迎關(guān)注創(chuàng)新互聯(lián)成都網(wǎng)站設(shè)計(jì)公司行業(yè)資訊頻道!
另外有需要云服務(wù)器可以了解下創(chuàng)新互聯(lián)scvps.cn,海內(nèi)外云服務(wù)器15元起步,三天無(wú)理由+7*72小時(shí)售后在線,公司持有idc許可證,提供“云服務(wù)器、裸金屬服務(wù)器、高防服務(wù)器、香港服務(wù)器、美國(guó)服務(wù)器、虛擬主機(jī)、免備案服務(wù)器”等云主機(jī)租用服務(wù)以及企業(yè)上云的綜合解決方案,具有“安全穩(wěn)定、簡(jiǎn)單易用、服務(wù)可用性高、性價(jià)比高”等特點(diǎn)與優(yōu)勢(shì),專為企業(yè)上云打造定制,能夠滿足用戶豐富、多元化的應(yīng)用場(chǎng)景需求。
新聞名稱:Python爬蟲(chóng)如何實(shí)現(xiàn)球迷速成-創(chuàng)新互聯(lián)
標(biāo)題鏈接:http://weahome.cn/article/dochhp.html