Python怎樣爬取B站視頻彈幕并做成詞云圖

Python怎樣爬取B站視頻彈幕并做成詞云圖，相信很多沒有經(jīng)驗的人對此束手無策，為此本文總結(jié)了問題出現(xiàn)的原因和解決方法，通過這篇文章希望你能解決這個問題。

成都創(chuàng)新互聯(lián)公司是一家集網(wǎng)站建設,青州企業(yè)網(wǎng)站建設,青州品牌網(wǎng)站建設,網(wǎng)站定制,青州網(wǎng)站建設報價,網(wǎng)絡營銷,網(wǎng)絡優(yōu)化,青州網(wǎng)站推廣為一體的創(chuàng)新建站企業(yè)，幫助傳統(tǒng)企業(yè)提升企業(yè)形象加強企業(yè)競爭力?？沙浞譂M足這一群體相比中小企業(yè)更為豐富、高端、多元的互聯(lián)網(wǎng)需求。同時我們時刻保持專業(yè)、時尚、前沿，時刻以成就客戶成長自我，堅持不斷學習、思考、沉淀、凈化自己，讓我們?yōu)楦嗟钠髽I(yè)打造出實用型網(wǎng)站。

前言

今天介紹一個獲取B站數(shù)據(jù)的Python擴展庫-bilibili_api

可以獲取的數(shù)據(jù)包括：

video-視頻模塊
user-用戶模塊
dynamic-動態(tài)模塊

我是對比

沒有對比，就沒有傷害，就像最近的“哈工大”某學生和“浙大”某學生一樣。

這是之前獲取彈幕的過程：

1、彈幕數(shù)據(jù)接口

https://comment.bilibili.com/123072475.xml (一個固定的url地址 + 視頻的cid + .xml)

2、利用Request模塊，獲取數(shù)據(jù)

3、利用Xpath解析數(shù)據(jù)

接下來，是時候表演真正的技術(shù)了。

經(jīng)過bilibili_api的封裝，彈幕數(shù)據(jù)獲取的部分僅用了一行代碼：

danmu = video_info.get_danmaku()

相應的獲取視頻的基本信息和評論信息也是一樣的便捷。

basic_info = video_info.get_video_info()
comments = video_info.get_comments()

快速開始

接下來，用bilibili_api獲取“Running Man”十周年特輯的彈幕數(shù)據(jù)，并繪制詞云。

視頻的鏈接：

https://www.bilibili.com/video/BV1gC4y1h722

B站有av號和bv號，改版之后，在鏈接中直接顯示的是bv號，這兩個必須提供一個。

bvid是b站新的視頻唯一標識符，由12位數(shù)字、字母組成，大小寫敏感，傳入時請包含頭部的“BV”

比如：“BV1gC4y1h722”

0）安裝過程

安裝需要依賴request 模塊，它是把B站數(shù)據(jù)的API封裝起來了。

通過pip安裝即可：

pip install bilibili_api

1）導入模塊

from bilibili_api import Verify
from bilibili_api.video import VideoInfo
from bilibili_api.video import Danmaku

VideoInfo類-獲取視頻的信息（彈幕、評論、投幣數(shù)量、播放量等）

Danmaku類-彈幕類，用于獲取和發(fā)送彈幕

Verify 類，可用可不用。部分視頻信息需要登錄（即需要 SESSDATA ）后才能使用（如歷史彈幕獲?。?。

對視頻進行點贊、投幣等用戶操作則需要 SESSDATA 和 csrf 。

關(guān)于 SESSDATA 和 csrf 獲取的詳細方法，可參考如下鏈接：

https://github.com/Passkou/bilibili_api/wiki/SESSDATA和CSRF獲取方法（Chrome為例）

2）獲取彈幕數(shù)據(jù)

創(chuàng)建VideoInfo對象，傳入兩個參數(shù)：

bvid="BV1gC4y1h722"（視頻的BV號）
verify=verify（根據(jù)sessdata和csrf，獲取彈幕）

獲取的彈幕數(shù)據(jù)為“Danmaku類”的列表，通過遍歷，打印它的text即可

貼個代碼：

verify = Verify(sessdata="你的", csrf="你的")
video_info = VideoInfo(bvid="BV1gC4y1h722", verify=verify)

danmu = video_info.get_danmaku()
for i in danmu:
    print(i.text)

3）繪制詞云

通過jieba分詞和WorldCloud繪制詞云。

可通過WordCloud對象，傳入“背景顏色”，“背景圖”，“字體”等參數(shù)。

貼個代碼：

wc = WordCloud(
    background_color='white',
    mask=background_Image,
    font_path=r'./SourceHanSerifCN-Medium.otf',
    color_func=random_color_func,
    random_state=50,
)

word_cloud = wc.generate(words_str) # 產(chǎn)生詞云
word_cloud.to_file("rm.jpg") #保存圖片

# 顯示詞云圖片
plt.imshow(word_cloud)
plt.axis('off')
plt.show()

4）最終效果

通過詞云，可以看到最明顯的就是 “快樂十周年”、“RM 十周年”、“哈哈哈哈哈哈”等，感謝Running Man...

Python怎樣爬取B站視頻彈幕并做成詞云圖

看完上述內(nèi)容，你們掌握Python怎樣爬取B站視頻彈幕并做成詞云圖的方法了嗎？如果還想學到更多技能或想了解更多相關(guān)內(nèi)容，歡迎關(guān)注創(chuàng)新互聯(lián)行業(yè)資訊頻道，感謝各位的閱讀！

文章標題：Python怎樣爬取B站視頻彈幕并做成詞云圖
網(wǎng)址分享：http://weahome.cn/article/gdpocs.html

真实的国产乱ⅩXXX66竹夫人,五月香六月婷婷激情综合,亚洲日本VA一区二区三区,亚洲精品一区二区三区麻豆

Python怎樣爬取B站視頻彈幕并做成詞云圖

其他資訊

網(wǎng)站制作

企業(yè)服務

網(wǎng)站建設

服務器托管