Pandas數(shù)據(jù)離散化的示例分析-創(chuàng)新互聯(lián)

這篇文章主要為大家展示了“Pandas數(shù)據(jù)離散化的示例分析”，內(nèi)容簡而易懂，條理清晰，希望能夠幫助大家解決疑惑，下面讓小編帶領(lǐng)大家一起研究并學習一下“Pandas數(shù)據(jù)離散化的示例分析”這篇文章吧。

為墨玉等地區(qū)用戶提供了全套網(wǎng)頁設(shè)計制作服務(wù)，及墨玉網(wǎng)站建設(shè)行業(yè)解決方案。主營業(yè)務(wù)為成都做網(wǎng)站、網(wǎng)站設(shè)計、墨玉網(wǎng)站設(shè)計，以傳統(tǒng)方式定制建設(shè)網(wǎng)站，并提供域名空間備案等一條龍服務(wù)，秉承以專業(yè)、用心的態(tài)度為用戶提供真誠的服務(wù)。我們深信只要達到每一位用戶的要求，就會得到認可，從而選擇與我們長期合作。這樣，我們也可以走得更遠！

為什么要離散化

連續(xù)屬性離散化的目的是為了簡化數(shù)據(jù)結(jié)構(gòu)，數(shù)據(jù)離散化技術(shù)可以用來減少給定連續(xù)屬性值的個數(shù)。離散化方法經(jīng)常作為數(shù)據(jù)挖掘的工具
扔掉一些信息,可以讓模型更健壯,泛化能力更強

什么是數(shù)據(jù)的離散化

連續(xù)屬性的離散化就是在連續(xù)屬性的值域上，將值域劃分為若干個離散的區(qū)間，最后用不同的符號或整數(shù) 值代表落在每個子區(qū)間中的屬性值

分箱

Pandas數(shù)據(jù)離散化的示例分析

案例

1.先讀取股票的數(shù)據(jù)，篩選出p_change數(shù)據(jù)

data = pd.read_csv("./data/stock_day.csv")
p_change= data['p_change']

2.將股票漲跌幅數(shù)據(jù)進行分組

使用的工具：

pd.qcut(data, bins)——等深分箱：

對數(shù)據(jù)進行分組將數(shù)據(jù)分組一般會與value_counts搭配使用，統(tǒng)計每組的個數(shù)

series.value_counts()：統(tǒng)計分組次數(shù)

# 自行分組
qcut = pd.qcut(p_change, 10)
# 計算分到每個組數(shù)據(jù)個數(shù)
qcut.value_counts()

自定義區(qū)間分組：

pd.cut(data, bins)——等寬分箱：

bins是整數(shù)—等寬
bins是列表--自定義分箱

# 自己指定分組區(qū)間
bins = [-100, -7, -5, -3, 0, 3, 5, 7, 100]
p_counts = pd.cut(p_change, bins)

Pandas數(shù)據(jù)離散化的示例分析

以上是“Pandas數(shù)據(jù)離散化的示例分析”這篇文章的所有內(nèi)容，感謝各位的閱讀！相信大家都有了一定的了解，希望分享的內(nèi)容對大家有所幫助，如果還想學習更多知識，歡迎關(guān)注創(chuàng)新互聯(lián)成都網(wǎng)站設(shè)計公司行業(yè)資訊頻道！

另外有需要云服務(wù)器可以了解下創(chuàng)新互聯(lián)scvps.cn，海內(nèi)外云服務(wù)器15元起步，三天無理由+7*72小時售后在線，公司持有idc許可證，提供“云服務(wù)器、裸金屬服務(wù)器、高防服務(wù)器、香港服務(wù)器、美國服務(wù)器、虛擬主機、免備案服務(wù)器”等云主機租用服務(wù)以及企業(yè)上云的綜合解決方案，具有“安全穩(wěn)定、簡單易用、服務(wù)可用性高、性價比高”等特點與優(yōu)勢，專為企業(yè)上云打造定制，能夠滿足用戶豐富、多元化的應(yīng)用場景需求。

網(wǎng)頁名稱：Pandas數(shù)據(jù)離散化的示例分析-創(chuàng)新互聯(lián)
網(wǎng)頁路徑：http://weahome.cn/article/piijs.html

真实的国产乱ⅩXXX66竹夫人,五月香六月婷婷激情综合,亚洲日本VA一区二区三区,亚洲精品一区二区三区麻豆

Pandas數(shù)據(jù)離散化的示例分析-創(chuàng)新互聯(lián)

其他資訊

網(wǎng)站制作

企業(yè)服務(wù)

網(wǎng)站建設(shè)

服務(wù)器托管