中文字幕日韩精品一区二区免费_精品一区二区三区国产精品无卡在_国精品无码专区一区二区三区_国产αv三级中文在线

pandas數(shù)據(jù)篩選和csv操作的實現(xiàn)方法-創(chuàng)新互聯(lián)

pandas數(shù)據(jù)篩選和csv操作的實現(xiàn)方法?很多新手對此不是很清楚,為了幫助大家解決這個難題,下面小編將為大家詳細(xì)講解,有這方面需求的人可以來學(xué)習(xí)下,希望你能有所收獲。

讓客戶滿意是我們工作的目標(biāo),不斷超越客戶的期望值來自于我們對這個行業(yè)的熱愛。我們立志把好的技術(shù)通過有效、簡單的方式提供給客戶,將通過不懈努力成為客戶在信息化領(lǐng)域值得信任、有價值的長期合作伙伴,公司提供的服務(wù)項目有:國際域名空間、虛擬空間、營銷軟件、網(wǎng)站建設(shè)、定海網(wǎng)站維護(hù)、網(wǎng)站推廣。

1. 數(shù)據(jù)篩選

 a b c
0 0 2 4
1 6 8 10
2 12 14 16
3 18 20 22
4 24 26 28
5 30 32 34
6 36 38 40
7 42 44 46
8 48 50 52
9 54 56 58

(1)單條件篩選

df[df['a']>30]
# 如果想篩選a列的取值大于30的記錄,但是之顯示滿足條件的b,c列的值可以這么寫
df[['b','c']][df['a']>30]
# 使用isin函數(shù)根據(jù)特定值篩選記錄。篩選a值等于30或者54的記錄
df[df.a.isin([30, 54])]

(2)多條件篩選

可以使用&(并)與| (或)操作符或者特定的函數(shù)實現(xiàn)多條件篩選

# 使用&篩選a列的取值大于30,b列的取值大于40的記錄
df[(df['a'] > 30) & (df['b'] > 40)]

(3)索引篩選

a. 切片操作

df[行索引,列索引]或df[[列名1,列名2]]

#使用切片操作選擇特定的行
df[1:4]
#傳入列名選擇特定的列
df[['a','c']]

b. loc函數(shù)

當(dāng)每列已有column name時,用 df [ ‘a(chǎn)' ] 就能選取出一整列數(shù)據(jù)。如果你知道column names 和index,且兩者都很好輸入,可以選擇 .loc同時進(jìn)行行列選擇。

In [28]: df.loc[0,'c']
Out[28]: 4

In [29]: df.loc[1:4,['a','c']]
Out[29]:
 a c
1 6 10
2 12 16
3 18 22
4 24 28

In [30]: df.loc[[1,3,5],['a','c']]
Out[30]:
 a c
1 6 10
3 18 22
5 30 34

c. iloc函數(shù)

如果column name太長,輸入不方便,或者index是一列時間序列,更不好輸入,那就可以選擇 .iloc了,該方法接受列名的index,iloc 使得我們可以對column使用slice(切片)的方法對數(shù)據(jù)進(jìn)行選取。這邊的 i 我覺得代表index,比較好記點。

In [35]: df.iloc[0,2]
Out[35]: 4

In [34]: df.iloc[1:4,[0,2]]
Out[34]:
 a c
1 6 10
2 12 16
3 18 22

In [36]: df.iloc[[1,3,5],[0,2]]
Out[36]:
 a c
1 6 10
3 18 22
5 30 34

In [38]: df.iloc[[1,3,5],0:2]
Out[38]:
 a b
1 6 8
3 18 20
5 30 32

d. ix函數(shù)

ix的功能更加強(qiáng)大,參數(shù)既可以是索引,也可以是名稱,相當(dāng)于,loc和iloc的合體。需要注意的是在使用的時候需要統(tǒng)一,在行選擇時同時出現(xiàn)索引和名稱, 同樣在同行選擇時同時出現(xiàn)索引和名稱。

df.ix[1:3,['a','b']]
Out[41]:
 a b
1 6 8
2 12 14
3 18 20

In [42]: df.ix[[1,3,5],['a','b']]
Out[42]:
 a b
1 6 8
3 18 20
5 30 32

In [45]: df.ix[[1,3,5],[0,2]]
Out[45]:
 a c
1 6 10
3 18 22
5 30 34

e. at函數(shù)

根據(jù)指定行index及列l(wèi)abel,快速定位DataFrame的元素,選擇列時僅支持列名。

In [46]: df.at[3,'a']
Out[46]: 18

f. iat函數(shù)

與at的功能相同,只使用索引參數(shù)

In [49]: df.iat[3,0]
Out[49]: 18

2. csv操作

csv文件內(nèi)容

Supplier Name,Invoice Number,Part Number,Cost,Purchase Date
Supplier X,001-1001,2341,$500.00 ,1/20/14
Supplier X,001-1001,2341,$500.00 ,1/20/14
Supplier X,001-1001,5467,$750.00 ,1/20/14
Supplier X,001-1001,5467,$750.00 ,1/20/14
Supplier Y,50-9501,7009,$250.00 ,1/30/14
Supplier Y,50-9501,7009,$250.00 ,1/30/14
Supplier Y,50-9505,6650,$125.00 ,2002/3/14
Supplier Y,50-9505,6650,$125.00 ,2002/3/14
Supplier Z,920-4803,3321,$615.00 ,2002/3/14
Supplier Z,920-4804,3321,$615.00 ,2002/10/14
Supplier Z,920-4805,3321,$615.00 ,2/17/14
Supplier Z,920-4806,3321,$615.00 ,2/24/14

(1)csv文件讀寫

關(guān)于read_csv函數(shù)中的參數(shù)說明參考博客:https://www.jb51.net/article/164445.htm

import pandas as pd

# 讀寫csv文件
df = pd.read_csv("supplier_data.csv")
df.to_csv("supplier_data_write.csv",index=None)

(2)篩選特定的行

#Supplier Nmae列中姓名包含'Z',或者Cost列中的值大于600
print(df[df["Supplier Name"].str.contains('Z')])
print(df[df['Cost'].str.strip('$').astype(float) > 600])
print(df.loc[(df["Supplier Name"].str.contains('Z'))|(df['Cost'].str.strip('$').astype(float) > 600.0),:])

#行中的值屬于某個集合
li = [2341,6650]
print(df[df['Part Number'].isin(li)])
print(df.loc[df['Part Number'].astype(int).isin(li),:])

#行中的值匹配某個模式
print(df[df['Invoice Number'].str.startswith("001-")])

 (3)選取特定的列

#選取特定的列
#列索引值,打印1,3列
print(df.iloc[:,1:4:2])
#列標(biāo)題打印
print(df.loc[:,["Invoice Number", "Part Number"]])
#選取連續(xù)的行
print(df.loc[1:4,:])

看完上述內(nèi)容是否對您有幫助呢?如果還想對相關(guān)知識有進(jìn)一步的了解或閱讀更多相關(guān)文章,請關(guān)注創(chuàng)新互聯(lián)行業(yè)資訊頻道,感謝您對創(chuàng)新互聯(lián)的支持。

網(wǎng)站題目:pandas數(shù)據(jù)篩選和csv操作的實現(xiàn)方法-創(chuàng)新互聯(lián)
URL網(wǎng)址:http://www.rwnh.cn/article38/csidpp.html

成都網(wǎng)站建設(shè)公司_創(chuàng)新互聯(lián),為您提供營銷型網(wǎng)站建設(shè)、服務(wù)器托管、網(wǎng)站建設(shè)、關(guān)鍵詞優(yōu)化、云服務(wù)器、微信公眾號

廣告

聲明:本網(wǎng)站發(fā)布的內(nèi)容(圖片、視頻和文字)以用戶投稿、用戶轉(zhuǎn)載內(nèi)容為主,如果涉及侵權(quán)請盡快告知,我們將會在第一時間刪除。文章觀點不代表本網(wǎng)站立場,如需處理請聯(lián)系客服。電話:028-86922220;郵箱:631063699@qq.com。內(nèi)容未經(jīng)允許不得轉(zhuǎn)載,或轉(zhuǎn)載時需注明來源: 創(chuàng)新互聯(lián)

成都網(wǎng)站建設(shè)公司
肇庆市| 江源县| 深水埗区| 抚宁县| 静宁县| 班戈县| 苍溪县| 茌平县| 崇左市| 广昌县| 黄大仙区| 黄山市| 错那县| 垣曲县| 西充县| 四会市| 襄汾县| 延安市| 民和| 鹤山市| 历史| 苍山县| 河间市| 东莞市| 囊谦县| 沧州市| 安远县| 黔西县| 保康县| 乌兰察布市| 云霄县| 襄城县| 类乌齐县| 江口县| 汤原县| 象山县| 邵阳市| 英超| 南部县| 江安县| 双城市|