您好,登錄后才能下訂單哦!
這篇文章主要為大家展示了“python中pandas.DataFrame選取、修改數據最好用.loc,.iloc,.ix的示例分析”,內容簡而易懂,條理清晰,希望能夠幫助大家解決疑惑,下面讓小編帶領大家一起研究并學習一下“python中pandas.DataFrame選取、修改數據最好用.loc,.iloc,.ix的示例分析”這篇文章吧。
先手工實現一個數據框吧
import numpy as np import pandas as pd df = pd.DataFrame(np.arange(0,60,2).reshape(10,3),columns=list('abc'))
df 是這樣子滴
那么這三種選取數據的方式該怎么選擇呢?
一、當每列已有column name時,用 df [ 'a' ] 就能選取出一整列數據。如果你知道column names 和index,且兩者都很好輸入,可以選擇 .loc
df.loc[0, 'a'] df.loc[0:3, ['a', 'b']] df.loc[[1, 5], ['b', 'c']]
由于這邊我們沒有命名index,所以是DataFrame自動賦予的,為數字0-9
二、如果我們嫌column name太長了,輸入不方便,有或者index是一列時間序列,更不好輸入,那就可以選擇 .iloc了。這邊的 i 我覺得代表index,比較好記點。
df.iloc[1,1] df.iloc[0:3, [0,1]] df.iloc[[0, 3, 5], 0:2]
iloc 使得我們可以對column使用slice(切片)的方法對數據進行選取。
三、.ix 的功能就更強大了,它允許我們混合使用下標和名稱進行選取。 可以說它涵蓋了前面所有的用法。基本上把前面的都換成df.ix 都能成功,但是有一點,就是
df.ix [ [ ..1.. ], [..2..] ], 1框內必須統一,必須同時是下標或者名稱,2框也一樣。 BTW, 1框是用來指定row,2框是指定column, 當然上面所有的取數方法都是這個規則。
這就是我目前的領悟吧。
以上是“python中pandas.DataFrame選取、修改數據最好用.loc,.iloc,.ix的示例分析”這篇文章的所有內容,感謝各位的閱讀!相信大家都有了一定的了解,希望分享的內容對大家有所幫助,如果還想學習更多知識,歡迎關注億速云行業資訊頻道!
免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。