最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

pandas loc iloc ix用法詳細分析

 更新時間:2023年01月09日 16:35:21   作者:bitcarmanlee  
pandas處理數(shù)據(jù)時,我們會經(jīng)??吹絛ataframe結(jié)構(gòu)使用loc, iloc, ix等方法,那么這些方法到底有啥區(qū)別,下面我們來進行詳細分析,感興趣的朋友跟隨小編一起看看吧

1.什么是label

pandas處理數(shù)據(jù)時,我們會經(jīng)常看到dataframe結(jié)構(gòu)使用loc, iloc, ix等方法。那么這些方法到底有啥區(qū)別,下面我們來進行詳細分析。

首先我們先明確一點,這幾個方法都可以用來過濾dataframe的行列。他們的不同,主要還是使用方式的不同。

在分析之前,我們先來明確一下標簽label的概念。為了方便看得更清楚,先構(gòu)造一個數(shù)據(jù)集

import pandas as pd

def test_loc():
    name = ['n1', 'n2', 'n3', 'n4', 'n5', 'n6']
    age = [1, 2, 3, 4, 5, 6]
    country = ['Chi', 'Chi', 'Ame', 'Ame', 'Jp', 'Koe']
    city = ['bj', 'sh', 'ny', 'ny', 'tok', 'se']
    data = pd.DataFrame({'name': name, 'age': age, 'country': country, 'city': city})

    # label
    print(data)
  name  age country city
0   n1    1     Chi   bj
1   n2    2     Chi   sh
2   n3    3     Ame   ny
3   n4    4     Ame   ny
4   n5    5      Jp  tok
5   n6    6     Koe   se

上面的data,0,1,2,3,4,5為索引,就是我們的行標簽。name ,age,country,city為列名,則是我們的列標簽。

2.loc用法

我們先直接上結(jié)論:loc可以基于行列標簽對數(shù)據(jù)進行篩選。

下面通過實驗來說明。

def test_loc():
    name = ['n1', 'n2', 'n3', 'n4', 'n5', 'n6']
    age = [1, 2, 3, 4, 5, 6]
    country = ['Chi', 'Chi', 'Ame', 'Ame', 'Jp', 'Koe']
    city = ['bj', 'sh', 'ny', 'ny', 'tok', 'se']
    data = pd.DataFrame({'name': name, 'age': age, 'country': country, 'city': city})
    # 取前幾行
    print(data.loc[[0, 1, 2]])
    print()
    print(data.loc[0:2])
    print()

    # 取某幾列
    print(data.loc[:, ['name', 'age', 'city']])
    print()

    # 取幾行幾列
    print(data.loc[0:2,['name', 'age', 'city']])
    print()

2.1 選擇行

loc的整體語法為loc[rows, columns]。逗號前面部分為選擇的行,后面部分為選擇的列,":"表示全選。

loc[0:2]與loc[[0, 1, 2]]的效果一致,都是表示選取前3行,可以認為此時是通過行標簽選擇數(shù)據(jù)。

2.2 選擇列

實際操作中,最常見的需求就是選擇某幾列而不是所有數(shù)據(jù)。loc[:, [‘name’, ‘age’, ‘city’]]就是選擇散列,逗號前面的:表示選擇所有行。

2.3 選擇指定的行列

data.loc[0:2,[‘name’, ‘age’, ‘city’]]這種用法,意思就是選擇前三行的name,age,city這三列。

2.4 loc小結(jié)

1.就像我們一開始提到的,loc是基于數(shù)據(jù)行列標簽對數(shù)據(jù)進行篩選。
2.針對行標簽選擇時,如果index是默認的整數(shù)序列,選擇的時候包括了末端的一行。
3.":"表示選擇所有行或者所有列。

3.iloc用法

直接上結(jié)論:iloc與loc的不同在于,loc基于數(shù)據(jù)標簽進行篩選,而iloc基于位置進行數(shù)據(jù)篩選,i可以認為是integer,即在loc的基礎(chǔ)上,用integer整數(shù)當作"索引"

看個例子

def test_iloc():
    name = ['n1', 'n2', 'n3', 'n4', 'n5', 'n6']
    age = [1, 2, 3, 4, 5, 6]
    country = ['Chi', 'Chi', 'Ame', 'Ame', 'Jp', 'Koe']
    city = ['bj', 'sh', 'ny', 'ny', 'tok', 'se']
    data = pd.DataFrame({'name': name, 'age': age, 'country': country, 'city': city})

    # iloc的索引,不包含最后一個
    print(data.iloc[0:2])
    print()

    #
    print(data.iloc[:, 0:2])
    print()
    print(data.iloc[:,[0, 1, 3]])
    print()

    # print(data.iloc[:, ['name', 'city']])
    # IndexError: .iloc requires numeric indexers, got ['name' 'city']

最后輸出為:

  name  age country city
0   n1    1     Chi   bj
1   n2    2     Chi   sh

  name  age
0   n1    1
1   n2    2
2   n3    3
3   n4    4
4   n5    5
5   n6    6

  name  age city
0   n1    1   bj
1   n2    2   sh
2   n3    3   ny
3   n4    4   ny
4   n5    5  tok
5   n6    6   se

iloc[0:2],表示選擇前兩行。注意在iloc中,末端那行不包括。因為起始索引是0,所以iloc[0:2]選擇的是第0行與第1行。

data.iloc[:, 0:2]表示選擇前兩列,data.iloc[:,[0, 1, 3]]表示選擇第0,1,3列。

如果我們嘗試用列名篩選數(shù)據(jù),data.iloc[:, [‘name’, ‘city’]]
代碼會報錯

IndexError: .iloc requires numeric indexers, got ['name' 'city']

上面的錯誤信息就很明確的告訴了我們,iloc方法需要numeric indexers。

4.ix

最后一個ix,是歷史版本的用法。ix的作用,現(xiàn)在用loc,iloc基本都能實現(xiàn),所以ix也基本上被loc,iloc所代替,現(xiàn)在官方不再推薦使用。

到此這篇關(guān)于pandas loc iloc ix用法詳解的文章就介紹到這了,更多相關(guān)pandas loc iloc ix用法內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

最新評論

诸城市| 隆昌县| 五台县| 于田县| 珲春市| 十堰市| 资兴市| 德保县| 天全县| 新宾| 会东县| 和林格尔县| 桃园县| 翼城县| 宝应县| 河西区| 商河县| 三江| 吉林省| 建昌县| 桂林市| 海林市| 盖州市| 江口县| 宜宾市| 河东区| 中牟县| 九江市| 南京市| 鄂伦春自治旗| 灵台县| 沅江市| 邯郸市| 台安县| 新竹县| 清水县| 工布江达县| 巴里| 靖江市| 柳江县| 开封市|