最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Pandas 中的 drop_duplicates()詳解

 更新時(shí)間:2023年09月26日 11:25:53   作者:紅水母  
Pandas 中的 drop_duplicates() 函數(shù)用于從 DataFrame 中刪除重復(fù)的行,該函數(shù)有一些參數(shù),允許你進(jìn)行不同方式的重復(fù)行處理,本文給大家介紹Pandas 中的 drop_duplicates(),感興趣的朋友跟隨小編一起看看吧

Pandas 中的 drop_duplicates()

Pandas 中的 drop_duplicates() 函數(shù)用于從 DataFrame 中刪除重復(fù)的行。該函數(shù)有一些參數(shù),允許你進(jìn)行不同方式的重復(fù)行處理。以下是 drop_duplicates() 函數(shù)的主要參數(shù)解析:

subset(可選參數(shù)):

作用:指定要考慮重復(fù)的列。

默認(rèn)值:None,表示考慮整個(gè)行的重復(fù)。

示例:df.drop_duplicates(subset=[‘column1’, ‘column2’])

keep(可選參數(shù)):

作用:指定保留哪些重復(fù)行。

可選值:‘first’:保留第一次出現(xiàn)的重復(fù)行(默認(rèn)值)。

‘last’:保留最后一次出現(xiàn)的重復(fù)行。

False:刪除所有重復(fù)行,不保留任何重復(fù)行。示例:df.drop_duplicates(keep=‘last’)

inplace(可選參數(shù)):

作用:如果設(shè)置為 True,將在原始 DataFrame 上執(zhí)行刪除操作,不返回新的 DataFrame。

默認(rèn)值:False,表示返回一個(gè)新的 DataFrame,原始 DataFrame 不受影響。

示例:df.drop_duplicates(inplace=True)

ignore_index(可選參數(shù)):

作用:如果設(shè)置為 True,刪除后的 DataFrame 將重新索引,以便索引從零開始。

默認(rèn)值:False。

示例:df.drop_duplicates(ignore_index=True)

subset 和 keep 參數(shù)的組合:

通常,subset 參數(shù)用于指定要考慮重復(fù)的列,而 keep 參數(shù)用于控制保留哪些重復(fù)行。例如,df.drop_duplicates(subset=[‘column1’, ‘column2’], keep=‘last’) 表示在 ‘column1’ 和 ‘column2’ 列上考慮重復(fù),但保留最后一次出現(xiàn)的重復(fù)行。

drop_duplicates() 函數(shù)通常用于數(shù)據(jù)清洗,以刪除數(shù)據(jù)中的重復(fù)記錄,以便進(jìn)行分析或建模。

你可以根據(jù)具體的需求使用不同的參數(shù)組合來執(zhí)行不同的重復(fù)行處理操作。

補(bǔ)充:

Pandas-去重函數(shù)drop_duplicates()詳解

Panda DataFrame 對(duì)象提供了一個(gè)數(shù)據(jù)去重的函數(shù) drop_duplicates(),本節(jié)對(duì)該函數(shù)的用法做詳細(xì)介紹。

格式介紹

drop_duplicates()函數(shù)的語法格式如下:

data.drop_duplicates(subset=['a','b','b'],keep='first',inplace=True)

參數(shù)說明如下:
subset:表示要進(jìn)去重的列名,默認(rèn)為 None。
keep:有三個(gè)可選參數(shù),分別是 first、last、False,默認(rèn)為 first,表示只保留第一次出現(xiàn)的重復(fù)項(xiàng),刪除其余重復(fù)項(xiàng),last 表示只保留最后一次出現(xiàn)的重復(fù)項(xiàng),F(xiàn)alse 則表示刪除所有重復(fù)項(xiàng)。
inplace:布爾值參數(shù),默認(rèn)為 False 表示刪除重復(fù)項(xiàng)后返回一個(gè)副本,若為 Ture 則表示直接在原數(shù)據(jù)上刪除重復(fù)項(xiàng)。

示例數(shù)據(jù)

代碼:

import pandas as pd
data = pd.DataFrame({
    'a':[2,1,1,1,1,1,2],
    'b':[1,3,2,4,1,1,5],
    'c':[1,3,2,4,1,1,3],
    'd':[1,3,2,4,1,1,8]
})
print (data)

打印結(jié)果

實(shí)際應(yīng)用

1、默認(rèn)保留第一次出現(xiàn)的重復(fù)項(xiàng)

代碼:

import pandas as pd
data = pd.DataFrame({
    'a':[2,1,1,1,1,1,2],
    'b':[1,3,2,4,1,1,5],
    'c':[1,3,2,4,1,1,3],
    'd':[1,3,2,4,1,1,8]
})
data_del = data.drop_duplicates()
print (data_del)

打印結(jié)果

在這里插入圖片描述

2、刪除所有重復(fù)項(xiàng)

代碼:

import pandas as pd
data = pd.DataFrame({
    'a':[2,1,1,1,1,1,2],
    'b':[1,3,2,4,1,1,5],
    'c':[1,3,2,4,1,1,3],
    'd':[1,3,2,4,1,1,8]
})
data_del = data.drop_duplicates(keep=False)
print (data_del)

打印結(jié)果

在這里插入圖片描述

3、根據(jù)指定列標(biāo)簽去重

代碼:

import pandas as pd
data = pd.DataFrame({
    'a':[2,1,1,1,1,1,2],
    'b':[1,3,2,4,1,1,5],
    'c':[1,3,2,4,1,1,3],
    'd':[1,3,2,4,1,1,8]
})
data_del = data.drop_duplicates(subset=['b'],keep=False)
print (data_del)

打印結(jié)果

在這里插入圖片描述

4、指定多列同時(shí)去重

代碼:

import pandas as pd
data = pd.DataFrame({
    'a':[2,1,1,1,1,1,2],
    'b':[1,3,2,4,1,1,5],
    'c':[1,3,2,4,1,1,3],
    'd':[1,3,2,4,1,1,8]
})
data_del = data.drop_duplicates(subset=['b','c'],keep=False)
print (data_del)

打印結(jié)果

到此這篇關(guān)于Pandas 中的 drop_duplicates()的文章就介紹到這了,更多相關(guān)Pandas drop_duplicates()內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

  • 解讀keras中的正則化(regularization)問題

    解讀keras中的正則化(regularization)問題

    這篇文章主要介紹了解讀keras中的正則化(regularization)問題,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。如有錯(cuò)誤或未考慮完全的地方,望不吝賜教
    2022-12-12
  • 基于Python打造超漂亮的HTML兩欄文本對(duì)比工具

    基于Python打造超漂亮的HTML兩欄文本對(duì)比工具

    在日常開發(fā)、文檔撰寫或代碼審查中,我們經(jīng)常需要對(duì)比兩個(gè)文本文件的差異,本文將使用Python + difflib + HTML + CSS 手動(dòng)打造一個(gè)支持行內(nèi)字符級(jí)差異高亮的兩欄對(duì)比工具,需要的可以了解下
    2025-09-09
  • MacOS(M1芯片?arm架構(gòu))下安裝tensorflow的詳細(xì)過程

    MacOS(M1芯片?arm架構(gòu))下安裝tensorflow的詳細(xì)過程

    這篇文章主要介紹了MacOS(M1芯片?arm架構(gòu))下如何安裝tensorflow,本節(jié)使用的版本是tensorflow2.4?python3.8,因此并未安裝加速插件,本文結(jié)合實(shí)例代碼詳細(xì)講解,需要的朋友可以參考下
    2023-02-02
  • Python數(shù)據(jù)可視化常用4大繪圖庫(kù)原理詳解

    Python數(shù)據(jù)可視化常用4大繪圖庫(kù)原理詳解

    這篇文章主要介紹了Python數(shù)據(jù)可視化常用4大繪圖庫(kù)原理詳解,文中通過示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友可以參考下
    2020-10-10
  • python圖片驗(yàn)證碼識(shí)別最新模塊muggle_ocr的示例代碼

    python圖片驗(yàn)證碼識(shí)別最新模塊muggle_ocr的示例代碼

    這篇文章主要介紹了python圖片驗(yàn)證碼識(shí)別最新模塊muggle_ocr的相關(guān)知識(shí),本文通過實(shí)例代碼給大家介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或工作具有一定的參考借鑒價(jià)值,需要的朋友可以參考下
    2020-07-07
  • Python pip 安裝與使用(安裝、更新、刪除)

    Python pip 安裝與使用(安裝、更新、刪除)

    pip 是 Python 包管理工具,該工具提供了對(duì)Python 包的查找、下載、安裝、卸載的功能,需要的朋友可以參考下
    2019-10-10
  • Python判斷文件和字符串編碼類型的實(shí)例

    Python判斷文件和字符串編碼類型的實(shí)例

    下面小編就為大家分享一篇Python判斷文件和字符串編碼類型的實(shí)例,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過來看看吧
    2017-12-12
  • 關(guān)于命令行執(zhí)行Python腳本的傳參方式

    關(guān)于命令行執(zhí)行Python腳本的傳參方式

    這篇文章主要介紹了關(guān)于命令行執(zhí)行Python腳本的傳參方式,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。如有錯(cuò)誤或未考慮完全的地方,望不吝賜教
    2022-09-09
  • Python入門教程(二十八)Python中的JSON

    Python入門教程(二十八)Python中的JSON

    這篇文章主要介紹了Python入門教程(二十八)Python中的JSON,JSON 是用 JavaScript 對(duì)象表示法(JavaScript object notation)編寫的文本,接下來我們就來學(xué)習(xí)一下
    2023-04-04
  • Eclipse + Python 的安裝與配置流程

    Eclipse + Python 的安裝與配置流程

    Eclipse的安裝是很容易的。Eclipse是基于java的一個(gè)應(yīng)用程序,因此需要一個(gè)java的運(yùn)行環(huán)境(JRE)才行。(我這里主要介紹windows下的安裝)
    2013-03-03

最新評(píng)論

甘德县| 西乌珠穆沁旗| 长宁县| 伊金霍洛旗| 安龙县| 察雅县| 思茅市| 洪湖市| 无极县| 商南县| 宕昌县| 安远县| 桂林市| 苏尼特左旗| 珲春市| 彝良县| 邓州市| 滨州市| 和政县| 隆安县| 三原县| 汝南县| 芦山县| 镇巴县| 柳林县| 开江县| 龙泉市| 泰顺县| 介休市| 兴海县| 扶风县| 福建省| 精河县| 鄱阳县| 陆良县| 六安市| 武隆县| 石家庄市| 济南市| 信宜市| 华亭县|