對dataframe數(shù)據(jù)之間求補集的實例詳解
python的pandas庫,對于dataframe數(shù)據(jù),有merge命令可以完成dataframe數(shù)據(jù)之間的求取交集并集等命令。
若存在df1與df2 ,他們的交集df3=pd.merge(df1,df2,on=[.....])。但是又想通過df3求df3與df1的補集時發(fā)現(xiàn)沒有該命令。
求df3(子集)與df1補集:
#x為子集 def Complement(x,y): import numpy as np array1 = np.array(x) list1=array1.tolist() array2=np.array(y) list2=array2.tolist() def list_to_tuple(t): l = [] for e in t: l.append(tuple(e)) return l def tuple_to_list(t): l = [] for e in t: l.append(list(e)) return l a=list_to_tuple(list1) b=list_to_tuple(list2) set3=set(b).difference(set(a)) list3=list(set3) list4=tuple_to_list(list3) from pandas import Series,DataFrame df1=DataFrame(list4,columns=x.columns) return df1
以上這篇對dataframe數(shù)據(jù)之間求補集的實例詳解就是小編分享給大家的全部內(nèi)容了,希望能給大家一個參考,也希望大家多多支持腳本之家。
相關(guān)文章
Python多線程threading join和守護線程setDeamon原理詳解
這篇文章主要介紹了Python多線程threading join和守護線程setDeamon原理詳解,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友可以參考下2020-03-03
pycharm不以pytest方式運行,想要切換回普通模式運行的操作
這篇文章主要介紹了pycharm不以pytest方式運行,想要切換回普通模式運行的操作,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧2020-09-09
django虛擬環(huán)境(virtualenv)的創(chuàng)建
在使用django開發(fā)項目的時候,一個環(huán)境只能對應(yīng)一個項目,若不安裝虛擬環(huán)境、都裝在系統(tǒng)里面,每次項目加載都需要加載所有的安裝包,本文就介紹django虛擬環(huán)境的安裝,感興趣的可以了解一下2021-08-08
Python 圖片文字識別的實現(xiàn)之PaddleOCR
OCR方向的工程師,之前一定聽說過PaddleOCR這個項目,其主要推薦的PP-OCR算法更是被國內(nèi)外企業(yè)開發(fā)者廣泛應(yīng)用,短短半年時間,累計Star數(shù)量已超過15k,頻頻登上Github Trending和Paperswithcode 日榜月榜第一2021-11-11
python實現(xiàn)文字轉(zhuǎn)語音的項目實踐
pyttsx3是一個Python庫,用于文字轉(zhuǎn)語音的功能,它可以將文本轉(zhuǎn)換為語音,并使用不同的音頻引擎進行輸出,本文就來詳細的介紹一下用法,具有一定的參考價值,感興趣的可以了解一下2023-08-08

