最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

python?pandas遍歷每行并累加進(jìn)行條件過濾方式

 更新時(shí)間:2022年05月12日 08:59:04   作者:向日葵  
這篇文章主要介紹了python?pandas遍歷每行并累加進(jìn)行條件過濾方式,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。如有錯(cuò)誤或未考慮完全的地方,望不吝賜教

pandas遍歷每行并累加進(jìn)行條件過濾

 本次記錄主要實(shí)現(xiàn)對(duì)每行進(jìn)行排序,并保留前80%以前的偏好。

思路:

將每行的概率進(jìn)行排序,然后累加,累加值小于等于0.8的偏好保留,獲得一個(gè)累加過濾的dataframe,然后映射回原始數(shù)據(jù)中,保留每行的偏好。接下來是代碼的實(shí)現(xiàn)

a = [[0.2, 0.35, 0.45], [0.1,0.2, 0.7], [0.3, 0.5, 0.2]]
data = pd.DataFrame(a, index=['user1','user2','user3'], columns=["a", "b", "c"])
sum_df=[]
for index,row in data.iterrows():
    df = row.sort_values(ascending=False).cumsum()
    if df[0]>0.8:
        new_df = df[:1]
    else:
        new_df = df[df<=0.8]
    sum_df.append(new_df)
sum_df = pd.DataFrame(sum_df)
print(sum_df)           

這是累加之后每個(gè)用戶保留的前80%偏好的類型,接下來如何將這個(gè)特征映射回去,將累加后的dataframe通過空值將其轉(zhuǎn)化為0-1dataframe,再和原數(shù)據(jù)集一一對(duì)應(yīng)相乘,就可以映射回去了,代碼如下

d = (sum_df.notnull())*1
print(d)

final_df = d*data #將保留地特征映射到原始數(shù)據(jù)中
print(final_df)

本節(jié)內(nèi)容目標(biāo)明確,實(shí)現(xiàn)了每個(gè)用戶的前80%偏好,不知道正在看的小伙伴有沒有懂?可以一起討論哦!

接下來,考慮優(yōu)化這個(gè)實(shí)現(xiàn)的代碼,前面的思路是通過兩個(gè)dataframe相乘實(shí)現(xiàn)的,當(dāng)數(shù)據(jù)集非常大的時(shí)候,效率很低,于是不用list,利用字典的形式實(shí)現(xiàn)

sum_df=[]
for index,row in data.iterrows():
    df = row.sort_values(ascending=False).cumsum()
    origin = row.to_dict() #原始每個(gè)用戶值
    if df[0]>0.8:
        new_df = df[:1]
    else:
        new_df = df[df<=0.8]
    name = new_df.name  #user
    tmp = new_df.to_dict()
    for key in tmp.keys(): # 原始值映射
        tmp[key] = origin[key]
    tmp['user'] = name
    sum_df.append(tmp)
sum_df = pd.DataFrame(sum_df).set_index('user').fillna(0)
print(sum_df)   

通過字典映射效率很高,新測(cè)有效!

python DataFrame遍歷

在數(shù)據(jù)分析的過程中,往往需要用到DataFrame的類型,因?yàn)檫@個(gè)類型就像EXCEL表格一樣,便于我們個(gè)中連接、計(jì)算、統(tǒng)計(jì)等操作。在數(shù)據(jù)分析的過程中,避免不了的要對(duì)數(shù)據(jù)進(jìn)行遍歷,那么,DataFrame如何遍歷呢?之前,小白每次使用時(shí)都是Google或百度,想想,還是總結(jié)一下~

小白經(jīng)常用到的有三種方式,如下:

首先,先讀入一個(gè)DataFrame

import pandas as pd
#讀入數(shù)據(jù)
df = pd.read_table('d:/Users/chen_lib/Desktop/tmp.csv',sep=',', header='infer')
df.head()
?
-----------------result------------------
? ? ? ? mas ?effectdate?? ? num
0?? ?371379?? ?2019-07-15?? ?361
1?? ?344985?? ?2019-07-13?? ?77
2?? ?425090?? ?2019-07-01?? ?105
3?? ?344983?? ?2019-02-19?? ?339
4?? ?432430?? ?2019-02-21?? ?162

1.DataFrame.iterrows()       

將DataFrame的每一行迭代為{索引,Series}對(duì),對(duì)DataFrame的列,用row['cols']讀取元素

for index, row in df.iterrows():
? ? print(index,row['mas'],row['num'])?
??
?
------------result---------------
0 371379 361
1 344985 77
2 425090 105
3 344983 339
4 432430 162

從結(jié)果可以看出,第一列就是對(duì)應(yīng)的index,也就是索引,從0開始,第二第三列是自定義輸出的列,這樣就完成了對(duì)DataFrame的遍歷。

2.DataFrame.itertuples()

將DataFrame的每一行迭代為元祖,可以通過row['cols']對(duì)元素進(jìn)行訪問,方法一效率高。

for row in df.itertuples():
? ? print(getattr(row, 'mas'), getattr(row, 'num')) # 輸出每一行
?
?
-------------result-----------------
371379 361
344985 77
425090 105
344983 339
432430 162

從結(jié)果可以看出,這種方法是沒有index的,直接輸出每一行的結(jié)果。

3.DataFrame.iteritems()

這種方法和上面兩種不同,這個(gè)是按列遍歷,將DataFrame的每一列迭代為(列名, Series)對(duì),可以通過row['cols']對(duì)元素進(jìn)行訪問。

for index, row in df.iteritems():
? ? print(index,row[0],row[1],row[2])
?
?
-------------result------------------
masterhotelid 371379 344985 425090
effectdate 2019-07-15 2019-07-13 2019-07-01
quantity 361 77 105

從結(jié)果可以看出,index輸出的是列名,row是用來讀取第幾行的數(shù)據(jù),結(jié)果是按列展示 

以上為個(gè)人經(jīng)驗(yàn),希望能給大家一個(gè)參考,也希望大家多多支持腳本之家。 

相關(guān)文章

  • dataframe設(shè)置兩個(gè)條件取值的實(shí)例

    dataframe設(shè)置兩個(gè)條件取值的實(shí)例

    下面小編就為大家分享一篇dataframe設(shè)置兩個(gè)條件取值的實(shí)例,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過來看看吧
    2018-04-04
  • Python基礎(chǔ)globlal nonlocal和閉包函數(shù)裝飾器語法糖

    Python基礎(chǔ)globlal nonlocal和閉包函數(shù)裝飾器語法糖

    這篇文章主要為大家介紹了Python基礎(chǔ)globlal nonlocal和閉包函數(shù)裝飾器語法糖示例詳解,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進(jìn)步,早日升職加薪
    2022-11-11
  • Python內(nèi)置模塊logging用法實(shí)例分析

    Python內(nèi)置模塊logging用法實(shí)例分析

    這篇文章主要介紹了Python內(nèi)置模塊logging用法,結(jié)合實(shí)例形式較為詳細(xì)的分析了Python基于logging模塊的日志配置、輸出等常用操作技巧,需要的朋友可以參考下
    2018-02-02
  • 巧妙使用Python裝飾器處理if...elif...else

    巧妙使用Python裝飾器處理if...elif...else

    大家好,今天在 Github 閱讀 EdgeDB[1] 的代碼,發(fā)現(xiàn)它在處理大量if…elif…else的時(shí)候,巧妙地使用了裝飾器,方法設(shè)計(jì)精巧,分享給大家一下,歡迎收藏學(xué)習(xí),喜歡點(diǎn)贊支持
    2021-11-11
  • anaconda python3.8安裝后降級(jí)

    anaconda python3.8安裝后降級(jí)

    想給新的環(huán)境安裝pip install tensorflow,結(jié)果報(bào)錯(cuò)了。網(wǎng)上了解可以降級(jí)為3.6,本文就詳細(xì)的介紹一下,感興趣的小伙伴們可以參考一下
    2021-06-06
  • Python + opencv對(duì)拍照得到的圖片進(jìn)行背景去除的實(shí)現(xiàn)方法

    Python + opencv對(duì)拍照得到的圖片進(jìn)行背景去除的實(shí)現(xiàn)方法

    這篇文章主要介紹了Python + opencv對(duì)拍照得到的圖片進(jìn)行背景去除的實(shí)現(xiàn)方法,本文通過實(shí)例代碼給大家介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或工作具有一定的參考借鑒價(jià)值,需要的朋友可以參考下
    2020-11-11
  • Python實(shí)現(xiàn)簡易Web爬蟲詳解

    Python實(shí)現(xiàn)簡易Web爬蟲詳解

    這篇文章主要介紹了Python實(shí)現(xiàn)簡易Web爬蟲詳解,具有一定借鑒價(jià)值,需要的朋友可以參考下
    2018-01-01
  • Python requests和httpx實(shí)例詳解

    Python requests和httpx實(shí)例詳解

    這篇文章主要介紹了Python requests和httpx的相關(guān)知識(shí),本文通過實(shí)例代碼給大家介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或工作具有一定的參考借鑒價(jià)值,需要的朋友參考下吧
    2023-12-12
  • python實(shí)現(xiàn)掃描日志關(guān)鍵字的示例

    python實(shí)現(xiàn)掃描日志關(guān)鍵字的示例

    下面小編就為大家分享一篇python實(shí)現(xiàn)掃描日志關(guān)鍵字的示例,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過來看看吧
    2018-04-04
  • Python中的匿名函數(shù)使用簡介

    Python中的匿名函數(shù)使用簡介

    這篇文章主要介紹了Python中的匿名函數(shù)的使用,lambda是各個(gè)現(xiàn)代編程語言中的重要功能,需要的朋友可以參考下
    2015-04-04

最新評(píng)論

泰宁县| 张掖市| 洪泽县| 南丹县| 克山县| 南郑县| 于田县| 义马市| 绍兴市| 南乐县| 新干县| 神农架林区| 思南县| 吴江市| 长岭县| 杭锦后旗| 海盐县| 兴义市| 四川省| 驻马店市| 濉溪县| 大石桥市| 盱眙县| 天长市| 长海县| 三台县| 兴安盟| 鲁甸县| 岱山县| 清水河县| 荣成市| 阿巴嘎旗| 繁昌县| 同德县| 凭祥市| 出国| 肇州县| 恩平市| 乐业县| 山东省| 临海市|