最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Pandas實(shí)現(xiàn)Excel文件讀取,增刪,打開,保存操作

 更新時間:2023年04月09日 15:29:20   作者:逃逸的卡路里  
Pandas?是一種基于?NumPy?的開源數(shù)據(jù)分析工具,用于處理和分析大量數(shù)據(jù)。本文將通過Pandas實(shí)現(xiàn)對Excel文件進(jìn)行讀取、增刪、打開、保存等操作,需要的可以參考一下

前言

Pandas 是一種基于 NumPy 的開源數(shù)據(jù)分析工具,用于處理和分析大量數(shù)據(jù)。Pandas 模塊提供了一組高效的工具,可以輕松地讀取、處理和分析各種類型的數(shù)據(jù),包括 CSV、Excel、SQL 數(shù)據(jù)庫、JSON 等格式的數(shù)據(jù)。

一、Pandas 的主要函數(shù)包括

pd.read_csv() / pd.read_excel() / pd.read_sql() 等:讀取不同格式的數(shù)據(jù)文件或 SQL 數(shù)據(jù)庫的數(shù)據(jù)。

DataFrame():創(chuàng)建數(shù)據(jù)框。

df.head() / df.tail():查看數(shù)據(jù)框的前幾行或后幾行。

df.info():查看數(shù)據(jù)框的基本信息。

df.describe():查看數(shù)據(jù)框的統(tǒng)計(jì)信息。

df.drop():刪除數(shù)據(jù)框的行或列。

df.rename():重命名數(shù)據(jù)框的行或列。

df.sort_values():按照指定列排序數(shù)據(jù)框。

df.groupby():按照指定列分組數(shù)據(jù)框。

df.apply():對指定列應(yīng)用函數(shù)。

pd.concat():合并數(shù)據(jù)框。

pd.merge():合并數(shù)據(jù)框的數(shù)據(jù)。

df.to_csv() / df.to_excel() / df.to_sql() 等:將數(shù)據(jù)框保存到不同格式的數(shù)據(jù)文件或 SQL 數(shù)據(jù)庫中。

以上是 Pandas 的一些常用函數(shù),這些函數(shù)使得數(shù)據(jù)的讀取、處理和分析變得更加方便和高效。

二、使用步驟

1.簡單示例

下面是 Pandas 對 Excel 文件進(jìn)行讀取、增刪、打開、保存等操作的代碼實(shí)現(xiàn):

import pandas as pd

# 讀取 Excel 文件
df = pd.read_excel('example.xlsx', sheet_name='Sheet1')

# 查看數(shù)據(jù)
print(df)

# 增加一列數(shù)據(jù)
df['New Column'] = [1, 2, 3, 4, 5]

# 刪除一列數(shù)據(jù)
df = df.drop('New Column', axis=1)

# 打開 Excel 文件
with pd.ExcelWriter('example.xlsx') as writer:
    df.to_excel(writer, sheet_name='Sheet1', index=False)

上述代碼中,我們首先使用 pd.read_excel() 函數(shù)讀取名為 example.xlsx 的 Excel 文件的 Sheet1 工作表,并將其存儲在 df 變量中。接著,我們使用 print() 函數(shù)查看數(shù)據(jù)。

接下來,我們使用 df[‘New Column’] = [1, 2, 3, 4, 5] 增加一列新數(shù)據(jù),表示新列的數(shù)據(jù)分別為 1、2、3、4 和 5。然后,我們使用 df = df.drop(‘New Column’, axis=1) 刪除剛剛增加的一列數(shù)據(jù)。

最后,我們使用 pd.ExcelWriter() 函數(shù)打開 Excel 文件,然后使用 df.to_excel() 函數(shù)將數(shù)據(jù)寫入名為 example.xlsx 的工作表 Sheet1 中,并將索引列排除在外。

2.保存Excel操作

Pandas 可以通過 to_excel() 函數(shù)將數(shù)據(jù)框保存到 Excel 文件中。下面是一個示例代碼,演示如何將數(shù)據(jù)框保存到 Excel 文件中:

import pandas as pd

# 創(chuàng)建數(shù)據(jù)框
data = {'Name': ['Tom', 'Jerry', 'Mickey', 'Donald'],
        'Age': [20, 25, 22, 28],
        'Gender': ['M', 'M', 'M', 'M']}
df = pd.DataFrame(data)


# 保存數(shù)據(jù)框到 Excel 文件
df.to_excel('example.xlsx', index=False)

在上述代碼中,我們首先創(chuàng)建了一個包含姓名、年齡和性別信息的數(shù)據(jù)字典 data,然后使用 pd.DataFrame() 函數(shù)將其轉(zhuǎn)換為數(shù)據(jù)框 df。最后,我們使用 df.to_excel() 函數(shù)將數(shù)據(jù)框保存到名為 example.xlsx 的 Excel 文件中,并將索引列排除在外。

在 to_excel() 函數(shù)中,我們可以設(shè)置一些參數(shù)來控制保存的格式和內(nèi)容,例如:

  • sheet_name:指定要保存的工作表名稱。
  • header:設(shè)置是否包含表頭行,可以設(shè)置為 True 或 False。
  • index:設(shè)置是否包含索引列,可以設(shè)置為 True 或 False。
  • startrow 和 startcol:設(shè)置數(shù)據(jù)框的起始行和列。
  • float_format:設(shè)置浮點(diǎn)數(shù)的輸出格式。
  • encoding:設(shè)置保存文件時使用的編碼格式。

需要注意的是,在使用 to_excel() 函數(shù)保存數(shù)據(jù)框到 Excel 文件時,需要安裝相應(yīng)的依賴庫 openpyxl 或 xlsxwriter。如果沒有安裝這些依賴庫,可以使用以下命令安裝:

pip install openpyxl
pip install xlsxwriter

安裝完依賴庫之后,就可以正常地將數(shù)據(jù)框保存到 Excel 文件中了。

3.刪除和添加數(shù)據(jù)

在 Pandas 中,可以使用 drop() 函數(shù)刪除數(shù)據(jù)框中的一行或一列數(shù)據(jù),使用 append() 函數(shù)添加一行或一列新的數(shù)據(jù)。下面是示例代碼,演示如何刪除一行或一列數(shù)據(jù)以及添加一行或一列新的數(shù)據(jù):

import pandas as pd

# 創(chuàng)建數(shù)據(jù)框
data = {'Name': ['Tom', 'Jerry', 'Mickey', 'Donald'],
        'Age': [20, 25, 22, 28],
        'Gender': ['M', 'M', 'M', 'M']}
df = pd.DataFrame(data)

# 刪除一行數(shù)據(jù)
df = df.drop(0)  # 刪除第一行數(shù)據(jù)
print(df)

# 刪除一列數(shù)據(jù)
df = df.drop('Gender', axis=1)  # 刪除“Gender”列
print(df)

# 添加一行新數(shù)據(jù)
new_data = {'Name': 'Daisy', 'Age': 24, 'Gender': 'F'}
df = df.append(new_data, ignore_index=True)  # 添加一行新數(shù)據(jù)
print(df)

# 添加一列新數(shù)據(jù)
new_column = ['A', 'B', 'C', 'D']
df['NewColumn'] = new_column  # 添加一列新數(shù)據(jù)
print(df)

在上述代碼中,我們首先創(chuàng)建了一個包含姓名、年齡和性別信息的數(shù)據(jù)字典 data,然后使用 pd.DataFrame() 函數(shù)將其轉(zhuǎn)換為數(shù)據(jù)框 df。接著,我們使用 drop() 函數(shù)刪除了第一行數(shù)據(jù)和“Gender”列,并使用 append() 函數(shù)添加了一行新數(shù)據(jù)和一列新數(shù)據(jù)。最后,我們打印出修改后的數(shù)據(jù)框。

在 drop() 函數(shù)中,我們需要指定要刪除的行或列的標(biāo)簽,并設(shè)置參數(shù) axis=0 表示刪除行,設(shè)置 axis=1 表示刪除列。

在 append() 函數(shù)中,我們需要指定要添加的新數(shù)據(jù),可以是字典、列表或數(shù)據(jù)框。參數(shù) ignore_index=True 表示忽略原始數(shù)據(jù)框的索引,并為新添加的行分配新的索引值。

添加新列時,我們可以直接為數(shù)據(jù)框 df 新建一個列,并將新數(shù)據(jù)賦值給這個列即可。需要注意的是,新數(shù)據(jù)的長度必須與數(shù)據(jù)框的行數(shù)相同。

4.添加新的表單

在 Pandas 中,可以使用 ExcelWriter() 對象來向 Excel 文件中添加新的表單。下面是示例代碼,演示如何向 Excel 文件中添加新的表單:

import pandas as pd

# 讀取 Excel 文件
excel_file = pd.ExcelFile('example.xlsx')

# 創(chuàng)建 ExcelWriter 對象
writer = pd.ExcelWriter('example.xlsx', engine='openpyxl')

# 讀取原始數(shù)據(jù)表單
df = pd.read_excel(excel_file, sheet_name='Sheet1')

# 添加新表單
new_data = {'Name': ['Alice', 'Bob', 'Charlie'],
            'Age': [25, 30, 35]}
df_new = pd.DataFrame(new_data)
df_new.to_excel(writer, sheet_name='Sheet2', index=False)

# 保存 Excel 文件
writer.save()

在上述代碼中,我們首先使用 ExcelFile() 函數(shù)讀取了一個名為 example.xlsx 的 Excel 文件。接著,我們使用 ExcelWriter() 函數(shù)創(chuàng)建了一個名為 writer 的 ExcelWriter 對象,用于向 Excel 文件中添加新的表單。然后,我們使用 read_excel() 函數(shù)讀取了原始數(shù)據(jù)表單,并將其存儲在數(shù)據(jù)框 df 中。接著,我們創(chuàng)建了一個包含姓名和年齡信息的數(shù)據(jù)字典 new_data,并使用 pd.DataFrame() 函數(shù)將其轉(zhuǎn)換為數(shù)據(jù)框 df_new。然后,我們使用 to_excel() 函數(shù)將數(shù)據(jù)框 df_new 寫入到名為 Sheet2 的新表單中,并設(shè)置參數(shù) index=False 表示不將索引寫入 Excel 文件。最后,我們使用 save() 函數(shù)保存 Excel 文件。

需要注意的是,在使用 ExcelWriter() 對象向 Excel 文件中添加新的表單時,需要指定參數(shù) engine=‘openpyxl’,以使用 openpyxl 引擎來處理 Excel 文件。同時,在使用 to_excel() 函數(shù)寫入數(shù)據(jù)時,需要傳遞 ExcelWriter 對象和新表單的名稱。

到此這篇關(guān)于Pandas實(shí)現(xiàn)Excel文件讀取,增刪,打開,保存操作的文章就介紹到這了,更多相關(guān)Pandas Excel操作內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

最新評論

淅川县| 娄烦县| 龙里县| 铜山县| 神农架林区| 蕲春县| 奇台县| 承德市| 林周县| 福清市| 和林格尔县| 聊城市| 凌海市| 个旧市| 桃江县| 武强县| 简阳市| 姜堰市| 札达县| 巩义市| 玉树县| 波密县| 朝阳市| 璧山县| 南昌市| 原阳县| 肇东市| 武鸣县| 长泰县| 成都市| 闻喜县| 高青县| 长宁县| 三江| 旌德县| 玛多县| 陈巴尔虎旗| 永仁县| 任丘市| 东乌珠穆沁旗| 湟源县|