使用Python讀取Excel數(shù)據(jù)并寫入到CSV、XML和文本
前言
Excel工作簿是常用的表格格式,許多數(shù)據(jù)呈現(xiàn)、數(shù)據(jù)分析和數(shù)據(jù)匯報都是以Excel工作表的形式進行。然而,在實際的數(shù)據(jù)管理、分析或自動化流程構(gòu)建過程中,我們常常需要將這些Excel中的數(shù)據(jù)遷移至更其他數(shù)據(jù)系統(tǒng),或者以文本形式存儲以便與其他程序進行交互。Python作為一種強大且靈活的編程語言,能夠高效地實現(xiàn)這一目標。本文將演示如何運用Python編程語言,將Excel工作表中的豐富數(shù)據(jù)導(dǎo)入到CSV、XML或文本中,我們也可以使用文中的方法讀取數(shù)據(jù)并寫入到其他文件或數(shù)據(jù)系統(tǒng)中。
本文所使用的方法需要用到Spire.XLS for Python,可從官網(wǎng)獲取或通過PyPI:pip install Spire.XLS。
示例Excel文件

直接將Excel工作表轉(zhuǎn)換為CSV
使用此API,我們可以直接獲取指定工作表并轉(zhuǎn)換為CSV文件。以下是操作步驟:
- 導(dǎo)入所需模塊。
- 創(chuàng)建
Workbook類的對象wb。 - 使用
wb.LoadFromFile()方法加載指定路徑下的Excel文件。 - 獲取指定索引位置處的工作表
ws。 - 使用
Worksheet.SaveToFile(string fileName, string Separator, Encoding)方法將工作表轉(zhuǎn)換為CSV文件并保存。 - 釋放資源。
代碼示例
from spire.xls import *
from spire.xls.common import *
# 創(chuàng)建 Workbook 對象
wb = Workbook()
# 加載 Excel 文件
wb.LoadFromFile("示例.xlsx")
# 獲取工作表
ws = wb.Worksheets.get_Item(0)
# 將工作表保存為 CSV 文件
ws.SaveToFile(f"output/{ws.Name}.csv", ",", Encoding.get_UTF8())
wb.Dispose()
提取結(jié)果

讀取Excel工作表數(shù)據(jù)保存到CSV
除了直接轉(zhuǎn)換外,我們還可以直接讀取指定單元格范圍的數(shù)據(jù),并寫入CSV文件,來實現(xiàn)自定義的數(shù)據(jù)提取。以下是操作步驟:
- 導(dǎo)入所需模塊。
- 創(chuàng)建
Workbook類的對象wb。 - 使用
wb.LoadFromFile()方法加載指定路徑下的Excel文件。 - 獲取指定索引位置處的工作表
ws。 - 確定工作表的已使用范圍(即有數(shù)據(jù)的部分)作為
usedRange。 - 遍歷
usedRange中的每一行和每一列:- 獲取單元格的值,并對包含逗號的字符串單元格值添加雙引號。
- 將處理過的單元格值添加到
rowData列表中。
- 對每一行的
rowData列表進行處理,將其轉(zhuǎn)換為逗號分隔的字符串,并在末尾添加換行符,然后將結(jié)果追加到data字符串中。 - 打開一個CSV文件(以當前工作表名稱命名),以寫模式和UTF-8編碼將
data字符串內(nèi)容寫入該文件。 - 使用
wb.Dispose()方法釋放資源,清理內(nèi)存。
代碼示例
from spire.xls import *
from spire.xls.common import *
# 創(chuàng)建 Workbook 對象
wb = Workbook()
# 加載 Excel 文件
wb.LoadFromFile("示例.xlsx")
# 獲取工作表
ws = wb.Worksheets.get_Item(0)
# 獲取已使用的區(qū)域
usedRange = ws.AllocatedRange
data = ""
# 遍歷已使用的區(qū)域
for i in range(1, usedRange.Rows.Count):
rowData = []
for j in range(len(usedRange.Rows.get_Item(i).Columns)):
# 獲取單元格的值
cellValue = usedRange[i + 1, j + 1].Value
# 對包含逗號的數(shù)據(jù)添加引號
if isinstance(cellValue, str) and ',' in cellValue:
cellValue = f'"{cellValue}"'
rowData.append(cellValue)
data += ','.join(rowData) + '\n'
# 將數(shù)據(jù)寫入 CSV 文件
with open(f"output/CSV/{ws.Name}.csv", "w", encoding='utf-8') as f:
f.write(data)
wb.Dispose()
提取效果

將Excel工作簿轉(zhuǎn)換為OpenXML
使用 Workbook 類的 SaveAsXml 方法可以直接將一個工作簿轉(zhuǎn)換為Open XML文件。以下是操作步驟:
- 導(dǎo)入所需模塊。
- 創(chuàng)建
Workbook類的對象wb。 - 使用
wb.LoadFromFile()方法加載指定路徑下的Excel文件。 - 使用
Workbook.SaveAsXml()方法將工作簿轉(zhuǎn)換為Open XML文件并保存。 - 釋放資源。
代碼示例
from spire.xls import *
from spire.xls.common import *
# 創(chuàng)建 Workbook 對象
wb = Workbook()
# 加載 Excel 文件
wb.LoadFromFile("示例.xlsx")
# 保存為 OpenXML 文件
wb.SaveAsXml("output/工作簿轉(zhuǎn)OpenXML.xml")
wb.Dispose()
提取效果

讀取Excel工作表數(shù)據(jù)寫入XML
除了將工作簿直接轉(zhuǎn)換為Open XML文件外,我們還可以讀取表格數(shù)據(jù),制作自定義的XML文件。我們可以引入 xml.etree.ElementTree 來方便對XML的寫入。以下是操作示例:
- 導(dǎo)入所需模塊。
- 創(chuàng)建
Workbook類的對象wb。 - 使用
wb.LoadFromFile()方法加載指定路徑下的Excel文件。 - 獲取工作表
ws,其索引為0。 - 獲取工作表中的已使用區(qū)域
usedRange。 - 創(chuàng)建 XML 的根元素
root,命名為 “Worksheet”。 - 在 XML 根元素下創(chuàng)建子元素 “Name”,并將其文本內(nèi)容設(shè)置為當前工作表的名稱。
- 遍歷已使用的區(qū)域(按行):
- 對于每一行,創(chuàng)建一個 “Row” 子元素。
- 再對該行的每個單元格進行遍歷(按列):
- 獲取單元格的值。
- 在 “Row” 元素下創(chuàng)建一個 “Cell” 子元素。
- 在 “Cell” 元素下進一步創(chuàng)建一個 “Data” 子元素,將單元格值轉(zhuǎn)換為字符串并設(shè)置為其文本內(nèi)容。
- 將所有生成的 XML 元素構(gòu)建成一個完整的 XML 樹結(jié)構(gòu),存儲在
xml_tree變量中。 - 使用
xml_tree.write()方法將 XML 數(shù)據(jù)寫入名為 “工作表寫入XML.xml” 的文件中,同時指定 UTF-8 編碼和添加 XML 聲明。 - 最后,調(diào)用
wb.Dispose()方法釋放資源,關(guān)閉并清理 Excel 工作簿對象。
代碼示例
import xml.etree.ElementTree as ET
from spire.xls import *
from spire.xls.common import *
# 創(chuàng)建 Workbook 對象
wb = Workbook()
# 加載 Excel 文件
wb.LoadFromFile("示例.xlsx")
# 獲取工作表
ws = wb.Worksheets.get_Item(0)
# 獲取已使用的區(qū)域
usedRange = ws.AllocatedRange
# 創(chuàng)建 XML 根元素
root = ET.Element("Worksheet")
# 設(shè)置工作表名稱
name_element = ET.SubElement(root, "Name")
name_element.text = ws.Name
# 遍歷已使用的區(qū)域
for i in range(1, usedRange.Rows.Count):
row_element = ET.SubElement(root, "Row")
for j in range(len(usedRange.Rows.get_Item(i).Columns)):
# 獲取單元格的值
cellValue = usedRange[i + 1, j + 1].Value
# 創(chuàng)建單元格元素
cell_element = ET.SubElement(row_element, "Cell")
# 創(chuàng)建數(shù)據(jù)元素
data_element = ET.SubElement(cell_element, "Data")
data_element.text = str(cellValue)
# 創(chuàng)建 XML 文檔
xml_tree = ET.ElementTree(root)
# 將數(shù)據(jù)寫入 XML 文件
xml_tree.write("output/XML/工作表寫入XML.xml", encoding="utf-8", xml_declaration=True)
wb.Dispose()
代碼示例

讀取Excel工作表數(shù)據(jù)保存為文本
我們還可以直接讀取表格文件寫入普通文本文件,用于其他用途。以下是操作步驟:
- 導(dǎo)入模塊。
- 初始化一個新的
Workbook實例wb。 - 使用
wb.LoadFromFile()函數(shù)加載 Excel 文件。 - 選取第一個工作表(索引為0),賦值給變量
ws。 - 獲取該工作表的已使用區(qū)域,存放在變量
usedRange中。 - 初始化一個空字符串
data,用于收集所有單元格的數(shù)據(jù)。 - 遍歷已使用的行與列范圍:
- 對于每一行(從第二行開始計數(shù),因為Excel索引從1開始):
- 對于該行內(nèi)的每一個單元格:
- 獲取單元格的值,并將其轉(zhuǎn)換為字符串形式,追加到
data后面。 - 如果當前單元格不是本行的最后一個單元格,則在其后添加制表符
\t分隔數(shù)據(jù)。
- 獲取單元格的值,并將其轉(zhuǎn)換為字符串形式,追加到
- 完成一行的所有單元格之后,在
data后面添加換行符\n,以便在輸出時區(qū)分不同行的數(shù)據(jù)。
- 對于該行內(nèi)的每一個單元格:
- 對于每一行(從第二行開始計數(shù),因為Excel索引從1開始):
- 使用
with open()語句以“寫入”模式打開一個新文件,文件名基于當前工作表的名稱加上.txt擴展名,且路徑設(shè)為 “output/” 目錄下。 - 將之前拼接好的包含所有單元格數(shù)據(jù)的字符串
data寫入所創(chuàng)建的文本文件中。 - 關(guān)閉文件流,確保數(shù)據(jù)成功寫入。
- 調(diào)用
wb.Dispose()方法釋放資源,關(guān)閉并清理 Excel 工作簿對象。
代碼示例
from spire.xls import *
from spire.xls.common import *
# 創(chuàng)建 Workbook 對象
wb = Workbook()
# 加載 Excel 文件
wb.LoadFromFile("示例.xlsx")
# 獲取工作表
ws = wb.Worksheets.get_Item(0)
# 獲取已使用的區(qū)域
usedRange = ws.AllocatedRange
data = ""
# 遍歷已使用的區(qū)域
for i in range(1, usedRange.Rows.Count):
for j in range(len(usedRange.Rows.get_Item(i).Columns)):
# 獲取單元格的值
cellValue = usedRange[i + 1, j + 1].Value
data += str(cellValue)
if j < len(usedRange.Rows.get_Item(i).Columns) - 1:
data += "\t"
data += "\n"
# 將數(shù)據(jù)寫入 CSV 文件
with open(f"output/{ws.Name}.txt", "w", encoding='utf-8') as f:
f.write(data)
wb.Dispose()
提取結(jié)果

以上內(nèi)容演示了如何使用Python讀取Excel數(shù)據(jù)并寫入到CSV、XML和文本文件中。
到此這篇關(guān)于使用Python讀取Excel數(shù)據(jù)并寫入到CSV、XML和文本的文章就介紹到這了,更多相關(guān)Python讀取Excel數(shù)據(jù)并導(dǎo)入內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!
相關(guān)文章
零基礎(chǔ)寫python爬蟲之爬蟲框架Scrapy安裝配置
Scrapy是一個使用Python編寫的,輕量級的,簡單輕巧,并且使用起來非常的方便。使用Scrapy可以很方便的完成網(wǎng)上數(shù)據(jù)的采集工作,它為我們完成了大量的工作,而不需要自己費大力氣去開發(fā)。2014-11-11
Python解決非線性規(guī)劃中經(jīng)濟調(diào)度問題
Scipy是Python算法庫和數(shù)學(xué)工具包,包括最優(yōu)化、線性代數(shù)、積分、插值、特殊函數(shù)、傅里葉變換等模塊。scipy.optimize模塊中提供了多個用于非線性規(guī)劃問題的方法,適用于不同類型的問題。本文將利用起解決經(jīng)濟調(diào)度問題,感興趣的可以了解一下2022-05-05
python等差數(shù)列求和公式前 100 項的和實例
今天小編就為大家分享一篇python等差數(shù)列求和公式前 100 項的和實例,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧2020-02-02
樹莓派4B+opencv4+python 打開攝像頭的實現(xiàn)方法
這篇文章主要介紹了樹莓派4B+opencv4+python 打開攝像頭的實現(xiàn)方法,文中通過示例代碼介紹的非常詳細,對大家的學(xué)習或者工作具有一定的參考學(xué)習價值,需要的朋友們下面隨著小編來一起學(xué)習學(xué)習吧2019-10-10
python中有關(guān)時間日期格式轉(zhuǎn)換問題
這篇文章主要介紹了python中有關(guān)時間日期格式轉(zhuǎn)換問題,本文給大家介紹的非常詳細,具有一定的參考借鑒價值,需要的朋友可以參考下2019-12-12

