Python操作Excel數(shù)據(jù)分組的完整指南
在日常數(shù)據(jù)處理工作中,Excel 數(shù)據(jù)分組是一項高頻使用的功能。當(dāng)面對包含大量明細數(shù)據(jù)的表格時,僅靠原始數(shù)據(jù)視圖往往難以快速把握整體結(jié)構(gòu)和匯總信息。Excel 的分組功能允許用戶將相鄰的行或列組織為可折疊/展開的層級結(jié)構(gòu),從而在宏觀匯總與微觀明細之間靈活切換。典型的應(yīng)用場景包括:
- 銷售報表按地區(qū)分組
- 財務(wù)報表按月度分組
- 庫存報表按品類分組等。
無論是業(yè)務(wù)人員直接在 Excel 中手動操作,還是開發(fā)者通過代碼批量處理,掌握數(shù)據(jù)分組功能背后的實現(xiàn)邏輯都至關(guān)重要。本文將系統(tǒng)介紹使用 Python代 碼實現(xiàn) Excel 數(shù)據(jù)分組的方法,提供完整代碼示例。
一、Excel 內(nèi)置數(shù)據(jù)分組功能
1.1 行分組與列分組
在 Excel 中,數(shù)據(jù)分組主要通過 “數(shù)據(jù)” 選項卡下的 “組合” 功能完成。用戶可以選中連續(xù)的行或列,點擊“分組”按鈕后,Excel 會在行號左側(cè)或列標(biāo)上方自動生成 “—” 形狀的控制按鈕,單擊該按鈕即可折疊或展開分組區(qū)域。反向操作選擇 “取消組合”,即可解除分組狀態(tài)。

1.2 分類匯總
分類匯總是 Excel 中一個更高級的數(shù)據(jù)分組功能。當(dāng)用戶需要對某一列的數(shù)據(jù)按特定字段進行分組匯總時,可以通過“數(shù)據(jù)”→“分類匯總”菜單進入設(shè)置界面。在該界面中,用戶需要指定:
- 分類字段(按哪個列進行分組)
- 匯總方式(求和、平均值、計數(shù)、最大值、最小值等)
- 選定匯總項(對哪些列進行匯總計算)
Excel 自動為每個分組插入?yún)R總行,并生成可折疊的數(shù)據(jù)層次結(jié)構(gòu)。

1.3 不足之處
Excel 手動操作的局限在于缺乏自動化能力。當(dāng)需要頻繁生成分組報表,或需要將分組功能嵌入數(shù)據(jù)處理流程時,手動操作顯然不能滿足要求。這便是 Python 的價值所在。
二、Python 實現(xiàn) Excel 數(shù)據(jù)分組
Free Spire.XLS for Python 是一個專門用于操作 Excel 文件的免費 Python 庫,通過pip命令即可完成安裝:
pip install Spire.XLS.Free
在數(shù)據(jù)分組功能方面,該庫提供了以下核心能力:
- 對連續(xù)行或列進行基礎(chǔ)分組
- 創(chuàng)建多級嵌套分組
- 一鍵生成分類匯總(
Subtotal) - 取消已有分組
下文將逐一詳細介紹這些功能的代碼實現(xiàn)。
三、使用 Free Spire.XLS 創(chuàng)建基礎(chǔ)行分組
最基礎(chǔ)的分組操作是將指定連續(xù)區(qū)域的行或列分組。Worksheet 類提供了 GroupByRows() 和 GroupByColumns() 方法來實現(xiàn)這一功能。
以下示例演示如何加載一個 Excel 文件,并對其中某個連續(xù)行區(qū)域進行分組:
from spire.xls import *
from spire.xls.common import *
# 創(chuàng)建Workbook對象
workbook = Workbook()
# 加載Excel文件
workbook.LoadFromFile("數(shù)據(jù).xlsx")
# 獲取第一個工作表
sheet = workbook.Worksheets[0]
# 對第2到第10行進行分組,F(xiàn)alse表示不折疊(即默認展開狀態(tài))
sheet.GroupByRows(2, 10, False)
# 保存結(jié)果文件
workbook.SaveToFile("行分組結(jié)果.xlsx", ExcelVersion.Version2016)
workbook.Dispose()
GroupByRows() 方法的三個參數(shù)依次為:起始行索引、結(jié)束行索引、是否折疊分組。當(dāng)?shù)谌齻€參數(shù)為True時,分組在打開時即處于折疊狀態(tài),所有明細行被隱藏,僅顯示分組摘要行。
如需對列進行分組,可調(diào)用 GroupByColumns() 方法:
# 對第4到第7列進行分組 sheet.GroupByColumns(4, 7, False)
上述代碼運行后,在生成的 Excel 文件中,行號左側(cè)或列標(biāo)上方會出現(xiàn)分組控制按鈕,用戶可以手動展開或折疊分組區(qū)域。

四、創(chuàng)建嵌套分組
在實際業(yè)務(wù)場景中,數(shù)據(jù)往往具有多層次結(jié)構(gòu)。這種嵌套分組可以通過多次調(diào)用GroupByRows()方法實現(xiàn):先創(chuàng)建外層分組,再在外層分組內(nèi)創(chuàng)建內(nèi)層分組。
from spire.xls import *
from spire.xls.common import *
workbook = Workbook()
workbook.LoadFromFile("數(shù)據(jù).xlsx")
sheet = workbook.Worksheets[0]
# 創(chuàng)建外層分組:第2到第10行(
sheet.GroupByRows(2, 10, False)
# 在外層分組內(nèi)部創(chuàng)建嵌套分組(第3到第7行)
sheet.GroupByRows(3, 7, False)
workbook.SaveToFile("嵌套分組.xlsx", ExcelVersion.Version2016)
workbook.Dispose()
執(zhí)行上述代碼后,Excel 文件中將出現(xiàn)內(nèi)外層兩級分組控制按鈕。這種結(jié)構(gòu)化的數(shù)據(jù)組織方式極大地提升了數(shù)據(jù)查看和報告的交互性。

五、創(chuàng)建分類匯總
分類匯總(Subtotal)是比單純行分組更高級的功能,它不僅自動生成分組結(jié)構(gòu),還在每個分組后插入?yún)R總行,并根據(jù)指定的匯總方式計算數(shù)值。Worksheet.Subtotal()方法正是為此設(shè)計的。
假設(shè)有如下圖所示的銷售數(shù)據(jù)表格(示例數(shù)據(jù)結(jié)構(gòu)):
| 行號 | 地區(qū) | 銷售人員 | 銷售額 | 訂單數(shù)量 |
|---|---|---|---|---|
| 1 | 華東 | 張三 | 12500 | 15 |
| 2 | 華東 | 李四 | 9800 | 12 |
| 3 | 華南 | 王五 | 15700 | 18 |
| 4 | 華南 | 趙六 | 11200 | 14 |
按“地區(qū)”字段進行分組并對“銷售額”求和,是典型的分類匯總需求。實現(xiàn)代碼如下:
from spire.xls import *
from spire.xls.common import *
# 創(chuàng)建Workbook對象并加載Excel文件(假設(shè)該文件包含上述示例數(shù)據(jù))
workbook = Workbook()
workbook.LoadFromFile("銷售明細.xlsx")
sheet = workbook.Worksheets[0]
# 定義需要進行分類匯總的數(shù)據(jù)區(qū)域
# 區(qū)域為 A2 到 D5(僅數(shù)據(jù)行)
data_range = sheet.Range["A2:D5"]
# 調(diào)用完整參數(shù)的 Subtotal 方法
# 參數(shù)說明:
# data_range : 要處理的單元格區(qū)域,本例為 A1:D5
# groupByIndex : 分組列在區(qū)域內(nèi)的索引(0-based),1 表示區(qū)域內(nèi)的第2列(B列,即“地區(qū)”列)
# totalFields : 需要匯總的列索引列表(0-based),[3] 表示區(qū)域內(nèi)的第4列(D列,即“銷售額”列)
# subtotalType : 匯總類型,SubtotalTypes.Sum 表示求和
# replace : 是否替換現(xiàn)有的分類匯總,True 表示替換
# addPageBreak : 是否在每組后添加分頁符,F(xiàn)alse 表示不添加
# addsummaryBelowData : 是否將匯總行顯示在數(shù)據(jù)下方,True 表示匯總行位于明細數(shù)據(jù)下方
sheet.Subtotal(data_range, 1, [3], SubtotalTypes.Sum, True, False, True)
workbook.SaveToFile("分類匯總結(jié)果.xlsx", ExcelVersion.Version2016)
workbook.Dispose()
執(zhí)行結(jié)果說明:
運行上述代碼后,生成的 Excel 文件中的表格將被轉(zhuǎn)換為以下結(jié)構(gòu):

六、取消分組
當(dāng)需要移除現(xiàn)有分組時,可使用 UngroupByRows() 和 UngroupByColumns() 方法:
from spire.xls import *
from spire.xls.common import *
workbook = Workbook()
workbook.LoadFromFile("已分組文件.xlsx")
sheet = workbook.Worksheets[0]
# 取消第2到第10行的分組
sheet.UngroupByRows(2, 10)
# 取消第2到第4列的分組
sheet.UngroupByColumns(2, 4)
workbook.SaveToFile("取消分組后.xlsx", ExcelVersion.Version2016)
workbook.Dispose()
UngroupByRows() 的參數(shù)只需指定起始行和結(jié)束行,方法會移除該范圍內(nèi)的所有分組,恢復(fù)到未分組狀態(tài)。
小結(jié)
本文系統(tǒng)介紹了在 Python 中實現(xiàn) Excel 數(shù)據(jù)分組功能的方法。通過 GroupByRows()、GroupByColumns() 和 Subtotal() 等方法,開發(fā)者可以以純代碼的方式完成行分組、列分組、嵌套分組以及分類匯總等常見數(shù)據(jù)處理任務(wù),生成可直接交付使用的帶有分組結(jié)構(gòu)的 Excel 報表。
到此這篇關(guān)于Python操作Excel數(shù)據(jù)分組的完整指南的文章就介紹到這了,更多相關(guān)Python Excel數(shù)據(jù)分組內(nèi)容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!
相關(guān)文章
Python學(xué)習(xí)筆記之列表推導(dǎo)式實例分析
這篇文章主要介紹了Python學(xué)習(xí)筆記之列表推導(dǎo)式,結(jié)合實例形式分析Python列表推導(dǎo)式的原理、寫法與相關(guān)使用技巧,需要的朋友可以參考下2019-08-08
Python求均值,方差,標(biāo)準(zhǔn)差的實例
今天小編就為大家分享一篇Python求均值,方差,標(biāo)準(zhǔn)差的實例,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧2019-06-06
PyQt5執(zhí)行耗時操作導(dǎo)致界面卡死或未響應(yīng)的原因及解決辦法
這篇文章主要給大家介紹了關(guān)于PyQt5執(zhí)行耗時操作導(dǎo)致界面卡死或未響應(yīng)的原因及解決辦法,由于耗時的操作會獨占系統(tǒng)cpu資源,讓界面卡死在那里,文中通過代碼介紹的非常詳細,需要的朋友可以參考下2023-12-12
基于PyQt5制作Excel文件數(shù)據(jù)去重小工具
這篇文章主要介紹了如何利用PyQt5模塊制作一個Excel文件數(shù)據(jù)去重小工具,可以將單個或者多個Excel文件數(shù)據(jù)進行去重操作,去重的列可以通過自定義制定,需要的可以參考一下2022-04-04
在Lighttpd服務(wù)器中運行Django應(yīng)用的方法
這篇文章主要介紹了在Lighttpd服務(wù)器中運行Django應(yīng)用的方法,本文所采用的是最流行的FastCGI模塊,包括同時運行多個Django應(yīng)用的方法,需要的朋友可以參考下2015-07-07
Python通過poplib庫實現(xiàn)POP3郵件收取的完整流程
本文介紹了Python中通過poplib模塊實現(xiàn)POP3協(xié)議郵件收取的完整流程,首先概述了POP3協(xié)議的特點(端口110/995、郵件下載后本地存儲),對比了與IMAP的區(qū)別,詳細講解了poplib的核心API,需要的朋友可以參考下2025-09-09

