发布于2026-05-30 阅读(0)
扫一扫,手机访问
在日常数据处理工作中,Excel 数据分组绝对是高频操作之一。面对那种动辄几百上千行的明细表格,光靠原始数据视图想快速读懂整体结构,基本是在为难自己。Excel 的分组功能恰好解决了这个痛点——它允许把相邻的行或列组织成可折叠、可展开的层级结构,让你在宏观汇总和微观明细之间自由切换。典型的场景大家都熟悉:销售报表按地区分组、财务报表按月分组、库存报表按品类分组,等等。
不管你是业务人员直接在 Excel 里手动操作,还是开发者希望通过代码批量处理,理解数据分组背后的实现逻辑都很有必要。这篇文章会系统地介绍用 Python 代码实现 Excel 数据分组的方法,并且给出可直接运行的完整示例。
在 Excel 里,数据分组主要通过“数据”选项卡下的“组合”功能完成。选中连续的行或列,点击“分组”,Excel 就会在行号左侧或列标上方自动生成一个“—”形状的控制按钮。单击它,分组区域就能折叠或展开。反过来,用“取消组合”就能解除分组状态。

分类汇总可以看作是数据分组的升级版。当你想按某个字段对数据进行分组汇总时,通过“数据”→“分类汇总”菜单进入设置。你需要指定三样东西:分类字段(按哪列分组)、汇总方式(求和、平均值、计数、最大值、最小值等)、选定汇总项(对哪些列进行计算)。设置好之后,Excel 会自动在每个分组后面插入汇总行,同时生成可折叠的层级结构。

手动操作最大的问题是缺乏自动化能力。如果只是偶尔做一次分组,那没问题;但当你需要频繁生成分组报表,或者要把分组功能嵌入到数据处理流程中时,手动操作就显得力不从心了。这时候,Python 的优势就体现出来了。
Free Spire.XLS for Python 是一个专门操作 Excel 文件的免费 Python 库,安装很简单,一条 pip 命令就能搞定:
pip install Spire.XLS.Free
在数据分组方面,这个库提供了几个核心能力:对连续行或列进行基础分组、创建多级嵌套分组、一键生成分类汇总(Subtotal)、取消已有分组。下面逐一展开。
最基础的操作就是把指定连续区域的行或列分组。Worksheet 类提供了 GroupByRows() 和 GroupByColumns() 方法。下面这个示例演示了如何加载一个 Excel 文件,并对某个连续行区域进行分组:
from spire.xls import *
from spire.xls.common import *
# 创建Workbook对象
workbook = Workbook()
# 加载Excel文件
workbook.LoadFromFile("数据.xlsx")
# 获取第一个工作表
sheet = workbook.Worksheets[0]
# 对第2到第10行进行分组,False表示不折叠(即默认展开状态)
sheet.GroupByRows(2, 10, False)
# 保存结果文件
workbook.Sa veToFile("行分组结果.xlsx", ExcelVersion.Version2016)
workbook.Dispose()
GroupByRows() 的三个参数依次是:起始行索引、结束行索引、是否折叠分组。第三个参数如果设为 True,分组在打开时就处于折叠状态,明细行全部隐藏,只显示分组摘要行。
如果要对列分组,调用 GroupByColumns() 即可:
# 对第4到第7列进行分组 sheet.GroupByColumns(4, 7, False)
运行之后,生成的 Excel 文件里,行号左侧或列标上方就会出现分组控制按钮,用户可以手动展开或折叠。

实际业务中,数据往往有多层结构。比如先按大区分组,再按省份分组。嵌套分组可以通过多次调用 GroupByRows() 来实现——先创建外层分组,再在外层分组内部创建内层分组。
from spire.xls import *
from spire.xls.common import *
workbook = Workbook()
workbook.LoadFromFile("数据.xlsx")
sheet = workbook.Worksheets[0]
# 创建外层分组:第2到第10行
sheet.GroupByRows(2, 10, False)
# 在外层分组内部创建嵌套分组(第3到第7行)
sheet.GroupByRows(3, 7, False)
workbook.Sa veToFile("嵌套分组.xlsx", ExcelVersion.Version2016)
workbook.Dispose()
执行之后,Excel 文件中会出现内外两层分组控制按钮。这种结构化的组织方式,对数据查看和报告交互来说非常实用。

分类汇总(Subtotal)比单纯的行分组更进一步——它不光自动生成分组结构,还在每个分组后插入汇总行,并按指定方式计算数值。Worksheet.Subtotal() 方法就是专门干这个的。
假设我们现在有一张销售数据表,结构如下:
| 行号 | 地区 | 销售人员 | 销售额 | 订单数量 |
|---|---|---|---|---|
| 1 | 华东 | 张三 | 12500 | 15 |
| 2 | 华东 | 李四 | 9800 | 12 |
| 3 | 华南 | 王五 | 15700 | 18 |
| 4 | 华南 | 赵六 | 11200 | 14 |
典型的分类汇总需求是按“地区”分组,并对“销售额”求和。实现代码:
from spire.xls import *
from spire.xls.common import *
workbook = Workbook()
workbook.LoadFromFile("销售明细.xlsx")
sheet = workbook.Worksheets[0]
# 定义需要汇总的数据区域(仅数据行)
data_range = sheet.Range["A2:D5"]
# 调用 Subtotal 方法,参数说明:
# data_range : 要处理的区域
# groupByIndex : 分组列在区域内的索引(0-based),1 表示B列(地区)
# totalFields : 需汇总的列索引列表,[3] 表示D列(销售额)
# subtotalType : 汇总类型,SubtotalTypes.Sum 求和
# replace : 是否替换现有分类汇总,True
# addPageBreak : 是否每组后加分页符,False
# addsummaryBelowData : 汇总行是否在数据下方,True
sheet.Subtotal(data_range, 1, [3], SubtotalTypes.Sum, True, False, True)
workbook.Sa veToFile("分类汇总结果.xlsx", ExcelVersion.Version2016)
workbook.Dispose()
执行结果说明: 运行后,生成的 Excel 文件中的表格会变成下面这样——每个地区组后面自动插入一个汇总行,并且可以折叠展开。

如果某个文件已经有分组,你想把分组去掉,可以用 UngroupByRows() 和 UngroupByColumns() 方法:
from spire.xls import *
from spire.xls.common import *
workbook = Workbook()
workbook.LoadFromFile("已分组文件.xlsx")
sheet = workbook.Worksheets[0]
# 取消第2到第10行的分组
sheet.UngroupByRows(2, 10)
# 取消第2到第4列的分组
sheet.UngroupByColumns(2, 4)
workbook.Sa veToFile("取消分组后.xlsx", ExcelVersion.Version2016)
workbook.Dispose()
UngroupByRows() 只需要指定起始行和结束行,就能把该范围内的所有分组移除,恢复到未分组状态。
这篇文章系统介绍了用 Python 实现 Excel 数据分组的方法。通过 GroupByRows()、GroupByColumns() 和 Subtotal() 等方法,开发者可以用纯代码完成行分组、列分组、嵌套分组以及分类汇总等常见任务,最终生成可直接交付使用的、带有分组结构的 Excel 报表。无论是日常报表自动化,还是嵌入到更大的数据处理流程中,这套方法都足够实用。
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
7
8