Python Excel 统计人数频次生成分类汇总方法
用pandas对Excel数据做频次统计:value_counts数人数、groupby分组求和、再把结果写回新sheet做成分类汇总表,搭配COUNTIF公式让结果实时联动。
场景痛点
HR 表、报名表、客户
用pandas对Excel数据做频次统计:value_counts数人数、groupby分组求和、再把结果写回新sheet做成分类汇总表,搭配COUNTIF公式让结果实时联动。
场景痛点
HR 表、报名表、客户
用pandas统计Excel每列非空值数量、缺失率、总行数总列数,快速体检数据质量,输出数据质量报告。
场景痛点
拿到一张表先要摸清楚:总共有多少行多少列?哪些列缺了一大半?哪些列全
用pandas批量清洗Excel数据:去除首尾空格、全角转半角、去除换行和不可见字符、统一标点,让脏数据变得规范。
Python Excel数据清洗去除空格特殊字符
场景痛点
从不同系统导出
用openpyxl的DataValidation给Excel单元格做下拉选择框,支持固定选项、引用其他sheet的选项列表、限制输入范围、中文错误提示,避免手输错。
场景痛点
做登记表、信息采集表时
用openpyxl把datetime对象写进Excel单元格,再用number_format控制显示成yyyy-mm-dd或yyyy年m月d日,避免日期变成数字或文本。
场景痛点
Python 里拼出来的日期,直接 ws["A1"] =
详解pandas drop_duplicates参数,按整行去重、按指定列去重、保留第一条/最后一条、多列联合去重,一次性清理Excel里的重复数据。
场景痛点
从系统导出的Excel常常有重复行:同
用openpyxl扫描工作表,整行全空就删、整列全空就删,从下往上删避免行号错乱,附完整代码。
场景痛点
从系统导出的表,中间夹着好多空行,末尾还拖着几列全是空的辅助列;直接发给别人
用openpyxl的delete_rows、delete_cols按位置删除指定行列,或按条件批量删除符合条件的行,附完整代码。
场景痛点
表里混着测试数据、空行、不要的列,手动选中删容易漏,删错位置
用pandas把Excel导出成CSV,解决中文乱码问题,使用utf-8-sig编码让Excel直接打开不乱码,支持导出单个sheet和多sheet分别导出。
Python Excel导出CSV格式
场景痛点
业务系统只接
用openpyxl从原表提取指定几列,写入新的xlsx文件,保留表头顺序,适合把宽表拆成窄表发给不同部门。
场景痛点
原表有 20 列敏感字段,财务只要「日期、区域、金额」三列,人事只要「
用pandas布尔索引按多条件筛选Excel数据,支持大于小于、等于、包含、多条件与或非,导出筛选结果到新表,比Excel自动筛选更快更稳。
场景痛点
从几万行数据里筛出"金额大于1000
用openpyxl的freeze_panes冻结首行表头、冻结首列,滚动长表时表头始终可见,附完整代码。
场景痛点
一张表几百行,往下滚找数据,滚着滚着就不知道每列叫什么了——因为表头被滚上
用pandas groupby对Excel分组聚合,按部门/地区/产品统计求和、计数、平均值、最大值,一行代码替代Excel分类汇总。
Python Excel分组统计求和count
场景痛点
一份订单明细,要按
用openpyxl控制Excel行列的隐藏与显示:按条件把辅助列、中间过程列藏起来,保护中间计算数据,同时保留主展示列,还能批量取消隐藏。
场景痛点
做报表时经常有一堆"中间计算列":单
用openpyxl的insert_rows、insert_cols在指定位置插入空行空列,已有数据自动下移右移,附完整代码。
场景痛点
表已经做好了,突然要在第 3 行前面塞一行「合计」,或者在 B 列前面
用openpyxl的merge_cells合并标题单元格、unmerge_cells取消合并,注意合并后只有左上角保留值,附完整可运行代码。
场景痛点
报表开头常要写一个跨几列的大标题「2026 年 9 月
用openpyxl一键生成月度报表模板:表头样式、标题、汇总公式、月度汇总sheet、季度对比sheet,每月换个日期直接跑脚本出报表,不用再复制模板。
场景痛点
每个月都要做同一张销售
用openpyxl的number_format把数字格式化成人民币金额、千分位、百分比、保留两位小数,避免直接显示原始浮点数,附完整代码。
场景痛点
Python 写进 Excel 的数字,默认就是一串
用pandas的pivot_table实现Excel数据透视表效果,按行按列分组、求和/计数/平均值,支持多级行列,导出成新Excel。
场景痛点
一份销售明细,要按"地区×月份"看各产品的销售额汇总,
用openpyxl设置print_area打印区域、页眉页脚内容、纸张方向和缩放,导出的表直接打印不用再调页面。
场景痛点
表里有几十列,领导要打印出来开会用。手动点「页面布局」调打印
用openpyxl或pandas读取带合并单元格的Excel时,只有左上角有值,其他位置都是None。本篇讲清怎么检测合并区域、把真实值填充到整行/整列,避免后续统计错。
场景痛点
领导丢过来
按业务主键去重,但保留修改时间最新的那条记录,按时间列排序后再drop_duplicates,实现\"同客户只留最后更新\"的效果。
Python Excel删除重复保留最新
场景痛点
客户信息表同一
用pandas sort_values对Excel按指定列排序,支持单列升序降序、多列联合排序、按自定义顺序排序,保留原索引重置。
Python Excel按列排序
场景痛点
一份报表要按金额从高到低排
遍历文件夹下所有Excel工作簿,读取每个文件的指定工作表,自动按列名对齐汇总成一张总表,支持子目录递归、跳过临时文件。
场景痛点
财务每个月一个Excel,12个月放在12个文件里;或
用pandas的merge替代Excel Vlookup,支持左连接、右连接、内连接,按主键把另一张表的字段拼过来,多列关联一次搞定。
场景痛点
订单表里只有商品编码,要把商品名称、单价从商品档
用openpyxl向Excel写入公式后,openpyxl本身不计算结果,本篇讲清怎么写入SUM/AVERAGE等公式、为什么data_only读出来是空、以及用LibreOffice无头重算后读取真实结果的完整流程
用pandas批量读取文件夹下所有xlsx文件,自动按列名对齐合并成一张总表,附带表头对齐、跳过空文件、保留来源列等实战技巧,几分钟搞定人工几小时的合并工作。
场景痛点
每个部门
用openpyxl.chart.BarChart在Excel里插入柱状图:指定数据源、类别轴、标题、图例位置,支持簇状/堆积柱形,图表随数据更新自动变化,不用手动插图表。
场景痛点
每次做完数据表,都
用pandas的read_excel读取xlsx,指定表头、跳过行、按列名筛选、读指定sheet,读出来直接就是DataFrame,适合数据分析场景。
场景痛点
openpyxl 适合改格式、写格子,但拿到一份表
用openpyxl打开xlsx,按坐标或行列号读取单元格值、读取整行整列、遍历工作表全部数据,附完整代码和取值注意事项。
场景痛点
拿到一份几百行的销售表,需要把里面某些单元格抽出