当前位置:

首页 > 编程开发 > Python自动创建递增文件夹并批量分发文件方法

Python自动创建递增文件夹并批量分发文件方法

本文目录

    本文介绍如何使用Python自动将数千个PDF文件按固定数量(如每批50个)分组,存入以数字命名(如batch_001、batch_002)的连续文件夹中,并支持基于模板目录复用空文件夹,同时精准记录每个文件所属的文件夹路径。

    如何在 Python 中自动创建编号递增的文件夹并批量分发文件

    本文介绍如何使用 Python 自动将数千个 PDF 文件按固定数量(如每批 50 个)分组,存入以数字命名(如 batch_001、batch_002)的连续文件夹中,并支持基于模板目录复用空文件夹,同时精准记录每个文件所属的文件夹路径。

    本文介绍如何使用 Python 自动将数千个 PDF 文件按固定数量(如每批 50 个)分组,存入以数字命名(如 `batch_001`、`batch_002`)的连续文件夹中,并支持基于模板目录复用空文件夹,同时精准记录每个文件所属的文件夹路径。

    在批量处理大量文档(如 3800 个 PDF)时,为适配打印软件对“分批次输出”的要求,需将文件系统化地组织进编号清晰、逻辑连续的文件夹中。以下是一个健壮、易维护的 Python 教程方案,兼顾自动编号建夹、模板复用可选、文件归属可追溯三大核心需求。

    ✅ 核心功能说明

    • 自动编号命名:生成形如 batch_001、batch_002 的标准化文件夹名(三位补零,便于排序与识别);
    • 双模式支持:
      • 若存在 sorted_template 模板目录(含一个或多个空文件夹),则复制首个模板文件夹并重命名为 batch_001,避免重复创建结构;
      • 否则直接调用 os.makedirs() 创建新文件夹;
    • 精准映射追踪:使用字典 file_to_folder_map 实时记录 filename → batch_X 的对应关系,便于后续生成分发清单、校验或调试。

    ? 完整可运行代码

    import os
    import shutil
    
    # ? 配置路径(请根据实际环境修改)
    source_directory = r"//All-the-data"              # 源文件所在目录
    destination_base_folder = r"//All-the-data/sorted"  # 目标父目录
    template_directory = r"//All-the-data/sorted_template"  # 可选:模板空文件夹目录(留空或设为 None 则跳过模板逻辑)
    
    batch_size = 50  # 每批文件数
    
    # ✅ 步骤 1:验证源目录
    if not (os.path.exists(source_directory) and os.path.isdir(source_directory)):
        print(f"❌ 错误:源目录不存在 — {source_directory}")
        exit(1)
    
    # ✅ 步骤 2:获取并排序文件(确保顺序稳定,如按字母/时间)
    files = [f for f in os.listdir(source_directory) if os.path.isfile(os.path.join(source_directory, f))]
    files.sort()  # 默认按字符串升序(适用于 'file001.pdf', 'file002.pdf' 等命名)
    
    # ✅ 步骤 3:初始化计数器与映射表
    folder_number = 1
    file_to_folder_map = {}
    
    print(f"? 开始处理 {len(files)} 个文件,每 {batch_size} 个一批...")
    
    # ✅ 步骤 4:主循环 — 分批创建文件夹 + 复制文件 + 记录映射
    for i in range(0, len(files), batch_size):
        # ? 确定当前批次的目标文件夹路径
        if template_directory and os.path.exists(template_directory) and os.path.isdir(template_directory):
            # 尝试读取模板目录中的第一个子目录(假设为标准空文件夹)
            template_subdirs = [d for d in os.listdir(template_directory) 
                                if os.path.isdir(os.path.join(template_directory, d))]
            if template_subdirs:
                template_path = os.path.join(template_directory, template_subdirs[0])
                target_folder_name = f"batch_{folder_number:03d}"
                batch_directory_path = os.path.join(destination_base_folder, target_folder_name)
    
                # 复制模板(保留权限、元数据)
                shutil.copytree(template_path, batch_directory_path, dirs_exist_ok=True)
                print(f"? 已从模板复制:{target_folder_name}")
            else:
                print("⚠️  模板目录存在但无子文件夹,将新建编号文件夹")
                batch_directory_path = os.path.join(destination_base_folder, f"batch_{folder_number:03d}")
                os.makedirs(batch_directory_path, exist_ok=True)
        else:
            # 直接新建编号文件夹
            batch_directory_path = os.path.join(destination_base_folder, f"batch_{folder_number:03d}")
            os.makedirs(batch_directory_path, exist_ok=True)
    
        # ? 批量复制本组文件
        batch_files = files[i:i + batch_size]
        for filename in batch_files:
            src = os.path.join(source_directory, filename)
            dst = os.path.join(batch_directory_path, filename)
            shutil.copy2(src, dst)  # copy2 保留修改时间、权限等元数据
            file_to_folder_map[filename] = batch_directory_path
    
        print(f"✅ 批次 {folder_number:03d} 完成:{len(batch_files)} 个文件 → {batch_directory_path}")
        folder_number += 1
    
    # ✅ 步骤 5:输出文件-文件夹映射(可用于生成 CSV 或日志)
    print("\n? 文件归属总览(前 10 条示例):")
    for idx, (fname, fpath) in enumerate(list(file_to_folder_map.items())[:10]):
        print(f"  {fname} → {os.path.basename(fpath)}")
    if len(file_to_folder_map) > 10:
        print(f"  ... 还有 {len(file_to_folder_map) - 10} 个文件映射未显示")
    
    # ? 提示:如需导出完整映射到 CSV,可追加如下代码(需 import csv)
    # with open(os.path.join(destination_base_folder, "file_mapping.csv"), "w", newline="", encoding="utf-8") as f:
    #     writer = csv.writer(f)
    #     writer.writerow(["Filename", "BatchFolder"])
    #     for fname, fpath in file_to_folder_map.items():
    #         writer.writerow([fname, os.path.basename(fpath)])

    ⚠️ 注意事项与最佳实践

    • 路径写法:Windows 下建议使用原始字符串(r"\\path")或正斜杠("//path"),避免反斜杠转义问题;
    • 模板目录要求:sorted_template 应仅包含空文件夹(无文件),且至少含一个子目录;若不确定,建议先注释掉模板逻辑,使用纯新建模式;
    • 文件筛选:os.listdir() 会返回所有条目(含子目录),因此添加了 os.path.isfile() 过滤,确保只处理文件;
    • 并发安全:本脚本为单线程顺序执行,适合常规批量任务;如需加速(如 SSD + 多核),可引入 concurrent.futures,但需注意 I/O 瓶颈;
    • 错误防御:已加入基础路径检查与异常提示;生产环境建议补充 try/except 包裹 shutil.copy2(),捕获 PermissionError 或 DiskFullError 等。

    ✅ 总结

    该方案摒弃了“先建夹再重命名”的低效方式,改为在创建/复制阶段即赋予规范编号,逻辑更直观、结果更可控。配合 file_to_folder_map 映射表,你不仅能完成打印分批,还可轻松导出分发清单、做一致性校验,甚至对接后续自动化流程(如生成打印指令、邮件通知等)。对于初学者,代码保持了清晰的步骤注释与模块化结构,便于理解与二次定制。

    本文内容来源于网友投稿,如有侵权请联系删除。
    作者最新文章
    编程开发
    相关文章 更多
    解决PHP递归报错:max_nesting_level限制与内存溢出处理
    解决PHP递归报错:max_nesting_level限制与内存溢出处理

    遇到PHP递归报错时,不要盲目调大max_nesting_level。本文教你区分Xdebug限制、内存耗尽和正则递归错误,提供代码级的终止条件优化与迭代替代方案,彻底解决栈溢出问题。

    PHP递归中static变量与引用传递的常见陷阱及调试
    PHP递归中static变量与引用传递的常见陷阱及调试

    本文分析PHP递归中static变量导致的状态污染及引用传递引发的共享数据修改问题。提供具体的代码复现、缓存键设计建议及调试打印技巧,帮助开发者避免隐蔽的逻辑错误。

    PHP递归性能优化技巧与迭代替代方案
    PHP递归性能优化技巧与迭代替代方案

    解析PHP递归函数在树形数据处理中的性能瓶颈,提供预加载数据消除I/O、使用显式栈替代深层递归的实战方案,帮助开发者在代码可读性与执行效率间做出合理取舍。

    Java测试中怎么使用Mockito模拟依赖对象
    Java测试中怎么使用Mockito模拟依赖对象

    详细讲解在Java单元测试中如何使用Mockito模拟依赖对象,包括引入依赖、创建Mock、打桩返回值、行为验证以及Mock与Spy的核心差异和常见陷阱排查。

    链表删除节点的时间复杂度是多少及其详细分析
    链表删除节点的时间复杂度是多少及其详细分析

    详细分析链表删除节点的时间复杂度,深入探讨单链表与双向链表在不同已知前提下的查找与删除开销,并结合完整代码与清晰图解进行对比总结。

    codex如何配置模型参数及文件设置教程
    codex如何配置模型参数及文件设置教程

    想知道如何让AI写出的代码更贴合你的习惯?本文手把手教你在VS Code中调整Codex相关模型参数,通过修改配置文件优化温度值和令牌限制,解决代码建议不准确或响应慢的问题。

    Claude Code AI编程工具实力揭秘与编程助手实测
    Claude Code AI编程工具实力揭秘与编程助手实测

    通过实测展示Claude Code在终端中如何理解自然语言指令、自动修改代码文件并处理复杂编程任务,帮助开发者评估其实际辅助能力。

    winforms教程自学入门与基础开发步骤详解
    winforms教程自学入门与基础开发步骤详解

    本教程详细讲解如何使用Visual Studio创建WinForms项目,通过添加按钮和标签控件并编写点击事件代码,实现一个基础的计数器功能,适合C#初学者快速上手Windows窗体应用开发。

    Cursor自动补全设置教程教你快速开启代码补全功能
    Cursor自动补全设置教程教你快速开启代码补全功能

    详解Cursor编辑器中自动补全功能的开启与优化设置,涵盖Tab触发机制、上下文窗口调整及模型切换,帮助开发者解决补全延迟、干扰大等问题,提升编码流畅度。

    pandas的数据格式怎么转换和设置方法教程
    pandas的数据格式怎么转换和设置方法教程

    详解Pandas中数据格式转换的核心方法,包括astype强制转换、to_numeric容错处理及日期解析技巧,解决常见类型错误并提升数据处理效率。

    查看更多
    精品专题 更多
    装机必备
    装机必备

    正软商城装机必备专区,精选办公、浏览器、安全防护、影音播放、压缩解压、设计创作和系统工具等电脑常用正版软件,帮助用户快速完成新电脑软件配置。

    Windows
    Windows

    正软商城Windows软件专区,汇集适用于Windows电脑的办公、设计、安全防护、影音播放、开发工具和系统优化软件,提供软件介绍、系统要求、正版授权及购买下载服务。

    macOS软件
    macOS软件

    正软商城macOS软件专区,精选适用于Mac电脑的办公、设计、影音、效率、开发和系统工具,提供软件功能介绍、macOS兼容版本、正版授权及购买下载服务。

    Mac软件 更多
    photoshop
    photoshop
    Windows、macOS 、 iPad

    Photoshop 2026 是 Adobe 推出的专业图像处理与视觉设计软件,支持 Windows、macOS 和 iPad 等平台,广泛应用于摄影修图、电商设计、平面海报、数字绘画及视觉合成等创作场景。

    Blender
    Blender
    Windows、macOS 和 Linux

    Blender 是一款免费开源、跨平台的专业 3D 创作软件,集建模、动画、渲染、视频编辑与视觉合成等功能于一体,广泛应用于影视动画、游戏设计和建筑可视化等领域。软件支持 Cycles 物理渲染器与 Eevee 实时渲染引擎,并提供多边形建模、骨骼绑定、物理模拟等专业工具。Blender 兼容 Windows、macOS 和 Linux 系统,安装包轻巧、运行流畅,依托活跃的全球开发者社区持续更新,是从初学者到专业创作者都值得选择的正版 3D 创作工具。

    灵活计算器
    灵活计算器
    macOS/iOS/Android

    灵活计算器是一款笔记式算数应用,支持实时计算、动态关联和云端同步功能。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

    WINDOWS 更多
    3dmax(3ds max)
    3dmax(3ds max)
    Windows

    Autodesk 3ds Max 是一款专业的三维建模、动画与渲染软件,广泛应用于建筑可视化、游戏开发、影视动画、广告设计和产品展示等领域。

    photoshop
    photoshop
    Windows、macOS 、 iPad

    Photoshop 2026 是 Adobe 推出的专业图像处理与视觉设计软件,支持 Windows、macOS 和 iPad 等平台,广泛应用于摄影修图、电商设计、平面海报、数字绘画及视觉合成等创作场景。

    Blender
    Blender
    Windows、macOS 和 Linux

    Blender 是一款免费开源、跨平台的专业 3D 创作软件,集建模、动画、渲染、视频编辑与视觉合成等功能于一体,广泛应用于影视动画、游戏设计和建筑可视化等领域。软件支持 Cycles 物理渲染器与 Eevee 实时渲染引擎,并提供多边形建模、骨骼绑定、物理模拟等专业工具。Blender 兼容 Windows、macOS 和 Linux 系统,安装包轻巧、运行流畅,依托活跃的全球开发者社区持续更新,是从初学者到专业创作者都值得选择的正版 3D 创作工具。