发布于2026-07-10 阅读(0)
扫一扫,手机访问
在处理 PDF 文档时,“拆分页面”可以说是最常遇上的需求之一。比方说:一份几十页的报告,你只想要其中某一章;或者开会发的 PDF 会议纪要,需要按参会者姓名拆成单页分别发邮件;又或者你刚把一份扫描件导出来,希望每一页变成一个独立的 PDF 文件……这些场景不少人都碰到过。

这次就用 Free Spire.PDF for .NET 这个免费库,把 C# 里拆分 PDF 的各种常见操作都梳理一遍。代码都是实际跑过的,改改路径就能直接用。
安装:在 NuGet 包管理器里搜 FreeSpire.PDF 直接安装就行。这是一个免费社区版,唯一的限制是单次处理不能超过 10 页,超过的部分会被悄悄截掉(不会报错,但结果会少页)。如果只是偶尔处理小文件,这个库用起来很顺手。
拆 PDF 其实就四步:先把原 PDF 读进来;接着决定要拆出哪些页(单页、某个范围、或者抽几页);然后新建一个空的 PDF 对象,把选中的页面“复制”进去;最后保存成新文件。
Free Spire.PDF 提供了一个 PdfDocument 类,里面的 Pages 集合就像数组一样,可以按索引取出每一页,然后插入到另一个文档里。下面会用实际代码演示。
如果目标就是“把一份 PDF 的每一页拆成单独的文件”,这个库内置了一个 Split 方法,一行调用就能搞定。
using Spire.Pdf;
namespace SplitPdfDemo
{
internal class Program
{
static void Main(string[] args)
{
PdfDocument pdf = new PdfDocument();
pdf.LoadFromFile("D:\\测试文档.pdf");
// 注意:模板里必须写 {0},这是编号占位符
// 比如 "page_{0}.pdf" 会生成 page_1.pdf, page_2.pdf ...
pdf.Split("C:\\output\\page_{0}.pdf", 1);
pdf.Close();
Console.WriteLine("拆分完成,请去 output 文件夹查看");
}
}
}
一点小经验:Split 方法的第二个参数 startNumber,实际推荐填 1,这样文件名看起来更自然。如果填 0,第一个文件就会变成 page_0.pdf,容易让人困惑。
有时候需要的是“每几页合成一个文件”,而不是“每页一个文件”。比如扫描仪设置成了连续进纸,每 3 页是一份合同,拆分时就需要按 3 页一组来切。
这种情况 Split 就不管用了,得自己动手循环。
using Spire.Pdf;
using System;
namespace SplitPdf
{
internal class Program
{
static void Main(string[] args)
{
string inputFile = "sample.pdf";
int pagesPerGroup = 3; // 每3页一组
string outputPattern = "Group_{0}.pdf";
PdfDocument source = new PdfDocument();
source.LoadFromFile(inputFile);
int totalPages = source.Pages.Count;
int groupCount = (int)Math.Ceiling((double)totalPages / pagesPerGroup);
for (int g = 0; g < groupCount; g++)
{
PdfDocument groupDoc = new PdfDocument();
int startIdx = g * pagesPerGroup; // 起始索引(0基)
int endIdx = Math.Min(startIdx + pagesPerGroup - 1, totalPages - 1);
for (int i = startIdx; i <= endIdx; i++)
{
groupDoc.InsertPage(source, source.Pages[i]);
}
string outputFile = string.Format(outputPattern, g + 1);
groupDoc.Sa veToFile(outputFile);
groupDoc.Close();
Console.WriteLine($"已生成:{outputFile}");
}
source.Close();
Console.WriteLine($"全部完成,共生成 {groupCount} 个文件");
}
}
}
有时只需要抽几页出来做成一个新 PDF,比如从合同里只把签字页拿出来。
PdfDocument source = new PdfDocument();
source.LoadFromFile("合同.pdf");
PdfDocument result = new PdfDocument();
int[] wantedPages = { 2, 5, 7 }; // 这里的数字是页码(从1开始)
foreach (int pageNum in wantedPages)
{
// 注意:Pages 集合的索引是从0开始的,所以要减1
if (pageNum >= 1 && pageNum <= source.Pages.Count)
{
result.InsertPage(source, source.Pages[pageNum - 1]);
}
else
{
Console.WriteLine($"警告:第{pageNum}页不存在,已跳过");
}
}
result.Sa veToFile("提取的签字页.pdf");
result.Close();
source.Close();
一个小坑:如果传入的页码超出范围,代码不会自动报错,只是那页不会被复制。所以最好加一个 if 判断并打印警告,避免“以为复制了、其实没有”的情况。
比如一份双面扫描的文档,想把奇数页和偶数页分开处理。
PdfDocument source = new PdfDocument();
source.LoadFromFile("双面扫描件.pdf");
PdfDocument oddPages = new PdfDocument(); // 奇数页(第1、3、5...)
PdfDocument evenPages = new PdfDocument(); // 偶数页(第2、4、6...)
for (int i = 0; i < source.Pages.Count; i++) // i 是0基索引
{
// 第1页的索引是0,第2页索引是1,依此类推
if (i % 2 == 0)
oddPages.InsertPage(source, source.Pages[i]);
else
evenPages.InsertPage(source, source.Pages[i]);
}
oddPages.Sa veToFile("奇数页.pdf");
evenPages.Sa veToFile("偶数页.pdf");
oddPages.Close();
evenPages.Close();
source.Close();
这里容易混淆的是:索引 i=0 对应第1页(奇数页),所以 i%2==0 取出的是奇数页。
库 | 许可 | 优点 | 缺点 |
|---|---|---|---|
| Free Spire.PDF | 免费社区版 | API 很直观,不需要装 Adobe,页面复制时注释、表单、书签都保留得不错。 | 10页限制,超过就截断(这是硬伤) |
| iTextSharp | AGPL | 功能最强,工业级。 | AGPL 许可证对商业项目很不友好,想商用必须买授权,而且配置略繁琐。 |
| PdfSharp | MIT | 完全免费无限制,轻量。 | 页面复制的效果一般,有些复杂元素(比如某些字体或透明度)会丢失。 |
如果只是偶尔处理一些不超过10页的 PDF,Free Spire.PDF 用起来最省心。如果经常处理几十页的文件又不想花钱,可以试试 PdfSharp,但要做好“部分样式可能丢失”的心理准备。
在 C# 中拆分 PDF 文件的需求多种多样,例如从多页 PDF 中提取某一页、将大文件按固定页数分成多个小文件、或者按页码列表提取特定页面。下面展示使用 PdfSharp(免费开源,推荐)、iTextSharp(LGPL/AGPL,需注意许可)和 Spire.PDF(商业库,功能丰富)这三种库,实现常见的拆分场景。
提醒:生产环境建议优先使用 PdfSharp(MIT 协议)或购买商业库。iTextSharp 的 AGPL 协议要求公开源代码,需谨慎使用。
使用 PdfSharp(免费、轻量)
PdfSharp 是一款纯 .NET 的 PDF 操作库,无需安装 Adobe 软件,支持 .NET Framework / .NET Core。
安装 NuGet 包:
Install-Package PdfSharp
场景1:按单页拆分(每页保存为一个单独的 PDF)
using PdfSharp.Pdf;
using PdfSharp.Pdf.IO;
public static void SplitPdfByPage(string inputFile, string outputFolder)
{
// 打开源 PDF 文档
PdfDocument inputDocument = PdfReader.Open(inputFile, PdfDocumentOpenMode.Import);
for (int i = 0; i < inputDocument.PageCount; i++)
{
// 创建一个新文档
PdfDocument outputDocument = new PdfDocument();
// 导入第 i 页(PdfSharp 的页码从 1 开始,但 AddPage 需传入页面对象)
outputDocument.AddPage(inputDocument.Pages[i]);
// 保存为独立文件
string outputFile = Path.Combine(outputFolder, $"page_{i + 1}.pdf");
outputDocument.Sa ve(outputFile);
}
}
场景2:拆分页码范围(例如第 3-5 页)
public static void SplitPageRange(string inputFile, string outputFile, int startPage, int endPage)
{
using (PdfDocument input = PdfReader.Open(inputFile, PdfDocumentOpenMode.Import))
{
PdfDocument output = new PdfDocument();
for (int i = startPage - 1; i < endPage && i < input.PageCount; i++)
{
output.AddPage(input.Pages[i]);
}
output.Sa ve(outputFile);
}
}
场景3:按固定页数拆分(如每 10 页一个文件)
public static void SplitByChunkSize(string inputFile, int chunkSize)
{
using (PdfDocument input = PdfReader.Open(inputFile, PdfDocumentOpenMode.Import))
{
int totalPages = input.PageCount;
for (int start = 0; start < totalPages; start += chunkSize)
{
PdfDocument chunkDoc = new PdfDocument();
int end = Math.Min(start + chunkSize, totalPages);
for (int i = start; i < end; i++)
{
chunkDoc.AddPage(input.Pages[i]);
}
chunkDoc.Sa ve($"chunk_{start / chunkSize + 1}.pdf");
}
}
}
使用 iText 7(功能强大,注意许可)
iText 7 是业界标准,但 AGPL 许可证要求开源,商业使用需购买许可。
安装 NuGet 包:
Install-Package itext7
场景:提取指定页面列表(例如第 1,3,5 页)
using iText.Kernel.Pdf; public static void ExtractPagesList(string inputFile, string outputFile, ListpageNumbers) { using (PdfDocument pdfDoc = new PdfDocument(new PdfReader(inputFile))) using (PdfDocument outDoc = new PdfDocument(new PdfWriter(outputFile))) { foreach (int pageNum in pageNumbers) { // iText 页码从 1 开始 PdfPage page = pdfDoc.GetPage(pageNum); outDoc.AddPage(page.CopyTo(outDoc)); } } }
使用 Spire.PDF(商业库,功能最全)
Spire.PDF 提供丰富的 API,免费版有页数限制。
安装 NuGet 包:
Install-Package Spire.PDF
场景:根据书签拆分(按章节拆分)
using Spire.Pdf;
using Spire.Pdf.Bookmarks;
public static void SplitByBookmarks(string inputFile)
{
PdfDocument doc = new PdfDocument();
doc.LoadFromFile(inputFile);
PdfBookmarkCollection bookmarks = doc.Bookmarks;
for (int i = 0; i < bookmarks.Count; i++)
{
PdfDocument newDoc = new PdfDocument();
int startPage = bookmarks[i].Destination.PageNumber;
int endPage = (i == bookmarks.Count - 1) ? doc.Pages.Count : bookmarks[i + 1].Destination.PageNumber - 1;
// 复制页面
for (int p = startPage; p <= endPage; p++)
{
newDoc.InsertPage(newDoc.Pages.Count, doc.Pages[p - 1]); // Spire 页码从 1 开始
}
newDoc.Sa veToFile($"chapter_{i + 1}.pdf");
}
}
需求 | 使用方法 | 核心 API |
|---|---|---|
每页单独保存 | pdf.Split("pattern_{0}.pdf", 1) | 内置 |
每 N 页合为一个文件 | 手动循环 + | PdfDocument.InsertPage |
按指定页码提取 | 手动筛选 + | 同上 |
掌握上述模式后,可以灵活组合出满足各种业务规则的 PDF 拆分逻辑。代码均已在实际项目中验证,可直接复用。
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
7
8