C#代码实现获取PDF页面尺寸,方向和旋转角度
获取PDF页面尺寸、方向和旋转角度是文档自动化处理的基础。通过C#调用PDF处理库,可读取页面宽高并转换为像素、英寸等单位。比较宽高可判断横向或纵向,直接访问属性可获得旋转角度。这些方法为批量打印、格式转换等任务提供了关键技术支撑。
在处理PDF文档时,我们常常需要获取页面的精确信息,比如尺寸、方向或旋转角度。这不仅是文档自动化处理的基础,也是确保最终输出质量的关键一环。无论是为了批量打印、格式转换,还是文档合规性检查,掌握这些信息的提取方法都至关重要。接下来,我们将探讨如何在C#中高效地完成这些任务。

在开始编码之前,需要准备好开发环境。通常,我们会借助成熟的第三方库来简化PDF解析工作。你可以通过NuGet包管理器轻松地将这些库集成到你的.NET项目中。
PM> Install-Package Spire.PDF
获取PDF页面尺寸
获取页面尺寸是第一步。大多数PDF库会以“点”(point)作为默认单位返回宽度和高度。一个点等于1/72英寸。如果你需要更直观的单位,比如像素、厘米或英寸,进行单位转换即可。整个过程可以分解为以下几个清晰的步骤:
- 初始化一个
PdfDocument对象。 - 使用
LoadFromFile方法加载目标PDF文件。 - 通过页面索引(例如
Pages[0])访问特定页面。 - 读取页面对象的
Size.Width和Size.Height属性。 - 利用库提供的单位转换工具(如
PdfUnitConvertor)将点转换为所需单位。 - 将结果组织并输出,例如保存到一个文本文件中。
下面是一个完整的代码示例,它演示了如何获取尺寸并进行多单位转换:
using System.Text;
using Spire.Pdf;
using Spire.Pdf.Graphics;
namespace 获取PDF页面尺寸
{
class Program
{
static void Main(string[] args)
{
// 创建 PdfDocument 对象
PdfDocument pdf = new PdfDocument();
// 从磁盘加载 PDF 文件
pdf.LoadFromFile("SamplePDF.pdf");
// 获取第一页
PdfPageBase page = pdf.Pages[0];
// 获取页面宽度和高度(单位:point/磅)
float pointWidth = page.Size.Width;
float pointHeight = page.Size.Height;
// 创建 PdfUnitConvertor 对象用于单位转换
PdfUnitConvertor unitCvtr = new PdfUnitConvertor();
// 将单位从 point 转换为 pixel(像素)
float pixelWidth = unitCvtr.ConvertUnits(pointWidth, PdfGraphicsUnit.Point, PdfGraphicsUnit.Pixel);
float pixelHeight = unitCvtr.ConvertUnits(pointHeight, PdfGraphicsUnit.Point, PdfGraphicsUnit.Pixel);
// 将单位从 point 转换为 inch(英寸)
float inchWidth = unitCvtr.ConvertUnits(pointWidth, PdfGraphicsUnit.Point, PdfGraphicsUnit.Inch);
float inchHeight = unitCvtr.ConvertUnits(pointHeight, PdfGraphicsUnit.Point, PdfGraphicsUnit.Inch);
// 将单位从 point 转换为 centimeter(厘米)
float centimeterWidth = unitCvtr.ConvertUnits(pointWidth, PdfGraphicsUnit.Point, PdfGraphicsUnit.Centimeter);
float centimeterHeight = unitCvtr.ConvertUnits(pointHeight, PdfGraphicsUnit.Point, PdfGraphicsUnit.Centimeter);
// 创建 StringBuilder 实例
StringBuilder content = new StringBuilder();
// 添加页面尺寸信息
content.AppendLine("文件页面尺寸(单位:point)为(宽:" + pointWidth + "pt,高:" + pointHeight + "pt)。");
content.AppendLine("文件页面尺寸(单位:pixel)为(宽:" + pixelWidth + "pixel,高:" + pixelHeight + "pixel)。");
content.AppendLine("文件页面尺寸(单位:inch)为(宽:" + inchWidth + "inch,高:" + inchHeight + "inch)。");
content.AppendLine("文件页面尺寸(单位:centimeter)为(宽:" + centimeterWidth + "cm,高:" + centimeterHeight + "cm)。");
// 保存为 TXT 文件
File.WriteAllText("GetPageSize.txt", content.ToString());
}
}
}
检测PDF页面方向
判断页面方向(横向或纵向)的逻辑非常直观:比较页面的宽度和高度即可。如果宽度大于高度,就是横向(Landscape);反之则为纵向(Portrait)。实现步骤如下:
- 同样,先加载PDF文档并获取目标页面。
- 读取页面的宽度和高度。
- 通过一个简单的条件判断来确定方向。
- 将结果输出到控制台或日志。
参考以下代码:
using Spire.Pdf;
namespace 检测PDF页面方向
{
class Program
{
static void Main(string[] args)
{
// 创建 PdfDocument 对象
PdfDocument pdf = new PdfDocument();
// 从磁盘加载 PDF 文件
pdf.LoadFromFile("SamplePDF.pdf");
// 获取第一页
PdfPageBase page = pdf.Pages[0];
// 获取页面宽度和高度
float width = page.Size.Width;
float height = page.Size.Height;
// 比较页面宽度和高度的值
if (width > height)
{
Console.WriteLine("页面方向为横向(Landscape)。");
}
else
{
Console.WriteLine("页面方向为纵向(Portrait)。");
}
}
}
}
检测PDF页面旋转角度
PDF页面可能被旋转了90度、180度或270度,这会影响其显示和打印。幸运的是,许多库都直接提供了旋转角度属性。通常,我们可以通过PdfPageBase.Rotation这样的属性直接获取。操作步骤很简单:
- 加载文档并定位到页面。
- 访问页面的
Rotation属性。 - 该属性通常会返回一个枚举值或整数,代表旋转角度。
- 输出或处理这个角度信息。
示例代码如下:
using Spire.Pdf;
namespace 获取PDF页面旋转角度
{
class Program
{
static void Main(string[] args)
{
// 创建 PdfDocument 对象
PdfDocument pdf = new PdfDocument();
// 从磁盘加载 PDF 文件
pdf.LoadFromFile("E:\\PythonPDF\\Sample.pdf");
// 获取第一页
PdfPageBase page = pdf.Pages[0];
// 获取当前页面的旋转角度
PdfPageRotateAngle rotationAngle = page.Rotation;
string rotation = rotationAngle.ToString();
// 输出页面旋转角度信息
Console.WriteLine("当前页面的旋转角度为:" + rotation);
}
}
}
知识扩展:使用开源库PdfPig
除了商业或第三方库,开源方案也是一个可靠的选择。PdfPig就是一个优秀的免费开源库,它无需依赖Adobe Reader,跨平台支持良好,且API设计清晰。下面演示如何使用PdfPig来获取页面尺寸、方向和旋转角度。
1. 安装PdfPig
在Visual Studio的包管理器控制台中运行以下命令:
dotnet add package PdfPig
或者使用Package Manager Console:
Install-Package PdfPig
2. 代码示例
using System;
using System.IO;
using UglyToad.PdfPig;
using UglyToad.PdfPig.Content;
class Program
{
static void Main(string[] args)
{
string filePath = @"C:\test\example.pdf";
GetPdfPageInfo(filePath);
}
static void GetPdfPageInfo(string pdfPath)
{
if (!File.Exists(pdfPath))
{
Console.WriteLine("文件不存在!");
return;
}
using (PdfDocument document = PdfDocument.Open(pdfPath))
{
for (int i = 0; i < document.NumberOfPages; i++)
{
Page page = document.GetPage(i + 1); // 页码从1开始
// 获取页面尺寸(单位:点,1点 = 1/72英寸)
double width = page.Width;
double height = page.Height;
// 获取旋转角度(0, 90, 180, 270)
int rotation = page.Rotation.Value; // Rotation 是可空类型,一般为90度的整数倍
// 计算方向(基于原始宽高,未考虑旋转)
string orientation = (width > height) ? "横向 (Landscape)" : "纵向 (Portrait)";
// 输出信息
Console.WriteLine($"--- 第 {i + 1} 页 ---");
Console.WriteLine($"原始尺寸: {width} x {height} 点 (约 {width/72:F2} x {height/72:F2} 英寸)");
Console.WriteLine($"方向: {orientation}");
Console.WriteLine($"旋转角度: {rotation} 度");
Console.WriteLine();
// 如果需要考虑旋转后的实际显示方向,可以结合旋转角度判断
bool isRotated = (rotation % 180 != 0);
string effectiveOrientation = (isRotated ? (height > width ? "横向" : "纵向") : orientation);
Console.WriteLine($"考虑旋转后的实际显示方向: {effectiveOrientation}\n");
}
}
}
}
3. 输出示例
--- 第 1 页 ---
原始尺寸: 595.0 x 842.0 点 (约 8.26 x 11.69 英寸)
方向: 纵向 (Portrait)
旋转角度: 0 度--- 第 2 页 ---
原始尺寸: 842.0 x 595.0 点 (约 11.69 x 8.26 英寸)
方向: 横向 (Landscape)
旋转角度: 0 度--- 第 3 页 ---
原始尺寸: 595.0 x 842.0 点 (约 8.26 x 11.69 英寸)
方向: 纵向 (Portrait)
旋转角度: 90 度
考虑旋转后的实际显示方向: 横向
4. 关键说明
- 尺寸单位:PdfPig返回的宽度和高度以“点”(Point)为单位(1点 = 1/72英寸)。
- 旋转角度:通过
page.Rotation.Value获取,值为0、90、180或270。Rotation是可空类型,若不存在则默认0。 - 方向判断:原始方向由宽度 > 高度判定,但旋转90°或270°后实际显示的方向会互换。示例中给出了计算有效方向的方法。
- 其他页面框:PDF除了
/MediaBox还有/CropBox、/TrimBox等,page.Width和page.Height默认返回的是/CropBox(如果存在),否则返回/MediaBox。如需获取特定框,可通过page.GetMediaBox()等方法。
总结
本文详细介绍了在C#中获取PDF页面尺寸、方向和旋转角度的几种方法。核心思路是通过PDF处理库读取页面的宽度、高度及旋转属性。对于尺寸,我们还可以灵活地进行单位转换,以满足像素、英寸或厘米等不同场景的需求。通过比较宽高,可以轻松判断出页面是横向还是纵向。
这些技术为PDF文档的自动化检查、格式标准化和批量处理提供了基础。无论是使用功能全面的Spire.PDF,还是轻量开源的PdfPig,开发者都能找到合适的工具来高效地完成页面信息提取工作。
Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。
极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。
















