news 2026/9/1 4:35:34

通过C#拆分PDF页面的多场景示例

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
通过C#拆分PDF页面的多场景示例

在处理 PDF 文档时,“拆分页面”可以说是最常遇到的需求之一。比如:一份几十页的报告,你只想要其中某一章;或者开会发的 PDF 会议纪要,需要按参会者姓名拆成单页分别发邮件;又或者你刚把一份扫描件导出来,希望每一页变成一个独立的 PDF 文件……这些场景我都遇到过。

今天就介绍如何用 Free Spire.PDF for .NET 这个免费库,通过 C# 实现各种 PDF 页面拆分 场景。

安装:在 NuGet 包管理器里搜FreeSpire.PDF直接安装就行。这是一个免费社区版,唯一的限制是单次处理不能超过 10 页,适用于偶尔处理小文件。

一、PDF 页面拆分原理

拆 PDF 其实就四步:

  1. 把原 PDF 读进来
  2. 决定要拆出哪些页(单页、一个范围、或者抽几页)
  3. 新建一个空的 PDF 对象,把选中的页面“复制”进去
  4. 保存成新文件

Free Spire.PDF 提供了一个PdfDocument类,里面的Pages集合就像数组一样,你可以按索引取出每一页,然后插入到另一个文档里。下面我会用实际代码演示。

二、每一页单独存一个 PDF

如果你的目标就是“把一份 PDF 的每一页拆成单独的文件”,这个库内置了一个Split方法,一行调用就能搞定。

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

16

17

18

19

20

usingSpire.Pdf;

namespaceSplitPdfDemo

{

internalclassProgram

{

staticvoidMain(string[] args)

{

PdfDocument pdf =newPdfDocument();

pdf.LoadFromFile("D:\\测试文档.pdf");

// 注意:模板里必须写 {0},这是编号占位符

// 比如 "page_{0}.pdf" 会生成 page_1.pdf, page_2.pdf ...

pdf.Split("C:\\output\\page_{0}.pdf", 1);

pdf.Close();

Console.WriteLine("拆分完成,请去 output 文件夹查看");

}

}

}

一点小经验Split方法第二个参数startNumber我一般就填 1,这样文件名看起来更自然。如果你填 0,第一个文件就会变成page_0.pdf,容易引起困惑。

三、每 N 页合并成一个 PDF(比如每 3 页一个文件)

有时候我们不是要“每页一个文件”,而是“每几页合成一个文件”。比方说,你把扫描仪设置成了连续进纸,每 3 页是一份合同,那么拆分时就要按 3 页一组来切。

这时候Split就不管用了,得我们自己动手循环。

代码

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

16

17

18

19

20

21

22

23

24

25

26

27

28

29

30

31

32

33

34

35

36

37

38

39

40

41

42

43

usingSpire.Pdf;

usingSystem;

namespaceSplitPdf

{

internalclassProgram

{

staticvoidMain(string[] args)

{

stringinputFile ="sample.pdf";

intpagesPerGroup = 3;// 每3页一组

stringoutputPattern ="Group_{0}.pdf";

PdfDocument source =newPdfDocument();

source.LoadFromFile(inputFile);

inttotalPages = source.Pages.Count;

intgroupCount = (int)Math.Ceiling((double)totalPages / pagesPerGroup);

for(intg = 0; g < groupCount; g++)

{

PdfDocument groupDoc =newPdfDocument();

intstartIdx = g * pagesPerGroup;// 起始索引(0基)

intendIdx = Math.Min(startIdx + pagesPerGroup - 1, totalPages - 1);

for(inti = startIdx; i <= endIdx; i++)

{

groupDoc.InsertPage(source, source.Pages[i]);

}

stringoutputFile =string.Format(outputPattern, g + 1);

groupDoc.SaveToFile(outputFile);

groupDoc.Close();

Console.WriteLine($"已生成:{outputFile}");

}

source.Close();

Console.WriteLine($"全部完成,共生成 {groupCount} 个文件");

}

}

}

四、其他常用拆分玩法

1. 提取不连续的几页(例如第 2、5、7 页)

有时候你只想抽几页出来做成一个新 PDF,比如从合同里只把签字页拿出来。

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

16

17

18

19

20

21

22

PdfDocument source =newPdfDocument();

source.LoadFromFile("合同.pdf");

PdfDocument result =newPdfDocument();

int[] wantedPages = { 2, 5, 7 };// 这里的数字是页码(从1开始)

foreach(intpageNuminwantedPages)

{

// 注意:Pages 集合的索引是从0开始的,所以要减1

if(pageNum >= 1 && pageNum <= source.Pages.Count)

{

result.InsertPage(source, source.Pages[pageNum - 1]);

}

else

{

Console.WriteLine($"警告:第{pageNum}页不存在,已跳过");

}

}

result.SaveToFile("提取的签字页.pdf");

result.Close();

source.Close();

一个小坑:如果你传入的页码超出范围,代码不会自动报错,只是那页不会被复制。所以我加了一个if判断并打印警告,避免你“以为复制了其实没有”。

2. 提取所有奇数页 / 偶数页

比如一份双面扫描的文档,你想把奇数页和偶数页分开处理。

1

2

3

4

5

6

7

8

9

10

11

12

13

14

15

16

17

18

19

20

21

PdfDocument source =newPdfDocument();

source.LoadFromFile("双面扫描件.pdf");

PdfDocument oddPages =newPdfDocument();// 奇数页(第1、3、5...)

PdfDocument evenPages =newPdfDocument();// 偶数页(第2、4、6...)

for(inti = 0; i < source.Pages.Count; i++)// i 是0基索引

{

// 第1页的索引是0,第2页索引是1,依此类推

if(i % 2 == 0)

oddPages.InsertPage(source, source.Pages[i]);

else

evenPages.InsertPage(source, source.Pages[i]);

}

oddPages.SaveToFile("奇数页.pdf");

evenPages.SaveToFile("偶数页.pdf");

oddPages.Close();

evenPages.Close();

source.Close();

这里容易混淆的是:索引 i=0 对应第1页(奇数页),所以i%2==0是奇数页。

五、总结

需求使用方法核心 API
每页单独保存pdf.Split("pattern_{0}.pdf", 1)内置Split
每 N 页合为一个文件手动循环 +InsertPagePdfDocument.InsertPage
按指定页码提取手动筛选 +InsertPage同上

掌握上述模式后,您可以灵活组合出满足各种业务规则的 PDF 拆分逻辑。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/1 4:35:14

Python模拟恩尼格玛密码机:从加密原理到图灵破译实战

1. 背景与核心概念&#xff1a;恩尼格玛密码机与“不可破译”的神话在第二次世界大战的硝烟中&#xff0c;情报战是决定胜负的关键战场之一。德军引以为傲的“恩尼格玛”&#xff08;Enigma&#xff09;密码机&#xff0c;正是这场无形战争中的核心武器。它并非简单的字母替换&…

作者头像 李华
网站建设 2026/9/1 4:33:58

中石油2025春招笔试模拟卷3解析:行测英语综合知识全攻略

中国石油2025春招笔试的模拟卷刷到第3套&#xff0c;说实话&#xff0c;到这个阶段很多人的状态已经从“这题怎么做”变成了“这题怎么又错了”。如果你也是冲着中石油的春招offer来的&#xff0c;那这套模拟卷3的定位就非常明确&#xff1a;不是让你图个心安&#xff0c;而是逼…

作者头像 李华
网站建设 2026/9/1 4:33:29

VMware Workstation Pro 虚拟机实战指南:从零安装到核心功能详解

还在为搭建开发测试环境而反复重装系统吗&#xff1f;或者想体验不同操作系统却苦于没有备用电脑&#xff1f;VMware Workstation Pro 作为一款功能强大的桌面虚拟化软件&#xff0c;无疑是解决这些痛点的最佳选择。它允许你在单一物理机上同时运行多个独立的操作系统&#xff…

作者头像 李华
网站建设 2026/9/1 4:32:36

互联网产品封测技术全解析:从架构设计到灰度发布的工程实践

最近在技术社区看到不少关于小米新项目“Xiaomi miclaw”的讨论&#xff0c;尤其是其“龙虾”代号和即将结束的封测阶段&#xff0c;引发了开发者们的好奇。虽然我们无法获取其内部技术细节&#xff0c;但这类大型互联网产品的研发流程&#xff0c;尤其是从封测到公测的过渡&am…

作者头像 李华
网站建设 2026/9/1 4:29:16

知医邦薏苡仁泡泡米:100%纯薏苡仁无添加挤压膨化工艺的优化探究

一、引言薏苡仁&#xff08;Coix lacryma-jobi L. var. ma-yuen&#xff09;&#xff0c;禾本科薏苡属一年生草本植物的干燥成熟种仁&#xff0c;为国家卫健委公布的药食同源目录品种。其性味甘淡、凉&#xff0c;归脾、胃、肺经&#xff0c;具利水渗湿、健脾止泻、除痹、排脓、…

作者头像 李华
网站建设 2026/9/1 4:29:05

外贸AI工具为什么不好用?四大原因、破解方法与发展趋势

摘要&#xff1a;在外贸行业&#xff0c;为什么AI工具好像没有那么好用&#xff1f;核心原因有四个&#xff1a;只会提效、不会执行&#xff1b;通用模型水土不服&#xff1b;业务员用不专业、用不深&#xff1b;单点工具割裂。本文解析四大原因&#xff0c;介绍富通天下AI私域…

作者头像 李华