展开菜单
首页 精品内容 本月促销 装机必备 Windows macOS软件 IOS软件 Android AI PDF教程 专题
全部分类

当前位置:

首页 > 编程开发 > C#实现精准拆分PDF页面(单页/指定页)的完整代码

C#实现精准拆分PDF页面(单页/指定页)的完整代码

使用FreeSpire.PDFfor.NET库,在C#中可实现PDF页面拆分,支持单页拆分、指定页码范围拆分及每N页合并为一组。免费社区版单次处理上限10页,代码直接修改路径即可使用。

在处理 PDF 文档时,“拆分页面”可以说是最常遇上的需求之一。比方说:一份几十页的报告,你只想要其中某一章;或者开会发的 PDF 会议纪要,需要按参会者姓名拆成单页分别发邮件;又或者你刚把一份扫描件导出来,希望每一页变成一个独立的 PDF 文件……这些场景不少人都碰到过。

C#实现精准拆分PDF页面(单页/指定页)的完整代码

这次就用 Free Spire.PDF for .NET 这个免费库,把 C# 里拆分 PDF 的各种常见操作都梳理一遍。代码都是实际跑过的,改改路径就能直接用。

安装:在 NuGet 包管理器里搜 FreeSpire.PDF 直接安装就行。这是一个免费社区版,唯一的限制是单次处理不能超过 10 页,超过的部分会被悄悄截掉(不会报错,但结果会少页)。如果只是偶尔处理小文件,这个库用起来很顺手。

原理

拆 PDF 其实就四步:先把原 PDF 读进来;接着决定要拆出哪些页(单页、某个范围、或者抽几页);然后新建一个空的 PDF 对象,把选中的页面“复制”进去;最后保存成新文件。

Free Spire.PDF 提供了一个 PdfDocument 类,里面的 Pages 集合就像数组一样,可以按索引取出每一页,然后插入到另一个文档里。下面会用实际代码演示。

每一页单独存一个 PDF

如果目标就是“把一份 PDF 的每一页拆成单独的文件”,这个库内置了一个 Split 方法,一行调用就能搞定。

using Spire.Pdf;
namespace SplitPdfDemo
{
    internal class Program
    {
        static void Main(string[] args)
        {
            PdfDocument pdf = new PdfDocument();
            pdf.LoadFromFile("D:\\测试文档.pdf");
            // 注意:模板里必须写 {0},这是编号占位符
            // 比如 "page_{0}.pdf" 会生成 page_1.pdf, page_2.pdf ...
            pdf.Split("C:\\output\\page_{0}.pdf", 1);
            pdf.Close();
            Console.WriteLine("拆分完成,请去 output 文件夹查看");
        }
    }
}

一点小经验Split 方法的第二个参数 startNumber,实际推荐填 1,这样文件名看起来更自然。如果填 0,第一个文件就会变成 page_0.pdf,容易让人困惑。

每 N 页合并成一个 PDF(比如每 3 页一个文件)

有时候需要的是“每几页合成一个文件”,而不是“每页一个文件”。比如扫描仪设置成了连续进纸,每 3 页是一份合同,拆分时就需要按 3 页一组来切。

这种情况 Split 就不管用了,得自己动手循环。

using Spire.Pdf;
using System;
namespace SplitPdf
{
    internal class Program
    {
        static void Main(string[] args)
        {
            string inputFile = "sample.pdf";
            int pagesPerGroup = 3;              // 每3页一组
            string outputPattern = "Group_{0}.pdf";
            PdfDocument source = new PdfDocument();
            source.LoadFromFile(inputFile);
            int totalPages = source.Pages.Count;
            int groupCount = (int)Math.Ceiling((double)totalPages / pagesPerGroup);
            for (int g = 0; g < groupCount; g++)
            {
                PdfDocument groupDoc = new PdfDocument();
                int startIdx = g * pagesPerGroup;                // 起始索引(0基)
                int endIdx = Math.Min(startIdx + pagesPerGroup - 1, totalPages - 1);
                for (int i = startIdx; i <= endIdx; i++)
                {
                    groupDoc.InsertPage(source, source.Pages[i]);
                }
                string outputFile = string.Format(outputPattern, g + 1);
                groupDoc.Sa veToFile(outputFile);
                groupDoc.Close();
                Console.WriteLine($"已生成:{outputFile}");
            }
            source.Close();
            Console.WriteLine($"全部完成,共生成 {groupCount} 个文件");
        }
    }
}

其他常用拆分玩法

提取不连续的几页(例如第 2、5、7 页)

有时只需要抽几页出来做成一个新 PDF,比如从合同里只把签字页拿出来。

PdfDocument source = new PdfDocument();
source.LoadFromFile("合同.pdf");
PdfDocument result = new PdfDocument();
int[] wantedPages = { 2, 5, 7 };   // 这里的数字是页码(从1开始)
foreach (int pageNum in wantedPages)
{
    // 注意:Pages 集合的索引是从0开始的,所以要减1
    if (pageNum >= 1 && pageNum <= source.Pages.Count)
    {
        result.InsertPage(source, source.Pages[pageNum - 1]);
    }
    else
    {
        Console.WriteLine($"警告:第{pageNum}页不存在,已跳过");
    }
}
result.Sa veToFile("提取的签字页.pdf");
result.Close();
source.Close();

一个小坑:如果传入的页码超出范围,代码不会自动报错,只是那页不会被复制。所以最好加一个 if 判断并打印警告,避免“以为复制了、其实没有”的情况。

提取所有奇数页 / 偶数页

比如一份双面扫描的文档,想把奇数页和偶数页分开处理。

PdfDocument source = new PdfDocument();
source.LoadFromFile("双面扫描件.pdf");
PdfDocument oddPages = new PdfDocument();   // 奇数页(第1、3、5...)
PdfDocument evenPages = new PdfDocument();  // 偶数页(第2、4、6...)
for (int i = 0; i < source.Pages.Count; i++)   // i 是0基索引
{
    // 第1页的索引是0,第2页索引是1,依此类推
    if (i % 2 == 0)
        oddPages.InsertPage(source, source.Pages[i]);
    else
        evenPages.InsertPage(source, source.Pages[i]);
}
oddPages.Sa veToFile("奇数页.pdf");
evenPages.Sa veToFile("偶数页.pdf");
oddPages.Close();
evenPages.Close();
source.Close();

这里容易混淆的是:索引 i=0 对应第1页(奇数页),所以 i%2==0 取出的是奇数页。

和其他库简单对比一下

许可

优点

缺点

Free Spire.PDF

免费社区版

API 很直观,不需要装 Adobe,页面复制时注释、表单、书签都保留得不错。

10页限制,超过就截断(这是硬伤)

iTextSharp

AGPL

功能最强,工业级。

AGPL 许可证对商业项目很不友好,想商用必须买授权,而且配置略繁琐。

PdfSharp

MIT

完全免费无限制,轻量。

页面复制的效果一般,有些复杂元素(比如某些字体或透明度)会丢失。

如果只是偶尔处理一些不超过10页的 PDF,Free Spire.PDF 用起来最省心。如果经常处理几十页的文件又不想花钱,可以试试 PdfSharp,但要做好“部分样式可能丢失”的心理准备。

方法补充

在 C# 中拆分 PDF 文件的需求多种多样,例如从多页 PDF 中提取某一页、将大文件按固定页数分成多个小文件、或者按页码列表提取特定页面。下面展示使用 PdfSharp(免费开源,推荐)、iTextSharp(LGPL/AGPL,需注意许可)和 Spire.PDF(商业库,功能丰富)这三种库,实现常见的拆分场景。

提醒:生产环境建议优先使用 PdfSharp(MIT 协议)或购买商业库。iTextSharp 的 AGPL 协议要求公开源代码,需谨慎使用。

使用 PdfSharp(免费、轻量)

PdfSharp 是一款纯 .NET 的 PDF 操作库,无需安装 Adobe 软件,支持 .NET Framework / .NET Core。

安装 NuGet 包

Install-Package PdfSharp

场景1:按单页拆分(每页保存为一个单独的 PDF)

using PdfSharp.Pdf;
using PdfSharp.Pdf.IO;
public static void SplitPdfByPage(string inputFile, string outputFolder)
{
    // 打开源 PDF 文档
    PdfDocument inputDocument = PdfReader.Open(inputFile, PdfDocumentOpenMode.Import);
    for (int i = 0; i < inputDocument.PageCount; i++)
    {
        // 创建一个新文档
        PdfDocument outputDocument = new PdfDocument();
        // 导入第 i 页(PdfSharp 的页码从 1 开始,但 AddPage 需传入页面对象)
        outputDocument.AddPage(inputDocument.Pages[i]);
        // 保存为独立文件
        string outputFile = Path.Combine(outputFolder, $"page_{i + 1}.pdf");
        outputDocument.Sa ve(outputFile);
    }
}

场景2:拆分页码范围(例如第 3-5 页)

public static void SplitPageRange(string inputFile, string outputFile, int startPage, int endPage)
{
    using (PdfDocument input = PdfReader.Open(inputFile, PdfDocumentOpenMode.Import))
    {
        PdfDocument output = new PdfDocument();
        for (int i = startPage - 1; i < endPage && i < input.PageCount; i++)
        {
            output.AddPage(input.Pages[i]);
        }
        output.Sa ve(outputFile);
    }
}

场景3:按固定页数拆分(如每 10 页一个文件)

public static void SplitByChunkSize(string inputFile, int chunkSize)
{
    using (PdfDocument input = PdfReader.Open(inputFile, PdfDocumentOpenMode.Import))
    {
        int totalPages = input.PageCount;
        for (int start = 0; start < totalPages; start += chunkSize)
        {
            PdfDocument chunkDoc = new PdfDocument();
            int end = Math.Min(start + chunkSize, totalPages);
            for (int i = start; i < end; i++)
            {
                chunkDoc.AddPage(input.Pages[i]);
            }
            chunkDoc.Sa ve($"chunk_{start / chunkSize + 1}.pdf");
        }
    }
}

使用 iText 7(功能强大,注意许可)

iText 7 是业界标准,但 AGPL 许可证要求开源,商业使用需购买许可。

安装 NuGet 包

Install-Package itext7

场景:提取指定页面列表(例如第 1,3,5 页)

using iText.Kernel.Pdf;
public static void ExtractPagesList(string inputFile, string outputFile, List pageNumbers)
{
    using (PdfDocument pdfDoc = new PdfDocument(new PdfReader(inputFile)))
    using (PdfDocument outDoc = new PdfDocument(new PdfWriter(outputFile)))
    {
        foreach (int pageNum in pageNumbers)
        {
            // iText 页码从 1 开始
            PdfPage page = pdfDoc.GetPage(pageNum);
            outDoc.AddPage(page.CopyTo(outDoc));
        }
    }
}

使用 Spire.PDF(商业库,功能最全)

Spire.PDF 提供丰富的 API,免费版有页数限制。

安装 NuGet 包

Install-Package Spire.PDF

场景:根据书签拆分(按章节拆分)

using Spire.Pdf;
using Spire.Pdf.Bookmarks;
public static void SplitByBookmarks(string inputFile)
{
    PdfDocument doc = new PdfDocument();
    doc.LoadFromFile(inputFile);
    PdfBookmarkCollection bookmarks = doc.Bookmarks;
    for (int i = 0; i < bookmarks.Count; i++)
    {
        PdfDocument newDoc = new PdfDocument();
        int startPage = bookmarks[i].Destination.PageNumber;
        int endPage = (i == bookmarks.Count - 1) ? doc.Pages.Count : bookmarks[i + 1].Destination.PageNumber - 1;
        // 复制页面
        for (int p = startPage; p <= endPage; p++)
        {
            newDoc.InsertPage(newDoc.Pages.Count, doc.Pages[p - 1]);  // Spire 页码从 1 开始
        }
        newDoc.Sa veToFile($"chapter_{i + 1}.pdf");
    }
}

总结

需求

使用方法

核心 API

每页单独保存

pdf.Split("pattern_{0}.pdf", 1)

内置 Split

每 N 页合为一个文件

手动循环 + InsertPage

PdfDocument.InsertPage

按指定页码提取

手动筛选 + InsertPage

同上

掌握上述模式后,可以灵活组合出满足各种业务规则的 PDF 拆分逻辑。代码均已在实际项目中验证,可直接复用。

本文内容来源于互联网,如有侵权请联系删除。
作者最新文章
编程开发
相关文章 更多
精品专题 更多
本月促销

正软商城本月促销专区,汇集办公、设计、安全、影音、系统工具及AI软件等正版软件优惠活动,提供限时折扣、特价授权和优惠购买信息,活动库存及价格以页面实时展示为准。

装机必备

正软商城装机必备专区,精选办公、浏览器、安全防护、影音播放、压缩解压、设计创作和系统工具等电脑常用正版软件,帮助用户快速完成新电脑软件配置。

Windows

正软商城Windows软件专区,汇集适用于Windows电脑的办公、设计、安全防护、影音播放、开发工具和系统优化软件,提供软件介绍、系统要求、正版授权及购买下载服务。

macOS软件

正软商城macOS软件专区,精选适用于Mac电脑的办公、设计、影音、效率、开发和系统工具,提供软件功能介绍、macOS兼容版本、正版授权及购买下载服务。

IOS软件

正软商城iOS软件专区,精选适用于iPhone和iPad的办公、学习、影音、设计、效率及AI应用,提供功能介绍、适用设备、系统要求和正版获取方式等信息。

AI

正软商城AI软件专区,汇集AI写作、AI绘画、AI视频、AI办公、AI编程、AI翻译、智能客服和数据分析等人工智能工具,提供功能介绍、适用平台、收费方式及正版购买信息。

PDF教程

正软商城PDF教程频道提供PDF编辑、转换、合并、拆分、压缩及格式处理方法,同时介绍常用PDF软件和工具的使用技巧。

Mac软件 更多
灵活计算器
灵活计算器

灵活计算器是一款笔记式算数应用,支持实时计算、动态关联和云端同步功能。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

赤友清理大师
赤友清理大师

赤友清理大师是一款为 Mac 设计的智能清理优化工具,可精准扫描垃圾、大文件、重复文件等,释放磁盘空间。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

极度公式
极度公式

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

图几
图几

图几是一款适用于 macOS 的截图、标注与美化工具,支持离线操作保障隐私。界面整理和高频系统操作被放到一起考虑,桌面或窗口内容一多时,管理起来会更省心。

密码键盘
密码键盘

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。

思源笔记
思源笔记

思源笔记是一款本地笔记软件,提供所见即所得的编辑方式,为长文写作带来顺滑的体验。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

Office 365 简体中文
Office 365 简体中文

一款文字处理软件,一种订阅式的跨平台办公软件,基于云平台提供多种服务,通过将 Excel 和 Outlook 等应用与 OneDrive 和 Microsoft Teams 等强大的云服务相结合,Office 365 可让任何人使用任何设备随时随地创建和共享内容。

WALTR PRO
WALTR PRO

WALTR是一款电脑至iOS文件传输转换工具,操作简单,快速实现文件识别与传送。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

CodeExpander
CodeExpander

CodeExpander 是一款快捷短语输入增强工具,通过键入缩写自动展开为自定义文段,提升工作效率。任务管理和过程控制会更完整,持续下载、批量同步或需要稳定传输流程的场景会更适合它。

Mountain Duck
Mountain Duck

Mountain Duck 是一款能将多个网盘挂载到本地的工具,像本地磁盘一样使用网盘。清理链路的完整性会更好一些,做应用卸载、残留处理和空间整理时,通常能少走很多手动排查步骤。

Menuist
Menuist

Menuist 是一款面向 macOS 的 Finder 右键菜单增强工具,主要用来补充新建文件、快捷导航等常用操作,让日常文件管理和访问路径时更高效、更顺手。

Mole
Mole

Mole 是一款专为 Mac 设计的深度清理优化工具,涵盖缓存清理、应用管理及实时状态监控等功能。清理链路的完整性会更好一些,做应用卸载、残留处理和空间整理时,通常能少走很多手动排查步骤。

WINDOWS 更多
Windows 10
Windows 10

Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

极度公式
极度公式

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

密码键盘
密码键盘

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。

思源笔记
思源笔记

思源笔记是一款本地笔记软件,提供所见即所得的编辑方式,为长文写作带来顺滑的体验。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

傲梅轻松备份
傲梅轻松备份

傲梅轻松备份是一款专业易用的数据备份软件,为重要数据提供安全保障。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。

Office 365 简体中文
Office 365 简体中文

一款文字处理软件,一种订阅式的跨平台办公软件,基于云平台提供多种服务,通过将 Excel 和 Outlook 等应用与 OneDrive 和 Microsoft Teams 等强大的云服务相结合,Office 365 可让任何人使用任何设备随时随地创建和共享内容。

Wise Folder Hider Pro
Wise Folder Hider Pro

Wise Folder Hider Pro 是一款专业级文件和文件夹隐藏加密软件,为私密数据添加多重保护。高频操作更强调就近处理,浏览、整理和跨目录移动文件时,来回切换和重复点击都会少很多。

WALTR PRO
WALTR PRO

WALTR是一款电脑至iOS文件传输转换工具,操作简单,快速实现文件识别与传送。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

CodeExpander
CodeExpander

CodeExpander 是一款快捷短语输入增强工具,通过键入缩写自动展开为自定义文段,提升工作效率。任务管理和过程控制会更完整,持续下载、批量同步或需要稳定传输流程的场景会更适合它。

PinStack
PinStack

PinStack是一款轻量级的Windows平台剪贴板管理工具,优化您的剪贴板使用体验。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

Mountain Duck
Mountain Duck

Mountain Duck 是一款能将多个网盘挂载到本地的工具,像本地磁盘一样使用网盘。清理链路的完整性会更好一些,做应用卸载、残留处理和空间整理时,通常能少走很多手动排查步骤。

Seer
Seer

Seer是一款在Win平台下的空格键功能增强效率工具,只需轻敲空格键,就能预览几乎任何格式的文件。它更适合把零散的小功能集中起来使用,处理高频琐碎任务时会更省事。