最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

C#實(shí)現(xiàn)精準(zhǔn)拆分PDF頁面(單頁/指定頁)的完整代碼

 更新時(shí)間:2026年04月30日 08:28:45   作者:LAYONTHEGROUND  
在 C# 中拆分 PDF 文件的需求多種多樣,例如從多頁 PDF 中提取某一頁、將大文件按固定頁數(shù)分成多個(gè)小文件、或者按頁碼列表提取特定頁面,下面我們就和大家詳細(xì)介紹一下具體的實(shí)現(xiàn)方法吧

在處理 PDF 文檔時(shí),“拆分頁面”可以說是最常遇到的需求之一。比如:一份幾十頁的報(bào)告,你只想要其中某一章;或者開會(huì)發(fā)的 PDF 會(huì)議紀(jì)要,需要按參會(huì)者姓名拆成單頁分別發(fā)郵件;又或者你剛把一份掃描件導(dǎo)出來,希望每一頁變成一個(gè)獨(dú)立的 PDF 文件……這些場景我都遇到過。

今天我就用 Free Spire.PDF for .NET 這個(gè)免費(fèi)庫,把 C# 里拆分 PDF 的各種姿勢(shì)都講一遍。代碼都是實(shí)際跑過的,你復(fù)制過去改改路徑就能用。

安裝:在 NuGet 包管理器里搜 FreeSpire.PDF 直接安裝就行。這是一個(gè)免費(fèi)社區(qū)版,唯一的限制是單次處理不能超過 10 頁,如果超過 10 頁,后面的頁會(huì)被悄悄截掉(不會(huì)報(bào)錯(cuò),但結(jié)果會(huì)少頁)。所以如果你只是偶爾處理小文件,這個(gè)庫很順手。

原理

拆 PDF 其實(shí)就四步:

  1. 把原 PDF 讀進(jìn)來
  2. 決定要拆出哪些頁(單頁、一個(gè)范圍、或者抽幾頁)
  3. 新建一個(gè)空的 PDF 對(duì)象,把選中的頁面“復(fù)制”進(jìn)去
  4. 保存成新文件

Free Spire.PDF 提供了一個(gè) PdfDocument 類,里面的 Pages 集合就像數(shù)組一樣,你可以按索引取出每一頁,然后插入到另一個(gè)文檔里。下面我會(huì)用實(shí)際代碼演示。

每一頁單獨(dú)存一個(gè) PDF

如果你的目標(biāo)就是“把一份 PDF 的每一頁拆成單獨(dú)的文件”,這個(gè)庫內(nèi)置了一個(gè) Split 方法,一行調(diào)用就能搞定。

using Spire.Pdf;
namespace SplitPdfDemo
{
    internal class Program
    {
        static void Main(string[] args)
        {
            PdfDocument pdf = new PdfDocument();
            pdf.LoadFromFile("D:\\測試文檔.pdf");
            // 注意:模板里必須寫 {0},這是編號(hào)占位符
            // 比如 "page_{0}.pdf" 會(huì)生成 page_1.pdf, page_2.pdf ...
            pdf.Split("C:\\output\\page_{0}.pdf", 1);
            pdf.Close();
            Console.WriteLine("拆分完成,請(qǐng)去 output 文件夾查看");
        }
    }
}

一點(diǎn)小經(jīng)驗(yàn)Split 方法第二個(gè)參數(shù) startNumber 我一般就填 1,這樣文件名看起來更自然。如果你填 0,第一個(gè)文件就會(huì)變成 page_0.pdf,容易引起困惑。

每 N 頁合并成一個(gè) PDF(比如每 3 頁一個(gè)文件)

有時(shí)候我們不是要“每頁一個(gè)文件”,而是“每幾頁合成一個(gè)文件”。比方說,你把掃描儀設(shè)置成了連續(xù)進(jìn)紙,每 3 頁是一份合同,那么拆分時(shí)就要按 3 頁一組來切。

這時(shí)候 Split 就不管用了,得我們自己動(dòng)手循環(huán)。

代碼

using Spire.Pdf;
using System;
namespace SplitPdf
{
    internal class Program
    {
        static void Main(string[] args)
        {
            string inputFile = "sample.pdf";
            int pagesPerGroup = 3;              // 每3頁一組
            string outputPattern = "Group_{0}.pdf";
            PdfDocument source = new PdfDocument();
            source.LoadFromFile(inputFile);
            int totalPages = source.Pages.Count;
            int groupCount = (int)Math.Ceiling((double)totalPages / pagesPerGroup);
            for (int g = 0; g < groupCount; g++)
            {
                PdfDocument groupDoc = new PdfDocument();
                int startIdx = g * pagesPerGroup;                // 起始索引(0基)
                int endIdx = Math.Min(startIdx + pagesPerGroup - 1, totalPages - 1);
                for (int i = startIdx; i <= endIdx; i++)
                {
                    groupDoc.InsertPage(source, source.Pages[i]);
                }
                string outputFile = string.Format(outputPattern, g + 1);
                groupDoc.SaveToFile(outputFile);
                groupDoc.Close();
                Console.WriteLine($"已生成:{outputFile}");
            }
            source.Close();
            Console.WriteLine($"全部完成,共生成 {groupCount} 個(gè)文件");
        }
    }
}

其他常用拆分玩法

提取不連續(xù)的幾頁(例如第 2、5、7 頁)

有時(shí)候你只想抽幾頁出來做成一個(gè)新 PDF,比如從合同里只把簽字頁拿出來。

PdfDocument source = new PdfDocument();
source.LoadFromFile("合同.pdf");
PdfDocument result = new PdfDocument();
int[] wantedPages = { 2, 5, 7 };   // 這里的數(shù)字是頁碼(從1開始)
foreach (int pageNum in wantedPages)
{
    // 注意:Pages 集合的索引是從0開始的,所以要減1
    if (pageNum >= 1 && pageNum <= source.Pages.Count)
    {
        result.InsertPage(source, source.Pages[pageNum - 1]);
    }
    else
    {
        Console.WriteLine($"警告:第{pageNum}頁不存在,已跳過");
    }
}
result.SaveToFile("提取的簽字頁.pdf");
result.Close();
source.Close();

一個(gè)小坑:如果你傳入的頁碼超出范圍,代碼不會(huì)自動(dòng)報(bào)錯(cuò),只是那頁不會(huì)被復(fù)制。所以我加了一個(gè) if 判斷并打印警告,避免你“以為復(fù)制了其實(shí)沒有”。

提取所有奇數(shù)頁 / 偶數(shù)頁

比如一份雙面掃描的文檔,你想把奇數(shù)頁和偶數(shù)頁分開處理。

PdfDocument source = new PdfDocument();
source.LoadFromFile("雙面掃描件.pdf");
PdfDocument oddPages = new PdfDocument();   // 奇數(shù)頁(第1、3、5...)
PdfDocument evenPages = new PdfDocument();  // 偶數(shù)頁(第2、4、6...)
for (int i = 0; i < source.Pages.Count; i++)   // i 是0基索引
{
    // 第1頁的索引是0,第2頁索引是1,依此類推
    if (i % 2 == 0)
        oddPages.InsertPage(source, source.Pages[i]);
    else
        evenPages.InsertPage(source, source.Pages[i]);
}
oddPages.SaveToFile("奇數(shù)頁.pdf");
evenPages.SaveToFile("偶數(shù)頁.pdf");
oddPages.Close();
evenPages.Close();
source.Close();

這里容易混淆的是:索引 i=0 對(duì)應(yīng)第1頁(奇數(shù)頁),所以 i%2==0 是奇數(shù)頁。

和其他庫簡單對(duì)比一下(個(gè)人感受)

許可優(yōu)點(diǎn)缺點(diǎn)
Free Spire.PDF免費(fèi)社區(qū)版API 很直觀,不需要裝 Adobe,頁面復(fù)制時(shí)注釋、表單、書簽都保留得不錯(cuò)。10頁限制,超過就截?cái)啵ㄟ@是硬傷)
iTextSharpAGPL功能最強(qiáng),工業(yè)級(jí)。AGPL 許可證對(duì)商業(yè)項(xiàng)目很不友好,想商用必須買授權(quán),而且配置略繁瑣。
PdfSharpMIT完全免費(fèi)無限制,輕量。頁面復(fù)制的效果一般,有些復(fù)雜元素(比如某些字體或透明度)會(huì)丟失。

我個(gè)人建議:如果你只是偶爾處理一些 ≤10 頁的 PDF,F(xiàn)ree Spire.PDF 最省心。如果經(jīng)常處理幾十頁的文件又不想花錢,可以試試 PdfSharp,但要做好“部分樣式丟失”的心理準(zhǔn)備。

方法補(bǔ)充

在 C# 中拆分 PDF 文件的需求多種多樣,例如從多頁 PDF 中提取某一頁、將大文件按固定頁數(shù)分成多個(gè)小文件、或者按頁碼列表提取特定頁面。本文將展示使用 PdfSharp(免費(fèi)開源,推薦)、iTextSharp(LGPL/AGPL,需注意許可)和 Spire.PDF(商業(yè)庫,功能豐富)這三種庫,實(shí)現(xiàn)常見的拆分場景。

提醒:生產(chǎn)環(huán)境建議優(yōu)先使用 PdfSharp(MIT 協(xié)議)或購買商業(yè)庫。iTextSharp 的 AGPL 協(xié)議要求公開源代碼,需謹(jǐn)慎使用。

使用 PdfSharp(免費(fèi)、輕量)

PdfSharp 是一款純 .NET 的 PDF 操作庫,無需安裝 Adobe 軟件,支持 .NET Framework / .NET Core。

安裝 NuGet 包

Install-Package PdfSharp

場景1:按單頁拆分(每頁保存為一個(gè)單獨(dú)的 PDF)

using PdfSharp.Pdf;
using PdfSharp.Pdf.IO;
public static void SplitPdfByPage(string inputFile, string outputFolder)
{
    // 打開源 PDF 文檔
    PdfDocument inputDocument = PdfReader.Open(inputFile, PdfDocumentOpenMode.Import);
    for (int i = 0; i < inputDocument.PageCount; i++)
    {
        // 創(chuàng)建一個(gè)新文檔
        PdfDocument outputDocument = new PdfDocument();
        // 導(dǎo)入第 i 頁(PdfSharp 的頁碼從 1 開始,但 AddPage 需傳入頁面對(duì)象)
        outputDocument.AddPage(inputDocument.Pages[i]);
        // 保存為獨(dú)立文件
        string outputFile = Path.Combine(outputFolder, $"page_{i + 1}.pdf");
        outputDocument.Save(outputFile);
    }
}

場景2:拆分頁碼范圍(例如第 3-5 頁)

public static void SplitPageRange(string inputFile, string outputFile, int startPage, int endPage)
{
    using (PdfDocument input = PdfReader.Open(inputFile, PdfDocumentOpenMode.Import))
    {
        PdfDocument output = new PdfDocument();
        for (int i = startPage - 1; i < endPage && i < input.PageCount; i++)
        {
            output.AddPage(input.Pages[i]);
        }
        output.Save(outputFile);
    }
}

場景3:按固定頁數(shù)拆分(如每 10 頁一個(gè)文件)

public static void SplitByChunkSize(string inputFile, int chunkSize)
{
    using (PdfDocument input = PdfReader.Open(inputFile, PdfDocumentOpenMode.Import))
    {
        int totalPages = input.PageCount;
        for (int start = 0; start < totalPages; start += chunkSize)
        {
            PdfDocument chunkDoc = new PdfDocument();
            int end = Math.Min(start + chunkSize, totalPages);
            for (int i = start; i < end; i++)
            {
                chunkDoc.AddPage(input.Pages[i]);
            }
            chunkDoc.Save($"chunk_{start / chunkSize + 1}.pdf");
        }
    }
}

使用 iText 7(功能強(qiáng)大,注意許可)

iText 7 是業(yè)界標(biāo)準(zhǔn),但 AGPL 許可證要求開源,商業(yè)使用需購買許可。

安裝 NuGet 包

Install-Package itext7

場景:提取指定頁面列表(例如第 1,3,5 頁)

using iText.Kernel.Pdf;
public static void ExtractPagesList(string inputFile, string outputFile, List<int> pageNumbers)
{
    using (PdfDocument pdfDoc = new PdfDocument(new PdfReader(inputFile)))
    using (PdfDocument outDoc = new PdfDocument(new PdfWriter(outputFile)))
    {
        foreach (int pageNum in pageNumbers)
        {
            // iText 頁碼從 1 開始
            PdfPage page = pdfDoc.GetPage(pageNum);
            outDoc.AddPage(page.CopyTo(outDoc));
        }
    }
}

使用 Spire.PDF(商業(yè)庫,功能最全)

Spire.PDF 提供豐富的 API,免費(fèi)版有頁數(shù)限制。

安裝 NuGet 包

Install-Package Spire.PDF

場景:根據(jù)書簽拆分(按章節(jié)拆分)

using Spire.Pdf;
using Spire.Pdf.Bookmarks;
public static void SplitByBookmarks(string inputFile)
{
    PdfDocument doc = new PdfDocument();
    doc.LoadFromFile(inputFile);
    PdfBookmarkCollection bookmarks = doc.Bookmarks;
    for (int i = 0; i < bookmarks.Count; i++)
    {
        PdfDocument newDoc = new PdfDocument();
        int startPage = bookmarks[i].Destination.PageNumber;
        int endPage = (i == bookmarks.Count - 1) ? doc.Pages.Count : bookmarks[i + 1].Destination.PageNumber - 1;
        // 復(fù)制頁面
        for (int p = startPage; p <= endPage; p++)
        {
            newDoc.InsertPage(newDoc.Pages.Count, doc.Pages[p - 1]);  // Spire 頁碼從 1 開始
        }
        newDoc.SaveToFile($"chapter_{i + 1}.pdf");
    }
}

總結(jié)

需求使用方法核心 API
每頁單獨(dú)保存pdf.Split("pattern_{0}.pdf", 1)內(nèi)置 Split
每 N 頁合為一個(gè)文件手動(dòng)循環(huán) + InsertPagePdfDocument.InsertPage
按指定頁碼提取手動(dòng)篩選 + InsertPage同上

掌握上述模式后,您可以靈活組合出滿足各種業(yè)務(wù)規(guī)則的 PDF 拆分邏輯。代碼均已在實(shí)際項(xiàng)目中驗(yàn)證,可直接復(fù)用。

到此這篇關(guān)于C#實(shí)現(xiàn)精準(zhǔn)拆分PDF頁面(單頁/指定頁)的完整代碼的文章就介紹到這了,更多相關(guān)C#拆分PDF內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

最新評(píng)論

景泰县| 文成县| 慈利县| 太保市| 贵定县| 江都市| 潞城市| 沛县| 阿拉善盟| 沂水县| 平原县| 平乡县| 循化| 旺苍县| 山东省| 双鸭山市| 灵宝市| 二连浩特市| 东山县| 朔州市| 嘉祥县| 玉田县| 漳浦县| 盐亭县| 丹凤县| 新昌县| 资中县| 泾川县| 新昌县| 祁门县| 浦北县| 丰都县| 南江县| 浪卡子县| 宣恩县| 宜章县| 云阳县| 秦安县| 定兴县| 油尖旺区| 靖宇县|