JavaScript使用pdf-lib在瀏覽器里實現(xiàn)PDF合并與拆分功能
在日常開發(fā)中,PDF 處理是一個常見的需求。無論是合并多份合同、提取指定頁面,還是在前端直接操作 PDF 文件,我們都希望在瀏覽器端就能完成,而不是依賴后端服務。
今天介紹一個輕量級的 JavaScript 庫 —— pdf-lib,它可以在瀏覽器和 Node.js 環(huán)境中對 PDF 進行各種操作,包括合并、拆分、旋轉(zhuǎn)、填寫表單等。
為什么選擇 pdf-lib?
| 特性 | 說明 |
|---|---|
| 純前端運行 | 無需后端,直接在瀏覽器中處理 PDF |
| 零依賴 | 不依賴原生插件或外部服務 |
| 功能豐富 | 支持合并、拆分、編輯、加密等 |
| TypeScript 支持 | 有完整的類型定義 |
| 體積小巧 | 壓縮后約 100KB 左右 |
相比后端方案(如 Python 的 PyPDF2、Java 的 iText),pdf-lib 的優(yōu)勢在于用戶體驗更流暢——用戶選擇文件后秒級出結(jié)果,無需等待上傳下載。
安裝與引入
npm 安裝
npm install pdf-lib
CDN 引入
<script src="https://unpkg.com/pdf-lib@1.17.1/dist/pdf-lib.min.js"></script>
基礎用法
import { PDFDocument } from 'pdf-lib';
?
// 讀取本地 PDF 文件
async function loadPdf(file) {
const arrayBuffer = await file.arrayBuffer();
const pdfDoc = await PDFDocument.load(arrayBuffer);
return pdfDoc;
}
實戰(zhàn)一:PDF 合并
需求:用戶上傳多份 PDF,按順序合并成一份文件。
import { PDFDocument } from 'pdf-lib';
?
/**
* 合并多個 PDF 文件
* @param {File[]} files - 用戶選擇的 PDF 文件列表
* @returns {Promise<Uint8Array>} 合并后的 PDF 數(shù)據(jù)
*/
async function mergePdfs(files) {
// 創(chuàng)建一個新的空白 PDF 文檔
const mergedPdf = await PDFDocument.create();
?
for (const file of files) {
const arrayBuffer = await file.arrayBuffer();
const pdf = await PDFDocument.load(arrayBuffer);
// 拷貝所有頁面到新文檔
const copiedPages = await mergedPdf.copyPages(pdf, pdf.getPageIndices());
copiedPages.forEach((page) => mergedPdf.addPage(page));
}
?
// 保存為 Uint8Array
return await mergedPdf.save();
}
?
// 下載合并后的文件
async function downloadMergedPdf(files) {
const pdfBytes = await mergePdfs(files);
const blob = new Blob([pdfBytes], { type: 'application/pdf' });
const url = URL.createObjectURL(blob);
const a = document.createElement('a');
a.href = url;
a.download = 'merged.pdf';
a.click();
URL.revokeObjectURL(url);
}
核心 API 解析
PDFDocument.create():創(chuàng)建空白 PDFPDFDocument.load(arrayBuffer):加載已有 PDFcopyPages(targetDoc, pageIndices):拷貝頁面(注意是異步的)addPage(page):添加頁面到文檔
實戰(zhàn)二:PDF 拆分
需求:從大文件中提取指定頁碼范圍,生成新的 PDF。
import { PDFDocument } from 'pdf-lib';
?
/**
* 提取 PDF 指定頁面
* @param {File} file - 源 PDF 文件
* @param {number[]} pageIndices - 要提取的頁碼索引(從0開始)
* @returns {Promise<Uint8Array>}
*/
async function splitPdf(file, pageIndices) {
const arrayBuffer = await file.arrayBuffer();
const srcPdf = await PDFDocument.load(arrayBuffer);
// 創(chuàng)建新文檔
const newPdf = await PDFDocument.create();
// 拷貝指定頁面
const copiedPages = await newPdf.copyPages(srcPdf, pageIndices);
copiedPages.forEach((page) => newPdf.addPage(page));
return await newPdf.save();
}
?
// 使用示例:提取第 2-5 頁(索引 1-4)
async function extractPages(file, startPage, endPage) {
const indices = [];
for (let i = startPage - 1; i < endPage; i++) {
indices.push(i);
}
return await splitPdf(file, indices);
}
進階:按固定頁數(shù)拆分
/**
* 將 PDF 按每 N 頁拆分成多個文件
*/
async function splitByPageCount(file, pagesPerFile) {
const arrayBuffer = await file.arrayBuffer();
const srcPdf = await PDFDocument.load(arrayBuffer);
const totalPages = srcPdf.getPageCount();
const results = [];
for (let i = 0; i < totalPages; i += pagesPerFile) {
const end = Math.min(i + pagesPerFile, totalPages);
const indices = Array.from({ length: end - i }, (_, j) => i + j);
const newPdf = await PDFDocument.create();
const copiedPages = await newPdf.copyPages(srcPdf, indices);
copiedPages.forEach((page) => newPdf.addPage(page));
results.push(await newPdf.save());
}
return results; // 返回多個 Uint8Array
}
一個簡單的 UI 示例
把上面的代碼封裝成一個簡單的網(wǎng)頁工具:
<!DOCTYPE html>
<html>
<head>
<meta charset="UTF-8">
<title>PDF 工具</title>
<script src="https://unpkg.com/pdf-lib@1.17.1/dist/pdf-lib.min.js"></script>
</head>
<body>
<h2>PDF 合并</h2>
<input type="file" id="mergeInput" multiple accept=".pdf">
<button onclick="handleMerge()">合并并下載</button>
?
<script>
const { PDFDocument } = PDFLib;
?
async function handleMerge() {
const files = document.getElementById('mergeInput').files;
if (files.length < 2) {
alert('請至少選擇兩個 PDF 文件');
return;
}
const mergedPdf = await PDFDocument.create();
for (const file of files) {
const bytes = await file.arrayBuffer();
const pdf = await PDFDocument.load(bytes);
const pages = await mergedPdf.copyPages(pdf, pdf.getPageIndices());
pages.forEach(p => mergedPdf.addPage(p));
}
const pdfBytes = await mergedPdf.save();
const blob = new Blob([pdfBytes], { type: 'application/pdf' });
const url = URL.createObjectURL(blob);
const a = document.createElement('a');
a.href = url;
a.download = 'merged.pdf';
a.click();
URL.revokeObjectURL(url);
}
</script>
</body>
</html>把上面代碼保存為 .html 文件,用瀏覽器打開就能直接用。
注意事項
- 大文件性能:pdf-lib 適合處理幾十 MB 以內(nèi)的 PDF,如果是幾百 MB 的掃描件,可能會有性能瓶頸
- 字體兼容:某些特殊字體嵌入的 PDF,合并后可能出現(xiàn)字體丟失
- 加密文件:受密碼保護的 PDF 需要先解密才能處理
不想寫代碼?
如果你只是想快速處理 PDF,不想搭建前端項目、寫代碼、調(diào)試兼容性問題,可以直接用現(xiàn)成的在線工具。


上面提到的合并、拆分功能,還有 PDF 轉(zhuǎn) Word、壓縮等常用操作,這個在線工具集都覆蓋了:
- ? 打開網(wǎng)頁直接用,不用下載軟件
- ? 無需注冊登錄
- ? 目前完全免費,沒有頁數(shù)限制
工具派:百度搜索:工具派,顯示的第一個就是
當然,如果你是開發(fā)者,想要把 PDF 功能集成到自己的項目里,pdf-lib 仍然是一個非常值得考慮的選擇。
以上就是JavaScript使用pdf-lib在瀏覽器里實現(xiàn)PDF合并與拆分功能的詳細內(nèi)容,更多關(guān)于JavaScript瀏覽器PDF合并與拆分的資料請關(guān)注腳本之家其它相關(guān)文章!
相關(guān)文章
微信小程序?qū)崿F(xiàn)發(fā)微博功能的示例代碼
這篇文章主要介紹了微信小程序?qū)崿F(xiàn)發(fā)微博功能,本文通過實例代碼給大家介紹的非常詳細,對大家的學習或工作具有一定的參考借鑒價值,需要的朋友可以參考下2020-06-06
JavaScript實現(xiàn)文本框中默認顯示背景圖片在獲得焦點后消失的方法
這篇文章主要介紹了JavaScript實現(xiàn)文本框中默認顯示背景圖片在獲得焦點后消失的方法,涉及javascript針對頁面元素樣式及屬性的相關(guān)操作技巧,需要的朋友可以參考下2015-07-07

