為什麼 PDF 壓縮後仍然很大?

理解文字型與掃描型 PDF 的差異,選擇壓縮預設,並瞭解某些 PDF 為什麼會返回原件,以及壓縮為何不會新增 OCR。

更新於 · FormatOwl

開啟 PDF 壓縮

PDF 中可能包含不同的資料

簡短的文字文件本身可能已經很小。掃描型 PDF 經常把每頁儲存為圖片,解析度和圖片編碼佔據很大一部分體積,因此相同頁數的兩個 PDF,可壓縮空間可能完全不同。

下方合成掃描樣例是一張鋪滿頁面的圖片,不含文字識別結果。它可用於測量圖片壓縮,但不能代表所有真實掃描文件。

按文件內容選擇預設

輕度壓縮最佳化檔案結構,均衡與強力還會最佳化支援的內嵌圖片。可以先用均衡,預覽檢查小字與細線,再在可讀性允許的情況下嘗試強力。

壓縮會保留現有文字,但不會新增 OCR。掃描圖片中的文字不會僅因 PDF 被壓縮而變成可選文字。

哪些情況應保留原件

已最佳化的檔案可能沒有多少壓縮空間;部分複雜圖片結構會保留,不會重寫。當無法生成有效且更小的結果時,FormatOwl 返回原件並提示,重複壓縮不能保證進一步縮小。

加密或帶數字簽名的 PDF 會被拒絕。分發結果前,請檢查表單、重要頁面與色彩。FormatOwl 不重新認證 PDF/A,也不保證所有特殊互動功能。

兩個單頁 PDF,使用同一強力預設

兩個單頁 PDF,使用同一強力預設
樣例輸入位元組數輸出位元組數
文字1,5781,147
合成掃描1,590,807531,720

2026 年 9 月 16 日使用生成內容進行本機實測。文字樣例只減少 431 位元組,掃描樣例的壓縮空間大得多。資料不代表對實際文件的保證,也不驗證 OCR 或歸檔規範。

相關工具

檔案上傳後由服務端處理。請在到期前下載,並保留重要原件。 使用與資料說明