為什麼 PDF 壓縮後仍然很大?
理解文字型與掃描型 PDF 的差異,選擇壓縮預設,並瞭解某些 PDF 為什麼會返回原件,以及壓縮為何不會新增 OCR。
更新於 · FormatOwl
開啟 PDF 壓縮PDF 中可能包含不同的資料
簡短的文字文件本身可能已經很小。掃描型 PDF 經常把每頁儲存為圖片,解析度和圖片編碼佔據很大一部分體積,因此相同頁數的兩個 PDF,可壓縮空間可能完全不同。
下方合成掃描樣例是一張鋪滿頁面的圖片,不含文字識別結果。它可用於測量圖片壓縮,但不能代表所有真實掃描文件。
按文件內容選擇預設
輕度壓縮最佳化檔案結構,均衡與強力還會最佳化支援的內嵌圖片。可以先用均衡,預覽檢查小字與細線,再在可讀性允許的情況下嘗試強力。
壓縮會保留現有文字,但不會新增 OCR。掃描圖片中的文字不會僅因 PDF 被壓縮而變成可選文字。
哪些情況應保留原件
已最佳化的檔案可能沒有多少壓縮空間;部分複雜圖片結構會保留,不會重寫。當無法生成有效且更小的結果時,FormatOwl 返回原件並提示,重複壓縮不能保證進一步縮小。
加密或帶數字簽名的 PDF 會被拒絕。分發結果前,請檢查表單、重要頁面與色彩。FormatOwl 不重新認證 PDF/A,也不保證所有特殊互動功能。
兩個單頁 PDF,使用同一強力預設
| 樣例 | 輸入位元組數 | 輸出位元組數 |
|---|---|---|
| 文字 | 1,578 | 1,147 |
| 合成掃描 | 1,590,807 | 531,720 |
2026 年 9 月 16 日使用生成內容進行本機實測。文字樣例只減少 431 位元組,掃描樣例的壓縮空間大得多。資料不代表對實際文件的保證,也不驗證 OCR 或歸檔規範。
相關工具
檔案上傳後由服務端處理。請在到期前下載,並保留重要原件。 使用與資料說明