PDF 압축 vs ZIP: 어느 쪽이 실제로 크기를 줄이나요?
PDF를 ZIP으로 압축하면 크기가 거의 줄지 않습니다 — 대부분의 PDF가 내부적으로 이미 압축되어 있기 때문입니다. PDF 압축이 훨씬 더 효과적입니다. 두 가지가 왜 그렇게 다르게 작동하는지, ZIP이 여전히 도움이 되는 경우, 그리고 PDF를 실제로 줄이는 방법을 알아보세요.
짧은 답
PDF를 ZIP으로 압축하면 거의 도움되지 않는 이유
PDF는 raw 문서가 아닙니다 — 내부 스트림(페이지 설명, 이미지, 글꼴)이 ZIP이 사용하는 것과 같은 알고리즘인 Flate(zlib)로 이미 압축된 컨테이너입니다. PDF를 ZIP에 넣으면, 본질적으로 이미 압축된 데이터를 압축하는 것입니다. 압축된 데이터는 높은 엔트로피를 가지며 두 번째 패스가 제거할 중복이 거의 없습니다.
실천에서, 일반적인 PDF를 ZIP으로 압축하면 0–5%를 절약합니다. 압축되지 않은 몇 킬로바이트의 메타데이터 및 압축되지 않은 PDF 헤더가 ZIP이 활용할 수 있는 전부입니다. 파일의 대부분 — 이미 압축된 스트림 — 은 그대로 통과합니다.
메커니즘
PDF가 내부적으로 압축되는 방법
현대 PDF는 여러 독립적인 방법으로 내용을 압축합니다:
- Flate 스트림 — 페이지 내용, 글꼴 및 많은 객체가 ZIP이 사용하는 것과 같은 zlib 압축으로 감싸집니다.
- JPEG 이미지 — 사진은 이미 압축된 JPEG로 저장되며, 이 자체가 손실 코덱입니다.
- 객체 스트림 (PDF 1.5+) — 작은 구조적 객체가 단일 압축 스트림에 패키징됩니다.
- JBIG2 / CCITT — 비트onal 스캔된 텍스트는 일반 zlib를 능가하는 특수 코덱을 사용합니다.
큰 작업이 PDF 내에서 이미 이루어졌기에, 외부 ZIP 래퍼는 압축할 것이 거의 없습니다. 각 메커니즘에 대한 자세한 내용은PDF 압축 설명을 참조하세요.
대안
PDF 압축이 실제로 하는 것
PDF 압축 도구는 컨테이너 내부에서 작업합니다. 객체 스트림으로 PDF를 다시 저장하고, 참조되지 않은 객체를 제거하며, 교차 참조 테이블을 압축합니다. 이들은 오버헤드가 파일 수준이 아닌 PDF 자체 스트림에 있기에 ZIP이 도달할 수 없는 실제 오버헤드를 제거하는 구조적 변경입니다.
결과: 오래된 PDF에서 압축 패스는 종종 10–40%를 절약하지만, 같은 파일을 ZIP으로 압축하면 기껏해야 몇 퍼센트를 절약합니다.PDF 압축 도구로 실제 파일에서 시도해 볼 수 있습니다 — 브라우저에서 로컬로 실행되어 아무것도 업로드되지 않습니다.
예외
ZIP이 여전히 유용한 경우
ZIP이 PDF에 쓸모없는 것은 아닙니다 — 단지 PDF의 크기 감소 도구가 아닐 뿐입니다. ZIP은 다음을 원할 때 유용합니다:
- 여러 PDF를 단일 다운로드 가능 파일로 묶기. 단일 첨부 파일의 편의가 미미한 크기 이득보다 중요.
- 폴더 구조 보존 (예: 하위 폴더에 장이 있는 프로젝트).
- 비밀번호 보호. ZIP은 비밀번호 암호화를 지원합니다(약하지만 널리 지원됨). PDF는 PDF 보호를 통해 자체 암호화를 가지며, 일반적으로 더 강력합니다.
- 압축되지 않은 PDF 보내기 (드묾). PDF가 내부 압축 없이 구축되었다면, ZIP이 도움될 것 — 하지만 거의 모든 현대 PDF가 이렇게 구축되지 않습니다.
실천에서
PDF를 실제로 줄이는 방법
시도
할 수 있는 빠른 테스트
수중에 있는 임의의 PDF를 가져와 두 가지를 시도하세요:PDF 압축으로 압축하고, 시스템의 내장 아카이버로 원본을 ZIP으로 압축합니다. 세 크기 — 원본, 압축, ZIP — 를 비교합니다. 거의 모든 경우, 압축된 PDF가 가장 작고, ZIP의 PDF는 원본의 몇 퍼센트 이내이며, 둘 사이의 차이가 PDF가 지니고 있던 구조적 여유의 실제 측정입니다.
압축 및 ZIP 크기가 거의 동일하면, PDF가 이미 잘 최적화되어 얻을 것이 거의 없습니다. 압축 크기가 훨씬 더 작으면, 원본 내보내기 도구가 구조를 남겨둔 것입니다 — 같은 원본에서 새 PDF를 생성할 때마다 압축이 가치가 있습니다.
더 읽기