일상 업무에서 PDF 파일이 너무 큰 문제는 빈번한 고질적 문제입니다. 이메일 첨부파일 용량 초과, 시스템 업로드 실패, 웹 페이지 로딩 지연—이는 종종 모두 같은 문제를 가리킵니다. PDF가 너무 크다는 것입니다. 이 글은 기본 원리에서 시작하여 PDF 압축의 기술적 방법, 매개변수 선택, 실용적 접근을 체계적으로 설명하여 효율적으로 PDF 크기를 줄이도록 돕습니다.
아직 파일 압축의 전체적인 개념에 익숙하지 않으시다면, 먼저 파일 압축 완전 가이드를 읽고 압축 기술의 기본 분류와 적용 시나리오를 이해하시기를 권장합니다.
1. PDF 파일이 왜 이렇게 큰가요?
과도하게 큰 PDF 문제를 해결하려면 먼저 크기의 원천을 이해해야 합니다. PDF는 본질적으로 컨테이너 포맷이며, 그 크기는 주로 다음 유형의 콘텐츠에 의해 결정됩니다.
1.1 포함된 이미지와 스캔 문서
이미지는 PDF 파일 크기의 가장 큰 원인입니다. 단일 300DPI 스캔 페이지는 2-5MB에 달할 수 있으며, 많은 스캐너가 기본적으로 600DPI 컬러 출력을 사용하므로 50페이지 문서는 쉽게 100MB를 초과합니다. 전자적으로 생성된 PDF라도 고해상도 제품 이미지와 스크린샷을 삽입하면 크기가 크게 증가합니다.
1.2 포함된 폰트
여러 기기에서 일관된 표시를 보장하기 위해 PDF는 폰트 파일을 포함합니다. 완전한 한자 폰트 세트는 10-20MB를 차지할 수 있으며, 여러 폰트가 포함되면 크기가 상당히 누적됩니다.
1.3 벡터 그래픽과 중복 객체
PDF 내의 벡터 그래픽(CAD 도면 내보내기 등)은 경로 복잡도에 따라 데이터량이 달라집니다. 또한 PDF에는 교체되었지만 삭제되지 않은 이전 이미지 버전, 숨겨진 레이어, 과도한 메타데이터 등 조용히 파일을 부풀리는 중복 객체가 포함될 수 있습니다.
2. 5가지 핵심 PDF 압축 기술
파일 크기의 원천을 이해하면 PDF 압축의 방향이 명확해집니다. 다음 5가지 기술은 각각 다른 측면에 초점을 맞추며 함께 사용할 때 가장 효과적입니다.
2.1 이미지 리샘플링
이것은 PDF 압축에서 가장 효과적인 단계입니다. 리샘플링의 핵심은 고해상도 이미지를 실제 표시에 필요한 해상도로 다운스케일링하는 것입니다. 화면 읽기에는 72-150DPI만 필요하고, 인쇄에는 일반적으로 300DPI가 필요하지만, 많은 스캔 문서는 기본적으로 600DPI를 사용합니다. 600DPI를 150DPI로 낮추면 이미지 데이터량을 약 90% 줄일 수 있습니다.
2.2 이미지 포맷 변환
PDF 내 이미지는 다른 인코딩 포맷을 사용할 수 있습니다. 무손실 FlateDecode(PNG와 유사)를 손실 DCTDecode(JPEG)로 변환하면 화질을 허용 가능한 수준으로 유지하면서 크기를 크게 줄일 수 있습니다. 이 단계는 대량의 사진이 포함된 PDF에 특히 효과적입니다.
2.3 폰트 서브셋
완전히 포함된 폰트는 모든 문자를 포함하지만, 폰트 서브셋은 문서에서 실제로 사용된 문자만 유지합니다. 한자 문서는 몇 백 자의 문자만 사용할 수 있으며, 서브셋 후 폰트 부분을 수십 MB에서 수십 KB로 압축할 수 있습니다. 이는 간과되기 쉽지만 PDF 크기 축소에 매우 효과적인 단계입니다.
2.4 중복 객체 제거
PDF 내 중복 데이터 정리: 참조되지 않은 이미지와 폰트 삭제, 메타데이터 스트림 압축, 숨겨진 레이어와 중복 객체 제거, 문서 버전 이력 정리. 이 단계는 무손실 작업으로 가시적 콘텐츠에 영향을 주지 않습니다.
2.5 PDF 선형화
선형화(Fast Web View)는 직접적으로 크기를 줄이지는 않지만 파일 구조를 재구성하여 PDF가 다운로드되는 동안 첫 페이지를 표시할 수 있게 합니다. 압축과 결합하면 대용량 파일의 웹 로딩 경험을 크게 개선할 수 있습니다.
3. 압축 수준 선택 가이드
용도에 따라 PDF 압축에 대한 허용 범위가 다릅니다. 크기와 화질의 균형을 맞추려면 적절한 매개변수를 선택하는 것이 중요합니다.
- 이메일 첨부파일: 10-25MB 이하를 목표로. 이미지를 150DPI로 낮추고, JPEG 품질 70%, 폰트 서브셋 활성화. 이것이 가장 일반적인 PDF 크기 축소 시나리오입니다.
- 웹 표시: 빠른 로딩을 우선. 이미지를 96-120DPI로 낮추고, JPEG 품질 60%, 선형화 활성화.
- 고품질 인쇄: 300DPI 유지, 과도한 이미지 압축을 피하고 폰트 서브셋과 중복 객체 제거를 주로 활용하여 크기 축소.
- 장기 보관: 무손실 전략을 우선—중복 객체 제거와 폰트 서브셋만 수행하고 원본 이미지 해상도를 유지하여 파일이 장기적으로 충실하게 재현될 수 있도록 보장.
4. 온라인 압축과 로컬 압축의 보안 차이
PDF 압축 도구는 주로 온라인 서비스와 로컬 소프트웨어로 나뉘며, 두 가지 간의 보안 차이에 주의할 필요가 있습니다.
온라인 압축은 편리하고 설치가 필요 없지만 파일을 서버에 업로드해야 합니다. 계약서, 재무제표, 개인 신분증 등 민감한 정보를 포함한 PDF를 업로드하면 데이터 유출 위험이 있습니다. 일부 온라인 서비스는 파일 크기와 사용 빈도 제한도 있습니다.
로컬 압축은 보안상 이점이 있으며, 전체 과정에서 파일이 기기를 떠나지 않습니다. SmartSlim과 같은 로컬 압축 도구는 배치 처리와 사용자 정의 매개변수를 지원하여 PDF 압축을 자주 필요로 하는 사용자에게 더 신뢰할 수 있는 선택입니다. 이미지와 비디오 압축 요구도 있으시다면 이미지 압축 가이드와 비디오 압축 가이드를 참조하십시오.
5. 사례 연구: 80MB 스캔 PDF를 10MB로 압축
다음은 실제 압축 사례입니다. 80MB 스캔 계약서 PDF(60페이지, 600DPI 컬러 스캔)를 이메일 전송을 위해 10MB 이하로 압축하는 것이 목표였습니다.
매개변수 구성:
- 이미지 리샘플링: 600DPI를 150DPI로 축소(흑백 페이지는 선명도를 위해 200DPI 유지 가능)
- 포맷 변환: FlateDecode를 DCTDecode(JPEG)로 변환, 품질 72% 설정
- 폰트 서브셋: 활성화(스캔 문서에 OCR 인식 레이어가 포함되어 있으며 서브셋으로 중복 문자 제거 가능)
- 중복 제거: 스캔 중 생성된 중복 객체와 메타데이터 정리
- 그레이스케일 처리: 컬러 페이지를 그레이스케일로 변환(계약서 텍스트는 컬러가 필요 없음)
최종 결과: 8.2MB, 약 90% 압축률, 텍스트가 선명하게 읽히며 이메일 전송 요건 충족. PDF 압축 과정에서 이미지 리샘플링과 포맷 변환이 크기 축소의 약 80%를 기여했습니다.
6. 일반적인 PDF 압축 오해
오해 1: 압축은 아카이빙과 같다. 많은 사람이 ZIP 아카이빙과 PDF 압축을 혼동합니다. ZIP은 전체 파일을 무손실로 패키징하지만, PDF 압축은 내부 객체를 개별적으로 최적화합니다. 100MB PDF를 ZIP으로 압축하면 2-3MB만 줄어들 수 있지만, 적절한 PDF 압축으로는 80% 이상 줄일 수 있습니다.
오해 2: 압축은 필연적으로 화질이 저하된다. 폰트 서브셋과 중복 객체 제거는 모두 시각적 화질에 영향을 주지 않는 무손실 작업입니다. 이미지 리샘플링과 포맷 변환만이 손실 압축이며, 합리적인 매개변수를 사용하면 육안으로는 거의 차이를 느낄 수 없습니다.
오해 3: 압축률이 높을수록 좋다. 과도한 압축은 텍스트가 흐려지고 이미지에 블록 아티팩트가 발생합니다. PDF 크기 축소는 "적당한 수준"의 원칙을 따라야 하며, 용도에 따라 매개변수를 선택해야지 맹목적으로 최소 크기를 추구해서는 안 됩니다.
7. 자주 묻는 질문 (FAQ)
압축 후 PDF가 더 커진 이유는 무엇인가요?
이미 고도로 압축된 PDF에서 자주 발생합니다. 내부 이미지가 이미 저해상도 JPEG인 경우, 압축 중 재인코딩으로 인해 추가 오버헤드가 발생할 수 있습니다. 중복 객체 제거와 폰트 서브셋 같은 무손실 작업을 우선하고, 이미 압축된 이미지의 반복 손실 압축을 피할 것을 권장합니다.
압축된 PDF 화질을 복원할 수 있나요?
아니요. 이미지 리샘플링과 손실 포맷 변환은 되돌릴 수 없습니다. 해상도가 한번 낮아지면 잃어버린 디테일은 복원할 수 없습니다. 원본 파일을 보관하고 압축본을 새 파일로 저장할 것을 권장합니다. 중요 문서는 먼저 무손실 압축을 시도하고 부족할 경우 손실 압축을 고려하십시오.
스캔 PDF를 압축하는 가장 좋은 방법은 무엇인가요?
스캔 문서는 PDF 압축이 가장 효과적인 시나리오입니다. 핵심 단계는 DPI를 150-200으로 낮추고, 컬러를 그레이스케일로 변환하며, JPEG 인코딩을 사용하는 것입니다. 순흑백 텍스트 문서의 경우 1비트 흑백 이미지로 변환하고 CCITT G4 인코딩을 사용하면 파일 크기를 추가로 절반으로 줄일 수 있습니다.
인터넷 연결 없이 PDF를 압축할 수 있는 방법이 있나요?
네. SmartSlim과 같은 로컬 압축 소프트웨어는 완전히 오프라인으로 실행되며, 파일이 네트워크를 통해 전송되지 않습니다. 이러한 도구는 사용자 정의 압축 매개변수를 지원하며 분류 또는 개인 문서 처리에 적합합니다. 기업 사용자는 대량의 PDF 파일을 배치 처리할 수도 있습니다.
결론
PDF 압축의 핵심은 파일 크기의 원천을 이해하고 그에 맞게 대응하는 것입니다. 이미지 리샘플링과 포맷 변환이 크기 축소의 주요 수단이며, 폰트 서브셋과 중복 제거가 무손실 최적화의 핵심입니다. 이메일, 웹, 인쇄, 보관 등 다양한 시나리오에 맞는 압축 매개변수를 선택하는 것이 크기와 화질의 최적 균형을 달성하는 데 필수적입니다.
관련 글: