PDF 압축이 작동하는 방식과 일부 파일이 거의 줄어들지 않는 이유
PDF 압축은 주로 파일 내의 이미지를 재인코딩하는 것을 의미하므로, 결과는 파일에 포함된 내용에 크게 좌우됩니다.
무손실 압축과 손실 압축 비교
무손실 압축은 정보를 버리지 않고 중복 데이터를 제거하며, 텍스트와 구조에 유용하지만 파일을 얼마나 줄일 수 있는지에 한계가 있습니다. 손실 압축은 사진과 스캔에 사용되며 훨씬 더 작은 파일을 위해 일부 시각적 세부 사항을 버립니다. 압축된 PDF의 크기 감소 대부분은 주변 텍스트나 레이아웃이 아닌 손실 이미지 재인코딩에서 비롯됩니다.
이미지 압축과 품질
1에서 100까지의 품질 설정이 손실 이미지 인코더가 유지하는 세부 정보의 양을 제어하며, 일반적인 기본값은 약 60입니다. 낮은 품질은 더 작은 파일과 더 눈에 띄는 아티팩트를 의미하며, 특히 날카로운 가장자리와 이미지 내의 세밀한 텍스트 주변에서 두드러집니다. 높은 품질은 세부 사항을 보존하지만 파일을 덜 줄입니다.
DPI와 다운샘플링
다운샘플링은 재인코딩 전에 너무 큰 삽입 이미지의 픽셀 치수를 줄여서, 페이지에 필요한 것보다 훨씬 높은 인쇄 해상도로 저장된 사진을 화면 보기나 표준 인쇄에 더 적합한 크기로 축소합니다. 이 단계만으로도 품질 설정과 독립적으로 파일 크기를 크게 줄일 수 있습니다.
스캔된 PDF vs 벡터 PDF vs 텍스트 PDF
스캔된 PDF는 본질적으로 페이지당 하나의 큰 이미지이므로 압축이 크기에 큰 영향을 미칩니다. 워드 프로세서에서 만든 텍스트만 있는 PDF는 삽입된 이미지 데이터가 거의 없거나 전혀 없어서, 재인코딩할 것이 거의 없기 때문에 이미지 재인코딩이 크기를 거의 바꾸지 않습니다. 차트나 선 그림과 같은 벡터 그래픽이 있는 PDF는 벡터 모양이 래스터 이미지가 아니기 때문에 압축 목적상 텍스트 PDF처럼 동작합니다.
품질 대 크기 절충
파일이 이미지로 가득 차 있을 때 시각적 비용 없이 파일을 줄이는 설정은 없습니다. 품질을 90에서 60으로 낮추면 일반적으로 적당한 시각적 손실로 눈에 띄는 크기 감소가 나타나며, 40 아래로 내려가면 텍스트가 많은 스캔에서 아티팩트가 나타나기 시작합니다. 적절한 설정은 출력이 화면에서 잘 보여야 하는지, 깨끗하게 인쇄되어야 하는지, 아니면 이메일이나 업로드를 위한 파일 크기 제한만 충족하면 되는지에 따라 달라집니다.
문서 유형별 일반적인 결과
- 스캔된 책 챕터 또는 계약서: 주로 큰 이미지로 구성되어 있어 크게 줄어드는 경우가 많음.
- 스크린샷과 사진이 포함된 슬라이드 덱: 스크린샷이 필요보다 클수록 더 많이 줄어듦.
- 텍스트와 간단한 표만 있는 워드 프로세서 보고서: 재인코딩할 것이 거의 없어 매우 조금 줄어듦.
- 고해상도 사진이 삽입된 디자인 파일: 다운샘플링이 대부분의 작업을 수행하여 잘 줄어듦.
문제 해결
파일이 별로 줄어들지 않았다면 텍스트만 또는 벡터만으로 구성되어 있을 가능성이 높으며, 압축이 실제로 작업할 것이 거의 없습니다. 결과가 흐릿해 보이면 해당 콘텐츠에는 품질 설정이 너무 공격적이었으므로 값을 높이고 다시 실행하세요. 압축 후에도 이메일 첨부 파일로 보내기에는 여전히 너무 크다면 한 번에 보낼 페이지를 줄이기 위해 Split PDF를 고려하거나, 색상 스캔의 경우 색상 데이터 제거가 도움이 될 수 있으므로 Grayscale PDF가 콘텐츠에 적합한지 확인하세요.
관련 도구
Compress PDF로 시작하여 품질 슬라이더를 원하는 대로 조정하세요. Resize PDF는 콘텐츠를 압축하는 것이 아니라 페이지 치수를 변경합니다. Compress Image는 소스 사진을 PDF에 넣기 전에 작업할 때 유용합니다. PDF to JPG는 압축된 PDF가 아닌 압축된 이미지가 필요할 때 페이지를 이미지로 내보냅니다. 페이지 치수와 픽셀 수가 dpi와 어떻게 관련되는지는 PDF page sizes guide를 참고하세요.