UGLYPEAR AI обновил бизнес: высокопроизводительное сжатие документов × RAG-платформа инженерии данныхУзнать о новом направлении →

Скан PDF слишком большой? Снижение DPI + перевод в JPEG на практике

Главный вывод: скан-PDF получается слишком большим потому, что более 90% объёма занимают высокое DPI сканирования и несжатый битовый формат. Решение — три шага: снизить DPI до 150, перевести BMP/несжатый формат в JPEG качества 75, добавить OCR-текстовый слой. 120-страничный скан цветного договора по этой схеме сжимается с 95 МБ до 3,2 МБ, текст остаётся чётким, копируемым и доступным для поиска. Ниже — источники объёма, параметры трёхшагового метода и дифференцированные стратегии для ч/б, серых и цветных сканов.

Если вы пока не знакомы с общими принципами сжатия PDF, рекомендуем сначала прочитать Принципы и методы сжатия PDF.

1. Почему скан-PDF получается таким большим

Скан-PDF по сути встраивает битовые изображения, сгенерированные сканером, в контейнер PDF постранично. В отличие от электронного PDF, каждая страница скана — полноценная картинка, и объём полностью определяется изображением. Поняв источники, можно точечно сжимать.

Источник объёмаТипичная доляПричинаПространство для сжатия
Высокий DPI сканирования50–65%300/600 DPI — пикселей намного больше, чем нужно для чтения★★★★★
Сжатие без потерь20–35%BMP / несжатый TIFF / FlateDecode — без сжатия с потерями★★★★★
Избыточный цвет5–15%Чистый текст сканируется в 24-битном цвете вместо 1-битного ч/б★★★★☆
Накопление по страницам5–10%Много страниц, избыточность суммируется★★★☆☆
Структурные накладки PDF1–3%Объекты страниц, таблица перекрёстных ссылок и пр.★☆☆☆☆

Из таблицы видно: высокий DPI и формат без потерь вместе дают более 80% — это главное поле сжатия. 120-страничный скан 300 DPI цвет: около 0,8 МБ на страницу, итого 95 МБ — но для чтения с экрана достаточно 150 DPI, после перевода в JPEG каждая страница станет 0,027 МБ, итого 3,2 МБ.

2. Подробно о трёхшаговом методе сжатия

Под источники объёма скан-PDF есть стандартизированный трёхшаговый метод. У каждого шага свой принцип, своя область применения и эффект — сначала общее сравнение, затем подробно по каждому.

ШагМетодПринципОжидаемое сжатиеВлияние на чёткость
1Снижение DPIУменьшение плотности пикселей50–75%Для экрана почти незаметно
2Смена форматаBMP/TIFF → JPEG80–95%При качестве 75 приемлемо для глаза
3OCR-текстовый слойДобавление поискового текста+5–10% к объёмуПовышает удобство

2.1. Снижение DPI (наибольший выигрыш)

DPI (точек на дюйм) задаёт плотность пикселей скана. Сканеры по умолчанию дают 300 или 600 DPI, но для экрана достаточно 96–150 DPI, для печати — 200–300 DPI. Снижение с 600 до 150 DPI уменьшает число пикселей в 16 раз, объём сразу падает на 94%. Снижение до 200 DPI даёт минус 89%.

Практика: откройте скан-PDF в SmartSlim, движок на Rust анализирует каждую страницу и автоматически выбирает оптимальный DPI по типу скана: ч/б текст — 200 DPI, серый — 150 DPI, цветной — 150 DPI. Снижение разрешения выполняется алгоритмом Lanczos для сохранения чёткости краёв, что избегает размытия текста от простого масштабирования.

Тип сканаИсходный DPIРекомендуемый DPIСнижение пикселейЧитаемость
Чёрно-белый текст30020056%Чётко и читаемо
Чёрно-белый текст60020089%Чётко и читаемо
Серый текст30015075%Чётко и читаемо
Цветной документ30015075%Цвет слегка бледный, приемлемо
Страница с цветным фото60020089%Детали чуть теряются

Подробнее о разнице между DPI и PPI см. DPI против PPI: разрешение при сканировании и печати.

2.2. Смена формата (наибольшее снижение)

Картинки в скан-PDF обычно используют три кодировки: FlateDecode (сжатие без потерь как в PNG), CCITT G4 (стандарт ч/б факса), DCTDecode (JPEG). Многие сканеры по умолчанию используют FlateDecode или вообще не сжимают (BMP), что даёт огромный объём. Перевод в JPEG качества 75 убирает 80–95% объёма.

У ч/б сканов есть ещё более удачный вариант — кодировка JBIG2. JBIG2 спроектирована специально для чёрно-белого текста: находит повторяющиеся глифы и сопоставляет по шаблонам, даёт на 50–70% меньше, чем CCITT G4. 100-страничный ч/б договор: FlateDecode ~40 МБ, CCITT G4 ~8 МБ, JBIG2 всего 2 МБ. SmartSlim автоматически распознаёт ч/б сканы и включает JBIG2.

КодировкаНазначениеОбъём 100 страницvs FlateDecode
FlateDecode (без потерь)Универсальная40 МББазовый
CCITT G4Ч/б8 МБ-80%
JBIG2Ч/б2 МБ-95%
JPEG q75Серый / цвет3,5 МБ-91%
JPEG q85Серый / цвет5,2 МБ-87%

2.3. OCR-текстовый слой (повышает удобство)

Скан-PDF по умолчанию — это картинка, в нём нельзя искать и копировать текст. OCR (оптическое распознавание символов) накладывает поверх изображения прозрачный текстовый слой, превращая скан в документ, доступный для поиска и копирования. Сам OCR-слой добавляет всего 5–10% к объёму, но сильно повышает удобство.

Дополнительная выгода OCR — помощь в сжатии: когда есть текстовый слой, картинку можно снижать до более низкого DPI (например, 100 DPI), потому что даже при размытии картинки текст всё равно доступен через текстовый слой. SmartSlim встроенный OCR — во время сжатия автоматически генерирует текстовый слой, поддерживает смешанное распознавание китайского и английского, точность выше 95%.

3. Практический кейс: 120-страничный скан-договор с 95 МБ до 3,2 МБ

Это корпоративный договор поставки, формат .pdf, исходный объём 95,4 МБ. 120 страниц A4, 300 DPI, цветной скан, кодировка FlateDecode. Нужно загрузить на платформу электронной подписи (лимит 10 МБ), цель — уложиться в 5 МБ.

Характеристики документа: 120 страниц A4, цветной скан, 300 DPI (каждая страница 2480×3508 пикселей), кодировка FlateDecode, около 0,8 МБ на страницу, без OCR-текстового слоя.

Параметры и изменение объёма:

ШагДействиеКлючевые параметрыИзменение объёма
1Снижение DPI300 DPI → 150 DPI, Lanczos95,4 → 28,6 МБ
2Цвет в серыйДоговор — чистый текст, 24-бит цвет → 8-бит серый28,6 → 12,4 МБ
3JPEG-кодированиеFlateDecode → JPEG q7512,4 → 3,0 МБ
4OCR-текстовый слойРаспознавание кит. и англ., наложение прозрачного текста3,0 → 3,2 МБ

Результат: 3,2 МБ, коэффициент сжатия около 29,8:1, экономия 96,6%. Значительно ниже лимита платформы в 10 МБ. Текст на экране чёткий и читаемый, печать на 150 DPI даёт хорошее качество, по всему документу работает поиск по ключевым словам, пункты договора можно копировать. Весь процесс выполнен локально, содержимое договора не проходило через сторонние серверы — соответствует требованиям конфиденциальности коммерческих договоров.

4. Дифференцированные стратегии для ч/б, серых и цветных сканов

У сканов с разным цветовым режимом оптимальная стратегия сжатия различается. Ниже сравнительные рекомендации для трёх типов.

Тип сканаТипичный сценарийРекомендуемый DPIРекомендуемая кодировкаОжидаемое сжатие
Ч/б (1 бит)Чисто текстовый договор/документ200JBIG295–98%
Серый (8 бит)С подписями/рукописными пометками150JPEG q7590–95%
Цветной (24 бита)Цветной документ/фотокопии150JPEG q7285–93%
СмешанныйДоговор + цветные вложенияПостраничноПостраничный выбор90–96%

Общий принцип: чистый текст — ч/б + JBIG2 (максимальное сжатие), с печатями — серый + JPEG, чистые цветные страницы — цвет + JPEG. SmartSlim анализирует цветовую сложность постранично и автоматически выбирает оптимальную кодировку: текстовые страницы — в ч/б JBIG2, страницы с печатями — в серый JPEG, цветные — в цветной JPEG, без единого подхода. Если вы тоже столкнулись с тем, что скан не отправляется по почте, см. PDF слишком большой и не отправляется по почте? 3 шага до 5 МБ.

5. Часто задаваемые вопросы (FAQ)

В1. Как сжать скан-PDF до 5 МБ?

По трёхшаговой схеме: снизить DPI до 150, перевести BMP/несжатый формат в JPEG качества 75, добавить OCR-текстовый слой. 120-страничный цветной скан-договор сжимается с 95 МБ до 3,2 МБ, текст чёткий, копируется и индексируется. Ключ — сначала снизить DPI (наибольшая доля), затем перевести в JPEG, и в конце добавить OCR-текстовый слой для удобства. Ч/б сканы дополнительно выигрывают от JBIG2 — объём ещё меньше.

В2. После снижения DPI текст в скан-PDF нечитаем — что делать?

Для чисто текстовых сканов 150 DPI достаточно для чёткого чтения и печати, при 100 DPI текст всё ещё узнаваем. Если текст нечитаем, обычно сам оригинал размыт или DPI снижен слишком сильно. Рекомендуем: ч/б текст — 200 DPI, серый текст — 150 DPI, цветной скан — 150 DPI. Можно также наложить фильтр повышения резкости для усиления краёв символов. SmartSlim автоматически распознаёт тип скана и подбирает DPI, избегая одинакового подхода, ведущего к размытию.

В3. Метод сжатия ч/б и цветных сканов одинаковый?

Нет. Для ч/б сканов рекомендуем JBIG2 (на 50–70% меньше CCITT G4), DPI можно снижать до 200 без потери чёткости; для серых сканов — JPEG q75, DPI 150; для цветных — JPEG q72, DPI 150, потери цвета приемлемы. Максимальное сжатие у ч/б (до 98%), у цветных — около 90–95%. SmartSlim по цветовому режиму автоматически выбирает оптимальную кодировку.

В4. Какая польза от OCR-текстового слоя в скан-PDF?

OCR-текстовый слой превращает скан из картинки в документ, по которому можно искать и из которого можно копировать. Польза тройная: 1) полнотекстовый поиск ключевых слов, не нужно листать страницы; 2) можно копировать текст в другие документы; 3) помогает сжатию — с текстовым слоем картинку можно снижать до более низкого DPI, а контент по-прежнему доступен через текстовый слой. Сам OCR-слой добавляет всего 5–10% к объёму, но сильно повышает удобство документа. SmartSlim встроенный OCR — при сжатии автоматически генерирует текстовый слой.

Заключение

Скан-PDF получается слишком большим потому, что более 80% объёма занимают высокое DPI сканирования и формат без потерь. Решение — три шага точечного сжатия: снижение DPI даёт наибольший выигрыш (300 → 150 DPI, минус 50–75%), смена формата даёт наибольшее уменьшение (BMP → JPEG q75, минус 80–95%; для ч/б JBIG2 — до 98%), OCR-текстовый слой повышает удобство (+5–10% к объёму в обмен на поиск и копирование). Три шага вместе дают 120-страничный цветной договор со стабильных 95 МБ до 3,2 МБ.

Запомните три правила: 1) выбирайте кодировку по цветовому режиму — ч/б в JBIG2, серый/цвет в JPEG, без единого подхода; 2) 150 DPI — золотая середина для скан-PDF: для экрана и печати достаточно; 3) чувствительные документы вроде договоров сжимайте локально, не загружайте в онлайн-инструменты. Правильный инструмент и метод — «похудение» скан-PDF на самом деле просто.

Похожие материалы

Нужно сжать скан-PDF? Попробуйте SmartSlim

Собственный движок сжатия на Rust, поддержка 10+ категорий и 40+ форматов (PDF, изображения, видео, Office, OFD и др.), локальная обработка — данные не покидают контур.