Лучшие программы для сканирования в Linux: 7 решений с проверкой PDF после сохранения
Сканирование в Linux начинается не с выбора красивого окна, а с проверки цепочки «устройство — драйвер — приложение — выходной файл». Одна программа может увидеть сетевой МФУ через eSCL, но не обнаружить старый USB-сканер без подходящего бэкенда SANE. Другая утилита без труда получает отдельные изображения, однако требует дополнительного шага для многостраничного PDF или распознавания текста. Поэтому решения оцениваются по воспроизводимому результату: страницы должны попасть в документ в правильном порядке, не обрезаться, сохраниться в копию и без ошибок открыться повторно.
PDF Commander занимает отдельную роль: это настольная альтернатива для поддерживаемых российских дистрибутивов и последующей работы с уже полученным PDF. Остальные участники непосредственно управляют сканированием через SANE, eSCL или доступный устройству интерфейс. Такой состав закрывает два этапа без ложного смешения: сначала получить корректные страницы, затем при необходимости организовать, проверить или обработать PDF.
Главное различие касается типа результата. Обычное сканирование создаёт растровое изображение страницы. Если изображения упакованы в PDF, визуально файл похож на электронный документ, но поиск и выделение текста не работают. Поисковый PDF появляется только после OCR, когда к изображению добавляется распознанный текстовый слой. Визуальная пометка, подпись или выделение поверх страницы также не превращают изображение в редактируемый текст.
Как проверялись программы для сканирования в Linux
Контрольный набор состоит из шести листов: обычный чёрно-белый договор, цветная страница с печатью, чек на тонкой бумаге, фотография, двусторонний лист и страница с мелким шрифтом. Для программ с поддержкой ADF дополнительно проверяется серия из десяти листов. После каждого прохода фиксируются количество страниц, ориентация, границы, читаемость мелких символов и размер файла. Оригинал сохраняется отдельно, а рабочий результат получает новое имя с датой или номером версии.
Тест считается завершённым только после закрытия программы. PDF открывается заново из файлового менеджера, затем прокручивается от первой до последней страницы. В поисковом PDF выполняется поиск редкого слова из середины документа и копирование одного предложения в текстовый редактор. Для графического PDF проверяется, что программа просмотра не выдаёт ошибку, страницы не пустые и их число совпадает с ожидаемым.
Критерии оценки
- Совместимость с Linux. Актуальный вариант установки, работа через SANE или eSCL, честно обозначенные ограничения универсальных пакетов.
- Обнаружение устройства. Возможность выбрать USB-, сетевой, планшетный сканер или ADF и понять, какой драйвер используется.
- Контроль захвата. Предпросмотр, выбор области, режима цвета, разрешения, источника бумаги, одностороннего или двустороннего прохода.
- Работа со страницами. Поворот, удаление ошибочного листа, перестановка миниатюр и повторный захват одной страницы.
- PDF и OCR. Создание многостраничного PDF, добавление поискового слоя и разделение между изображением страницы и распознанным текстом.
- Безопасное сохранение. Выбор новой папки и имени, отсутствие обязательной перезаписи оригинала, проверка после закрытия программы.
- Диагностика. Понятное поведение при отсутствии сканера, недоступной функции, пустом ADF или нехватке дополнительного пакета.
Сводная таблица
| Место и программа | Платформа и условия | Сильный сценарий | PDF и OCR | Главное ограничение |
|---|---|---|---|---|
| 1. PDF Commander | Astra Linux, ALT Linux, РЕД ОС, РОСА; DEB/RPM | Проверка и дальнейшая работа с полученным PDF | Операции со страницами и OCR в поддерживаемой сборке | Не универсальная SANE-оболочка для любого дистрибутива |
| 2. Document Scanner | GNOME/Linux, SANE | Быстрое сканирование нескольких листов | Многостраничный PDF; встроенного OCR нет | Небольшой набор пакетных средств |
| 3. NAPS2 | Современные дистрибутивы; SANE или eSCL | Профили, ADF, повторяемые задания | PDF, OCR, автосохранение, пакетный режим | Flatpak ограничен со сторонними SANE-драйверами |
| 4. Skanlite | KDE/Linux, SANE | Точный предпросмотр и отдельные изображения | PDF зависит от процесса; OCR не основная функция | Для длинного документа удобнее другой участник |
| 5. gscan2pdf | Linux, SANE и дополнительные пакеты | Большие задания, ручной дуплекс, OCR | PDF, DjVu, TIFF, изображения; внешний OCR | Часть команд требует дополнительных пакетов |
| 6. XSane | Linux/Unix, SANE | Тонкая настройка старых сканеров | Сохранение изображений; OCR отдельно | Несколько окон и высокий порог входа |
| 7. Skanpage | KDE/Linux, SANE, планшет или ADF | Многостраничный PDF с миниатюрами | PDF и изображения | Параметры зависят от устройства и бэкенда |
1. PDF Commander — настольная работа с полученным сканом
Платформа и условия. Linux-версия заявлена для Astra Linux, ALT Linux, РЕД ОС и РОСА и распространяется в пакетах DEB и RPM. Это не универсальная оболочка для любого Ubuntu-подобного или Arch-дистрибутива, поэтому до установки нужно сверить конкретную систему и архитектуру. Сильная сторона участника проявляется после получения страниц: открыть PDF, оценить структуру, убрать лишнее, переставить листы, добавить допустимые элементы и сохранить отдельную копию.
Сильный сценарий. Сканер управляется штатной утилитой, Document Scanner, NAPS2 или другим Linux-приложением, а итоговый PDF затем передаётся в PDF Commander для контроля и дальнейшей обработки. Такой двухэтапный процесс удобен, когда оператору сканера нужен простой интерфейс захвата, а сотруднику, принимающему файл, — панель страниц, поиск, подпись, объединение или исправление структуры документа.

Воспроизводимый мини-процесс
- Сохраните результат сканирования под техническим именем, например
dogovor_scan_raw.pdf. Не перезаписывайте единственную копию во временной папке. - Запустите PDF Commander и откройте файл. На первой странице увеличьте масштаб, чтобы были видны края букв, печати и тонкие линии.
- Откройте панель миниатюр. Сверьте число страниц с бумажным комплектом, затем проверьте первую, одну среднюю и последнюю страницу.
- Удалите только явно лишние тестовые или пустые листы. При сомнении оставьте страницу: бледная печать или подпись может выглядеть как пустота.
- Если требуется OCR, запускайте его отдельно и выбирайте язык документа. После завершения найдите редкое слово и скопируйте контрольный фрагмент.
- Сохраните копию под новым именем, закройте документ, откройте сохранённый файл заново и повторите контроль количества, порядка и поискового слоя.

Панель страниц особенно полезна после ручного двустороннего сканирования. Типичная ошибка выглядит так: сначала получены нечётные стороны 1, 3, 5, затем обороты попали в обратном порядке 6, 4, 2. Недостаточно переместить все обороты вниз. Нужно собрать последовательность 1, 2, 3, 4, 5, 6, открыть несколько переходов и проверить продолжение абзацев, подписи и реквизиты.
Инструменты подписи, заметок и выделения относятся к визуальному слою поверх PDF. Они полезны для согласования и оформления, но не меняют текст, запечатанный внутри изображения скана. Если требуется исправить букву в отсканированном договоре, сначала нужен OCR, затем проверка распознавания и только после этого — подходящий режим редактирования.

Проверка результата и ограничение
Ограничение связано с совместимостью Linux-сборки и ролью приложения. На неподдерживаемом дистрибутиве нельзя обещать штатную установку. Кроме того, OCR или редактирование не исправляют плохой захват: обрезанный край, смазанная строка и пересвеченная печать останутся дефектами изображения. Если на увеличении отсутствуют пиксели части символов, возвращайтесь к сканеру и повторяйте страницу.
Финальный файл проверяйте не только внутри редактора. Закройте программу и откройте копию в независимом просмотрщике. В качестве второго контрольного приложения подходит опубликованный разбор Adobe Acrobat Reader на поддерживаемой им системе или другой надёжный PDF-просмотрщик. Цель — убедиться, что файл открывается вне среды, в которой был сохранён.

Плюсы
- Панель страниц и инструменты последующей организации PDF.
- Рабочая обработка хранится отдельно от первичного скана.
- Локальная настольная работа без обязательной отправки конфиденциальных листов в браузерный сервис.
- Отдельные пакеты для нескольких российских Linux-дистрибутивов.
Минусы
- Не универсальная программа прямого сканирования через SANE.
- Нужно проверить поддержку конкретного дистрибутива.
- OCR не восстанавливает информацию, потерянную из-за плохого захвата.
2. Document Scanner — быстрый захват в среде GNOME
Платформа и условия. Приложение известно также под прежним названием Simple Scan и использует SANE для доступа к совместимым устройствам. Оно ориентировано на короткий путь: выбрать сканер, получить страницу, повернуть или обрезать её и экспортировать документ. Интерфейс подходит для домашнего МФУ, учебного кабинета и небольшого офиса, где важнее надёжно получить несколько листов, чем строить сложные профили автоматизации.
Сильный сценарий. Односторонний договор, квитанции, конспект или несколько фотографий на планшетном сканере. Оператор видит полученные страницы и исправляет ориентацию до сохранения. Для большого массива с ADF, разделителями, именованием по шаблону и OCR удобнее NAPS2 или gscan2pdf.

Как получить проверяемый PDF
- Подключите и включите сканер до запуска приложения. Дождитесь, пока вместо поиска появится название устройства.
- Создайте новый документ. Для обычных листов выберите режим документа, для фотографий — режим изображения, если он доступен.
- Положите первый лист по меткам стекла и нажмите
Scan. После появления страницы проверьте четыре угла, строку у корешка и нижние реквизиты. - Добавляйте следующие листы в тот же документ. Следите за миниатюрами и сразу пересканируйте неудачный лист.
- Вызовите сохранение, выберите PDF и задайте новое имя. Не сохраняйте рабочий документ поверх ранее проверенного файла.
- Закройте приложение, откройте PDF из папки и прокрутите все страницы. Отсутствие выделения текста для обычного графического скана ожидаемо.

Кадрирование применяют после проверки границ. Слишком тесная рамка отрезает номера страниц, подписи на полях или тень от сгиба. Слишком широкая добавляет тёмную полосу от крышки и увеличивает размер файла. Оставьте небольшой запас вокруг полезного содержимого, затем проверьте лист при масштабе «по ширине».
Document Scanner не является редактором текста скана. Поворот и обрезка меняют геометрию изображения, но не позволяют переписать строку договора или исправить таблицу как в текстовом процессоре. Для поиска по тексту экспортированный PDF пропускают через отдельный OCR-инструмент, сохраняя графическую версию для сверки.
Если приложение не видит устройство
Состояние Searching for Scanners… означает, что приложение ещё не получило доступный источник. Сначала исключите питание, кабель, транспортную блокировку и неверный сетевой сегмент. Затем проверьте устройство другим SANE-клиентом. Если один клиент работает, а Document Scanner нет, проблема вероятнее связана с упаковкой приложения или разрешениями.

Для сетевого МФУ различайте обнаружение по адресу и автоматический поиск. Устройство может открываться в браузере по IP, но не объявлять сервис сканирования в текущем сегменте. Тогда проверяют поддержку eSCL/AirScan или настройку SANE-бэкенда. Не стоит многократно переустанавливать графическую программу, пока сама система не видит сканер.
Плюсы
- Минимум действий от запуска до PDF.
- Поворот, кадрирование и сборка нескольких страниц.
- Естественная интеграция со средой GNOME.
- Подходит для быстрой проверки домашнего или офисного сканера.
Минусы
- Нет встроенного OCR для поискового слоя.
- Мало средств для сложного пакетного именования.
- Проблемы драйвера диагностируются вне приложения.
3. NAPS2 — профили, ADF и поисковый PDF
Платформа и условия. NAPS2 выпускается для современных Linux-дистрибутивов в пакетах DEB и RPM, а также в универсальном формате. Для прямого сканирования нужны подходящие библиотеки и доступ к SANE либо сетевому eSCL-устройству. Важное ограничение официально обозначено для Flatpak: сторонние SANE-драйверы внутри такой упаковки могут быть недоступны. При старом USB-сканере разумно начинать с нативного пакета, а не с изолированной сборки.
Сильный сценарий. Повторяющиеся офисные задания: «договор A4, серый, 300 dpi, ADF», «цветные акты, не удалять обороты», «фотографии, 600 dpi, PNG». Профиль фиксирует параметры и снижает риск, что два оператора получат несовместимые результаты.

Создание рабочего профиля
- Нажмите
Scan. При первом запуске программа предложит создать профиль. Дайте ему описательное имя, напримерДоговор A4 300 серый. - Выберите
SANE Driverдля поддерживаемого локального сканера илиESCL Driverдля совместимого сетевого устройства. НажмитеChoose deviceи дождитесь списка. - Укажите источник:
Glassдля планшета,Feederдля одностороннего ADF илиDuplex, если аппарат умеет сканировать обе стороны. - Задайте формат A4, цветовой режим и разрешение. Для большинства текстовых документов 300 dpi даёт хороший баланс. 600 dpi оправдано для мелких деталей, фото или трудного OCR.
- Проверьте автоповорот, выравнивание, удаление пустых страниц и качество. На первом задании не включайте агрессивное удаление пустых листов.
- Нажмите
OK, выполните одну тестовую страницу и оцените её до массового прохода.

Профиль не гарантирует одинаковость результата на разных моделях сканеров. Параметр 300 dpi имеет общий смысл, но яркость, порог чёрно-белого режима и обработка цвета зависят от устройства. При переносе профиля на другой компьютер или замене МФУ сначала сделайте контрольный лист. Особенно внимательно проверяйте страницу с печатью, карандашной пометкой и светло-серой таблицей.
Пакетное сканирование и сохранение
Команда пакетного сканирования открывается из раскрывающегося меню Scan. В ней можно выбрать один проход, несколько запусков с запросом между ними или фиксированную задержку. Для планшетного сканера удобен запрос между проходами: программа ждёт, пока оператор заменит лист. Для ADF обычно достаточно одного запуска.

- Выберите профиль, уже проверенный на одной странице. Не настраивайте новый режим непосредственно перед большим заданием.
- Для планшета выберите несколько сканирований с подтверждением между проходами. После каждого прохода меняйте лист и запускайте следующий.
- Оставьте загрузку изображений в NAPS2, если нужна ручная проверка. Автосохранение напрямую в файл быстрее, но скрывает ошибочную ориентацию до завершения.
- После серии сравните миниатюры с бумажным комплектом. Переставьте страницы, поверните отдельные листы и удалите только подтверждённый мусор.
- Нажмите
Save PDF, задайте новое имя и сохраните в рабочую папку. При OCR убедитесь, что выбран нужный язык и включён поисковый PDF. - Закройте NAPS2, откройте файл заново, выполните поиск и проверьте последнюю страницу.

OCR в NAPS2 добавляет текстовый слой к страницам. PDF становится доступным для поиска и копирования, но изображение остаётся визуальной основой. Ошибки распознавания не всегда видны при обычном просмотре: слово на странице выглядит правильно, а скрытый слой содержит другую букву. Для важных фамилий, сумм, номеров и дат используйте поиск или копирование и сверяйте с изображением.
Практическое ограничение Flatpak
Если Flatpak-сборка видит сетевой eSCL-сканер, но не видит USB-устройство с фирменным сторонним SANE-бэкендом, это не обязательно ошибка NAPS2. Изоляция пакета ограничивает доступ к драйверу хост-системы. Проверьте устройство нативным пакетом или другим нативным SANE-клиентом. Если оно появляется там, меняйте способ установки приложения, а не кабель.
Плюсы
- Профили с устройством, источником, разрешением и обработкой.
- Удобный ADF, пакетный режим, перестановка страниц и автосохранение.
- Создание поискового PDF через OCR.
- SANE и eSCL для локальных и сетевых устройств.
- Командный режим для повторяемых процессов.
Минусы
- Flatpak ограничен при работе со сторонними SANE-драйверами.
- Много настроек повышает риск слишком агрессивного удаления пустых страниц.
- OCR требует отдельной проверки важных данных.
4. Skanlite — точный предпросмотр и серия изображений
Платформа и условия. Skanlite — графическая программа KDE, работающая поверх SANE. Она показывает параметры, которые предоставляет конкретный бэкенд: режим, глубину, разрешение, яркость, контраст, источник и область. Поэтому два пользователя могут видеть разные наборы полей даже в одной версии приложения. Это следствие устройства и драйвера, а не неполная установка интерфейса.
Сильный сценарий. Оцифровка фотографий, рисунков, отдельных справок и листов, где важны предварительный просмотр и точная рамка. Автосохранение удобно для последовательности изображений. Для большого многостраничного PDF с OCR Skanlite лучше использовать как этап получения качественных кадров, а сборку выполнять в другом инструменте.

Точный захват одного листа
- Выберите сканер. Если список пуст, проверьте SANE вне Skanlite; графическая оболочка не заменяет драйвер.
- Установите источник
Flatbedили доступный аналог. Для фотографии включите цвет, для обычного текста начните с оттенков серого. - Задайте 300 dpi для текста или 600 dpi для небольших фотографий и мелкой полиграфии. Не выбирайте максимальное значение автоматически.
- Нажмите
Preview. На предварительном изображении выделите область так, чтобы рамка не пересекала важные элементы. - Запустите финальное сканирование. Сравните резкость мелкого текста с предпросмотром и сохраните результат в новую папку.
- Откройте сохранённое изображение отдельно. Проверьте размеры, ориентацию и отсутствие цветной полосы по краю.

Предпросмотр имеет низкое или среднее разрешение и служит для геометрии, а не окончательной оценки мелких букв. Если текст выглядит мягким, это ещё не дефект. Окончательный кадр проверяется после полного прохода. Обратная ситуация тоже встречается: на маленьком предпросмотре лист выглядит ровно, но при увеличении видна ступенька по диагональным линиям или цифровой шум.
Автосохранение и проверка устройства
При серии изображений задайте отдельную папку, основу имени и счётчик. Перед большим проходом создайте три тестовых файла и убедитесь, что нумерация увеличивается, а существующие изображения не перезаписываются. Если Skanlite задерживается в окне поиска устройств, сначала проверьте сканер другим SANE-клиентом и только затем возвращайтесь к автосохранению.

Если после сканирования нужно одинаково повернуть или привести к единому размеру десятки изображений, пригодится Converseen. Оригинальные сканы оставляют в отдельной папке: пакетную ошибку тогда можно отменить удалением производных копий.

Ограничение многостраничного процесса
Skanlite хорошо получает отдельные изображения, однако организация длинного документа не является его центральной задачей. Если нужно двадцать страниц в одном PDF, порядок удобнее контролировать в NAPS2, gscan2pdf или Skanpage. Возможен двухэтапный путь: Skanlite сохраняет TIFF или PNG с нумерацией, затем проверенные файлы собираются в PDF. Используйте имена 001, 002, 003, а не 1, 10, 11, 2.
Плюсы
- Понятный предпросмотр и ручное выделение области.
- Доступ к параметрам SANE-бэкенда.
- Автосохранение и последовательные имена.
- Хороший вариант для фотографий, рисунков и отдельных листов.
Минусы
- Не самый удобный центр сборки длинного PDF.
- Набор параметров различается между сканерами.
- OCR и сложная организация страниц требуют отдельного инструмента.
5. gscan2pdf — многостраничные задания и ручной дуплекс
Платформа и условия. gscan2pdf — открытая Linux-программа, которая получает страницы через SANE и сохраняет PDF, DjVu, TIFF и изображения. Часть функций реализуется внешними компонентами: ImageMagick отвечает за ряд преобразований, unpaper — за очистку, Tesseract, GOCR или Cuneiform — за OCR. Если дополнительный пакет не установлен, соответствующая команда может быть неактивна. Это модульность, а не случайный сбой интерфейса.
Сильный сценарий. Большой бумажный комплект, где нужно управлять числом страниц, ADF, односторонним или ручным двусторонним проходом, затем переставить миниатюры, обработать отдельные листы и встроить OCR-слой. Программа требует больше времени на освоение, зато хорошо показывает структуру задания.

Сканирование серии
- Откройте
File → Scan. Выберите устройство и дождитесь загрузки параметров. Если сканер не найден, проверьте SANE до изменения настроек gscan2pdf. - Укажите число страниц. Для ADF можно выбрать все листы, если устройство корректно возвращает состояние «бумага закончилась». Для планшета надёжнее задавать по одной странице.
- Выберите
Single sidedдля обычного задания. Для ручного дуплекса задайте двусторонний документ и сначала лицевые стороны, затем обороты. - Проверьте источник
FlatbedилиADF, режим цвета, формат страницы и разрешение. Названия зависят от бэкенда. - Запустите сканирование. После появления миниатюр проверьте их количество, переставьте страницы, поверните отдельные листы и удалите подтверждённые пустые.
- Сохраните выбранные или все страницы через
File → Save, выбрав PDF и новое имя. Закройте программу и проверьте файл повторным открытием.

Ручной дуплекс без перепутанных оборотов
Для планшетного или одностороннего ADF программа умеет учитывать лицевые и оборотные стороны. Рабочая последовательность зависит от того, как аппарат возвращает стопку. Сначала сделайте тест на трёх листах, крупно подпишите стороны 1–6 и посмотрите, в каком порядке они поступают. Только после этого переносите схему на настоящий документ.
После второго прохода не доверяйте одной автоматической сортировке. Откройте переходы 1→2, 2→3 и несколько мест в середине. В договоре оборот часто начинается продолжением предложения; в книге — продолжением абзаца; в анкете — обратной стороной бланка. Смысловой контроль надёжнее номера миниатюры.
OCR и дополнительные пакеты
Команда OCR использует внешний движок и помещает распознанный текст за изображением страницы. Установите нужные языковые данные и проверьте одну сложную страницу: колонку, таблицу, печать, мелкий шрифт. Если язык не отображается, проблема обычно связана с отсутствующим языковым пакетом. После распознавания откройте вкладку OCR Output и сравните фрагменты с изображением.
Поворот, очистка и некоторые команды могут быть неактивны без ImageMagick или unpaper. Отдельный разбор ImageMagick помогает понять роль технического обработчика. Установка компонента возвращает зависимую команду, но не добавляет возможность, которую не поддерживает устройство.

Ограничение импорта PDF
gscan2pdf умеет импортировать PDF, но разработчик указывает, что этот путь прежде всего предназначен для обратной работы с файлами, созданными самой программой. Не стоит использовать его как универсальный редактор сложных PDF с формами, векторами и вложениями. Сохраните копию, проверьте импорт нескольких страниц и убедитесь, что содержимое не было упрощено до изображений неожиданного качества.
Плюсы
- Контроль числа страниц, источника и двустороннего процесса.
- Перестановка, удаление, поворот и обработка выбранных страниц.
- PDF, DjVu, TIFF и изображения.
- OCR через внешние движки.
- Журнал для диагностики сложных ошибок.
Минусы
- Интерфейс и зависимости требуют освоения.
- Часть функций неактивна без дополнительных пакетов.
- Импорт произвольных PDF не равен полноценному редактированию.
6. XSane — подробный доступ к возможностям SANE
Платформа и условия. XSane — классический графический фронтенд SANE. Он показывает большой набор параметров устройства и часто полезен со старыми, плёночными или специализированными сканерами. Интерфейс состоит из нескольких окон: основные настройки, предпросмотр, гистограмма и изображение. Такая модульность даёт контроль, но новичку кажется менее цельной, чем Document Scanner или NAPS2.
Сильный сценарий. Точная настройка источника, разрешения, режима, порога, цветовых каналов и рамки, особенно когда автоматические приложения скрывают нужный параметр. XSane также полезен как диагностический клиент: если он видит устройство и получает страницу, базовая цепочка SANE работает.

Мини-процесс с предпросмотром
- Запустите XSane и выберите устройство. Дождитесь заполнения панели параметров.
- Выберите
Color,GrayилиLineart. Для первого теста текста безопаснееGray: пороговый режим может потерять светлые детали. - Установите разрешение. Начните с 300 dpi для документов и повышайте только при доказанной необходимости.
- Откройте окно предпросмотра и выполните быстрый проход. Выделите рамку, исключая пустое стекло, но оставляя небольшой запас.
- Оцените гистограмму и изображение. Корректируйте яркость и контраст умеренно; пересвет нельзя полностью восстановить.
- Запустите финальный проход, сохраните изображение под новым именем и откройте его независимо от XSane.

Гистограмма показывает распределение тонов и помогает заметить обрезание светов или теней. Если график упирается в край, детали могут исчезнуть. Перед настройкой убедитесь, что XSane завершил поиск устройства: окно «scanning for devices» должно закрыться, а параметры выбранного сканера — появиться в основной панели.

Сохранение и сборка PDF
XSane надёжно получает отдельные изображения, но сложный многостраничный процесс зависит от режима и сборки. Для критичного задания удобнее сохранять каждую страницу в отдельный TIFF или PNG с последовательным номером, затем собрать проверенный набор в PDF. Такой путь позволяет заменить одну неудачную страницу без повторного сканирования всей стопки.

Не приписывайте XSane встроенный OCR. Программа отвечает за получение изображения и параметры SANE. Чтобы сделать текст доступным для поиска, сохранённые страницы передаются в OCR-инструмент или приложение, которое умеет встроить текстовый слой в PDF. Визуально удачный скан остаётся изображением, пока этот этап не выполнен.
Ограничение интерфейса
Несколько окон требуют дисциплины: окно предпросмотра может оказаться за основным, диалог сохранения — на другом рабочем столе, а параметры — измениться после выбора нового источника. Перед большим заданием расположите окна и сделайте контрольный лист. Не закрывайте окно изображения, пока не убедитесь, что файл записан на диск.
Плюсы
- Подробный доступ к параметрам SANE.
- Предпросмотр, рамка и гистограмма.
- Полезен со старыми и специализированными сканерами.
- Подходит для диагностики уровня драйвера.
Минусы
- Фрагментированный и устаревший по ощущениям интерфейс.
- OCR выполняется отдельно.
- Длинные задания требуют внимательной организации файлов.
7. Skanpage — многостраничный PDF в среде KDE
Платформа и условия. Skanpage — приложение KDE для планшетных сканеров и ADF. Оно получает параметры через SANE, показывает миниатюры страниц и позволяет переставлять, поворачивать и удалять их перед экспортом. Программа подходит пользователям Plasma, которым нужен современный интерфейс именно для документов.
Сильный сценарий. Небольшие и средние многостраничные комплекты, где после каждого прохода требуется визуально контролировать список страниц и сохранить единый PDF. В отличие от Skanlite, акцент сделан на документе как наборе листов.

Сборка документа
- Выберите сканер и источник. Для ADF проверьте, что указан податчик, а не стекло.
- Задайте формат страницы, режим и разрешение. Выполните один тестовый лист.
- Отсканируйте серию. Каждая физическая сторона должна соответствовать одной странице проекта.
- Поверните листы, переставьте ошибочно расположенные страницы и удалите только подтверждённые пустые кадры.
- Экспортируйте многостраничный PDF под новым именем. Не закрывайте проект до появления файла в папке.
- Закройте Skanpage, откройте PDF и проверьте первую, среднюю и последнюю страницу, затем просмотрите все миниатюры.

Поля параметров зависят от сканера. На одном устройстве доступны ADF, duplex, автоматический размер и аппаратный порог; на другом — только стекло, цвет и несколько разрешений. Нельзя обещать функцию только потому, что она видна на чужом снимке интерфейса. Надёжный признак — параметр присутствует после выбора вашего устройства и проходит тест.
Ограничение OCR
Основной официальный сценарий Skanpage — сканирование, организация страниц и сохранение многостраничного PDF или изображений. Если установленная сборка не предлагает OCR, поисковый слой создаётся отдельно. Это не мешает получить качественный графический PDF, но поиск по словам работать не будет.
Плюсы
- Современный KDE-интерфейс и наглядные миниатюры.
- Планшетные сканеры и ADF через SANE.
- Поворот, удаление и перестановка страниц.
- Экспорт многостраничного PDF.
Минусы
- Параметры зависят от бэкенда и устройства.
- OCR не гарантирован в базовом процессе.
- Для сложной автоматизации NAPS2 функциональнее.
Как выбрать режим сканирования под конкретный оригинал
Универсальной настройки не существует. Разрешение, цвет и обработка выбираются по типу бумаги и дальнейшему использованию. Ошибка чаще возникает не из-за слишком низкого числа dpi, а из-за неверного режима: чёрно-белый порог стирает серую печать, цветной режим раздувает простой текстовый комплект, агрессивный автоконтраст превращает фон старой бумаги в пятна. Сначала определяют ценность деталей, затем делают один контрольный лист и только после него запускают серию.
| Оригинал | Стартовая настройка | Что проверить | Когда менять |
|---|---|---|---|
| Обычный печатный текст | 300 dpi, оттенки серого | Мелкие буквы, подписи, номер страницы | Перейти в цвет при печатях и пометках |
| Документ с цветной печатью | 300 dpi, цвет | Оттенок печати и тонкие линии | Серый только если цвет не несёт смысла |
| Чек или тонкая термобумага | 300–400 dpi, серый, умеренный контраст | Бледные цифры и фон от оборота | Повысить dpi и снизить порог |
| Фотография | 600 dpi, цвет | Резкость, пыль, края, цветовой сдвиг | Выше только для маленького оригинала |
| Газета и старая книга | 300–400 dpi, серый | Просвечивание, изгиб у корешка | Использовать мягкую очистку на копии |
| Чертёж или мелкая схема | 400–600 dpi, серый или цвет | Тонкие линии, индексы, масштаб | Не применять агрессивное удаление шума |
| Рукописные заметки карандашом | 400 dpi, серый | Слабые штрихи и исправления | Цвет при разноцветных пометках |
| Двусторонний офисный комплект | 300 dpi, серый или цвет | Ориентация оборотов и пустые листы | Отключить автоудаление при бледном обороте |
Текстовый документ
Для чёткой лазерной печати 300 dpi обычно достаточно, чтобы OCR распознавал основной текст, а PDF не становился чрезмерно большим. Оттенки серого безопаснее порогового чёрно-белого режима на первой попытке: они сохраняют сглаживание букв, подписи и светлые штампы. После теста можно сравнить размер и читаемость с чёрно-белым вариантом. Выбор делается по фактическому результату, а не по названию режима.
Если документ содержит таблицу с тонкими линиями, смотрите не только на буквы. Пропавшая горизонтальная граница способна изменить смысл ячейки после OCR. Откройте страницу на 200%, проверьте пересечения линий и индексы. При дефекте сначала снизьте порог или вернитесь к серому режиму; повышение разрешения помогает только тогда, когда устройство действительно передаёт дополнительную детализацию.
Поля документа тоже являются данными. В них могут находиться номер страницы, штамп, пометка согласования или подпись. Автоматическая рамка часто пытается убрать белое пространство и подрезает край слишком близко. Для теста используйте лист с элементом у самой кромки. Если он пропадает, расширьте область или задайте фиксированный формат A4.
Цветная печать, подпись и маркер
Цвет важен, когда оттенок несёт смысл: синяя подпись, красная отметка, зелёный штамп, разные цвета правок. Скан в оттенках серого может оставить форму, но убрать различие между слоями. Для значимого документа лучше хранить цветную мастер-копию, а компактную серую версию создавать отдельно, если это допускают правила работы.
Автокоррекция цвета нередко усиливает фон или меняет оттенок печати. На первом листе сравните экранный результат с бумагой при нейтральном освещении. Монитор не является точным измерительным прибором, но грубый сдвиг заметен: синяя печать не должна становиться фиолетовой, а белая бумага — жёлтой. Сохраняйте мастер без агрессивной коррекции; улучшение выполняйте на копии.
Флуоресцентный маркер иногда плохо передаётся сканером: жёлтый становится почти белым, а зелёный — серым. Проверьте страницу с каждым используемым цветом. Если отметка теряется, попробуйте другой цветовой профиль устройства, отключите автоматическое удаление фона и сравните результат при 300 и 600 dpi. Повышение разрешения не всегда помогает, потому что причина может быть в спектральной чувствительности сканера.
Чеки и тонкая бумага
Термобумага выцветает, а текст на ней часто имеет низкий контраст. Пороговый режим способен превратить часть цифр в белое поле. Начните с оттенков серого и немного увеличенного разрешения, затем подберите яркость так, чтобы фон оставался светлым, но тонкие штрихи не исчезали. Если оборот просвечивает, не пытайтесь полностью убрать его ценой потери лицевого текста.
Чек уже формата A4, поэтому автоматический размер страницы иногда создаёт узкий длинный кадр, а иногда обрезает нижний край. Сделайте предпросмотр, задайте рамку вручную и оставьте запас. Для серии чеков полезно сохранять отдельные файлы с датой и номером, а затем собирать PDF только после проверки каждого изображения.
Скрученный чек не лежит плоско и даёт разную резкость по длине. Не прижимайте его предметом, который может поцарапать стекло. Безопаснее аккуратно распрямить бумагу, положить чистую нейтральную подложку и выполнить несколько коротких тестов. Если текст продолжает исчезать, сфотографируйте чек как дополнительную резервную копию, но не подменяйте ею проверенный скан без необходимости.
Фотографии и иллюстрации
Для фото важны не только dpi, но и чистота стекла, цвет, глубина и отсутствие чрезмерной автоматической резкости. Перед сканированием протрите стекло безворсовой салфеткой и уберите пыль с фотографии. Сделайте тест на 600 dpi, откройте 100% и проверьте мелкие детали. Если увеличение до 1200 dpi лишь удваивает пиксели и шум, дополнительной информации нет, а файл становится тяжелее.
Не сохраняйте единственную мастер-копию только в JPEG с низким качеством. Для мастер-файла подходят форматы без потерь, если объём допустим; JPEG можно сделать производной копией для отправки. Если конечная цель — PDF-альбом, сначала сохраните проверенные изображения, затем соберите документ. Одна ошибка экспорта тогда не уничтожит всю работу.
Несколько фотографий на стекле можно сканировать одним проходом, но автоматическое разделение должно быть проверено. Белая рамка снимка на светлом фоне иногда не определяется, а тёмная фотография сливается с крышкой. Если приложение не разделяет кадры уверенно, получите общий мастер, затем создайте отдельные копии ручным кадрированием.
Старая книга и газета
У корешка возникает тень и геометрическое искажение. Не прижимайте переплёт с силой: повреждение бумаги нельзя оправдать идеально плоским изображением. Оставьте внутренний запас, выберите режим серого и проверьте, что текст у сгиба не исчез. Для последующей очистки используйте копию. Мастер должен сохранять фактический вид страницы, включая умеренную тень, если её удаление стирает буквы.
Газетная бумага просвечивает, а растровая печать создаёт муар. Изменение разрешения на небольшую величину иногда уменьшает узор лучше, чем сильное размытие. Сравните 300, 400 и 600 dpi на одном фрагменте. Выберите вариант, в котором буквы читаются, фотографии не покрыты цветными волнами, а файл остаётся управляемым.
Для разворотов заранее определите, будет ли каждая страница отдельной страницей PDF или один разворот останется одним кадром. Смешение двух схем в одном документе затрудняет чтение. Если разворот делится, линии кадрирования должны проходить одинаково, а номер страницы и колонтитул не должны попадать на соседний лист.
Чертежи, схемы и мелкий шрифт
Тонкие линии и индексы требуют повышенного внимания к реальной оптике сканера. 600 dpi может быть полезно, но только после сравнения с 400 dpi. Откройте одинаковый участок двух версий и проверьте, появились ли новые детали, а не только больше пикселей. Сильное удаление шума способно разорвать штриховые линии, поэтому любые фильтры применяйте после сохранения мастер-копии.
Физический размер страницы важен, если PDF будут печатать в масштабе. Проверьте, что A4 остаётся A4, а не превращается в изображение произвольного размера. В просмотрщике откройте свойства страницы, затем напечатайте тестовую линейку или известный размер на черновом листе с параметром «фактический размер».
Как понять, какой PDF получился
Расширение .pdf не сообщает, есть ли внутри текст. После сканирования встречаются три основных типа. Первый — графический PDF: каждая страница является изображением. Второй — поисковый PDF: изображение сохранено, а за ним расположен OCR-слой. Третий — созданный в офисной программе PDF с настоящими текстовыми и векторными объектами. Сканер почти всегда даёт первый или второй тип; третий нельзя получить простым распознаванием без дальнейшей реконструкции макета.
Проверка графического PDF
- Откройте файл после полного закрытия программы сканирования.
- Попробуйте выделить отдельное слово. Если выделяется вся страница или ничего, перед вами, вероятно, изображение.
- Нажмите поиск и введите редкое слово, которое точно видно на странице. Нулевой результат подтверждает отсутствие поискового слоя, если слово набрано правильно.
- Увеличьте страницу до 300%. Растровая структура букв станет заметнее, но это нормально для скана.
- Проверьте количество и ориентацию страниц. Тип PDF не отменяет контроль структуры.
Проверка поискового PDF
- Найдите редкое слово на средней странице. Просмотрщик должен перейти именно к нему.
- Выделите одно предложение и вставьте его в простой текстовый редактор.
- Сравните фамилии, номера, суммы и даты с изображением. Ошибки OCR могут скрываться за визуально правильной страницей.
- Проверьте порядок выделения в двух колонках и таблицах. Текстовый слой иногда читается не в визуальном порядке.
- Сохраните графическую мастер-копию отдельно. Она позволит повторить OCR с другим языком или настройками.
Поисковый слой не означает, что PDF можно безопасно редактировать как Word. Замена текста внутри скана требует либо редактирования изображения, либо реконструкции распознанного содержимого. В обоих случаях форматирование и достоверность могут пострадать. Для исправления бумажного документа надёжнее получить правильный лист заново и заменить страницу.
Как отличить OCR от настоящего текста
В поисковом скане выделение часто повторяет строки приблизительно, а курсор может захватывать невидимые области между колонками. При увеличении буквы остаются пиксельными, хотя поиск работает. В PDF, созданном из текстового редактора, контуры шрифта обычно остаются гладкими при сильном увеличении, а порядок выделения соответствует структуре. Это различие важно при дальнейшей обработке: распознанный слой требует сверки, а настоящий текст обычно переносится точнее.
Попробуйте скопировать таблицу. Если в буфере строки смешались, а столбцы идут в неправильном порядке, OCR выполнил лишь базовое распознавание. Не обещайте пользователю редактируемую таблицу. Для точного переноса нужны специализированное распознавание структуры и ручная проверка. Изображение страницы сохраняйте как эталон.
Проверка ограничений PDF
Иногда файл открывается, но запрещает копирование, печать или изменение. Это ограничения безопасности PDF, а не неисправность сканера. Проверьте свойства документа. Не пытайтесь обходить защиту: запросите версию с нужными разрешениями у владельца или повторно создайте собственный скан с законно доступного бумажного оригинала.
Пароль на открытие тоже меняет рабочий процесс. Сначала убедитесь, что пароль принят и файл полностью открывается, затем сохраните рабочую копию только в соответствии с правилами организации. Не вставляйте пароли в имена файлов и журналы. После передачи убедитесь, что получатель знает безопасный канал для получения пароля.
Сохранение оригинала, версии и откат
Самая дорогая ошибка — перезапись единственной удачной копии. Рабочая папка должна отделять мастер-сканы, промежуточные файлы и финальный PDF. Для небольшого задания достаточно трёх каталогов: 01_master, 02_work, 03_final. В мастер-папке ничего не поворачивают пакетно и не сжимают. В рабочей можно экспериментировать с OCR и очисткой. В финальной лежит только проверенный документ.
Имена должны сортироваться предсказуемо. Используйте ведущие нули: 001.png, 002.png, а не 1.png, 2.png. Для версий PDF полезна схема nazvanie_YYYY-MM-DD_v01.pdf. Не используйте слово «final» как единственный признак: после первой правки появятся «final2» и «final_new». Номер версии и дата показывают последовательность без открытия файлов.
Минимальный протокол отката
- Сразу после сканирования скопируйте мастер-файлы в отдельную папку и запретите пакетной обработке писать туда.
- Перед OCR или сжатием создайте рабочую копию PDF.
- После каждого крупного этапа увеличивайте номер версии, а не перезаписывайте предыдущий файл.
- Запишите, что изменено: удалены пустые страницы, исправлен порядок, добавлен OCR, уменьшен размер.
- После проверки перенесите выбранную версию в финальную папку. Старые рабочие версии удаляйте только после резервного копирования.
Для десятков изображений пакетное преобразование удобно, но вывод должен идти в новую папку. Утилиты вроде XnConvert показывают предварительный результат и цепочку действий, однако неправильная папка вывода всё равно способна перезаписать оригиналы. Первый запуск делайте на копиях трёх файлов, проверяйте формат, размеры и имена, затем применяйте к серии.
Когда сохранять отдельные изображения
Отдельные страницы полезны, если ожидается замена листа, повторный OCR или несколько вариантов PDF. Они позволяют исправить один дефект без нового прохода всей стопки. Недостаток — больше файлов и риск перепутать порядок. Поэтому используйте нумерацию, отдельную папку задания и список ожидаемых страниц. После сборки PDF не удаляйте изображения до финальной приёмки.
Если приложение умеет сразу писать PDF, это быстрее, но снижает гибкость. Для короткого бытового документа прямое сохранение оправдано. Для длинного комплекта, редких фотографий или сложного ручного дуплекса лучше сначала сохранить проверяемые страницы, затем собрать документ. Выбор определяется стоимостью повторного сканирования.
Контрольная сумма и перенос
При передаче между компьютерами полезно сравнить размер файла и, при строгом процессе, контрольную сумму. Простое совпадение имени ничего не доказывает: копирование могло оборваться, а старая версия — остаться под тем же названием. После переноса откройте файл с нового носителя, а не из списка недавних документов.
Облачная синхронизация может создать конфликтные копии. Не редактируйте один PDF одновременно на двух компьютерах. Дождитесь завершения загрузки, проверьте значок синхронизации и откройте файл на втором устройстве только после появления актуальной версии. Для конфиденциальных документов используйте разрешённое организацией хранилище.
Диагностика: сканер не найден
Графическая программа находится в конце цепочки. Если она не видит сканер, нужно последовательно выяснить, на каком уровне пропал доступ. Хаотичная переустановка пяти приложений редко помогает: все они могут использовать один и тот же SANE-бэкенд и одинаково не видеть устройство.
Шаг 1. Физическое состояние
Убедитесь, что сканер включён, не находится в транспортной блокировке и завершил самопроверку. Переподключите USB-кабель напрямую, без пассивного концентратора. Для МФУ проверьте, что ошибка бумаги или картриджа не блокирует сканирующий модуль. Если устройство сетевое, откройте его адрес и убедитесь, что компьютер находится в нужной сети.
Шаг 2. Видимость на уровне системы
Запустите второй нативный SANE-клиент. Если устройство появляется в XSane, но не в Flatpak-приложении, вероятна проблема изоляции пакета. Если не появляется нигде, изучайте бэкенд, права доступа и поддержку модели. Название принтера в системном диалоге печати не доказывает наличие сканера: печать и сканирование используют разные протоколы и драйверы.
Шаг 3. Драйвер и бэкенд
Некоторые модели работают с открытым бэкендом, другие требуют пакета производителя, третьи поддерживают сетевой eSCL без фирменного драйвера. Выбирайте путь по модели, а не по бренду в целом. Две внешне похожие серии одного производителя могут использовать разные контроллеры. После установки бэкенда перезапустите приложение и, если требуется, сеанс пользователя.
Шаг 4. Права доступа
USB-устройство может быть обнаружено системой, но недоступно обычному пользователю. Признак — работа от имени администратора и отказ в обычном сеансе. Не оставляйте постоянный запуск графической программы с повышенными правами; исправьте правило доступа или членство в нужной группе по документации дистрибутива. Запуск от администратора создаёт файлы с неудобным владельцем и повышает риск случайной записи в системные каталоги.
Шаг 5. Сеть и eSCL
Для eSCL важны обнаружение mDNS, отсутствие блокировки между сегментами и доступ к устройству. Если автоматический поиск не проходит, проверьте ручное подключение по адресу, когда программа это поддерживает. Не публикуйте сканер в открытый интернет: сетевое сканирование рассчитано на локальную защищённую сеть.
Шаг 6. Способ установки приложения
Нативный пакет, Flatpak и Snap могут иметь разные разрешения и доступ к библиотекам хоста. Если сканер работает в одном варианте и не работает в другом, зафиксируйте это как ограничение упаковки. Не переносите настройки между сборками вслепую: профиль может ссылаться на другое имя устройства или путь. Сначала проверьте чистый профиль с одной страницей.
Шаг 7. Журнал и повторяемость ошибки
Запишите точное время сбоя, выбранный драйвер, имя устройства, источник бумаги и действие, после которого возникла ошибка. В NAPS2 и gscan2pdf есть журналы, которые помогают отличить отсутствие устройства от сбоя при передаче страницы. Повторите тест с одним листом и стандартными параметрами. Если ошибка исчезает при меньшем разрешении, проверьте память, временную папку и устойчивость соединения.
Частые дефекты и точные способы исправления
Обрезан левый или нижний край
Сначала выполните предпросмотр и расширьте рамку. Если край исчезает даже при полной области, проверьте формат страницы, выравнивание бумаги и аппаратное смещение. В NAPS2 для некоторых драйверов существуют дополнительные параметры совместимости, но применять их нужно только после теста. Сохранённый PDF не восстановит отсутствующие пиксели; страницу надо пересканировать.
Страница повернута на 90 градусов
Поверните конкретную миниатюру до экспорта. Если все листы приходят одинаково, измените ориентацию профиля. Не используйте пакетный поворот всех страниц, если в комплекте есть альбомные приложения: их ориентация может быть правильной изначально.
Каждый второй лист вверх ногами
Это типичная проблема дуплексного ADF. В профиле найдите параметр переворота оборотов или выберите правильный тип переплёта. Проверьте тест из двух листов с крупными отметками «лицо» и «оборот», затем повторите серию. Ручной поворот сотен страниц — признак неверного профиля.
В PDF пропала последняя страница
Сравните число миниатюр до сохранения и число страниц после повторного открытия. Убедитесь, что выбрано сохранение всех страниц, а не выделенных. При ADF дождитесь завершения задания и возврата интерфейса в состояние готовности; преждевременное закрытие способно оборвать экспорт.
Пустые страницы удаляются вместе с печатями
Отключите автоматическое исключение пустых листов или снизьте чувствительность. Бледная печать занимает малую площадь и может быть классифицирована как пустота. На первом документе сохраните все листы, затем удалите пустые вручную после визуального контроля.
Файл слишком большой
Проверьте, не отсканирован ли простой текст в цвете при 600–1200 dpi. Создайте новую копию с рациональными параметрами или аккуратно сожмите рабочий PDF. Не уменьшайте мастер-копию до проверки мелких деталей. Сильное JPEG-сжатие создаёт ореолы вокруг букв и ухудшает OCR.
Мелкий текст распознаётся неверно
Проверьте фокус, геометрию, язык OCR и реальное разрешение. Увеличьте до 400 dpi, если 300 dpi недостаточно, но не ожидайте чуда от размытых букв. Для таблиц и колонок проверяйте порядок текста. Критичные значения сверяйте вручную.
Фон серый или пятнистый
Очистите стекло, проверьте крышку и уменьшите чрезмерный контраст. Для старой бумаги допустим лёгкий фон; попытка сделать его абсолютно белым может удалить тонкие штрихи. Очистку применяйте к копии и сравнивайте с мастером.
Просвечивает оборот
Используйте тёмную подложку за тонким листом, если это не повредит оригинал, и умеренно настройте контраст. Автоматический порог может убрать оборот, но вместе с ним слабые элементы лицевой стороны. Сохраните версию с данными, а очищенную создайте отдельно.
На скане вертикальная полоса
Протрите узкую полосу стекла ADF: маленькая пылинка в зоне прохода превращается в линию на каждой странице. Если полоса появляется только через податчик, а на планшете её нет, причина почти наверняка в тракте ADF. Повторите тест после очистки.
Листы захватываются по два
Распушите стопку, снимите скобы, выровняйте края и не превышайте ёмкость ADF. Тонкую или липкую бумагу подавайте меньшими партиями. После каждого блока сверяйте число страниц; двойной захват легко пропускает один лист без явной ошибки.
Сканер останавливается посередине серии
Проверьте память, свободное место временной папки, журнал приложения и состояние ADF. Высокое разрешение и цвет создают крупные промежуточные файлы. Повторите меньший блок; если он проходит, разделите задание и объедините проверенные части.
PDF открывается только в одной программе
Сохраните новую копию и проверьте экспорт без экзотических параметров. Если файл повреждён, вернитесь к мастер-изображениям и соберите PDF заново. Совместимость с одним редактором не считается успешной проверкой.
После OCR поиск находит неправильную страницу
Проверьте, не перепутан ли текстовый слой при перестановке страниц после OCR. Безопаснее окончательно упорядочить и повернуть страницы, а затем запускать распознавание. Если порядок уже изменён, повторите OCR на новой копии.
Кириллица превращается в бессмысленные символы
Выберите русский язык или сочетание языков и убедитесь, что соответствующие данные установлены. Не используйте английский профиль по умолчанию для русского договора. После изменения языка распознайте одну страницу и проверьте фамилии.
Цветные печати выглядят чёрными
Проверьте, не выбран ли серый или пороговый режим. Если мастер уже сохранён без цвета, оттенок восстановить нельзя — нужен повторный скан. Для документа, где цвет важен, храните цветную версию независимо от компактной копии.
Страница перекошена
Выровняйте направляющие ADF и не загружайте согнутые листы. Программное выравнивание исправляет небольшой угол, но не лечит волнистую геометрию и разную ширину полей. После выравнивания убедитесь, что текст не был обрезан по краям.
Скан выглядит резким, но OCR плохой
Проверьте масштаб: чрезмерная цифровая резкость создаёт ложные контуры. OCR также страдает от фоновой сетки, штампов и двух колонок. Сравните распознавание с более нейтральной версией без усиления и выберите лучшую.
После пакетной обработки изменились размеры страниц
Программа могла пересчитать dpi или геометрию изображения. В gscan2pdf свойства страницы позволяют исправить метаданные без масштабирования пикселей. Перед печатью проверьте физический формат A4 и режим «фактический размер» на тестовом листе.
Неясно, сохранился ли файл
Не ориентируйтесь на миниатюру в текущем окне. Найдите файл в папке, проверьте размер больше нуля, закройте приложение и откройте его заново. Только этот цикл подтверждает запись на диск.
Часть страницы стала полностью белой
Проверьте автоматическое удаление фона, яркость и режим Lineart. Если белая область видна уже в предпросмотре, измените параметры захвата. Если дефект возникает только после сохранения, отключите дополнительную обработку и сравните несжатое изображение.
Текст у корешка размыт
Книга или журнал не лежит в плоскости фокуса. Не усиливайте резкость до появления ореолов. Попробуйте безопаснее расположить разворот, оставить больший внутренний запас и сделать отдельный проход каждой страницы. Для толстого переплёта нужен сканер с подходящей конструкцией.
Сетевой сканер появляется и исчезает
Проверьте устойчивость Wi‑Fi, энергосбережение МФУ, изменение IP-адреса и прохождение mDNS. Для длительного задания предпочтительнее проводная сеть или ручной адрес, если приложение это поддерживает. После пробуждения устройства обновите список и выполните тестовый лист.
ADF мнёт тонкую бумагу
Не подавайте чеки, кальку и повреждённые листы через податчик, если производитель не разрешает. Используйте планшетное стекло. Ремонт механически повреждённого оригинала сложнее, чем дополнительное время на ручной проход.
В таблице OCR перепутал столбцы
Распознавание текста не гарантирует восстановление структуры. Проверьте порядок копирования, заголовки и числа. Для передачи данных в электронную таблицу используйте специализированное распознавание и ручную сверку; PDF оставьте как визуальное подтверждение.
После сжатия появились квадраты вокруг букв
Сжатие JPEG слишком сильное или страница повторно перекодирована. Вернитесь к мастер-копии, выберите более высокое качество либо чёрно-белое сжатие, подходящее тексту. Сравните мелкий шрифт и печати до замены финального файла.
Рабочие профили для типовых задач
Ниже приведены стартовые профили, а не абсолютные нормы. Конкретный сканер, бумага и требования к хранению могут потребовать корректировки. Каждый профиль сначала проверяется на одной странице, затем на небольшом блоке и только после этого применяется к полной стопке.
Договор на 20 страниц
Используйте 300 dpi, оттенки серого или цвет при значимых печатях, ADF и ручную проверку пустых страниц. До запуска посчитайте физические листы. После прохода сравните число страниц, проверьте подписи и приложения, переставьте листы, затем сохраните графическую мастер-копию. OCR выполняйте на отдельной версии и проверяйте фамилии, номера договоров, суммы и даты.
Если договор подписан только на последней странице, не ограничивайте контроль ею. Приложения могут иметь отдельную нумерацию, а оборот последнего листа — реквизиты. Проверьте переход от основного текста к приложениям и убедитесь, что каждый раздел начинается с ожидаемой страницы.
Двусторонние акты
Выберите duplex, а если его нет — протестируйте ручной дуплекс на трёх листах. Отключите автоматическое удаление пустых оборотов, пока не убедитесь, что бледные подписи не исчезают. Проверьте ориентацию каждой второй страницы и смысловые переходы. При неправильном перевороте исправьте профиль и пересканируйте блок, а не поворачивайте сотни листов вручную.
Для нескольких актов в одной стопке заранее вставьте безопасные разделители или сканируйте каждый комплект отдельно. Автоматическое разделение по пустой странице ненадёжно, если обороты содержат бледные элементы. После сохранения откройте каждый PDF и убедитесь, что первый и последний лист относятся к одному документу.
Квитанции разных размеров
Используйте планшет, предпросмотр и ручную рамку. Сохраняйте отдельные изображения с датой, затем собирайте PDF после сортировки. Автоматическое определение границ проверяйте на каждом новом размере. Для термобумаги выберите серый режим и умеренный контраст, чтобы не потерять цифры.
Несколько квитанций можно разместить на одном листе, но это ухудшает поиск и замену отдельного документа. Для бухгалтерского процесса удобнее одна квитанция на одну страницу PDF или чётко разделённые изображения. Имя файла должно связывать скан с операцией без включения лишних персональных данных.
Учебные конспекты
Цветной режим нужен при маркерах и разноцветных схемах; для обычной ручки достаточно серого. Разрешение 300–400 dpi помогает распознаванию, но рукописный OCR остаётся ненадёжным. Основной результат — читаемое изображение, а не обещание редактируемого текста. Проверьте поля, номера страниц и развороты тетради.
Если тетрадь сканируется разворотами, заранее решите, нужно ли делить каждый кадр на две страницы. Для чтения на экране отдельные страницы удобнее, но автоматическое деление может отрезать текст у сгиба. Сначала проверьте один разворот и настройте одинаковую границу для всей серии.
Коллекция фотографий
Сканируйте по одной или нескольким фотографиям с последующим разделением, если стекло и программа поддерживают удобную рамку. 600 dpi — разумная отправная точка. Сохраняйте мастер без потерь и отдельные JPEG-копии для просмотра. Не применяйте автоматическую реставрацию ко всей коллекции без сравнения: один профиль не подходит одновременно светлым и тёмным снимкам.
Подписи на обороте фотографии тоже являются данными. Если они важны, сканируйте оборот отдельным файлом и связывайте его с лицевой стороной одинаковым номером, например photo_012_front и photo_012_back. В PDF размещайте оборот сразу после соответствующей фотографии.
Старая книга
Не давите на корешок и не повреждайте переплёт ради ровного кадра. Используйте мягкое прижатие, если оно безопасно, и оставляйте запас у внутреннего поля. Сканируйте развороты или отдельные страницы в зависимости от конструкции. После OCR проверяйте переносы, колонтитулы и порядок колонок. Мастер-изображения сохраняйте отдельно.
Нумерация печатных страниц может не совпадать с номером PDF из-за обложки, титула и пустых листов. При проверке фиксируйте оба значения: «страница PDF 7 — печатная страница 3». Это помогает быстро заменить дефектный лист и не ошибиться при повторном сканировании.
Чертежи и схемы
Выберите повышенное разрешение и серый либо цветной режим, чтобы сохранить тонкие линии. Проверьте масштаб и физический размер страницы. Если большой лист сканируется частями, перекрывайте фрагменты и собирайте копию отдельно; не удаляйте части до проверки стыков. PDF после сборки откройте при 100% и проверьте линии на границах.
При склейке фрагментов не растягивайте одну часть независимо от другой. Иначе масштаб по разным сторонам листа станет неодинаковым. Используйте общие опорные точки, сохраняйте неизменённые части и проверяйте известный размер на готовом изображении.
Ежедневная входящая корреспонденция
Создайте профиль с ADF, 300 dpi, автосохранением в папку дня и последовательным номером. Однако оставьте изображения в интерфейсе хотя бы на пилотном периоде, чтобы оценить ошибочные пустые страницы и ориентацию. В конце дня проверяйте количество файлов, уникальность имён и резервную копию.
Профиль ежедневного процесса должен быть простым. Если оператор каждый раз меняет пять параметров, ошибки неизбежны. Создайте отдельные профили для одностороннего серого, двустороннего цветного и фотографий. Название профиля должно объяснять результат без открытия настроек.
Анкеты и формы
Форма может содержать печатный текст, рукописные ответы и отметки в клетках. Цветной или серый режим безопаснее порогового, потому что слабый карандаш и галочка могут исчезнуть. После OCR не используйте распознанный текст как единственный источник данных: сравнивайте поля с изображением и проверяйте, к какому вопросу относится ответ.
Если форма состоит из нескольких листов без номера, добавьте порядок до сканирования безопасным способом, который не портит документ, либо ведите отдельный список. После сохранения проверьте заголовок каждого листа и переходы между разделами.
Как выбирать программу по сценарию
Для поддерживаемой российской Linux-системы и последующей работы с уже созданным PDF подходит PDF Commander. Он полезен там, где сканирование выполняется отдельно, а затем нужно проверить структуру, заменить или переставить страницы, добавить OCR или сохранить управляемую копию. На другом дистрибутиве не следует рассчитывать на неподтверждённую установку.
Для нескольких листов в GNOME выбирайте Document Scanner. Он быстро показывает устройство, получает страницы и сохраняет PDF без длинной настройки. Если нужен поисковый слой, добавьте отдельный OCR-этап и не удаляйте графическую мастер-копию.
Для повторяемых офисных процессов, ADF, профилей, автосохранения и OCR удобнее NAPS2. При старом USB-сканере избегайте Flatpak, если требуется сторонний SANE-драйвер. Для современного сетевого МФУ проверьте eSCL.
Для фотографий и точной рамки выбирайте Skanlite. Он помогает получить качественные изображения, но длинный PDF лучше собирать в программе с панелью страниц. Для сложного ручного дуплекса и модульной обработки подходит gscan2pdf.
XSane стоит использовать, когда нужен полный набор параметров SANE, диагностика или работа со старым оборудованием. Skanpage удобен пользователям KDE, которым нужна современная сборка многостраничного документа с миниатюрами.
Финальная проверка перед передачей PDF
- Закройте программу, в которой выполнялось сканирование или сохранение.
- Убедитесь, что открываете именно финальную копию, а не файл из списка недавних документов.
- Сверьте число страниц с бумажным комплектом и журналом сканирования.
- Проверьте первую, последнюю и не менее трёх страниц из середины; для длинного документа просмотрите все миниатюры.
- Убедитесь, что ни один лист не повёрнут и не отражён, а обороты стоят после соответствующих лицевых сторон.
- Увеличьте страницу с мелким шрифтом до 200–300% и проверьте края букв, печати и тонкие линии.
- Для поискового PDF найдите редкое слово, скопируйте фрагмент и сравните важные реквизиты с изображением.
- Откройте файл во втором просмотрщике. Проверьте одинаковое отображение и отсутствие сообщения о повреждении.
- Скопируйте файл в другую папку или на тестовый носитель и откройте копию.
- Сохраните мастер-сканы и рабочую версию до подтверждения, что получатель открыл финальный PDF.
Проверка страницы после замены
Если одна страница была пересканирована, проверьте не только её качество. Убедитесь, что новая страница заняла правильное место, имеет ту же ориентацию и физический формат, а OCR-слой соответствует изображению. Старый текстовый слой может остаться связанным с прежней страницей, поэтому после замены безопаснее повторить OCR для финальной копии.
Проверка после уменьшения размера
Сравните до и после одну страницу с мелким шрифтом, одну с печатью и одну с фотографией. Откройте обе версии при одинаковом масштабе. Если вокруг букв появились ореолы, а тонкие линии распались, сжатие слишком сильное. Размер файла не должен уменьшаться ценой потери юридически или смыслово важных деталей.
Проверка на другом компьютере
Второй компьютер полезен не ради другого интерфейса, а ради независимости от временных данных и локальных шрифтов. Откройте скопированный файл, проверьте число страниц, поиск и отображение. Если проблема проявляется только на одном компьютере, сравните версии просмотрщика; если на обоих, исправляйте сам PDF.
Вопросы и ответы
Какая программа лучше подходит для простого домашнего сканирования в Linux?
Для нескольких листов в среде GNOME обычно удобен Document Scanner: минимальный интерфейс, поворот, кадрирование и PDF. В KDE похожий сценарий закрывают Skanpage или Skanlite, но первый лучше организует многостраничный документ, а второй — отдельные изображения и точный предпросмотр. Выбор проверяют на своём сканере, потому что доступные параметры зависят от SANE-бэкенда.
Можно ли использовать PDF Commander на любом Linux?
Нет. Linux-версия заявлена для Astra Linux, ALT Linux, РЕД ОС и РОСА. На неподдерживаемом дистрибутиве нельзя обещать штатную установку. В этом рейтинге программа рассматривается как настольный этап работы с уже полученным PDF на совместимой системе, а не как универсальный SANE-клиент.
Почему МФУ печатает в Linux, но не сканирует?
Печать и сканирование используют разные протоколы и драйверы. Наличие очереди принтера подтверждает только печатающую часть. Для сканера нужен подходящий SANE-бэкенд, фирменный пакет или eSCL/AirScan. Проверяйте сканирующую часть отдельно и не переустанавливайте приложение, пока устройство не видно на системном уровне.
Что выбрать: SANE или eSCL?
SANE подходит локальным и многим сетевым устройствам, включая старые модели со специальными бэкендами. eSCL удобен современным сетевым сканерам и часто не требует фирменного драйвера. Выбор определяется поддержкой конкретной модели. В NAPS2 оба варианта проверяются через выбор драйвера и тест одной страницы.
Почему NAPS2 Flatpak не видит USB-сканер?
Универсальная сборка изолирована и официально ограничена при работе со сторонними SANE-драйверами. Проверьте нативный DEB/RPM и другой SANE-клиент. Если устройство появляется там, причина связана со способом упаковки, а не с кабелем. Профиль создавайте заново после смены сборки, чтобы не сохранить неверное имя устройства.
Достаточно ли 300 dpi для документов?
Для большинства печатных текстов — да. 400–600 dpi нужны при мелком шрифте, трудном OCR, схемах и маленьких оригиналах. Сравните одну страницу: увеличение dpi оправдано только при реальном улучшении деталей. Если картинка стала больше, а контуры остались такими же размытыми, дополнительного качества нет.
Нужно ли сканировать текст в чёрно-белом режиме?
Не обязательно. Оттенки серого лучше сохраняют сглаживание, подписи и бледные печати. Чёрно-белый режим даёт компактный файл, но требует точного порога. Начинайте с серого и переходите к пороговому режиму после теста на странице с самым слабым элементом.
Как сделать PDF с поиском по словам?
Нужно выполнить OCR и встроить текстовый слой. Это умеют NAPS2, gscan2pdf с установленным движком и поддерживаемая сборка PDF Commander. Document Scanner, Skanlite и XSane прежде всего получают изображения; им нужен отдельный OCR-этап. После распознавания обязательно найдите редкое слово и проверьте критичные значения.
Становится ли скан редактируемым после OCR?
OCR добавляет распознанный текст, но визуальная страница остаётся изображением. Поиск и копирование появляются, однако безопасное редактирование макета не гарантируется. Таблицы, колонки, печати и рукописные поля могут распознаться неверно. Изменения проверяют по изображению, а для исправления бумажного документа лучше заменить страницу.
Как не потерять страницы при ручном двустороннем сканировании?
Сначала протестируйте три листа с крупными номерами сторон. Зафиксируйте, как переворачивать стопку, и используйте режим лицевых и оборотных сторон в gscan2pdf либо ручную перестановку миниатюр. После сборки проверьте смысловые переходы и несколько мест в середине, а не только первую пару страниц.
Можно ли автоматически удалять пустые страницы?
Можно, но только после настройки на реальном документе. Бледная печать, подпись или карандашная отметка могут быть приняты за пустоту. На важных заданиях сначала сохраняйте все страницы, затем удаляйте пустые вручную. При массовом процессе протестируйте чувствительность на самом бледном обороте.
Какой формат сохранять до сборки PDF?
Для мастер-страниц предпочтительны PNG или TIFF, если объём допустим. JPEG подходит фотографиям и рабочим копиям при разумном качестве, но повторное сохранение ухудшает изображение. Главное — не удалять мастер до проверки PDF и не смешивать страницы с разным форматом именования.
Почему PDF после сканирования огромный?
Чаще всего выбраны цвет, высокое разрешение и слабое сжатие для простого текста. Проверьте профиль и создайте отдельную компактную копию. Не сжимайте единственный мастер и обязательно сравните мелкий текст, печать и фотографию до и после. Большой размер сам по себе не доказывает высокое качество.
Как проверить, что PDF не повреждён?
Закройте программу, откройте файл заново, прокрутите все страницы и затем откройте во втором просмотрщике. Скопируйте файл в другую папку и повторите открытие. Наличие миниатюры в текущем приложении не подтверждает корректную запись: она может показывать данные текущей сессии.
Что делать, если одна страница получилась плохо?
Не пересканируйте всю стопку. Получите только нужный лист с теми же параметрами, сохраните отдельно и замените страницу в программе с панелью миниатюр. После замены снова проверьте порядок, физический размер и OCR-слой. Старую страницу удаляйте только после повторного открытия новой версии.
Какая программа удобнее для старого сканера?
Начните с проверки поддержки SANE. XSane хорошо показывает параметры бэкенда и подходит для диагностики. Если устройство работает, можно перейти к более современному интерфейсу. При фирменном стороннем драйвере выбирайте нативный пакет приложения, а не изолированную сборку, пока не доказана совместимость.
Нужно ли сохранять пустые обороты?
Если пустой оборот не несёт смысла и правила документооборота разрешают его удалить, страницу можно убрать после визуальной проверки. Но автоматическое удаление опасно для бледных пометок. В двустороннем комплекте сначала сохраните всё, сравните число сторон и только затем удаляйте подтверждённые пустые листы.
Можно ли сканировать напрямую в один PDF?
Да, Document Scanner, NAPS2, gscan2pdf и Skanpage поддерживают многостраничный сценарий. Прямой PDF удобен для короткого задания. Для большого или ценного комплекта отдельные мастер-изображения дают лучший откат: одну страницу можно заменить без нового прохода всей стопки.
Как выбрать между Skanlite и Skanpage?
Skanlite сильнее в точном предпросмотре, выборе области и сохранении отдельных изображений. Skanpage лучше показывает документ как набор страниц и экспортирует многостраничный PDF. Для фотографий чаще удобен Skanlite, для договора — Skanpage. Оба зависят от параметров, которые предоставляет SANE.
Почему в программе нет параметра, показанного на снимке интерфейса?
Многие поля приходят от устройства и SANE-бэкенда. Если сканер не поддерживает duplex, аппаратный порог или конкретное разрешение, программа не обязана показывать этот пункт. Проверьте выбранный источник и драйвер. Не устанавливайте случайные пакеты только ради чужой кнопки: функция должна поддерживаться аппаратно или бэкендом.
Как проверить правильность OCR в таблице?
Скопируйте несколько строк в текстовый редактор или электронную таблицу и сравните порядок столбцов, десятичные разделители, минусы и номера. Поиск одного слова недостаточен. Если структура нарушена, оставьте PDF как визуальный документ и извлекайте данные специализированным средством с ручной сверкой.
Что делать, если программа зависла после сканирования?
Не закрывайте окно мгновенно, если индикатор диска или процесс экспорта ещё активен. Подождите разумное время, проверьте свободное место и журнал. После принудительного завершения не доверяйте последнему файлу: откройте его, проверьте число страниц и при необходимости повторите только незавершённый блок.
Итоги
Лучший выбор определяется не числом кнопок, а стабильностью полного цикла. PDF Commander подходит для поддерживаемых Linux-систем и последующей работы с полученным PDF. Document Scanner обеспечивает быстрый простой захват. NAPS2 сильнее в профилях, ADF, пакетных заданиях и OCR. Skanlite удобен для точного предпросмотра и отдельных изображений. gscan2pdf закрывает сложные многостраничные процессы и ручной дуплекс. XSane даёт подробный контроль SANE, а Skanpage сочетает KDE-интерфейс с организацией страниц.
Независимо от программы, сохраняйте мастер, проверяйте границы и порядок до экспорта, не путайте OCR с редактированием и обязательно открывайте готовый PDF заново. Именно повторное открытие показывает, что результат существует как самостоятельный файл, а не только как удачная картинка в текущем окне. Для важного документа добавьте второй просмотрщик, проверку поиска и копирование файла в другую папку.