capture2text: программа для распознавания текста с экрана
Capture2Text — компактная OCR-программа для Windows, которая распознает текст с выбранной области экрана и сразу помещает результат в буфер обмена. Ее основной сценарий простой: на экране есть текст, который нельзя выделить мышью, пользователь нажимает горячую клавишу, обводит нужный фрагмент, а затем вставляет распознанный текст в Word, Excel, браузер, переводчик, заметки, письмо или любую другую программу. Capture2Text полезна там, где обычное копирование не работает: в скриншотах, изображениях, защищенных PDF, интерфейсах старых программ, окнах ошибок, видео, играх, презентациях, комиксах и документах, открытых как картинка. Программа бесплатная, распространяется по лицензии GNU GPL, работает без установки и поддерживает OCR-захват через графический режим и командную строку.
Скачать capture2text
Для текста и надписей на фото
⬇ Скачать PDF Commander бесплатно
⬇ Скачать capture2text бесплатно
Это не редактор PDF, не сканер документов и не приложение для верстки распознанных страниц. Capture2Text устроена иначе: она решает точечную задачу быстрого извлечения текста из изображения на экране. За счет этого программа запускается из папки, живет в системном трее, не перегружает пользователя большим главным окном и большую часть времени работает через сочетания клавиш. Такой подход особенно удобен, когда нужно не распознавать целую книгу, а быстро забрать номер заказа, фразу из скриншота, строку из PDF, текст ошибки, японскую реплику из игры, подпись на изображении или таблицу с сайта, где выделение текста заблокировано.

Меню Capture2Text в системном трее: через него открываются настройки, выбирается язык OCR, включается сохранение в буфер обмена и отображение всплывающего окна.
Главная идея Capture2Text — распознавание текста с экрана без лишних промежуточных действий. Не нужно сначала делать скриншот, сохранять файл, открывать его в отдельном OCR-редакторе, запускать анализ и копировать результат вручную. В стандартном режиме достаточно поставить курсор в левый верхний угол нужной области, нажать Windows Key + Q, растянуть синюю рамку по тексту и завершить захват. После этого результат попадает в clipboard, а при включенной опции Show Popup Window дополнительно появляется окно с распознанным текстом.
Содержание
- 1 Назначение Capture2Text
- 2 Основные характеристики
- 3 Интерфейс: программа без большого главного окна
- 4 Установка и первый запуск
- 5 Поддержка языков и русский OCR
- 6 Как распознать текст с экрана через Windows Key + Q
- 7 Text Line Capture: распознавание одной строки
- 8 Forward Text Line Capture: захват строки от выбранной точки
- 9 Bubble Capture: OCR текста в облачках комиксов
- 10 Окно настроек Capture2Text
- 11 Hotkeys: настройка горячих клавиш
- 12 OCR 1: язык, whitelist, blacklist, ориентация и предварительная обработка
- 13 OCR 2: автоматические режимы строки и облачка
- 14 Capture Box: настройка области захвата
- 15 Preview: предварительный просмотр результата
- 16 Output: куда попадает распознанный текст
- 17 Popup-окно с результатом OCR
- 18 Replace: автозамены и регулярные выражения
- 19 Translate: перевод распознанного текста
- 20 Speech: озвучивание распознанного текста
- 21 Command Line Options: работа через Capture2Text_CLI.exe
- 22 Практические сценарии использования
- 23 Точность распознавания
- 24 Плюсы Capture2Text
- 25 Минусы и ограничения
- 26 Сравнение с аналогами
- 27 Для кого подходит Capture2Text
- 28 Кому лучше выбрать другое решение
- 29 Частые проблемы и решения
- 29.1 Нет значка Capture2Text в трее
- 29.2 Клик по значку ничего не делает
- 29.3 Вместо текста появляются мусорные символы
- 29.4 Нужного языка нет в меню OCR Language
- 29.5 Горячая клавиша не срабатывает
- 29.6 OCR обрезает часть текста
- 29.7 OCR захватывает лишние строки
- 29.8 Плохо распознаются цифры
- 29.9 Плохо распознается наклонный текст
- 29.10 Перевод не работает
- 29.11 Не хватает переносов строк
- 29.12 Нужно сохранить все OCR-захваты
- 30 Рекомендации по настройке для разных задач
- 31 Итоговая оценка Capture2Text
Назначение Capture2Text
Capture2Text нужна для случаев, когда текст виден глазами, но недоступен как обычный текстовый слой. Программа превращает изображение текста в редактируемую строку, которую можно вставить, сохранить, перевести, озвучить или передать другой программе. В русском языке такой сценарий обычно называют распознаванием текста с экрана, OCR с экрана, извлечением текста из картинки или копированием текста из скриншота.
Типичные задачи, которые можно сделать в Capture2Text:
| Задача | Как помогает Capture2Text |
|---|---|
| Скопировать текст из картинки | Выделяется область изображения, результат попадает в буфер обмена |
| Распознать текст в невыделяемом PDF | Захватывается участок страницы, открытой в любом просмотрщике |
| Забрать текст из видео | Видео ставится на паузу, затем распознается нужный фрагмент кадра |
| Скопировать сообщение об ошибке | Обводится окно ошибки или отдельная строка |
| Распознать номер, код, артикул | Используются OCR-захват, whitelist и автозамены |
| Перевести фрагмент на другой язык | Включается вкладка Translate и вывод перевода в popup или clipboard |
| Озвучить распознанную строку | Включается Enable Text-to-speech, затем используется кнопка Say |
| Автоматизировать OCR | Используется Capture2Text_CLI.exe с параметрами командной строки |
Главное отличие Capture2Text от тяжелых OCR-приложений в том, что программа ориентирована на быстрые фрагменты. Она не просит импортировать документ, не строит сложную структуру страницы и не заставляет проходить мастер распознавания. Это делает ее удобной для повседневных мелких задач: распознать пару строк, вставить текст в форму, скопировать дату из изображения, перевести подпись, получить текст из скриншота товара, сохранить фрагмент инструкции.
Основные характеристики
| Параметр | Значение |
|---|---|
| Название | Capture2Text |
| Тип | OCR-утилита для распознавания текста с экрана |
| Платформа | Windows |
| Поддерживаемые ОС в списке программы | Windows 7, Windows 8/8.1, Windows 10 |
| Установка | Не требуется, запуск из распакованной папки |
| Основной файл | Capture2Text.exe |
| Командная строка | Capture2Text_CLI.exe |
| Основная горячая клавиша | Windows Key + Q |
| Режим одной строки | Windows Key + E |
| Режим строки от выбранной точки | Windows Key + W |
| Режим облачка комикса | Windows Key + S |
| Быстрое переключение языков | Windows Key + 1, Windows Key + 2, Windows Key + 3 |
| Переключение ориентации текста | Windows Key + O |
| Вывод результата | Буфер обмена, popup, лог-файл, внешний исполняемый файл, stdout через CLI |
| Перевод | Через вкладку Translate, требуется интернет |
| Озвучивание | Через вкладку Speech и Text-to-speech |
| Лицензия | GNU GPL |
| Последнее обновление страницы проекта на SourceForge | 2022-03-19 |
| Дополнительные возможности | Whitelist, Blacklist, Replace, регулярные выражения, deskew, trim, масштабирование, CLI |
Capture2Text рассчитана на Windows. В списке поддерживаемых систем указаны Windows 7, Windows 8/8.1 и Windows 10; Windows XP не поддерживается начиная с версии 4.0. Программа обозначена как Windows-приложение, не требующее установки.
Интерфейс: программа без большого главного окна
Capture2Text не открывает привычное стартовое окно с крупными кнопками Открыть файл, Распознать, Сохранить. После запуска Capture2Text.exe программа добавляет значок в системный трей Windows. Именно через этот значок открывается контекстное меню, где находятся основные переключатели и вход в настройки.
В меню видны пункты Settings…, Save to Clipboard, Show Popup Window, OCR Language, Text Orientation, Help и Exit. Такая структура показывает логику программы: сначала пользователь выбирает язык и поведение вывода, затем работает горячими клавишами. Если включен Save to Clipboard, результат OCR автоматически сохраняется в буфер обмена. Если включен Show Popup Window, после захвата появляется отдельное окно с распознанным текстом.
Значок в трее важен по двум причинам. Во-первых, через него выбирается активный язык OCR. Во-вторых, через него открывается окно Capture2Text — Settings, где находятся вкладки Hotkeys, OCR 1, OCR 2, Capture Box, Preview, Output, Replace, Translate и Speech. Управление выглядит старомодно, но оно логичное: каждая вкладка отвечает за отдельный участок работы — горячие клавиши, качество распознавания, вид рамки, вывод текста, автозамены, перевод и озвучивание.
Если значок не виден, его нужно искать не в окне программы, а в области уведомлений Windows. Частая ситуация — значок скрыт за стрелкой Show hidden icons. В этом случае надо раскрыть скрытые значки, найти Capture2Text, а затем щелкнуть по нему правой кнопкой мыши. Обычный левый клик по значку не открывает основное меню: для доступа к настройкам используется именно правый клик.
Установка и первый запуск
Capture2Text работает без классической установки. Пользователь скачивает ZIP-архив, распаковывает его в удобную папку и запускает файл Capture2Text.exe. После запуска в правой нижней части экрана появляется значок программы. Если значок не отображается сразу, нужно раскрыть скрытые значки Windows в системном трее.
Правильный порядок первого запуска выглядит так:
-
Распаковать ZIP-архив Capture2Text в отдельную папку.
-
Открыть распакованную папку.
-
Запустить
Capture2Text.exe. -
Найти значок Capture2Text в системном трее.
-
Щелкнуть по значку правой кнопкой мыши.
-
Проверить, включен ли пункт Save to Clipboard.
-
При необходимости включить Show Popup Window.
-
Через OCR Language выбрать язык распознавания.
-
Через Settings… открыть расширенные настройки.
Запускать программу прямо из архива не стоит. Если файл открыт без распаковки, часть компонентов может работать неправильно, а языковые данные и настройки окажутся недоступны. У Capture2Text нет отдельного деинсталлятора, потому что программа не ставит себя в систему обычным установщиком. Для удаления достаточно закрыть программу через Exit и удалить папку Capture2Text. Настройки по умолчанию можно восстановить удалением файла конфигурации из %appdata%Capture2Text; для полностью переносимого режима используется запуск с параметром --portable, при котором .ini хранится рядом с Capture2Text.exe.
Поддержка языков и русский OCR
Capture2Text поддерживает большое количество языков OCR. В комплекте идут English, French, German, Japanese, Korean, Russian и Spanish. Русский язык присутствует в базовом наборе, поэтому для распознавания русскоязычных фрагментов обычно достаточно выбрать Russian в меню OCR Language. Дополнительные языки добавляются через словари: файлы из языкового архива помещаются в папку tessdata, после чего Capture2Text перезапускается.

Меню OCR Language: здесь выбирается активный язык распознавания, например English, Russian, Japanese или Spanish.
Выбор языка — один из главных факторов точности. Если на изображении русский текст, а в Capture2Text активен English, OCR может вернуть набор похожих латинских символов, неправильно распознать кириллицу или выдать бессмысленный результат. Для английского текста нужно выбирать English, для русского — Russian, для японского — Japanese, для корейского — Korean. При работе с китайским и японским текстом дополнительно важна ориентация: горизонтальный и вертикальный текст обрабатываются по-разному, а переключение выполняется через меню Text Orientation или горячую клавишу Windows Key + O.
В повседневной работе удобно настроить три быстрых языка. Для этого используются Quick-Access Languages и сочетания Windows Key + 1, Windows Key + 2, Windows Key + 3. Например, первый слот можно отдать под English, второй — под Russian, третий — под Japanese. Тогда не придется каждый раз открывать меню в трее: язык переключается горячей клавишей перед захватом.
Как распознать текст с экрана через Windows Key + Q
Стандартный OCR-захват — основной режим Capture2Text. Он используется для большинства задач: скриншотов, PDF, изображений, сайтов, окон программ, видео и любых областей экрана, где есть текст.

Синяя область Capture Box показывает фрагмент экрана, который будет отправлен на распознавание.
Порядок действий:
-
Поставить курсор мыши в левый верхний угол текста, который нужно распознать.
-
Нажать
Windows Key + Q. -
Переместить мышь так, чтобы синяя рамка покрыла весь нужный фрагмент.
-
Если рамку нужно сдвинуть целиком, удерживать правую кнопку мыши и перетащить область.
-
Завершить захват повторным нажатием
Windows Key + Q, левым кликом мыши или клавишейEnter. -
Вставить результат из буфера обмена через
Ctrl + V.
После завершения захвата Capture2Text помещает распознанный текст в clipboard. Если включено всплывающее окно, результат дополнительно появляется в popup-окне. Такой вариант удобен, когда нужно сначала проверить OCR-текст глазами, исправить ошибку или нажать кнопку озвучивания.
Практический пример: на сайте размещена картинка с таблицей, а текст в ней не выделяется. Пользователь выбирает Russian, нажимает Windows Key + Q, обводит только ячейки с нужными данными и получает текст в буфере. Затем результат можно вставить в Excel или в заметки. Если OCR склеил строки, помогает настройка Keep line breaks на вкладке Output. Если в таблице нужны только цифры, можно использовать Whitelist и ограничить распознавание символами 0123456789.,-.
Второй пример: в PDF открыт отсканированный документ. В нем нельзя выделить строку с номером договора. Вместо запуска отдельной OCR-программы достаточно увеличить масштаб страницы, выбрать язык, обвести номер через Windows Key + Q и вставить результат в нужное поле.
Третий пример: на экране ошибка программы. Вместо ручного перепечатывания длинного сообщения можно обвести текст ошибки, получить его в буфере обмена и отправить в поддержку. Для таких задач Capture2Text особенно удобна: распознавание занимает меньше времени, чем ручной набор.
Text Line Capture: распознавание одной строки
Режим Text Line OCR Capture нужен, когда требуется забрать не прямоугольный блок, а одну строку рядом с курсором. Горячая клавиша по умолчанию — Windows Key + E. Пользователь ставит указатель мыши на строку или рядом с ней, нажимает сочетание, а Capture2Text автоматически определяет ближайшую строку, обводит ее и отправляет результат OCR в буфер обмена.

Режим Text Line OCR Capture автоматически находит строку около курсора и распознает ее без ручного растягивания рамки.
Этот режим полезен при работе со списками, меню, субтитрами, строками таблиц, журналами событий, логами и интерфейсами, где текст расположен ровными горизонтальными линиями. Например, если нужно скопировать одну строку из окна программы, нет необходимости аккуратно обводить прямоугольник. Достаточно поставить курсор рядом с фразой и нажать Windows Key + E.
Для распознавания одной строки особенно важны настройки вкладки OCR 2. Там задаются параметры автоматического поиска строки: длина, ширина, смещение, область анализа. Если Capture2Text захватывает слишком короткий или слишком длинный фрагмент, эти параметры можно подстроить под конкретный тип текста. На обычных интерфейсах настройки по умолчанию часто подходят, но для игр, субтитров, японского текста, нестандартных шрифтов и плотных таблиц ручная настройка может заметно улучшить результат.
Forward Text Line Capture: захват строки от выбранной точки
Forward Text Line OCR Capture похож на режим одной строки, но захватывает текст не целиком, а от символа рядом с курсором и дальше по направлению строки. Горячая клавиша по умолчанию — Windows Key + W. Такой режим удобен, когда строка длинная, а нужна только ее часть. Например, в интерфейсе есть строка Order ID: 582940 / Status: Paid / Date: 2026-06-30, а пользователю нужно быстро забрать участок начиная с номера заказа.
Порядок работы простой:
-
Навести курсор на символ или слово, с которого должен начинаться захват.
-
Нажать
Windows Key + W. -
Дождаться обводки найденного фрагмента.
-
Вставить результат из буфера обмена.
Этот режим стоит использовать аккуратно. Если строка слишком близко расположена к соседним строкам, если фон шумный или текст идет нестандартным шрифтом, Capture2Text может захватить не тот участок. В таких случаях надежнее использовать обычный режим Windows Key + Q и вручную задать область.
Bubble Capture: OCR текста в облачках комиксов
Режим Bubble OCR Capture создан для распознавания текста внутри полностью замкнутых облачков речи или мыслей. Горячая клавиша по умолчанию — Windows Key + S. Пользователь ставит курсор не на буквы, а в пустую часть облачка, нажимает сочетание, после чего Capture2Text определяет границы пузыря, обводит текст и сохраняет OCR-результат в буфер обмена.

Режим Bubble Capture рассчитан на текст внутри замкнутых speech/thought bubble.
Этот режим интересен тем, кто читает комиксы, мангу, визуальные новеллы или игры с текстовыми репликами. Он не заменяет специализированные инструменты для перевода манги, но позволяет быстро вытащить отдельную фразу без ручного выделения прямоугольной области. Важно, чтобы облачко было замкнутым: если границы разорваны, фон сложный, текст залезает на контур или пузырь частично перекрыт, автоматическое определение области может ошибиться.
При работе с японским текстом нужно правильно выбрать Japanese и настроить Text Orientation. Для горизонтальных реплик подходит горизонтальная ориентация, для вертикального текста — вертикальная. Режим Auto выбирает ориентацию по соотношению ширины и высоты области: если ширина больше высоты более чем в два раза, используется горизонтальный режим, иначе вертикальный.
Окно настроек Capture2Text
Окно Capture2Text — Settings открывается через правый клик по значку в трее и пункт Settings…. В нем собраны основные параметры программы. Вкладки распределены логично:
| Вкладка | За что отвечает |
|---|---|
| Hotkeys | Горячие клавиши для OCR-захвата, языков и ориентации |
| OCR 1 | Активный язык, quick-access languages, whitelist, blacklist, ориентация, deskew, trim |
| OCR 2 | Параметры автоматических режимов Text Line, Forward Text Line и Bubble |
| Capture Box | Цвета и прозрачность рамки захвата |
| Preview | Внешний вид окна предпросмотра |
| Output | Буфер обмена, popup, переносы строк, логирование, вызов внешней программы |
| Replace | Автозамены и регулярные выражения |
| Translate | Перевод OCR-текста |
| Speech | Text-to-speech, голос, громкость, темп и тон |
В Capture2Text почти нет случайных настроек. Большинство параметров прямо связано с качеством распознавания или дальнейшей обработкой результата. Это делает программу гибкой: ее можно использовать как простую утилиту по схеме нажал Win+Q — вставил текст, а можно настроить под узкие сценарии вроде распознавания только цифровых кодов, сохранения всех результатов в лог, передачи текста скрипту или перевода японских реплик.
Hotkeys: настройка горячих клавиш
Вкладка Hotkeys отвечает за все основные сочетания клавиш. Здесь можно изменить старт стандартного OCR-захвата, повтор последнего захвата, режим одной строки, режим строки от выбранной точки, Bubble Capture, быстрые языки и переключение ориентации текста.

Вкладка Hotkeys: здесь назначаются сочетания клавиш для основных режимов Capture2Text.
На вкладке доступны следующие действия:
| Действие | Назначение |
|---|---|
| Start OCR Capture | Запуск стандартного OCR-захвата |
| Re-Capture Last | Повторное распознавание последней области |
| Text Line Capture | Захват одной строки рядом с курсором |
| Forward Text Line Capture | Захват строки от выбранного символа вперед |
| Bubble Capture | Захват текста внутри облачка |
| Quick-Access Language 1 | Быстрое переключение на первый выбранный язык |
| Quick-Access Language 2 | Быстрое переключение на второй выбранный язык |
| Quick-Access Language 3 | Быстрое переключение на третий выбранный язык |
| Text Orientation | Переключение ориентации текста |
| Toggle Whitelist | Включение и отключение whitelist |
| Toggle Blacklist | Включение и отключение blacklist |
Если какая-то горячая клавиша конфликтует с другой программой, ее можно заменить. Если действие не нужно, его можно отключить через значение <Unmapped>. Это полезно, когда Windows Key + Q или другие сочетания уже используются системой, лаунчером, менеджером окон, утилитой скриншотов или корпоративным ПО.
Для повседневной работы лучше оставить отдельные сочетания для трех действий: стандартного захвата, переключения языка и повтора последней области. Re-Capture Last удобен, когда на экране постоянно обновляется один и тот же блок: например, меняются субтитры, строки лога, значения в удаленном окне, статус заказа или ячейка в таблице. Пользователь один раз задает область, а затем повторяет распознавание без нового выделения.
OCR 1: язык, whitelist, blacklist, ориентация и предварительная обработка
Вкладка OCR 1 — одна из самых важных. Здесь задается активный язык распознавания, быстрые языки, ограничения символов и параметры предварительной обработки изображения.

Вкладка OCR 1: выбор языка, быстрые языки, whitelist, blacklist, ориентация текста, Scale Factor, Trim Capture и Deskew Capture.
Поле Current OCR Language определяет, какой язык будет использоваться при следующем захвате. Этот же параметр можно менять через меню OCR Language в трее. Блок Quick-Access Languages позволяет назначить языки на быстрые переключатели. Например, если пользователь часто работает с английским, русским и немецким текстом, эти языки можно назначить на быстрые слоты и не открывать меню каждый раз.
Whitelist сообщает OCR-движку, какие символы разрешено распознавать. Это сильная настройка для узких задач. Если нужно распознать только номер заказа, артикул, сумму или дату, можно ограничить набор символов цифрами, дефисом, точкой, запятой и слешем. Например:
0123456789-./,
Такой whitelist помогает уменьшить путаницу между похожими символами. OCR часто путает O и 0, I, l и 1, S и 5, особенно на мелких скриншотах. Если пользователь заранее знает, что в захватываемой области должны быть только цифры, whitelist делает результат чище.
Blacklist работает наоборот: он исключает символы, которые не должны появляться в результате. Например, если OCR постоянно добавляет лишние кавычки, вертикальные черты или случайные спецсимволы, их можно занести в blacklist. В отличие от автозамен, blacklist влияет уже на этап распознавания: программа старается не возвращать запрещенные символы.
Text Orientation используется для китайского и японского текста. Для русского и английского текста эта настройка обычно не нужна, потому что текст почти всегда горизонтальный. Для японской манги, игр и вертикальных реплик выбор ориентации критичен. Если вертикальный текст распознавать как горизонтальный, результат будет плохим даже при хорошем качестве изображения.
Tesseract Config File — расширенная настройка для пользователей, которые знают параметры Tesseract и хотят передать собственный конфигурационный файл. В обычном сценарии этот пункт не нужен. Для большинства пользователей полезнее правильно выбрать язык, увеличить область, повысить масштаб исходного текста и настроить whitelist.
Scale Factor задает масштабирование при предварительной обработке. Для мелкого текста увеличение масштаба может помочь OCR-движку увидеть буквы четче. Но слишком большой масштаб не всегда лучше: если исходное изображение шумное, увеличение может усилить дефекты. Практический подход простой: если мелкий текст распознается плохо, стоит попробовать увеличить масштаб и сравнить результат.
Trim Capture обрезает захваченное изображение до переднего плана и добавляет тонкую рамку. Эта функция помогает, когда вокруг текста много пустого пространства или область выделена неточно. Deskew Capture пытается компенсировать наклон текста. Она полезна для слегка повернутых сканов, фотографий, кривых изображений и фрагментов, где строка идет под углом.
OCR 2: автоматические режимы строки и облачка
Вкладка OCR 2 управляет автоматическими режимами Text Line Capture, Forward Text Line Capture и Bubble Capture. Здесь находятся параметры, которые определяют, как далеко Capture2Text ищет текст от курсора, какую ширину и высоту области анализирует, насколько далеко смотрит вперед и назад, как выбирает границы строки и пузыря.

Вкладка OCR 2: параметры автоматического поиска строки и текста внутри облачка.
Эта вкладка нужна не всем. Если пользователь применяет только стандартный режим Windows Key + Q, настройки OCR 2 можно почти не трогать. Но при активной работе с одной строкой, субтитрами, мангой, играми, таблицами и интерфейсами с повторяющимися элементами вкладка становится полезной.
Например, если Text Line Capture захватывает не всю строку, можно увеличить параметры длины или области поиска. Если программа захватывает соседнюю строку, стоит уменьшить высоту поиска или точнее ставить курсор. Если Bubble Capture не видит текст в облачке, проблема может быть не только в настройках, но и в самом изображении: разорванный контур, декоративный фон, текст на границе пузыря и низкий контраст ухудшают автоматический захват.
Для обычного OCR с экрана надежнее всего работает ручное выделение области. Автоматические режимы стоит рассматривать как ускорение для повторяющихся задач, где текст расположен предсказуемо.
Capture Box: настройка области захвата
Capture Box — это синяя рамка, которая появляется при стандартном OCR-захвате. Вкладка Capture Box позволяет настроить ее внешний вид: цвет фона, цвет границы и прозрачность. Это не просто декоративная настройка. На разных рабочих столах рамка должна быть хорошо видна: на светлом фоне, темном фоне, поверх PDF, браузера, игры, изображения или терминала.

Вкладка Capture Box: настройка цвета и прозрачности рамки захвата.
Если рамка сливается с фоном, выделять текст становится неудобно. Пользователь может случайно захватить лишнюю строку, обрезать буквы сверху или снизу, оставить за пределами области часть слова. Особенно это заметно при распознавании мелких таблиц и интерфейсных подписей. Хорошо заметная рамка снижает количество ошибок еще до OCR: программа получает более аккуратно выбранное изображение.
Практический совет: область захвата должна включать весь текст, но не захватывать много лишнего. Если обвести только середину букв, OCR потеряет верхние или нижние элементы символов. Если захватить слишком большую область с соседними строками, результат может смешаться. Для одной строки лучше выделять прямоугольник чуть выше и чуть ниже текста, оставляя небольшой запас.
Preview: предварительный просмотр результата
Вкладка Preview отвечает за окно предпросмотра. Его можно включать и отключать через Show Preview Box, менять положение, цвет фона, цвет границы, цвет текста и шрифт. Предпросмотр полезен, когда пользователь хочет видеть распознаваемый фрагмент до окончательного завершения захвата.

Вкладка Preview: настройка предварительного окна с текстом.
В обычной офисной работе preview можно отключить, если нужен максимально быстрый сценарий: нажал горячую клавишу, выделил область, получил текст в буфере. Но при распознавании сложных фрагментов предпросмотр помогает понять, насколько удачно выбрана область. Это особенно полезно, когда текст мелкий, строка расположена рядом с другими строками, есть фоновые элементы или пользователь работает с языком, где ошибки OCR трудно заметить сразу.
Если preview мешает выделению, его можно переместить или отключить. Если текст в preview плохо читается, стоит изменить цвет и шрифт. Это мелкая настройка, но при регулярном использовании Capture2Text она влияет на скорость работы.
Output: куда попадает распознанный текст
Вкладка Output определяет, что Capture2Text делает с результатом после распознавания. Здесь находятся ключевые параметры: Save to clipboard, Show popup window, Keep line breaks, логирование, сохранение изображений и вызов внешнего исполняемого файла.

Вкладка Output: буфер обмена, popup, переносы строк, логирование, сохранение изображений и вызов внешней программы.
Save to clipboard — основная настройка для большинства пользователей. Когда она включена, распознанный текст сразу попадает в буфер обмена. После OCR-захвата достаточно нажать Ctrl + V в нужной программе. Это самый быстрый режим для копирования текста с картинки, PDF или скриншота.
Show popup window включает всплывающее окно с результатом. Оно полезно, если нужно проверить распознанный текст перед вставкой. В popup можно увидеть ошибки, лишние переносы, неправильные символы и при включенной озвучке использовать кнопку Say. Если пользователь работает с большим количеством коротких фрагментов и уверен в качестве OCR, popup можно отключить, чтобы не закрывать окно каждый раз.
Keep line breaks сохраняет переносы строк. Если опция отключена, Capture2Text может убирать carriage returns и line feeds, превращая многострочный текст в более компактную строку. Если нужно распознавать абзацы, списки, адреса, таблицы и блоки кода, Keep line breaks лучше включить. Если нужно получать одну строку для формы, поиска или перевода, переносы иногда удобнее отключить.
Logging сохраняет все OCR-захваты в файл. Это удобно для накопления истории: пользователь распознает много фрагментов подряд, а затем открывает лог и видит весь собранный текст. В формате логирования можно использовать токены ${capture}, ${translation}, ${timestamp}, ${linebreak}, ${tab}. Например, можно сохранять каждую распознанную строку вместе с датой и временем.
Save captured image и Save enhanced image полезны для диагностики. Если OCR дает плохой результат, сохраненное изображение помогает понять причину: слишком мелкий текст, плохой контраст, захвачена лишняя область, буквы обрезаны, текст наклонен, включен неправильный язык. Enhanced image показывает, как картинка выглядит после предварительной обработки.
Call Executable — расширенная функция для автоматизации. После OCR Capture2Text может вызвать внешнюю программу или скрипт и передать туда распознанный текст, перевод и timestamp. Это открывает сценарии вроде отправки результата в словарь, обработчик, базу данных, собственный Python-скрипт или внутреннюю утилиту. В параметрах используются токены ${capture}, ${translation}, ${timestamp}.
Popup-окно с результатом OCR
Когда включена опция Show popup window, после захвата появляется окно Capture2Text — OCR Text. В нем отображается распознанный текст. В зависимости от настроек могут быть доступны кнопки и элементы вроде OK, Say, Topmost и ссылка font для изменения шрифта.

Окно Capture2Text — OCR Text показывает распознанный текст и может содержать кнопку Say для озвучивания.
Popup удобен не только для проверки. Он помогает работать с текстом, который нужно просмотреть, но не обязательно вставлять сразу. Например, пользователь распознал строку из игры или изображения, увидел перевод, прослушал произношение, затем закрыл окно. Если включить Topmost, popup может оставаться поверх других окон — это удобно при сравнении результата с исходным изображением.
Недостаток popup-режима в том, что он добавляет лишний шаг. Если задача состоит только в быстром копировании текста в другое поле, всплывающее окно может мешать. В таком случае лучше оставить Save to clipboard включенным, а Show popup window отключить.
Replace: автозамены и регулярные выражения
Вкладка Replace предназначена для исправления типичных ошибок OCR. В ней есть выбор OCR Language и таблица с колонками Find (regex) и Replace With. Замены можно задавать отдельно для разных языков. Поддержка регулярных выражений делает вкладку полезной для повторяющихся сценариев: дат, номеров, артикулов, кодов, телефонных номеров, технических строк и фрагментов таблиц.

Вкладка Replace: автозамены и регулярные выражения для исправления результата OCR.
Пример простой автозамены: OCR часто путает латинскую букву O с нулем 0 в числовых кодах. Если пользователь регулярно распознает только номера, можно сочетать Whitelist с заменой. Другой пример — удаление лишних пробелов перед запятой или точкой, замена двойных пробелов на одинарные, исправление неправильных дефисов, нормализация дат.
Для регулярных выражений вкладка особенно полезна. Например, если OCR возвращает строки с лишними символами вокруг номера, можно настроить поиск по шаблону и оставить только нужную часть. При этом важно не делать слишком агрессивные замены. Если правило подходит не ко всем случаям, оно может испортить корректно распознанный текст.
Хорошая практика — сначала накопить несколько типичных OCR-результатов, посмотреть повторяющиеся ошибки, а затем добавлять правила. Не стоит заранее создавать десятки замен: это усложнит диагностику, если результат внезапно станет хуже.
Translate: перевод распознанного текста
Вкладка Translate добавляет к OCR-захвату перевод. Здесь можно включить Append translation to clipboard и Show translation in popup window, задать Separator, настроить Server Timeout и выбрать направление перевода для каждого OCR-языка. Перевод работает через Google Translate и требует интернет-доступа.

Вкладка Translate: настройка перевода распознанного текста.
Append translation to clipboard добавляет перевод к тексту, который помещается в буфер обмена. Это удобно, если нужно вставлять сразу исходную фразу и перевод. Например, можно настроить разделитель так, чтобы результат выглядел как две строки: сначала оригинал, затем перевод.
Show translation in popup window показывает перевод во всплывающем окне рядом с OCR-текстом. Такой режим удобен при чтении иностранного текста с экрана: пользователь выделяет фразу, сразу видит исходный вариант и перевод, но не обязательно вставляет его в документ.
Практические сценарии перевода:
-
чтение английского текста в изображении;
-
перевод японских реплик в визуальной новелле;
-
работа с интерфейсом программы на иностранном языке;
-
быстрый перевод подписи на скриншоте;
-
проверка фразы из PDF без копируемого текстового слоя.
Ограничение очевидное: если интернет недоступен, перевод работать не будет. Сам OCR-захват при этом остается локальным сценарием программы, но вкладка Translate требует сетевого доступа. Также перевод зависит от качества исходного распознавания. Если OCR ошибся в символах, переводчик получит уже испорченный текст и переведет его неправильно.
Speech: озвучивание распознанного текста
Вкладка Speech отвечает за Text-to-speech. Здесь включается Enable Text-to-speech, задается Volume, выбирается OCR Language, настраиваются Rate, Pitch и Voice. Для проверки голоса используется Preview. Если озвучивание включено и для языка выбран доступный голос, в popup-окне появляется кнопка Say.

Вкладка Speech: включение озвучивания, выбор голоса, темпа, высоты и громкости.
Озвучивание полезно при изучении языков, проверке коротких фраз, чтении распознанного текста вслух и работе с иностранными словами. Например, пользователь выделяет английскую фразу на изображении, Capture2Text распознает ее, показывает popup, а затем через Say произносит результат. Для японского, корейского, английского, немецкого и других языков качество озвучивания зависит от установленных голосов в Windows и выбранного языка.
Параметр Rate регулирует скорость речи. Если голос говорит слишком быстро, скорость можно уменьшить. Pitch меняет высоту звучания. Volume управляет общей громкостью TTS внутри Capture2Text. Voice выбирает конкретный голос; значение <Disabled> отключает озвучивание для выбранного языка, даже если общая функция включена.
Эта функция не обязательна для OCR, но она делает Capture2Text удобнее для языковых задач. Особенно в связке с Translate: пользователь получает исходный текст, перевод и возможность прослушать фразу.
Command Line Options: работа через Capture2Text_CLI.exe
Кроме графического режима, Capture2Text поддерживает командную строку через Capture2Text_CLI.exe. Этот вариант нужен для автоматизации: распознавания области экрана по координатам, обработки файлов изображений, пакетной обработки списка картинок, вывода результата в файл, clipboard или stdout.
Базовый формат:
Capture2Text_CLI.exe [options]
Пример распознавания области экрана по координатам:
Capture2Text_CLI.exe --screen-rect "400 200 600 300"
Пример распознавания изображения:
Capture2Text_CLI.exe -i img1.png
Пример распознавания нескольких изображений и сохранения результата в файл:
Capture2Text_CLI.exe -i img1.png -i img2.jpg -o result.txt
Пример выбора языка:
Capture2Text_CLI.exe -l Japanese -f "C:Tempimage_files.txt"
Пример вертикального китайского текста:
Capture2Text_CLI.exe --vertical -l "Chinese - Simplified" -i img1.png
Важные параметры CLI:
| Параметр | Назначение |
|---|---|
-h, --help |
Показать справку |
-v, --version |
Показать версию |
-b, --line-breaks |
Не удалять переносы строк |
-d, --debug |
Сохранить захваченное и обработанное изображение для диагностики |
--debug-timestamp |
Добавить timestamp к debug-изображениям |
-f, --images-file <file> |
Взять список изображений из файла |
-i, --image <file> |
Распознать изображение |
-l, --language <language> |
Выбрать язык OCR |
-o, --output-file <file> |
Вывести OCR-текст в файл |
--output-file-append |
Дописывать результат в файл |
-s, --screen-rect <"x1 y1 x2 y2"> |
Распознать прямоугольник экрана по координатам |
-t, --vertical |
Распознавать вертикальный текст |
-w, --show-languages |
Показать установленные языки |
--output-format <format> |
Настроить формат вывода |
--whitelist <characters> |
Распознавать только указанные символы |
--blacklist <characters> |
Исключить указанные символы |
--clipboard |
Отправить результат в буфер обмена |
--trim-capture |
Обрезать изображение до переднего плана |
--deskew |
Компенсировать наклон |
--scale-factor <factor> |
Задать масштаб предварительной обработки |
--tess-config-file <file> |
Передать конфигурационный файл Tesseract |
CLI делает Capture2Text полезной не только для ручного копирования текста с экрана, но и для повторяющихся задач. Например, можно настроить скрипт, который распознает одну и ту же область окна, сохраняет результат в файл, передает его в обработчик и добавляет timestamp. Это подходит для локальных рабочих процессов, где не нужен интерфейс, но нужен быстрый OCR по координатам или файлам.
Пример для цифровых кодов:
Capture2Text_CLI.exe -i code.png --whitelist "0123456789" --clipboard
Пример с сохранением переносов строк:
Capture2Text_CLI.exe -i table.png -b -o table_text.txt
Пример с отладкой качества OCR:
Capture2Text_CLI.exe -i scan_fragment.png --trim-capture --deskew -d -o result.txt
Практические сценарии использования
Capture2Text особенно сильна в небольших, но частых задачах. Ее не нужно открывать как отдельный проект: программа уже находится в трее, ждет горячую клавишу и сразу возвращает текст.
Скопировать текст из скриншота
Пользователь открывает скриншот, выбирает нужный язык, нажимает Windows Key + Q, обводит текст и вставляет результат в редактор. Если на скриншоте несколько строк, включается Keep line breaks. Если нужен только один номер, используется Whitelist.
Распознать фрагмент PDF
Если PDF состоит из изображений или защищен от копирования, Capture2Text позволяет распознать конкретный фрагмент без обработки всего файла. Нужно увеличить масштаб страницы, чтобы буквы стали четче, выделить область и получить текст. Для многостраничного OCR лучше использовать специализированные решения, но для одной строки, абзаца или таблицы Capture2Text работает быстрее.
Забрать текст из видео
Видео ставится на паузу в момент, где видна надпись. Затем выделяется область с текстом. Это удобно для субтитров, слайдов лекций, обучающих роликов, вебинаров, демонстраций программ и кадров с инструкциями. Если текст мелкий, помогает увеличение масштаба видео или полноэкранный режим.
Скопировать сообщение об ошибке
В окнах ошибок часто нельзя выделить текст или неудобно копировать подробности. Capture2Text позволяет обвести сообщение, получить его в буфере и отправить разработчику, системному администратору или в службу поддержки. Если ошибка содержит путь к файлу, код и техническую строку, лучше сохранить переносы строк.
Распознать артикул, номер заказа или код
Для артикулов и кодов полезны Whitelist, Blacklist и Replace. Если код состоит только из цифр и дефисов, стоит ограничить набор символов. Если OCR стабильно путает похожие буквы и цифры, можно добавить автозамены. Так Capture2Text превращается в быстрый инструмент для работы с заказами, накладными, изображениями товаров и скриншотами кабинетов.
Перевести иностранную фразу
Пользователь выбирает язык OCR, включает перевод, выделяет текст и получает исходную фразу вместе с переводом. Этот сценарий особенно удобен для коротких фрагментов: интерфейсных надписей, реплик в игре, фраз из изображения, подписей на скриншоте.
Собрать текст из нескольких изображений
Через графический режим можно последовательно выделять фрагменты, а через Logging сохранять все захваты в один файл. Через CLI можно распознавать изображения пакетно, указывая несколько -i или список файлов через -f. Это не заменяет полноценный пакетный OCR документов, но подходит для набора отдельных картинок.
Передать OCR-текст во внешний инструмент
Через Call Executable можно отправить результат в программу, скрипт или словарь. Например, распознанное слово передается в локальный словарь, а фраза — в собственный обработчик. Это полезно для тех, кто строит персональные рабочие процессы вокруг OCR.
Точность распознавания
Качество Capture2Text зависит не только от самой программы, но и от исходного изображения. OCR лучше работает с четким текстом, контрастным фоном, нормальным размером букв и правильно выбранным языком. Если изображение размытое, текст слишком мелкий, буквы декоративные, фон шумный, строка наклонена или захвачены лишние элементы, результат ухудшается.
Факторы, которые сильнее всего влияют на OCR:
| Фактор | Как влияет |
|---|---|
| Язык OCR | Неправильный язык дает мусорные символы |
| Размер текста | Слишком мелкие буквы распознаются хуже |
| Контраст | Серый текст на сером фоне ухудшает результат |
| Наклон | Помогает Deskew Capture, но не всегда полностью |
| Лишний фон | Помогает Trim Capture и аккуратное выделение |
| Шрифт | Простые печатные шрифты распознаются лучше декоративных |
| Межстрочный интервал | Слишком плотные строки могут смешиваться |
| Качество скрина | Размытие, сжатие JPEG и шум снижают точность |
| Whitelist/Blacklist | Ограничение символов помогает для кодов и чисел |
При плохом результате стоит действовать по порядку. Сначала проверить OCR Language. Затем увеличить исходный текст на экране. После этого аккуратнее выделить область, не обрезая буквы. Если текст наклонен, включить Deskew Capture. Если вокруг много пустого поля, включить Trim Capture. Если распознаются коды или цифры, настроить Whitelist. Если ошибки повторяются, добавить правила на вкладке Replace.
Важно понимать границы программы. Capture2Text хорошо подходит для быстрого OCR с экрана, но не является инструментом для точного восстановления верстки больших документов. Если нужно распознать многостраничный скан с таблицами, колонками, сносками и сохранением структуры, лучше использовать специализированный OCR-редактор. Если нужно быстро скопировать текст из картинки, Capture2Text справляется быстрее и проще.
Плюсы Capture2Text
| Плюс | Почему это важно |
|---|---|
| Бесплатная лицензия | Программу можно использовать без покупки |
| Запуск без установки | Удобно хранить в отдельной папке или на флешке |
| OCR по горячей клавише | Текст с экрана копируется за несколько секунд |
| Автоматический вывод в clipboard | Результат сразу готов к вставке |
| Popup-окно | Можно проверить текст перед использованием |
| Русский язык в комплекте | Не нужно отдельно добавлять базовый русский OCR |
| Много языков | Подходит для мультиязычных задач |
| Whitelist и Blacklist | Удобно для номеров, кодов, артикулов |
| Replace с regex | Можно исправлять повторяющиеся ошибки OCR |
| Перевод | Полезно для иностранных фрагментов |
| Text-to-speech | Подходит для языковой практики |
| CLI | Можно автоматизировать OCR через командную строку |
| Логирование | Все захваты можно сохранять в файл |
Главное преимущество Capture2Text — скорость. Программа убирает лишние этапы между видимым текстом на экране и вставкой текста в другое место. Для обычных пользователей это экономия времени, для техподдержки — быстрый способ копировать сообщения об ошибках, для переводчиков и изучающих языки — удобный OCR поверх изображений, для офисной работы — инструмент для извлечения фрагментов из PDF, скриншотов и интерфейсов.
Второй сильный плюс — гибкость вывода. Один пользователь ограничится clipboard, другой включит popup, третий будет сохранять лог, четвертый подключит внешний скрипт, пятый будет распознавать изображения через CLI. Для небольшой программы набор возможностей широкий.
Минусы и ограничения
| Минус | Что это значит на практике |
|---|---|
| Устаревший внешний вид | Интерфейс функциональный, но не современный |
| Нет полноценной обработки документов | Не подходит для комфортного OCR больших многостраничных сканов |
| Нет редактора структуры страницы | Не восстанавливает сложную верстку как специализированные OCR-программы |
| Качество зависит от изображения | Плохой скриншот дает плохой OCR |
| Нужно вручную выбирать язык | При неправильном языке результат резко ухудшается |
| Перевод требует интернет | Без сети работает OCR, но не перевод |
| Windows-only | Для macOS и Linux нужна другая программа или обходной сценарий |
| Новых обновлений давно не видно | На странице проекта последняя дата обновления — 2022-03-19 |
| Для новичка много настроек | Whitelist, regex, CLI и orientation требуют понимания задачи |
Главный минус Capture2Text — не качество идеи, а возраст интерфейса и отсутствие ощущения современного приложения. Программа выглядит как утилита для тех, кто готов один раз разобраться с настройками. Пользователь, которому нужен красивый интерфейс, встроенная история, современный OCR по Windows API и активные обновления, может предпочесть другой инструмент.
Второй минус — ограниченность при больших документах. Capture2Text распознает область экрана или изображение, но не превращает стопку сканов в аккуратный редактируемый документ с сохранением таблиц, колонок, стилей и структуры. Для таких задач лучше брать ABBYY FineReader PDF, Adobe Acrobat OCR или другой документный OCR.
Сравнение с аналогами
Capture2Text стоит сравнивать не с абстрактными программами для OCR, а с конкретными инструментами, которые решают похожую задачу: быстрое извлечение текста с экрана.
| Программа | Сильная сторона | В чем уступает Capture2Text | В чем лучше Capture2Text |
|---|---|---|---|
| Capture2Text | Быстрый OCR с экрана, clipboard, CLI, языки, автозамены | Старый интерфейс, мало современных удобств | Более тонкие настройки OCR, whitelist/blacklist, Replace, CLI |
| Microsoft PowerToys Text Extractor | Встроен в набор PowerToys, современный сценарий Windows | Меньше специализированных OCR-настроек | Лучше вписан в современную Windows-среду |
| Text Grab | Современные режимы захвата, Edit Text Window, Spreadsheet mode | Больше функций, но меньше простоты старой portable-утилиты | Лучше для очистки и доработки OCR-текста после захвата |
| ShareX OCR | OCR внутри мощного инструмента скриншотов | OCR — только одна из функций, интерфейс перегружен для простой задачи | Лучше, если нужны скриншоты, запись экрана и автоматизация загрузок |
| ABBYY Screenshot Reader | Коммерческий OCR для скриншотов, поддержка текстов и таблиц | Платная модель | Лучше для пользователей, которым важна экосистема ABBYY и форматы Word/Excel |
| Snipping Tool / системное извлечение текста Windows | Системный вариант без отдельной portable-утилиты | Меньше настроек и автоматизации | Удобнее для тех, кто не хочет ставить сторонние программы |
Microsoft PowerToys Text Extractor позволяет копировать текст с любого места экрана, включая изображения и видео. По умолчанию он активируется через Win + Shift + T, пользователь выделяет область, а текст сохраняется в буфер обмена. Это хороший вариант для тех, кто уже использует PowerToys и хочет системный OCR без отдельной программы. Но Capture2Text сильнее там, где нужны отдельные OCR-языки, whitelist, blacklist, автозамены, перевод, TTS и CLI.
Text Grab выглядит более современно и шире по возможностям обработки результата. В нем есть Full-Screen Mode, Grab Frame Mode, Edit Text Window, очистка OCR-вывода, поиск и замена, извлечение регулярными выражениями, Spreadsheet mode, работа с папками изображений и дополнительные сценарии постобработки. Он лучше подходит тем, кто не просто копирует текст, а сразу чистит, структурирует и готовит его для таблиц или документов. Capture2Text при этом остается проще как portable-утилита: горячая клавиша, рамка, буфер обмена, минимум действий.
ShareX OCR стоит выбирать, если OCR нужен как часть большого процесса работы со скриншотами. ShareX умеет захватывать экран, записывать видео, обрабатывать изображения, выполнять действия после захвата и работать с загрузками. OCR в нем — одна из функций. Если пользователь и так применяет ShareX для скриншотов, добавление OCR логично. Если нужен только быстрый текст с экрана, Capture2Text проще и прямее. ShareX использует OCR-языки, установленные в Windows, а дополнительные языки добавляются через настройки языков Windows.
ABBYY Screenshot Reader ориентирован на захват изображений и текста с экрана, в том числе из документов, меню, веб-страниц, презентаций и PDF. Он умеет превращать текст внутри изображения в редактируемый формат, сохранять скриншоты как JPEG, Bitmap или PNG, а текстовые результаты — в RTF, TXT, DOC или XLS. Это более коммерческий и документно-ориентированный подход. Capture2Text выигрывает бесплатностью, portable-запуском и скоростью горячей клавиши, но уступает по ощущению готового коммерческого продукта и сохранению в офисные форматы.
Для кого подходит Capture2Text
Capture2Text хорошо подходит пользователям, которым часто нужно копировать текст из того, что не копируется обычным способом. Это офисные специалисты, студенты, переводчики, тестировщики, сотрудники техподдержки, контент-менеджеры, пользователи PDF, люди, работающие с изображениями, а также те, кто изучает иностранные языки и регулярно сталкивается с текстом в картинках.
Программа особенно удобна, если:
-
нужно быстро распознавать короткие фрагменты;
-
текст часто находится на скриншотах;
-
приходится работать с невыделяемыми PDF;
-
нужно копировать ошибки из окон программ;
-
требуется OCR с экрана без установки;
-
важна поддержка русского языка;
-
нужно переключаться между несколькими языками;
-
полезны whitelist, blacklist и автозамены;
-
нужен CLI для автоматизации;
-
требуется сохранять историю распознаваний в лог.
Capture2Text также подходит тем, кто предпочитает portable-инструменты. Ее можно держать в отдельной папке, запускать при необходимости и закрывать через Exit. При использовании параметра --portable настройки можно хранить рядом с исполняемым файлом, что удобно для переносимого набора утилит.
Кому лучше выбрать другое решение
Capture2Text не лучший выбор, если задача связана с большими документами. Для распознавания многостраничных сканов, сохранения структуры PDF, восстановления таблиц, колонок, сносок и форматирования лучше подходят специализированные OCR-программы. Capture2Text можно использовать для фрагмента страницы, но не стоит ждать от нее полноценной обработки всего документа.
Лучше выбрать другой инструмент, если:
| Сценарий | Более подходящий вариант |
|---|---|
| Нужно распознавать многостраничные PDF | ABBYY FineReader PDF, Adobe Acrobat OCR |
| Нужен современный OCR-интерфейс Windows | Text Grab, PowerToys Text Extractor |
| Нужна мощная работа со скриншотами | ShareX |
| Нужны Word/Excel-форматы из скриншотов | ABBYY Screenshot Reader |
| Нужен OCR на телефоне | Google Lens, Microsoft Lens, мобильные OCR-приложения |
| Нужна командная автоматизация простых областей | Capture2Text_CLI.exe подходит хорошо |
| Нужен быстрый clipboard-OCR | Capture2Text подходит хорошо |
Если пользователь хочет одну кнопку для всего и не хочет изучать настройки, Capture2Text может показаться сухой и технической. Если же задача понятная — быстро извлекать текст с экрана — программа решает ее без лишней оболочки.
Частые проблемы и решения
Нет значка Capture2Text в трее
Значок может быть скрыт Windows. Нужно нажать стрелку Show hidden icons в области уведомлений и найти Capture2Text там. Если программа не запущена, нужно открыть папку и снова запустить Capture2Text.exe.
Клик по значку ничего не делает
Меню открывается правым кликом. Левый клик по значку может не показывать настройки. Для доступа к Settings…, OCR Language, Text Orientation и Exit нужно щелкнуть правой кнопкой мыши.
Вместо текста появляются мусорные символы
Почти всегда сначала нужно проверить OCR Language. Если русский текст распознается как English, результат будет плохим. Для кириллицы выбирается Russian, для английского — English, для японского — Japanese. Также нужно убедиться, что текст достаточно крупный и не размыт.
Нужного языка нет в меню OCR Language
Дополнительный язык нужно добавить в папку tessdata и перезапустить Capture2Text. В комплекте уже есть English, French, German, Japanese, Korean, Russian и Spanish, но другие языки добавляются отдельно.
Горячая клавиша не срабатывает
Возможен конфликт с Windows или другой программой. Нужно открыть Settings…, перейти на вкладку Hotkeys и назначить другое сочетание для Start OCR Capture. Если действие не нужно, можно выбрать <Unmapped>.
OCR обрезает часть текста
Нужно выделять область с небольшим запасом сверху, снизу и по бокам. Если буквы обрезаны рамкой, OCR не сможет корректно восстановить символы. Для автоматических режимов стоит проверить параметры на вкладке OCR 2.
OCR захватывает лишние строки
Рамку нужно делать уже и ниже по высоте. При работе с одной строкой можно использовать Text Line Capture, но если строки расположены слишком плотно, ручной режим Windows Key + Q может быть надежнее.
Плохо распознаются цифры
Для цифровых кодов стоит использовать Whitelist. Например, если в области должны быть только цифры, можно указать 0123456789. Для дат добавить точку, дефис и слеш. Это помогает снизить ошибки вроде O вместо 0.
Плохо распознается наклонный текст
На вкладке OCR 1 нужно включить Deskew Capture. Если текст наклонен слишком сильно или сфотографирован под углом, результат все равно может быть слабым. Лучше выровнять изображение или увеличить масштаб.
Перевод не работает
Функция Translate требует интернет. Нужно проверить соединение, настройки вкладки Translate, направление перевода и Server Timeout. Также стоит убедиться, что исходный OCR-текст распознан правильно: перевод неправильного текста будет неправильным.
Не хватает переносов строк
На вкладке Output нужно включить Keep line breaks. Это особенно важно для списков, адресов, абзацев, таблиц и кода. Если нужен однострочный результат, эту опцию можно отключить.
Нужно сохранить все OCR-захваты
На вкладке Output нужно включить логирование и указать файл. В формате можно использовать ${capture}, ${translation}, ${timestamp}, ${linebreak}, ${tab}. Это удобно для последовательного сбора текста из разных изображений.
Рекомендации по настройке для разных задач
Для обычного копирования текста с картинки достаточно включить Save to Clipboard, выбрать нужный OCR Language и использовать Windows Key + Q. Popup можно оставить включенным на первое время, чтобы проверять результат, а затем отключить для ускорения.
Для русского текста:
| Настройка | Рекомендация |
|---|---|
| OCR Language | Russian |
| Save to Clipboard | Включить |
| Show Popup Window | Включить для проверки, отключить для быстрой работы |
| Keep line breaks | Включить для абзацев и списков |
| Deskew Capture | Включать при наклонном тексте |
| Trim Capture | Включать при лишнем фоне |
Для кодов, номеров и артикулов:
| Настройка | Рекомендация |
|---|---|
| Whitelist | Ограничить допустимые символы |
| Blacklist | Исключить заведомо ненужные символы |
| Replace | Добавить исправления повторяющихся ошибок |
| Keep line breaks | Обычно отключить |
| Popup | Включить, если нужна ручная проверка |
Для иностранного текста с переводом:
| Настройка | Рекомендация |
|---|---|
| OCR Language | Выбрать язык исходного текста |
| Translate | Включить перевод |
| Show translation in popup window | Включить |
| Append translation to clipboard | Включить, если нужно вставлять оригинал и перевод |
| Speech | Включить при изучении произношения |
Для японского текста:
| Настройка | Рекомендация |
|---|---|
| OCR Language | Japanese |
| Text Orientation | Horizontal, Vertical или Auto по ситуации |
| Bubble Capture | Использовать для замкнутых облачков |
| Translate | Настроить перевод на нужный язык |
| Popup | Включить для проверки результата |
| Scale Factor | Подбирать при мелком шрифте |
Для автоматизации:
| Настройка | Рекомендация |
|---|---|
Capture2Text_CLI.exe |
Использовать вместо GUI |
--screen-rect |
Для фиксированной области экрана |
-i |
Для изображений |
-f |
Для списка изображений |
-o |
Для вывода в файл |
--clipboard |
Для вывода в буфер |
--output-format |
Для собственного формата результата |
--deskew, --trim-capture |
Для предварительной обработки |
Итоговая оценка Capture2Text
Capture2Text — узкая, быстрая и полезная OCR-программа для Windows, которая хорошо решает задачу распознавания текста с экрана. Ее стоит использовать, когда нужно быстро скопировать текст из картинки, PDF, скриншота, окна программы, видео или игры. Программа не требует установки, запускается из папки, работает через трей и горячие клавиши, сохраняет результат в буфер обмена, поддерживает русский язык, умеет переводить, озвучивать текст, исправлять результат через автозамены и работать через командную строку.
Сильные стороны Capture2Text — скорость, простота основного сценария, гибкие настройки OCR, whitelist, blacklist, Replace, логирование, Text-to-speech, перевод и CLI. Слабые стороны — устаревший интерфейс, ограниченность при больших документах, зависимость качества от исходного изображения и отсутствие свежего темпа обновлений. Это не универсальная программа для всех OCR-задач, а практичная утилита для быстрого извлечения текста с экрана.
Для повседневного копирования небольших фрагментов Capture2Text остается удачным выбором. Если нужно распознать одну строку, абзац, подпись, код, ошибку, фразу из изображения или текст из невыделяемого PDF, программа делает это быстрее, чем большинство тяжелых OCR-решений. Если требуется точная обработка многостраничных документов с сохранением структуры, лучше выбрать специализированный OCR-редактор. В своей нише Capture2Text ценна именно тем, что не пытается быть всем сразу: она быстро захватывает текст с экрана и отдает его туда, где он нужен пользователю.