OCR-распознавание PDF
Бесплатно Локальная обработкаБесплатный онлайн-инструмент OCR-распознавания текста PDF, рендерит каждую страницу PDF в изображение и распознаёт текст с помощью tesseract.js. Поддерживает упрощённый и традиционный китайский, английский, японский, корейский, французский, немецкий, испанский и другие 10+ языков, можно указать диапазон страниц. Файлы не загружаются на сервер, вся обработка в браузере, защита вашей конфиденциальности.
Перетащите файлы сюда, или
макс. каждый 100.0 MB
Параметры
Как использовать
- 1 Выберите PDF-файл
- 2 Выберите язык распознавания (поддержка упрощённого и традиционного китайского, английского, японского, корейского, французского, немецкого, испанского, русского, арабского и других 10+ языков)
- 3 Опционально: укажите диапазон страниц (например, 1-3), пусто = распознать все страницы
- 4 Нажмите кнопку «PDF OCR-распознавание», дождитесь завершения и просмотрите/скопируйте текст
FAQ
Q: Почему так медленно?
OCR требует предварительного рендеринга каждой страницы в высокое разрешение, затем постраничного распознавания текста — вычислений много. Чем больше страниц и выше разрешение, тем медленнее. Рекомендуется сначала использовать «диапазон страниц» для распознавания только нужных страниц или закрыть другие вкладки, потребляющие память.
Q: Что делать, если точность распознавания невысокая?
Точность зависит от чёткости PDF. Чёткие сканы с аккуратным шрифтом распознаются хорошо; размытые, наклонные или рукописные — хуже. Можно выбрать более подходящий язык (для чистого английского «Только английский» может быть точнее).
Q: Загружаются ли файлы на сервер?
Нет. Весь рендеринг и распознавание выполняются в вашем браузере, файлы не покидают ваше устройство, полная защита конфиденциальности.
Похожие инструменты
Извлечение текста PDF
Извлечение всего текста из PDF, возможность скачивания в формате TXT
Извлечение страниц PDF
Извлечение страниц PDF по диапазону номеров в один новый файл
PDF в изображения
Преобразование каждой страницы PDF в изображение PNG или JPEG, поддержка настраиваемого DPI
Организация страниц PDF
Комплексная организация страниц PDF: извлечение, переупорядочивание, удаление, поворот, копирование