Skip to content
DocsAll

OCR-распознавание PDF

Бесплатно Локальная обработка

Бесплатный онлайн-инструмент OCR-распознавания текста PDF, рендерит каждую страницу PDF в изображение и распознаёт текст с помощью tesseract.js. Поддерживает упрощённый и традиционный китайский, английский, японский, корейский, французский, немецкий, испанский и другие 10+ языков, можно указать диапазон страниц. Файлы не загружаются на сервер, вся обработка в браузере, защита вашей конфиденциальности.

Перетащите файлы сюда, или

макс. каждый 100.0 MB

Параметры

Как использовать

  1. 1 Выберите PDF-файл
  2. 2 Выберите язык распознавания (поддержка упрощённого и традиционного китайского, английского, японского, корейского, французского, немецкого, испанского, русского, арабского и других 10+ языков)
  3. 3 Опционально: укажите диапазон страниц (например, 1-3), пусто = распознать все страницы
  4. 4 Нажмите кнопку «PDF OCR-распознавание», дождитесь завершения и просмотрите/скопируйте текст

FAQ

Q: Почему так медленно?

OCR требует предварительного рендеринга каждой страницы в высокое разрешение, затем постраничного распознавания текста — вычислений много. Чем больше страниц и выше разрешение, тем медленнее. Рекомендуется сначала использовать «диапазон страниц» для распознавания только нужных страниц или закрыть другие вкладки, потребляющие память.

Q: Что делать, если точность распознавания невысокая?

Точность зависит от чёткости PDF. Чёткие сканы с аккуратным шрифтом распознаются хорошо; размытые, наклонные или рукописные — хуже. Можно выбрать более подходящий язык (для чистого английского «Только английский» может быть точнее).

Q: Загружаются ли файлы на сервер?

Нет. Весь рендеринг и распознавание выполняются в вашем браузере, файлы не покидают ваше устройство, полная защита конфиденциальности.

Похожие инструменты