OCR online: extrair texto de imagens e PDF
Готовы к распознаванию
Три шага, без установки
Частые вопросы
Мои файлы загружаются на сервер?
Нет. Картинки и PDF обрабатываются в вашем браузере, на вашем устройстве. Из интернета скачиваются только сам движок распознавания и данные языков (с CDN jsDelivr) — ваши документы никуда не отправляются, и тексты тоже.
Насколько точно распознаётся текст?
На чётком печатном тексте ошибок мало, но точность зависит от качества скана: размытые, тёмные, перекошенные фото, мелкий шрифт и необычные шрифты дают больше ошибок. Для лучшего результата снимайте ровно и при хорошем свете, для PDF-сканов берите 200–300 dpi. Рядом с каждым файлом показывается «уверенность» — это подсказка, но не гарантия, поэтому результат стоит вычитать.
Какие языки и форматы поддерживаются?
Языки: русский, украинский, португальский и английский, можно отметить несколько сразу. Форматы: JPG, PNG, WebP (и другие картинки, которые открывает ваш браузер) и PDF — многостраничные тоже, с выбором страниц. При первом запуске скачиваются данные языка (порядка 1–2 МБ на язык), затем они хранятся в браузере.
Читает ли он рукописный текст, таблицы и сканы PDF?
Рукописный текст — нет, только печатный. Таблицы и колонки превращаются в обычные строки без сохранения вёрстки. Сканы PDF — да, страница за страницей: получите текст, .txt или PDF с невидимым текстовым слоем. Если в PDF текст уже выделяется мышью, распознавать его не нужно.