Сделайте отсканированные PDF доступными для поиска с помощью OCR
Отсканированный PDF — это просто набор картинок: в нём нельзя искать, выделить предложение или скопировать текст. Загрузите один или несколько отсканированных PDF-файлов, и этот инструмент распознает текст на каждой странице (OCR) и добавит его невидимым слоем точно поверх слов на странице. Страницы выглядят как прежде, но теперь можно искать с помощью Ctrl+F, выделять и копировать текст, а документ можно найти по его содержимому.
Распознавание поддерживает 30 языков и лучше всего работает с чёткими сканами с разрешением не менее 200–300 dpi. Страницы, которые уже содержат текст, пропускаются, поэтому смешанные документы обрабатываются правильно. Файлы хранятся 48 часов и затем удаляются автоматически — или вы можете удалить их сами в любое время.
Почему стоит использовать этот инструмент OCR для PDF?
- Поиск, выделение и копирование текста в отсканированных документах
- Страницы выглядят точно так же — текстовый слой невидим
- 30 языков распознавания, несколько в одном документе
- Страницы, которые уже содержат текст, остаются нетронутыми
Как распознать текст в PDF
- Перетащите отсканированные PDF-файлы или нажмите, чтобы выбрать их
- Выберите языки документа
- Нажмите «Сделать доступным для поиска» и скачайте PDF с поиском по тексту
Часто задаваемые вопросы
Этот инструмент OCR для PDF бесплатный?
Да, сделать ваши отсканированные PDF-файлы доступными для поиска можно совершенно бесплатно.
Что OCR делает с моим PDF?
OCR (оптическое распознавание символов) считывает текст с изображений страниц и добавляет его в PDF невидимым текстовым слоем. Сами отсканированные страницы не меняются, поэтому документ выглядит так же, но в нём становится возможен поиск и выделение текста.
Какие языки поддерживаются?
30 языков, в том числе английский, испанский, французский, немецкий, русский, арабский, хинди, китайский, японский и корейский. Для наилучшего результата выберите все языки, которые встречаются в документе.
Насколько точно распознавание?
На чётких и ровных сканах печатного текста оно очень точное. Низкое разрешение, размытые или перекошенные сканы, рукописный текст и необычные шрифты снижают точность.
Мой файл останется приватным?
Файлы передаются по защищённому соединению и обрабатываются на нашем сервере. Загруженные файлы и результаты хранятся 48 часов, чтобы вы могли скачать результат по ссылке, а затем удаляются автоматически. Вы можете удалить их сами в любое время кнопкой удаления в списке «Ваши файлы».
Есть ли ограничение на размер файла?
Да, загружаемый PDF-файл должен быть не больше 1 ГБ.