Загружает свой движок при первом запуске, поэтому скачать офлайн-версию нельзя — но инструмент всё равно работает приватно в вашем браузере, ничего не передаётся на сервер.
Об этом инструменте
Извлеките текстовый слой PDF в чистый, копируемый обычный текст. Перетащите файл — каждая страница будет прочитана по порядку с маркером между страницами, после чего результат можно скопировать в буфер обмена или скачать как файл .txt.
Всё выполняется локально в вашем браузере — документ никогда не покидает ваше устройство и нигде не сохраняется. Поэтому инструмент безопасен для договоров, счетов, выписок и других конфиденциальных файлов.
Обратите внимание: инструмент читает встроенный текстовый слой, который можно выделить и скопировать в просмотрщике PDF. Отсканированные документы — это просто фотографии страниц без текстового слоя, поэтому результат будет пустым; для них используйте инструмент OCR, чтобы распознать символы.
Часто задаваемые вопросы
Почему из моего PDF не извлёкся текст?
Скорее всего, это отсканированный документ: страницы — изображения без выделяемого текстового слоя. Этот инструмент не выполняет OCR — прогоните страницы через инструмент распознавания текста (OCR) на этом сайте, чтобы распознать отсканированный текст.
Загружается ли PDF на сервер?
Нет. Текст извлекается движком PDF, работающим полностью во вкладке вашего браузера, поэтому файл никогда не покидает ваше устройство — безопасно для конфиденциальных документов.
Сохраняется ли исходная разметка?
Переносы строк сохраняются там, где они отмечены в PDF, но колонки, таблицы и точные интервалы сводятся к порядку чтения — PDF является форматом для печати, поэтому идеально восстановить макет не всегда возможно.
Можно ли извлечь только некоторые страницы?
Инструмент извлекает все страницы и вставляет между ними разделитель «Страница N», поэтому нужный фрагмент легко найти и скопировать из поля с результатом.
Больше инструментов