Извлечение текста из PDF
Извлеките весь текст из PDF, просмотрите его, скопируйте или скачайте как файл .txt. Ничего не загружается, всё происходит на вашем устройстве.
Нажмите, чтобы выбрать PDF-файл, или перетащите его сюда
Остаётся на вашем устройстве, ничего не загружается.
Загружаются ли мои PDF-файлы куда-либо?
Нет. Текст извлекается полностью в вашем браузере с помощью JavaScript. Ваши файлы никогда не покидают устройство и не попадают на сервер.
Сработает ли это на сканированном PDF?
Нет, само по себе не сработает. Инструмент читает текст, уже встроенный в PDF, а сканированная страница - это просто изображение, поэтому извлекать нечего, если только к ней уже не применялось распознавание текста (OCR).
Сохраняется ли форматирование вроде колонок или таблиц?
В основном да, но сложные макеты (страницы с несколькими колонками, таблицы) могут выйти в неожиданном порядке чтения, поскольку PDF не хранит текст в строгой структуре сверху вниз.
Могу ли я извлечь текст из PDF, защищённого паролем?
Пока нет. Инструмент не может прочитать PDF, защищённый паролем или зашифрованный, и покажет ошибку. Сначала снимите пароль с помощью программы для чтения PDF.