Извлечение текста из PDF

Извлеките весь текст из PDF, просмотрите его, скопируйте или скачайте как файл .txt. Ничего не загружается, всё происходит на вашем устройстве.

Нажмите, чтобы выбрать PDF-файл, или перетащите его сюда

Остаётся на вашем устройстве, ничего не загружается.

Загружаются ли мои PDF-файлы куда-либо?

Нет. Текст извлекается полностью в вашем браузере с помощью JavaScript. Ваши файлы никогда не покидают устройство и не попадают на сервер.

Сработает ли это на сканированном PDF?

Нет, само по себе не сработает. Инструмент читает текст, уже встроенный в PDF, а сканированная страница - это просто изображение, поэтому извлекать нечего, если только к ней уже не применялось распознавание текста (OCR).

Сохраняется ли форматирование вроде колонок или таблиц?

В основном да, но сложные макеты (страницы с несколькими колонками, таблицы) могут выйти в неожиданном порядке чтения, поскольку PDF не хранит текст в строгой структуре сверху вниз.

Могу ли я извлечь текст из PDF, защищённого паролем?

Пока нет. Инструмент не может прочитать PDF, защищённый паролем или зашифрованный, и покажет ошибку. Сначала снимите пароль с помощью программы для чтения PDF.