PDF в текст

Извлеките текст из PDF онлайн: скопируйте его или скачайте файлом .txt, постранично, с сохранением строк и абзацев. Бесплатно и конфиденциально, без загрузки.

Файл читает ваш браузер, и он никуда не отправляется. Ни загрузки, ни хранения.

Что он делает


Этот инструмент читает текст PDF и возвращает его в виде простого текста, который можно скопировать, отредактировать или сохранить в файл .txt. Строки и абзацы восстанавливаются по положению слов на странице, а начало каждой страницы можно отметить. Инструмент работает с любым PDF, содержащим настоящий текст, например с документами, экспортированными из текстового редактора; отсканированные страницы — это изображения, и извлекать из них нечего.

Как пользоваться


  1. Выберите PDF.
  2. Нажмите «Извлечь текст». Длинные документы обрабатываются несколько секунд.
  3. Скопируйте текст или скачайте его файлом .txt.

Частые вопросы


Почему в моём PDF не найден текст?
Потому что страницы — это изображения, как в отсканированном документе или фотографии, сохранённой в PDF. В таком PDF нет текста, только пиксели, и прочитать его можно лишь с помощью распознавания символов (OCR).

Сохраняется ли вёрстка?
Текст сохраняет строки и абзацы, но не шрифты, колонки и изображения. В документах с двумя колонками текст одной строки может смешивать обе колонки; таблицы превращаются в строки текста с пробелами между ячейками.

Мой документ в безопасности?
Да. PDF читает ваш браузер, и файл никогда не отправляется на сервер, поэтому инструментом можно пользоваться и для личных документов.

Работает ли это с любым языком?
Да, если PDF содержит настоящий текст и его шрифты правильно сопоставляют символы. Некоторые старые или плохо сделанные PDF показывают на экране правильный текст, но при извлечении дают нечитаемые символы; это дефект самого файла, и восстановить текст может только OCR.

Wikipedia — PDF
Wikipedia — Optical character recognition