PDF в текст

Извлеките текст из любого PDF и скопируйте или скачайте его как обычный файл .txt. Всё выполняется в вашем браузере, поэтому документ никогда не покидает устройство.

Перетащите PDF-файл сюда

или

Параметры

Как извлечь текст из PDF

  1. Перетащите один PDF-файл в область загрузки или нажмите, чтобы выбрать его на устройстве.
  2. Выберите, добавлять ли маркеры страниц между страницами — это помогает находить контент.
  3. Нажмите «Извлечь текст» и подождите, пока текст будет извлечён с каждой страницы.
  4. Скопируйте результат в буфер обмена или скачайте его как файл .txt.

Частые вопросы

Загружаются ли мои PDF-файлы на сервер?

Нет. Инструмент «PDF в текст» полностью работает в вашем браузере с помощью pdf.js, поэтому документ никогда не покидает устройство.

Какой текст может извлечь этот инструмент?

Он извлекает встроенный текстовый слой PDF. Отсканированные или основанные на изображениях PDF без текстового слоя вернут мало текста или не вернут его вовсе.

Выполняет ли этот инструмент OCR?

Нет. Handio не выполняет оптическое распознавание символов. Если ваш PDF отсканирован, для восстановления текста понадобится отдельный инструмент OCR.

Почему интервалы в тексте немного необычные?

PDF хранит текст как позиционированные фрагменты, а не как связные абзацы. Сложные макеты, такие как колонки и таблицы, могут давать необычные интервалы и переносы строк.

Похожие инструменты

Зачем нужен «PDF в текст»?

Извлеките слова из PDF, чтобы использовать их повторно — вставьте в редактор, процитируйте из отчёта или выполните поиск по длинному документу без повторного набора текста.

Советы и ограничения

Инструмент «PDF в текст» извлекает встроенный текстовый слой с помощью pdf.js, поэтому он быстрый и конфиденциальный, но не выполняет OCR. Отсканированные документы вернут мало текста или не вернут его вовсе, а сложные макеты, такие как многоколоночные страницы или таблицы, могут выводиться с необычными интервалами.