Извлечь текст из PDF

Файл остаётся на вашем устройстве — ничего не загружается на сервер.

Как это работает

Извлечение текста вытаскивает из PDF текстовый слой и отдаёт его простым текстом — можно вставить в редактор, переводчик или скрипт. На выходе именно plain text: переносы строк восстанавливаются по расположению слов на странице, а колонки, таблицы, шрифты и оформление не сохраняются. Если не извлеклось ничего, значит текстового слоя в файле просто нет — это скан или картинки страниц, и превратить их в текст может только OCR. Разбор идёт целиком в браузере, поэтому ни PDF, ни полученный текст не уходят на сервер.

  1. Перетащите PDF на страницу.
  2. Нажмите «Извлечь текст» — страницы читаются по очереди, счётчик показывает прогресс.
  3. Просмотрите превью. Длинные документы на экране обрезаются, но в скачанном файле всегда полный текст.
  4. Скопируйте текст в буфер обмена или скачайте обычный .txt в UTF-8, где страницы разделены пустой строкой.