Извлечь текст из PDF
Файл остаётся на вашем устройстве — ничего не загружается на сервер.
Как это работает
Извлечение текста вытаскивает из PDF текстовый слой и отдаёт его простым текстом — можно вставить в редактор, переводчик или скрипт. На выходе именно plain text: переносы строк восстанавливаются по расположению слов на странице, а колонки, таблицы, шрифты и оформление не сохраняются. Если не извлеклось ничего, значит текстового слоя в файле просто нет — это скан или картинки страниц, и превратить их в текст может только OCR. Разбор идёт целиком в браузере, поэтому ни PDF, ни полученный текст не уходят на сервер.
- Перетащите PDF на страницу.
- Нажмите «Извлечь текст» — страницы читаются по очереди, счётчик показывает прогресс.
- Просмотрите превью. Длинные документы на экране обрезаются, но в скачанном файле всегда полный текст.
- Скопируйте текст в буфер обмена или скачайте обычный .txt в UTF-8, где страницы разделены пустой строкой.