Extraer el texto de un PDF

Tu archivo no sale de tu dispositivo — no se sube nada.

Cómo funciona

PDF a texto saca la capa de texto de un documento y te la devuelve como texto plano, listo para pegarlo en un editor, en un traductor o en un script. La salida es texto plano: los saltos de línea se reconstruyen a partir de dónde están las palabras en la página, pero las columnas, las tablas, las tipografías y el formato no se conservan. Si no sale nada, es que el PDF no tiene capa de texto: es un escaneo o un conjunto de imágenes de las páginas, y para convertir eso en palabras hace falta el reconocimiento de texto. La extracción ocurre entera en tu navegador, así que ni el PDF ni el texto se envían nunca a un servidor.

  1. Arrastra un PDF a la página.
  2. Pulsa «Extraer texto»: las páginas se leen una a una y el contador te dice por dónde va.
  3. Lee la vista previa. En los documentos largos se recorta en pantalla, pero el archivo descargado siempre trae el texto completo.
  4. Copia el texto directamente al portapapeles o descarga un archivo .txt normal en UTF-8, con cada página separada por una línea en blanco.