Extraer el texto de un PDF
Tu archivo no sale de tu dispositivo — no se sube nada.
Cómo funciona
PDF a texto saca la capa de texto de un documento y te la devuelve como texto plano, listo para pegarlo en un editor, en un traductor o en un script. La salida es texto plano: los saltos de línea se reconstruyen a partir de dónde están las palabras en la página, pero las columnas, las tablas, las tipografías y el formato no se conservan. Si no sale nada, es que el PDF no tiene capa de texto: es un escaneo o un conjunto de imágenes de las páginas, y para convertir eso en palabras hace falta el reconocimiento de texto. La extracción ocurre entera en tu navegador, así que ni el PDF ni el texto se envían nunca a un servidor.
- Arrastra un PDF a la página.
- Pulsa «Extraer texto»: las páginas se leen una a una y el contador te dice por dónde va.
- Lee la vista previa. En los documentos largos se recorta en pantalla, pero el archivo descargado siempre trae el texto completo.
- Copia el texto directamente al portapapeles o descarga un archivo .txt normal en UTF-8, con cada página separada por una línea en blanco.