Extraer texto de PDF (PDF → TXT)

Sube un PDF y verás el texto del documento extraído en el orden de sus páginas. Puedes copiar el resultado al momento o guardarlo como archivo TXT.

📄 Arrastra aquí un PDF o haz clic para seleccionarlo El texto se extrae en cuanto lo seleccionas

Cómo usar: Extraer texto de PDF

  1. Selecciona el archivo PDF del que quieres sacar el texto. La extracción página por página empieza en cuanto lo eliges.
  2. Si no necesitas separadores entre páginas como ----- 1 -----, desmarca la casilla. El cambio se aplica al resultado al instante.
  3. En el cuadro de resultado, selecciona y copia solo la parte que necesites o pulsa Copiar todo.
  4. Pulsa Guardar como TXT para descargar un archivo de texto UTF-8 que puedes abrir con el Bloc de notas o cualquier editor.

Por qué no se puede copiar bien el texto de un PDF

Cuando seleccionas y copias texto desde un visor de PDF, es habitual que los saltos de línea queden desordenados, que en documentos a dos columnas se mezclen las frases de la izquierda y la derecha, o que aparezcan espacios extraños entre letras. Esto ocurre porque un PDF solo guarda «qué carácter se dibuja y en qué posición», sin almacenar la estructura de frases y párrafos.

Esta herramienta lee las coordenadas de los fragmentos de texto del PDF, agrupa en una misma línea los fragmentos que están a la misma altura y, cuando el espacio entre líneas es mayor de lo normal, lo interpreta como un cambio de párrafo e inserta una línea en blanco. Así obtienes un texto más fácil de leer que si lo copiaras directamente desde el visor.

Cuándo no se puede extraer texto de un PDF escaneado

Los PDF creados con un escáner o con la cámara del móvil son, en realidad, una fotografía de cada página. Aunque a la vista parezcan letras, el archivo no contiene información de texto, así que la extracción saldrá vacía. En estos casos hace falta un programa de OCR (reconocimiento óptico de caracteres) que identifique las letras dentro de la imagen; esta herramienta no incluye OCR.

Para saber si un documento está escaneado, intenta seleccionar texto en tu visor de PDF. Si en lugar de seleccionarse palabra por palabra se selecciona la página entera como un bloque, se trata de un PDF de imagen.

Consejos para aprovechar el texto extraído

  • Al citar informes, artículos académicos o tesis, puedes pegar las frases directamente sin volver a teclearlas.
  • Si el resultado tiene saltos de línea en mitad de las frases, usa la herramienta Quitar saltos de línea para unirlas en un solo párrafo.
  • Si necesitas comprobar la extensión, pega el resultado en el Contador de caracteres para ver el número de caracteres y bytes.
  • Las tablas se extraen como texto corrido, sin separar las celdas. Si la estructura de la tabla es importante, lo más fiable es conseguir el archivo original (Excel, Word, etc.).
  • Los PDF protegidos con contraseña de apertura deben desbloquearse antes, creando una copia sin contraseña.

Privacidad: tus archivos no salen de tu dispositivo

Todo el proceso, desde la lectura del PDF hasta la extracción del texto, se realiza dentro de tu navegador. El archivo no se sube a ningún servidor, por lo que puedes usar la herramienta con contratos, facturas u otros documentos confidenciales con tranquilidad. Es gratis y no necesitas registrarte.

Preguntas frecuentes

El resultado de la extracción sale vacío. ¿Qué pasa?
Los PDF escaneados o creados a partir de fotos no contienen información de texto, por lo que no se puede extraer nada. En ese caso necesitas un programa con función de OCR.
Salen caracteres raros o los acentos aparecen mal. ¿Por qué?
Algunos PDF guardan la información de las fuentes de forma especial, de modo que los códigos de carácter no coinciden con las letras reales. Con este tipo de documentos es difícil obtener el texto correcto con cualquier herramienta de extracción.
¿Funciona con PDF protegidos con contraseña?
No se pueden leer los PDF que tienen contraseña de apertura. Crea primero una copia sin contraseña y úsala aquí.
¿Se queda guardado el contenido en algún servidor?
No. El análisis del PDF y la extracción del texto se hacen por completo en tu navegador; ni el archivo ni el resultado se envían a ningún sitio.
¿Puedo abrir el TXT en Word o en el móvil?
Sí. El archivo se guarda en UTF-8, un formato que abren sin problemas el Bloc de notas, Word, Google Docs y las apps de notas del móvil, respetando acentos y eñes.

Última actualización: 2026-10-06