Convertidor de PDF a texto
Obtén texto limpio y editable de tus PDFs, incluidas las páginas escaneadas. Cópialo o guárdalo como archivo .txt.
¿Por qué no puedo copiar texto de algunos PDFs?
Algunos PDFs contienen una imagen del texto en lugar del texto real. Una página escaneada es solo una imagen, así que no hay nada que seleccionar ni copiar. Este convertidor lee el texto real directamente del PDF sin usar OCR, lo cual es rápido y exacto. Solo aplica OCR en las páginas que son imágenes.
Para qué usa la gente el PDF a texto
Trabajo
- Copiar cláusulas de un contrato o una carta escaneada
- Reutilizar texto de un informe o presentación guardado como PDF
- Obtener los datos de una factura o un extracto bancario
- Pegar el texto en un documento o una hoja de cálculo para editarlo
Estudios e investigación
- Citar un artículo de investigación sin volver a escribirlo
- Convertir páginas escaneadas de un libro en notas que puedas buscar
- Extraer el texto de diapositivas de clase y material de apoyo
- Reunir citas de varios PDFs de una sola vez
Uso diario
- Pegar un PDF en herramientas de chat con IA para resumirlo o hacer preguntas
- Copiar texto de un PDF que no te deja seleccionarlo
- Pegar el texto en un traductor
- Guardar un manual, formulario o receta como archivo de texto plano
Cómo convertir un PDF a texto
- 1
Añade tus PDFs
Suelta tus PDFs en el recuadro de la parte superior de esta página, o haz clic para elegirlos. Puedes añadir hasta 20 a la vez.
- 2
Deja que se lean las páginas
Las páginas con texto real se leen al instante. Las páginas escaneadas se detectan automáticamente y se leen con OCR en el idioma que elijas. No hay que cambiar de modo.
- 3
Copia o descarga
Edita el texto si quieres, luego cópialo o guárdalo como archivo .txt. Con varios PDFs, descarga todo en un solo archivo .txt o en un ZIP.
Convierte PDF escaneado a texto con OCR
Un PDF escaneado es una imagen de cada página, así que su texto debe leerse con OCR (reconocimiento óptico de caracteres). Este convertidor revisa cada página por separado y lee automáticamente las escaneadas con OCR.
- Cada página se marca como texto, OCR o en blanco, para que veas cuáles fueron escaneadas.
- Las páginas cuyo texto se copia como cuadros o símbolos raros se tratan como escaneos y también se leen con OCR.
- Las páginas escaneadas se leen en el idioma que elijas. Escoge entre 18 idiomas, hasta 3 a la vez.
- Si el texto de una página se ve mal, haz clic en su número de página y elige Leer con OCR para volver a leerla como escaneo.
Los PDFs mixtos también funcionan. Las páginas escritas y las escaneadas se combinan en un solo texto, en el orden de las páginas.
¿Tienes una foto o captura de pantalla en lugar de un PDF? Extrae su texto con el convertidor de imagen a texto.
Copia texto de un PDF sin saltos de línea
El texto copiado de un PDF suele cortarse al final de cada línea. La opción Unir líneas en párrafos vuelve a juntar las frases divididas, para que el texto se pegue limpio en un documento, un correo o herramientas de chat con IA. Está activada por defecto.
La limpieza también corrige otras cosas que ensucian el texto de un PDF:
- Las palabras cortadas con guion al final de una línea se vuelven a unir en una sola palabra.
- Los títulos, elementos de lista y filas de tabla se mantienen en sus propias líneas.
- Eliminar encabezados, pies de página y números de página quita los encabezados, pies de página y números que se repiten en todas las páginas. Está activado por defecto.
- Los marcadores de página como --- Página 3 --- muestran dónde empieza cada página. Desactívalos para obtener un solo bloque de texto limpio.
Cada opción actualiza el texto al instante, sin necesidad de volver a leer el PDF. Desactiva Unir líneas en párrafos para conservar cada salto de línea tal como está en el PDF.
Gratis, privado y sin límites
Este convertidor de PDF a texto es gratis, sin registro ni cuenta. Además obtienes:
- Privacidad. Tu PDF se queda en tu dispositivo. Se abre y se lee directamente en tu teléfono u ordenador, y el archivo nunca se envía a un servidor.
- Sin límite de páginas ni límite diario. Cada PDF puede pesar hasta 100 MB, y puedes añadir hasta 20 a la vez.
- Archivos protegidos manejados con cuidado. Un PDF con contraseña se abre con tu contraseña en tu propio dispositivo, y esta nunca se guarda.
La primera vez que se lee una página escaneada, el lector OCR se descarga una única vez (unos 4 MB con inglés). Se guarda en tu navegador, así los siguientes escaneos empiezan más rápido. Los PDFs con solo texto real no lo necesitan.
¿Cuál es la mejor forma de extraer texto de un PDF?
Leer el texto que el PDF ya contiene, y usar OCR solo en las páginas escaneadas, en el idioma correcto. Así las páginas escritas quedan exactas y las escaneadas lo más precisas posible. Esta herramienta hace esa elección por ti, página por página.
Estos consejos te dan un texto más limpio:
- Elige el idioma de OCR correcto. Por ejemplo, un texto en alemán leído como inglés pierde sus diéresis.
- Elige hasta 3 idiomas para escaneos con varios idiomas mezclados.
- Usa un escaneo nítido y derecho. Las páginas borrosas o torcidas dan más errores.
- Si una página sale con caracteres extraños, haz clic en su número de página y elige Leer con OCR.
- Revisa nombres, números y direcciones de correo en las páginas escaneadas. Son los más fáciles de leer mal.
¿Cuánto tarda el OCR de un PDF? Las páginas con texto real se leen casi al instante, incluso en un PDF largo. Cada página escaneada tarda unos segundos, y puedes ver el progreso o detenerlo en cualquier momento.
El OCR está pensado para texto impreso. La letra manuscrita y los escaneos de mala calidad suelen dar errores. Los diseños complejos, como revistas y formularios, también pueden salir en un orden desordenado, así que revisa el texto antes de usarlo.
Herramientas relacionadas
Más herramientas gratis para PDFs e imágenes
Preguntas frecuentes
Páginas escaneadas, idiomas, límites y privacidad