Herramienta PDF gratis

PDF a texto

Saca las palabras sin volver a teclearlas.

Un PDF creado desde un procesador de texto lleva una capa de texto real bajo el diseño. Extraerla te da algo que puedes pegar en un correo, buscar en condiciones o pasar a otra herramienta, sin copiar página a página peleándote con los saltos de línea.

El texto sale página por página, con marcas que puedes desactivar. Lo que no se puede sacar es texto que nunca estuvo ahí: un escaneo es una foto de unas palabras, y extraer texto de ahí requiere OCR, que esta herramienta no hace.

Cómo usarla

  1. 01Arrastra el PDF.
  2. 02Elige si quieres marcar dónde empieza cada página.
  3. 03Extrae y luego copia el texto o descárgalo como archivo .txt.

Preguntas frecuentes

¿Por qué no obtuve nada de texto?

Casi con seguridad el PDF es un escaneo: las páginas son imágenes, así que no hay capa de texto que extraer. Necesitarías un programa de OCR para reconocer las palabras dentro de esas imágenes.

¿Por qué el espaciado sale raro en algunos sitios?

Los PDF guardan el texto como fragmentos colocados en unas coordenadas, no como frases. Los diseños a varias columnas, las tablas y los encabezados pueden salir en el orden en que se dibujaron, no en el que se leen.

¿Conserva el formato?

No: esto produce texto plano. Las negritas, los títulos, las tablas y los colores son información de diseño que un archivo .txt no puede llevar.

Herramientas relacionadas

Esto es lo que Purgify automatiza.

Conecta tus cuentas en la nube y Purgify encuentra duplicados y espacio recuperable como este — en todas a la vez, de forma programada.

Disponible muy pronto

¿Quieres acceso anticipado? Escríbenos a [email protected]