CanDoYa
ES

PDF a texto

Funciona del todo en tu navegador: sin subir nada y sin registro.

Elige un PDF digital para extraer el texto seleccionable.

Comparte esta herramienta

¿Cómo pasar un PDF a texto?

Usa este conversor de PDF a texto para extraer el texto seleccionable que ya está guardado en un PDF digital, y luego cópialo o descárgalo como TXT. El proceso se ejecuta dentro de tu navegador, así que el documento no se sube. Los PDF escaneados o hechos solo con imágenes necesitan OCR, y esta herramienta concreta no hace OCR.

Cómo se usa

  1. 1Elige un PDF digital. Suelta un único PDF en la herramienta o selecciónalo desde tu dispositivo. Para obtener el mejor resultado, comprueba que puedes seleccionar palabras en tu visor de PDF habitual.
  2. 2Extrae la capa de texto. Pulsa Extraer texto. PDF.js lee cada página de forma local y muestra el progreso sin enviar el archivo a un servidor.
  3. 3Revisa el texto plano. Comprueba párrafos, columnas, tablas y símbolos frente al original. El orden de lectura del PDF puede no coincidir con el orden visual de la página.
  4. 4Copia o descarga. Edita el resultado si hace falta, cópialo al portapapeles o guárdalo como archivo TXT en UTF-8.

Para quién es

Este conversor usa Mozilla PDF.js para leer la capa de texto existente de cada página en tu dispositivo. Mantiene el orden de las páginas y los saltos de línea detectados, y después te ofrece un resultado de texto plano editable. Las imágenes, las tipografías, las columnas, las tablas y el formato visual no se conservan en la salida TXT.

Hay un límite importante: un PDF digital guarda caracteres que el software puede seleccionar y buscar. Un escaneo puede guardar solo una fotografía de una página. Extraer el primer tipo es análisis de texto; leer el segundo requiere reconocimiento óptico de caracteres. Esta herramienta solo hace la primera parte.

Preguntas frecuentes

¿Se suben mis archivos PDF a un servidor?

No. Tu navegador lee el PDF seleccionado en local con PDF.js, y el archivo no se envía a CanDoYa. El código del motor PDF puede descargarse la primera vez que usas la herramienta, pero tu documento no forma parte de esa petición.

¿Este conversor de PDF a texto es gratis?

Sí. Puedes extraer, editar, copiar y descargar texto sin cuenta, sin marca de agua y sin pagar. El trabajo se ejecuta en tu dispositivo, así que no hay cola de conversión en un servidor ni un archivo subido que recuperar después.

¿Qué límites de tamaño y páginas tiene?

La herramienta admite un único PDF de hasta 100 MB y 2.000 páginas. La memoria disponible y la velocidad del dispositivo pueden imponer un límite práctico menor, sobre todo en móviles. Divide un documento muy grande en PDF más pequeños si el navegador no puede terminar.

¿Puede extraer texto de un PDF escaneado?

No cuando el escaneo contiene solo imágenes de las páginas. Este conversor lee texto seleccionable ya existente y no hace OCR. Un PDF escaneado necesita una herramienta OCR que reconozca caracteres a partir de píxeles. Algunos PDF mixtos tienen texto seleccionable en ciertas páginas pero no en otras; el resultado marca las páginas sin texto.

¿Por qué el texto extraído sale en el orden incorrecto?

Las páginas PDF colocan fragmentos de texto en coordenadas y pueden no guardar un orden claro de párrafos o columnas. PDF.js sigue los elementos de texto y los saltos de línea del documento, y eso puede diferir del orden de lectura visual en diseños a varias columnas, tablas, encabezados o formularios complejos.

¿PDF a texto conserva el formato y las imágenes?

No. Los archivos TXT solo contienen caracteres planos, así que no se conservan fuentes, colores, imágenes, enlaces, columnas ni bordes de tabla. Los saltos de línea vienen de la capa de texto del PDF y puede que tengas que editarlos después de extraer.

¿Por qué se rechaza un PDF protegido con contraseña?

El navegador no puede leer un documento cifrado sin su contraseña. Abre el PDF en un visor de confianza, introduce la contraseña y guarda una copia desbloqueada si tienes permiso. Después añade esa copia al conversor.

¿Qué idiomas se pueden extraer de un PDF?

El analizador no está ligado a un idioma concreto. Puede devolver texto Unicode en cualquier escritura cuando el PDF contiene un mapa de caracteres correcto y texto seleccionable. Si un documento usa mapeos de fuente ausentes o personalizados, los caracteres copiados pueden seguir siendo incompletos o incorrectos.