Docuboxer
Por Sergio Alonzo Piña··5 min de lectura

No puedo copiar texto de un PDF: qué hacer

Haz una prueba de diez segundos para saber si tu PDF tiene texto de verdad o solo imágenes, y elige la salida que corresponde, con tu archivo en el navegador.

Un PDF no deja copiar su texto casi siempre por una de tres razones: sus páginas son imágenes de un escaneo, el autor puso restricciones, o las fuentes no traducen bien a letras al copiar. Si el PDF tiene texto de verdad, extraer el texto de un PDF con tu archivo lo saca entero de una vez, lo muestra con el conteo de palabras y lo deja listo para copiar o bajar como .txt. Si es un escaneo, la herramienta te lo dice en lugar de devolver un resultado vacío. El archivo se procesa en tu navegador y no se sube.

Para saber en qué caso estás, hazte esta prueba.

La prueba de diez segundos

Abre el PDF y pulsa Ctrl+F (o Cmd+F en Mac). Busca una palabra que veas en pantalla.

  • Si la encuentra, el documento tiene texto de verdad. El problema es el visor, una restricción o el orden de lo que copias.
  • Si no la encuentra, lo que ves es una imagen del texto. Es un escaneo o una captura convertida a PDF, y copiar no funcionará con ningún visor.

Caso 1: es un escaneo

Un PDF que sale de un escáner o de fotos de una hoja guarda cada página como una imagen. No hay letras que seleccionar. Aquí la solución es un OCR, un proceso que reconoce el texto dentro de la imagen. La herramienta de extraer texto de Docuboxer no hace OCR: detecta qué páginas son imagen y te las lista para que sepas que su contenido no aparece en el resultado. Para ese caso, la guía de cómo extraer texto de un PDF escaneado explica el procedimiento.

Caso 2: el autor restringió la copia

Un PDF puede llevar permisos que impiden copiar o imprimir. Si es un documento tuyo y conoces la contraseña, quita la contraseña del PDF y vuelve a intentar. Si el documento es de otra persona y la restricción es deliberada, respétala: está ahí porque el autor decidió que el contenido no se reproduzca. Pedir una versión editable al autor es el camino correcto.

Si el PDF pide contraseña para abrirse, la herramienta de extraer texto la acepta en un campo opcional y la usa solo en tu navegador.

Caso 3: copias, pero sale desordenado o con símbolos raros

Hay dos variantes. La primera es que el texto sale en el orden equivocado, con las columnas mezcladas o saltos de línea en medio de cada frase. Pasa porque el PDF guarda fragmentos de texto posicionados, no párrafos. Esa causa, y el remedio con Markdown para pegarlo en un chat de IA, la explicamos en por qué los PDFs se pegan mal en la IA. La segunda es que salen símbolos o letras sin sentido. Ocurre cuando una fuente incrustada no trae la correspondencia entre sus glifos y las letras. No hay arreglo fiable desde el texto, y a veces la única salida es tratar esa página como imagen y aplicar OCR.

Cómo extraer el texto paso a paso

  1. Abre Extraer texto de PDF y suelta el archivo (hasta 50 MB).
  2. Si el PDF tiene contraseña de apertura, escríbela en el campo opcional.
  3. Pulsa Extraer texto. Si el PDF tiene más de 300 páginas, la herramienta te avisa de que puede tardar y pide confirmación.
  4. Revisa el conteo de caracteres y palabras, y el aviso de páginas sin texto si lo hay.
  5. Copia al portapapeles o descarga el .txt.

El resultado es texto plano, sin formato: no conserva títulos, tablas ni negritas. Si quieres conservar la estructura, usa PDF a Markdown, pensado para respetar encabezados y listas.

Si lo que necesitas es una página como imagen

Para una captura de la página con el texto incluido, usa PDF a JPG. No te dará texto, pero sí una imagen que puedes pasar por un OCR. Si en cambio quieres las fotos que lleva dentro, mira cómo sacar las imágenes de un PDF.

Preguntas frecuentes

¿Por qué no puedo seleccionar texto en mi PDF?

Normalmente porque las páginas son imágenes (un escaneo), porque el autor aplicó restricciones o porque el visor no lo permite. Una prueba rápida es buscar una palabra con Ctrl+F: si la encuentra, el texto existe y el problema es otro.

¿Cómo copio el texto de un PDF escaneado?

Hace falta un OCR, que reconoce las letras dentro de la imagen. La herramienta de Docuboxer para extraer texto no hace OCR: te avisa de qué páginas son imagen para que sepas que su texto no está en el resultado.

¿Puedo extraer texto de un PDF con contraseña?

Sí, si conoces la contraseña de apertura: la escribes en el campo opcional y se usa solo en tu navegador. No sirve para saltarse restricciones de un documento ajeno.

¿Por qué el texto copiado sale con saltos de línea y columnas mezcladas?

Porque un PDF guarda fragmentos de texto colocados en la página y no párrafos. Al copiar, el orden depende de cómo se dibujó. Convertirlo a Markdown suele dar un resultado más limpio.

¿El texto extraído conserva el formato?

No. Sale como texto plano, sin títulos, negritas ni tablas. Para conservar la estructura básica, usa la conversión a Markdown.

¿Se sube mi PDF a algún servidor?

No. El texto se extrae en tu navegador y el archivo no sale de tu equipo. Puedes comprobarlo en la pestaña Red de las herramientas de desarrollo: aparecen peticiones de analítica, pero ninguna POST o PUT con el tamaño de tu archivo.

Extrae el texto de tu PDF

Obtén todo el texto de una vez, con conteo de palabras, para copiarlo o descargarlo como .txt. Gratis y sin registro.

Abrir Extraer texto de PDF →

Herramientas relacionadas

  • Extraer texto de PDF: todo el texto de una vez, para copiar o descargar como .txt.
  • PDF a Markdown: conserva títulos y listas, ideal para pegar en un chat de IA.
  • Desbloquear PDF: quita la contraseña de un documento tuyo que ya conoces.
  • PDF a JPG: convierte las páginas en imágenes, por ejemplo para pasarlas por un OCR.

También te puede interesar: abrir un PDF sin Adobe y qué datos ocultos lleva un PDF.