Saltar al contenido
100 % local · 0 KB subidosComprimir PDF

Cómo reparar un PDF corrupto

🔒 Tus archivos nunca salen de tu dispositivo. Todo el procesamiento ocurre localmente en tu navegador.

Un PDF corrupto tiene daños estructurales internos — la tabla de referencias cruzadas, cabecera, flujos de objetos o trailer faltan o son inconsistentes, de modo que un lector no puede localizar las páginas. Reparar significa reconstruir esa estructura a partir de los objetos que sobrevivan. A veces funciona; a veces el daño es demasiado grave y se pierden páginas. Esta guía explica los cuatro tipos de corrupción, las herramientas locales que pueden reconstruir un archivo dañado y un respaldo honesto cuando la reparación es imposible.

IXPDF no puede reparar un PDF corrupto
Reparar un PDF corrupto requiere reconstruir su tabla de referencias cruzadas y reensamblar flujos de objetos a partir de bytes en bruto — una tarea que los motores PDF de navegador (incluido el nuestro) no pueden hacer de forma fiable. Está marcado como Investigación requerida según AGENTS.md §16. Las herramientas siguientes se ejecutan localmente en tu máquina y no suben tu archivo. Como respaldo parcial, Extraer páginas a veces puede sacar páginas intactas de un archivo parcialmente roto.

Los cuatro tipos de corrupción PDF

1. Corrupción de cabecera

La primera línea de un PDF es %PDF-1.x (donde x es la versión). Si esta cabecera falta o está dañada, los visores rechazan abrir el archivo porque no pueden identificarlo como PDF. Es el daño más fácil de arreglar: abre el archivo en un editor de texto y añade la línea de cabecera %PDF-1.7 al principio del todo. Guarda y prueba a abrir de nuevo.

2. Corrupción de tabla de referencias cruzadas (xref)

La tabla xref es el índice del PDF — indica al visor dónde vive cada objeto (página, fuente, imagen) en el archivo. Si la xref falta o apunta a offsets erróneos, el visor no encuentra las páginas. Es la forma más común de corrupción, normalmente causada por una descarga truncada o un escritor que cerró antes de terminar el archivo.

Arreglo: reconstruye la xref con ghostscript (gs -dNOPAUSE -dBATCH -sDEVICE=pdfwrite -sOutputFile=out.pdf in.pdf) o Adobe Acrobat Preflight. Ambas herramientas escanean el archivo en busca de objetos y escriben una xref nueva. Si los objetos en sí están intactos, esto repara el archivo por completo.

3. Corrupción de flujo de objetos

Los PDFs modernos empaquetan múltiples objetos en flujos de objetos comprimidos para ahorrar espacio. Si un flujo está dañado, los objetos dentro son irrecuperables — se han perdido. Los síntomas incluyen un archivo que abre pero muestra páginas en blanco o fuentes ausentes. Las herramientas de reparación pueden reconstruir la xref pero no pueden resucitar objetos que nunca se escribieron correctamente.

Arreglo: prueba ghostscript o Acrobat Preflight. Si las páginas siguen en blanco tras la reparación, los objetos de esas páginas se perdieron en el daño original. Restaura desde copia de seguridad o reexporta desde la aplicación fuente.

4. Corrupción de trailer

El trailer es el pequeño bloque al final del archivo que apunta a la xref y al catálogo raíz. Un archivo sin un trailer válido es ilegible, incluso si todos los objetos están intactos. Esto ocurre normalmente cuando una escritura se interrumpió — el archivo termina abruptamente a mitad de un objeto en vez de con %%EOF.

Arreglo: ghostscript y Acrobat a menudo pueden reconstruir un trailer ausente. Si el archivo termina a mitad de un objeto, puede que necesites truncar el objeto dañado primero y luego reconstruir. El comando qpdf --check informa de qué elementos estructurales faltan.

Herramientas locales de reparación

Todas las herramientas siguientes se ejecutan en tu máquina. Ninguna sube tu documento. Eso importa: un archivo corrupto puede seguir conteniendo contenido sensible legible, y subirlo a un servicio «reparación de PDF online gratuito» envía ese contenido al servidor de un desconocido antes de que sepas qué sobrevivió.

1. ghostscript (gratuito, multiplataforma, línea de comandos)

La herramienta de reparación gratuita más fiable. Relee el archivo, reconstruye la xref y el trailer y escribe una copia limpia. En Windows:

gswin64c -dNOPAUSE -dBATCH -sDEVICE=pdfwrite -sOutputFile=out.pdf in.pdf

En macOS y Linux, sustituye gswin64c por gs. ghostscript no puede reparar flujos de objetos dañados, pero arregla la mayoría de daños de xref y trailer.

2. Adobe Acrobat Pro (de pago, Preflight)

La función Preflight de Acrobat Pro tiene un perfil «Reparar PDF» que reconstruye la xref, reembebe fuentes ausentes y aplana anotaciones rotas. Abre el archivo, luego Herramientas > Producción de impresión > Preflight, y ejecuta el perfil de reparación. Acrobat es la herramienta de reparación más capaz pero no es gratuita.

3. PDF24 Creator (gratuito, Windows)

PDF24 incluye una herramienta «Reparar PDF» que envuelve ghostscript con una GUI. Abre PDF24, elige Reparar PDF, suelta el archivo y guarda el resultado. Útil si estás en Windows y prefieres no usar la línea de comandos.

4. Recovery Toolbox for PDF (de pago, Windows)

Una herramienta comercial dedicada de reparación que gestiona daños graves que ghostscript no puede arreglar. Escanea el archivo byte a byte en busca de firmas de objetos reconocibles y reconstruye lo que puede. Úsalo solo cuando las herramientas gratuitas han fallado y el archivo es lo bastante importante para justificar la licencia.

Paso a paso: reparar con ghostscript

  1. Instala ghostscript. En Windows, descarga desde ghostscript.com. En macOS, brew install ghostscript. En Linux, usa tu gestor de paquetes.
  2. Abre una terminal. Navega a la carpeta que contiene el PDF corrupto.
  3. Ejecuta el comando de reparación.gs -dNOPAUSE -dBATCH -sDEVICE=pdfwrite -sOutputFile=repaired.pdf corrupted.pdf
  4. Comprueba el resultado. Abre repaired.pdfen Acrobat Reader o Preview. Si abre y muestra todas las páginas, la reparación tuvo éxito.
  5. Si siguen faltando páginas, los flujos de objetos originales estaban dañados. Restaura desde copia de seguridad o reexporta desde la aplicación fuente.

Respaldo: extraer páginas intactas con IXPDF

Cuando la reparación completa falla, a veces puedes recuperar las páginas intactas. Abre Extraer páginas, suelta el archivo corrupto e intenta extraer la página 1. Si tiene éxito, prueba rangos (1–5, 6–10) hasta que alcances la sección dañada. IXPDF lee el archivo en local en tu navegador — sin subida — y escribe un PDF nuevo a partir de las páginas que pueda parsear. Las páginas de la región dañada fallarán; el resto se recuperará.

Errores comunes

  • Subir el archivo corrupto a un servicio de reparación online. El archivo puede seguir conteniendo contenido sensible legible. Usa una herramienta local.
  • Sobrescribir la única copia. Escribe siempre el archivo reparado a un nombre nuevo. Guarda el original corrupto hasta que hayas verificado la reparación.
  • Asumir que la reparación restaurará el contenido perdido.Si los flujos de objetos estaban dañados, el contenido se ha ido. La reparación reconstruye la estructura; no puede resucitar bytes ausentes.
  • Intentar reparar un archivo protegido por contraseña.El cifrado no es corrupción. Descifra primero (con la contraseña), luego repara si hace falta.

Intenta recuperar páginas intactas

La herramienta Extraer páginas de IXPDF se ejecuta en local en tu navegador. Suelta el archivo corrupto e intenta sacar las páginas que sobrevivieron. Tu archivo nunca sale de tu dispositivo.

Abrir Extraer páginas