Saltar al contenido
100 % local · 0 KB subidosComprimir PDF

¿Qué es un PDF? Conceptos básicos del formato

PDF significa Portable Document Format (Formato de Documento Portátil). Es el formato más usado para compartir documentos que deben verse igual en cualquier dispositivo. Esta página explica qué es realmente un PDF, de dónde viene y cómo funciona por dentro.

Historia

De dónde viene el PDF

El PDF fue inventado por Adobe Systems en 1993. El objetivo era simple pero ambicioso: un único formato de archivo que preservara las fuentes, imágenes, gráficos y diseño de un documento exactamente como el autor pretendía, sin importar el ordenador, sistema operativo o impresora usados para verlo. El nombre "Portable Document Format" refleja esa ambición.

Durante su primera década, PDF fue un formato propietario de Adobe. En 2008 se publicó como un estándar internacional abierto, ISO 32000-1, que transfirió la gestión a la Organización Internacional de Normalización (ISO). Ahora cualquiera puede construir software que lea o escriba PDFs sin pagar regalías. Una versión revisada,ISO 32000-2 (PDF 2.0), se publicó en 2020 y aclaró muchos casos límite sin romper los archivos existentes.

Adopción

Por qué PDF se volvió universal

Los PDFs resuelven un problema real que los formatos anteriores no podían. Un documento de Word abierto en otro ordenador puede reordenarse, cambiar fuentes y modificar los saltos de página. Una página web depende del navegador y del tamaño de pantalla. Un PDF, en cambio, es un documento de diseño fijo: la página 3 se ve como la página 3 en todas partes.

Esa fiabilidad convirtió al PDF en el formato predeterminado para contratos, facturas, trabajos de investigación, formularios oficiales, libros electrónicos y cualquier documento pensado para imprimir o archivar. Los lectores gratuitos (Adobe Acrobat Reader, luego navegadores y sistemas operativos) hicieron que verlos fuera sin fricción. Hoy, todos los sistemas operativos principales pueden abrir un PDF sin instalar software adicional.

Por dentro

Qué hay dentro de un archivo PDF

Un PDF es un archivo estructurado de texto y binario formado por cuatro partes:

  • Cabecera — una sola línea que indica la versión de PDF (por ejemplo, %PDF-1.7).
  • Cuerpo — una secuencia de objetos numerados que describen páginas, fuentes, imágenes, flujos de texto y metadatos. Cada objeto es independiente y puede leerse en cualquier orden.
  • Tabla de referencias cruzadas — un índice que da el desplazamiento en bytes de cada objeto, para que un lector pueda saltar directamente a cualquier objeto sin recorrer todo el archivo.
  • Tráiler — apunta a la tabla de referencias cruzadas y al objeto raíz (el catálogo del documento), para que el lector sepa por dónde empezar.

Este diseño es la razón por la que los PDFs pueden ser grandes pero abrirse rápido: la tabla de referencias cruzadas permite a los lectores obtener solo los objetos que necesitan. También es la razón por la que son posibles las actualizaciones incrementales — cuando editas un PDF, se pueden añadir un objeto nuevo y una sección nueva de referencias cruzadas sin reescribir todo el archivo.

Versiones

Versiones de PDF, brevemente

El número de versión en la cabecera (%PDF-1.x o%PDF-2.0) indica a un lector qué funciones puede usar el archivo. La mayoría de los PDFs reales están entre 1.4 y 1.7. La versión 1.5 introdujo flujos de objetos y flujos de referencias cruzadas que reducen el tamaño. La 1.6 añadió contenido 3D y cifrado más rico. La 1.7 (la base de ISO 32000-1) consolidó todo. PDF 2.0 limpió la especificación pero sigue siendo poco común en la práctica.

Para el uso diario, la versión rara vez importa. Los lectores modernos manejan todas. Lo que importa más es qué hay dentro de los objetos: fuentes incrustadas, compresión de imágenes y metadatos.

Sigue leyendo

Recursos relacionados