PDF a Imágenes (PNG / JPG)
Convierte cada página de un PDF a imágenes PNG o JPG, enteramente en tu navegador.
Cargando PDF a Imágenes (PNG / JPG)… Si no ocurre nada, activa JavaScript.
Convertir un PDF a imágenes se llama rasterización, el proceso de renderizar las instrucciones vectoriales, las fuentes incrustadas y los gráficos de mapa de bits de una página de PDF en una cuadrícula de píxeles a una resolución concreta. Cada página del PDF se dibuja en un lienzo HTML5 a la escala de DPI (puntos por pulgada) solicitada, y el lienzo se exporta luego como un archivo PNG o JPEG. A diferencia de un PDF puramente vectorial, una imagen rasterizada puede abrirse en cualquier editor de imágenes, incrustarse directamente en una diapositiva de presentación, publicarse en un sitio web o compartirse en redes sociales sin necesitar ningún visor de PDF. Esta herramienta usa PDF.js, el motor de renderizado de PDF de código abierto de Mozilla, para gestionar la rasterización enteramente dentro de tu navegador.
Preguntas frecuentes
¿Se suben mis archivos a un servidor?
¿Cuál es el tamaño máximo de archivo o el número de páginas que admite esta herramienta?
¿Funciona con PDF protegidos con contraseña?
¿Qué resolución debería elegir para obtener la mejor calidad?
¿Cómo se compara esto con usar Adobe Acrobat para exportar imágenes?
¿Cuándo debería usar la salida PNG frente a la JPEG?
¿Qué formatos y versiones de PDF se admiten como entrada?
¿Puedo convertir solo páginas concretas en lugar del documento entero?
¿Puedo automatizar la conversión de PDF a imagen para muchos archivos?
¿Hay funciones de PDF que puedan no renderizarse correctamente?
Acerca de PDF a Imágenes (PNG / JPG)
Los casos de uso más comunes para la conversión de PDF a imagen incluyen extraer diagramas o gráficos concretos de un informe para usarlos en una presentación, convertir documentos escaneados a un formato aceptado por los portales de subida de imágenes, producir miniaturas para sistemas de gestión documental, archivar páginas de un contrato firmado como imágenes a prueba de manipulaciones y preparar contenido para publicaciones en redes sociales donde el PDF no está admitido. Los desarrolladores también usan la conversión de PDF a imagen para generar miniaturas de vista previa en aplicaciones de gestión documental y para ejecutar canalizaciones de OCR (reconocimiento óptico de caracteres) que aceptan entrada de imagen en lugar de PDF.
Como PDF.js es un renderizador de PDF completo que se ejecuta enteramente en tu navegador, tu documento nunca sale de tu dispositivo. No hay subida a servidor, ni llamada a API, ni procesamiento por terceros. Esto es especialmente importante para los PDF que contienen información de identificación personal, documentos legales bajo acuerdo de confidencialidad o estados financieros, todos los cuales conllevan obligaciones de confidencialidad que los servicios de conversión basados en la nube no pueden satisfacer de forma fiable.
Elegir los ajustes de salida correctos importa para la calidad y el tamaño del archivo. A escala 1x (aproximadamente 96 DPI), las imágenes son adecuadas para la visualización en pantalla pero se verán borrosas al imprimirlas. A 2x (192 DPI) la salida se ve nítida en pantallas de alta densidad y es aceptable para impresión de bajo volumen. A 3x (288 DPI) y superiores, las imágenes son adecuadas para reproducción impresa. El PNG es sin pérdidas y produce archivos más grandes, pero es ideal para documentos con texto nítido, dibujo lineal y gráficos de color sólido. El JPEG tiene pérdidas pero produce archivos mucho más pequeños y es lo mejor para páginas fotográficas o muy ilustradas donde los artefactos de compresión no se notan. En caso de duda, usa PNG para documentos con mucho texto y JPEG para los que tienen muchas imágenes.
De PostScript a píxeles: cómo PDF.js llevó el renderizado de PDF al navegador
Durante la mayor parte de la historia del PDF, ver un PDF requería una aplicación nativa dedicada, primero Adobe Reader, luego rivales como Foxit y Sumatra. Los navegadores lanzaban un complemento externo o un control ActiveX embebido, ambos famosos por sus vulnerabilidades de seguridad y sus cierres inesperados. Mozilla cambió esto en 2011 al lanzar PDF.js, un proyecto de código abierto que implementó un renderizador de PDF completo en JavaScript puro y HTML5 Canvas, sin código nativo ni complementos. Se incorporó en Firefox 19 (2013) como visor de PDF predeterminado, marcando la primera vez que un navegador importante podía mostrar PDF sin ningún software de terceros.
El reto técnico que resolvió PDF.js es considerable. Las páginas de PDF se describen en un subconjunto de PostScript, un lenguaje de programación basado en pila donde comandos como 'moveto', 'lineto', 'setfont' y 'showstring' se interpretan para construir la apariencia visual de una página. PDF.js tuvo que implementar un intérprete para este lenguaje, un motor de renderizado de fuentes capaz de manejar fuentes TrueType, Type 1, CFF y OpenType, un decodificador de imágenes para JPEG, JBIG2, CCITT Fax y otros esquemas de compresión, y un motor de composición para el complejo modelo de transparencia del PDF, todo ello en JavaScript, ejecutándose a velocidades interactivas en una pestaña del navegador.
La rasterización a alta DPI revela una propiedad interesante del PDF: es verdaderamente independiente de la resolución para el contenido vectorial. Una página de PDF descrita enteramente con instrucciones vectoriales puede renderizarse a 72 DPI para una miniatura de pantalla o a 4800 DPI para una filmadora de fotocomposición, produciendo una salida apropiada para cada medio a partir exactamente del mismo archivo de origen. Por eso se prefiere el PDF a formatos rasterizados como el TIFF para fines de archivo: la fidelidad del documento no está limitada por la resolución a la que se creó originalmente, sino solo por la precisión de la aritmética de coma flotante que se usa para interpretar sus instrucciones de dibujo.