Comparar Dos PDF

Suelta dos PDF, compara su contenido de texto línea por línea, con las adiciones y eliminaciones resaltadas.

Haz clic o suelta el PDF original

Haz clic o suelta el PDF modificado

Suelta ambos PDF para ver la comparación.

Cómo funciona

Cada PDF se lee con pdf.js, el mismo motor que usa Firefox para renderizar PDF, recorriendo el flujo de contenido de cada página para recopilar su texto incrustado mediante getTextContent(). Los dos textos resultantes se dividen luego en líneas y se procesan con el mismo algoritmo de diferencias de subsecuencia común más larga que hay detrás de la herramienta Comparador de Texto de norito, que encuentra el conjunto más pequeño de adiciones y eliminaciones de líneas que explica la diferencia entre los dos documentos, en lugar de comparar ingenuamente por posición línea a línea (lo que marcaría cada línea como cambiada tras un solo párrafo insertado).

Como con cualquier extracción de texto de PDF, los resultados dependen de que el PDF realmente contenga texto. Las páginas escaneadas son imágenes y no aportan nada que comparar. Todo, extracción y comparación, ocurre en esta pestaña del navegador; ningún archivo se sube.

Preguntas frecuentes

¿Esto compara el diseño o solo el texto?

Solo el contenido de texto. Extrae el texto incrustado de cada PDF y lo compara, así que detecta cambios de redacción, párrafos añadidos o eliminados, y números editados, pero no cambios puramente visuales como un cambio de fuente o una imagen movida con el mismo texto alrededor.

¿Funcionará con PDF escaneados?

No, las páginas escaneadas son imágenes sin texto incrustado, así que no hay nada que extraer ni comparar a menos que el PDF ya haya pasado por OCR.

¿Se suben mis PDF a algún sitio?

No. Ambos archivos se leen y comparan por completo en tu navegador. No se sube nada, algo que importa para contratos o borradores que estés comparando.