Comparar Dos PDF
Suelta dos PDF, compara su contenido de texto línea por línea, con las adiciones y eliminaciones resaltadas.
Haz clic o suelta el PDF original
Haz clic o suelta el PDF modificado
Suelta ambos PDF para ver la comparación.
Cómo funciona
Cada PDF se lee con pdf.js, el mismo motor que usa Firefox para renderizar PDF, recorriendo
el flujo de contenido de cada página para recopilar su texto incrustado mediante
getTextContent(). Los dos textos resultantes se dividen luego en líneas y se
procesan con el mismo algoritmo de diferencias de subsecuencia común más larga que hay
detrás de la herramienta Comparador de Texto de norito, que
encuentra el conjunto más pequeño de adiciones y eliminaciones de líneas que explica la
diferencia entre los dos documentos, en lugar de comparar ingenuamente por posición línea a
línea (lo que marcaría cada línea como cambiada tras un solo párrafo insertado).
Como con cualquier extracción de texto de PDF, los resultados dependen de que el PDF realmente contenga texto. Las páginas escaneadas son imágenes y no aportan nada que comparar. Todo, extracción y comparación, ocurre en esta pestaña del navegador; ningún archivo se sube.
Preguntas frecuentes
¿Esto compara el diseño o solo el texto?
Solo el contenido de texto. Extrae el texto incrustado de cada PDF y lo compara, así que detecta cambios de redacción, párrafos añadidos o eliminados, y números editados, pero no cambios puramente visuales como un cambio de fuente o una imagen movida con el mismo texto alrededor.
¿Funcionará con PDF escaneados?
No, las páginas escaneadas son imágenes sin texto incrustado, así que no hay nada que extraer ni comparar a menos que el PDF ya haya pasado por OCR.
¿Se suben mis PDF a algún sitio?
No. Ambos archivos se leen y comparan por completo en tu navegador. No se sube nada, algo que importa para contratos o borradores que estés comparando.