Guías

Cómo encontrar archivos duplicados de forma fiable

Dos archivos pueden tener el mismo nombre y contenido distinto, o nombres distintos y contenido idéntico. Así encuentras duplicados reales de forma fiable, por tamaño y por huella, en lugar de adivinar por el nombre.


Sabes que hay archivos duplicados comiéndose tu espacio, pero encontrarlos a mano es imposible. El instinto es ordenar una carpeta por nombre y buscar repeticiones. Ahí es justo donde se tuerce la mayoría de las cazas de duplicados, porque un nombre de archivo no dice casi nada de lo que hay dentro.

El nombre engaña en los dos sentidos

Cuando copias un archivo, tu sistema lo renombra: foto (1).jpg, foto copia.jpg, foto-final-v2.jpg. El contenido es idéntico, pero los nombres difieren todos, así que ordenar por nombre pasa de largo. Al revés también ocurre. Dos archivos sin relación pueden llamarse los dos scan.pdf o IMG_0042.jpg. Fíate del nombre y marcarás archivos que no tienen nada en común.

El tamaño es un filtro, no una respuesta

Comparar tamaños es un buen primer paso. Si dos archivos difieren en un solo byte, no son idénticos: puedes saltarte la comparación. Pero un tamaño igual no prueba nada por sí solo. Muchos archivos distintos pesan lo mismo, sobre todo los pequeños. El tamaño sirve para reducir el montón rápido, para que la comprobación real solo se ejecute en candidatos que de verdad podrían coincidir.

La huella lo zanja

La única forma fiable de saber que dos archivos son iguales es mirar su contenido. Una buena herramienta lee los bytes y calcula con ellos una huella corta. Mismo contenido da la misma huella, cada vez, se llame como se llame el archivo. Contenido distinto da una huella distinta: nada se empareja por error. Eso separa una copia real de un archivo que solo se parece, y la diferencia vale la pena: mira duplicado exacto frente a archivo similar.

Hacerlo en un NAS

En un NAS aplica la misma lógica, pero los archivos están tras una carpeta de red. NAS Ranger se conecta por el protocolo estándar SMB, filtra primero por tamaño, luego confirma por huella, sobre carpetas enteras a la vez. Obtienes una lista limpia de grupos de duplicados reales con el espacio exacto que liberaría cada uno, y decides qué se va.

Pruébalo gratis: apúntalo a tu NAS, deja que encuentre cada duplicado real por contenido, y mira lo que puedes recuperar antes de tocar nada.

FAQ

¿Por qué no puedo ordenar por nombre para encontrar duplicados?
Porque el nombre engaña en los dos sentidos. Una copia suele renombrarse a foto (1).jpg o foto-final.jpg: archivos idénticos acaban con nombres distintos. Y dos documentos totalmente diferentes pueden compartir un nombre como scan.pdf. Ordenar por nombre se pierde el primer caso y marca por error el segundo.
¿Comparar el tamaño de los archivos basta?
El tamaño es un buen primer filtro, no un veredicto. Muchos archivos distintos comparten por casualidad el mismo número de bytes, y un solo píxel cambiado da a dos fotos casi idénticas tamaños distintos. El tamaño acota rápido, y luego una comprobación de contenido confirma.
¿Qué significa en la práctica 'encontrar por contenido'?
La herramienta lee los bytes de cada archivo y calcula con ellos una huella corta. Dos archivos con la misma huella tienen el mismo contenido, se llamen como se llamen. Es el único método a la vez certero y rápido a gran escala.
¿Esto funciona para archivos en un NAS?
Sí. NAS Ranger se conecta a tu NAS por el protocolo estándar SMB y aplica el mismo método de tamaño y luego huella a carpetas enteras: encuentras duplicados por la red, no solo en tu disco local.