Ratgeber

Doppelte Dateien zuverlässig finden

Zwei Dateien können denselben Namen und anderen Inhalt haben, oder andere Namen und identischen Inhalt. So finden Sie echte Duplikate zuverlässig, nach Größe und nach Fingerabdruck, statt aus Dateinamen zu raten.


Sie wissen, dass doppelte Dateien Ihren Speicher auffressen, aber sie von Hand zu finden ist aussichtslos. Der Reflex ist, einen Ordner nach Namen zu sortieren und nach Wiederholungen zu suchen. Genau da läuft die meiste Duplikatjagd schief, denn ein Dateiname sagt fast nichts über den Inhalt.

Der Name täuscht in beide Richtungen

Wenn Sie eine Datei kopieren, benennt Ihr System sie um: foto (1).jpg, foto Kopie.jpg, foto-final-v2.jpg. Der Inhalt ist identisch, aber die Namen unterscheiden sich alle, also geht das Sortieren nach Namen daran vorbei. Andersherum passiert es auch. Zwei völlig unabhängige Dateien können beide scan.pdf oder IMG_0042.jpg heißen. Vertrauen Sie dem Namen, markieren Sie Dateien, die nichts gemeinsam haben.

Größe ist ein Filter, keine Antwort

Dateigrößen zu vergleichen ist ein kluger erster Schritt. Unterscheiden sich zwei Dateien um ein einziges Byte, sind sie nicht identisch, den Vergleich kann man sich sparen. Aber eine gleiche Größe beweist für sich nichts. Viele verschiedene Dateien wiegen gleich viel, besonders kleine. Die Größe ist da, um den Haufen schnell zu verkleinern, damit die eigentliche Prüfung nur auf Kandidaten läuft, die wirklich passen könnten.

Der Fingerabdruck entscheidet

Der einzige zuverlässige Weg zu wissen, dass zwei Dateien gleich sind, ist ihren Inhalt anzusehen. Ein gutes Tool liest die Bytes und berechnet daraus einen kurzen Fingerabdruck. Gleicher Inhalt gibt jedes Mal denselben Fingerabdruck, egal wie die Datei heißt. Anderer Inhalt gibt einen anderen Fingerabdruck, nichts wird fälschlich gepaart. Das trennt eine echte Kopie von einer Datei, die nur ähnlich aussieht, und der Unterschied lohnt sich: siehe exaktes Duplikat gegen ähnliche Datei.

Auf einem ganzen NAS

Auf einem NAS gilt dieselbe Logik, aber die Dateien liegen hinter einer Netzwerkfreigabe. NAS Ranger verbindet sich über das Standardprotokoll SMB, filtert zuerst nach Größe, bestätigt dann per Fingerabdruck, über ganze Freigaben auf einmal. Sie bekommen eine saubere Liste echter Duplikatgruppen mit dem genauen Speicher, den jede freigäbe, und Sie entscheiden, was geht.

Kostenlos testen: Richten Sie es auf Ihr NAS, lassen Sie es jedes echte Duplikat nach Inhalt finden, und sehen Sie, was Sie zurückgewinnen, bevor Sie etwas anfassen.

FAQ

Warum kann ich nicht einfach nach Namen sortieren, um Duplikate zu finden?
Weil der Name in beide Richtungen täuscht. Eine Kopie wird oft in foto (1).jpg oder foto-final.jpg umbenannt: Identische Dateien tragen dann andere Namen. Und zwei völlig verschiedene Dokumente können einen Namen wie scan.pdf teilen. Das Sortieren nach Namen verpasst den ersten Fall und meldet den zweiten fälschlich.
Reicht der Vergleich der Dateigröße?
Größe ist ein guter erster Filter, kein Urteil. Viele verschiedene Dateien teilen zufällig dieselbe Bytezahl, und ein einziges geändertes Pixel gibt zwei fast identischen Fotos verschiedene Größen. Größe engt das Feld schnell ein, dann bestätigt eine Inhaltsprüfung.
Was heißt konkret 'nach Inhalt finden'?
Das Tool liest die Bytes jeder Datei und berechnet daraus einen kurzen Fingerabdruck. Zwei Dateien mit demselben Fingerabdruck haben denselben Inhalt, egal wie sie heißen. Es ist die einzige Methode, die zugleich sicher und in großem Maßstab schnell ist.
Funktioniert das für Dateien auf einem NAS?
Ja. NAS Ranger verbindet sich über das Standardprotokoll SMB mit Ihrem NAS und wendet dieselbe Methode aus Größe und dann Fingerabdruck auf ganze Freigaben an: Sie finden Duplikate über das Netzwerk, nicht nur auf Ihrer lokalen Festplatte.