Detector voor dubbele bestandsnamen

Een mapexport toont report.pdf, report (1).pdf en report (2).pdf, en je wilt bevestigen wat er gedupliceerd is voordat je opruimt. Plak een lijst met bestandsnamen, één naam per regel, en deze tool telt hoe vaak elke naam voorkomt. Paden worden genegeerd: alleen de bestandsnaam aan het einde van elke regel wordt vergeleken, en je kiest zelf of hoofdletters meetellen.

Dubbele bestandsnamen vinden

  1. 1

    Plak de lijst

    Eén bestandsnaam per regel. Bevat de regel een volledig pad, dan wordt alleen de bestandsnaam aan het einde vergeleken.

  2. 2

    Kies de vergelijkingsoptie

    Laat "Hoofdletters negeren" aan staan zodat `IMG_1234.jpg` en `img_1234.JPG` als één naam tellen, of zet het uit voor exacte vergelijking.

  3. 3

    Detecteer duplicaten

    Klik op de knop. Elke naam die vaker dan één keer voorkomt, wordt gegroepeerd met het aantal.

  4. 4

    Gebruik het resultaat

    De uitvoer is een korte CSV-lijst: naam, aantal. Kopieer hem naar je opschoonscript of spreadsheet.

Zo werkt de vergelijking

Instelling Gedrag Voorbeeld
Hoofdletters negeren (standaard) Hoofdletters doen er niet toe IMG_1234.jpg = img_1234.JPG
Exact De namen moeten identiek zijn IMG_1234.jpg komt alleen overeen met IMG_1234.jpg
Volledige paden Alleen de bestandsnaam aan het einde wordt vergeleken /photos/IMG_1234.jpg = IMG_1234.jpg

De uitvoer toont elke herhaalde naam één keer met het aantal. Namen die maar één keer voorkomen, worden niet getoond.

Patronen die deze tool detecteert

  • Kopieën van browsergedownloads. doc.pdf, doc (1).pdf en doc (2).pdf ontstaan wanneer je hetzelfde bestand herhaaldelijk opslaat.
  • macOS-“kopie”-markeringen. file.jpg en file copy.jpg, file copy 2.jpg.
  • Windows-duplicaatachtervoegsels. name - Copy.docx, name - Copy (2).docx.
  • Imports uit cameramappen. Dezelfde naam IMG_1234 verschijnt in meerdere jaarmappen wanneer de teller van de camera wordt gereset.

Wat de tool niet doet

  • Geen inhoudsvergelijking. Twee verschillende bestanden met de naam invoice.pdf tellen hier als duplicaten. De tool vergelijkt alleen namen, dus controleer de inhoud voordat je verwijdert.
  • Geen gelijkende namen. report.pdf en reprot.pdf zijn verschillende namen en worden niet gegroepeerd.
  • Geen speciale behandeling van extensies. photo.jpg en photo.png zijn verschillende namen.
  • Geen verwijdering. De tool toont alleen namen en aantallen; de beslissing is aan jou.

Nadat je duplicaten hebt gevonden

  1. Verwijder niet automatisch. Bekijk de groepen, vooral wanneer namen veel voorkomen (report.pdf, image.jpg).
  2. Controleer de inhoud voordat je verwijdert: vergelijk bestandsgroottes of een inhoudshash (SHA-256) om te bevestigen dat de bestanden echt gelijk zijn.
  3. Maak eerst een back-up wanneer de bestanden uit een archief komen dat je niet kunt vervangen.

Veelgestelde vragen

Alleen de namen. Voor duplicaatdetectie op inhoud heb je een hash-tool nodig die de werkelijke bytes van het bestand leest. Deze detector werkt met gewone bestandsnamenlijsten, zoals die uit directory-exports.

Ja. Wanneer een regel een pad bevat, wordt alleen de bestandsnaam aan het einde vergeleken; de mappen worden genegeerd.

Omdat “Hoofdletters negeren” standaard aan staat. Zet je het uit, dan behandelt de tool de twee namen als verschillend.

Ja. De lijst wordt naar onze server gestuurd zodat de detectie kan draaien, en het resultaat wordt op de pagina getoond. De lijst wordt daarna niet opgeslagen.

Gerelateerde tools

Tool beschikbaar in andere talen