Sökning efter duplikat

<< Click to Display Table of Contents >>

Navigation:  Använda TreeSize-filsökning >

Sökning efter duplikat

Söker efter dubbletter av filer på de valda enheterna eller delningarna.
I det här sammanhanget är duplicerade filer filer som verkar finnas mer än en gång. Sådana redundanta filer ökar det allokerade utrymmet på dina diskar i onödan.

Ett detaljerat steg-för-steg-exempel på hur du använder duplikatsökningen finns här.

TreeSize-FileSearch_DuplicateFiles

 

Fliken Kontext: Duplikatsökning

 

Sökningsläge:

Välj ett av tre lägen för duplikatsökning. Du kan söka efter dubbletter av filer, dubbletter av mappar eller filer som inte har några dubbletter.

Duplicerade filer

Söker efter filer som är kopior av varandra med hjälp av den valda jämförelsemetoden.

Duplicerade mappar

Söker efter mappar som är dubbletter av varandra. Två mappar betraktas som dubbletter om de innehåller samma antal undermappar och filer. Dessa undermappar och filer måste också vara likvärdiga med varandra, med avseende på den valda jämförelsemetoden.

Unika filer

Den här inställningen söker efter filer som inte har några dubbletter över de valda sökvägarna.

 

Jämförelsemetod:

Definierar vilka kriterier som ska användas för att identifiera filer som dubbletter. Här är en lista över de tillgängliga strategierna:

Filens innehåll

Det här alternativet använder MD5-kontrollsummor för jämförelse som standard.

När den här metoden används beräknas ett så kallat hashvärde baserat på innehållet i varje fil. Filer med samma innehåll kommer att ha samma hashvärde, medan filer med olika innehåll nästan säkert kommer att ha olika värden. Tomma filer ignoreras, eftersom det inte finns något innehåll att jämföra.

Detta är mer exakt än att jämföra filer efter namn, storlek och datum, men det är också mycket långsammare.

 

I filsökningsalternativen är det möjligt att justera den här metoden så att den använder SHA256-hashar i stället. SHA256-algoritmen minskar den statistiska risken för hashkollisioner ytterligare jämfört med MD5, men den är också betydligt långsammare. Det här alternativet är endast synligt när du använder expertläget.

Storlek, namn och datum

Välj det här alternativet för att identifiera dubbletter av filer genom att leta efter lika namn, storlekar och datum för senaste ändring.

Detta är mycket snabbare än att använda kontrollsummor för att ange dubbletter, men det är också mindre exakt.

Namn och storlek

Välj det här alternativet för att identifiera dubbletter genom att leta efter lika namn och storlek.

Lika med det allra första jämförelsekriteriet, men utan hänsyn till filernas tidsstämpel för "senast ändrad".
Detta är användbart om filerna har flyttats från en plats till en annan, vilket kan ändra denna tidsstämpel.

Namn

Välj det här alternativet om du vill hitta alla filer med samma filnamn.

Denna jämförelsetyp kan vara till hjälp när du söker efter oönskade kopior (t.ex. dokument som har kopierats och ändrats lokalt).

Namn utan tillägg

Välj det här alternativet för att hitta filer med samma namn, utan att ta hänsyn till filtillägget.

Detta kan vara intressant om du söker efter duplicerade säkerhetskopior eller t.ex. raddata och kompakta bild- eller videofiler ("MyPhoto.bmp" - "MyPhoto.png").

Storlek och datum

Jämför filer utifrån deras storlek och datumvärden. Detta möjliggör en snabbare, men därför mindre exakt sökning efter dubbletter av filer med olika namn. Oavsiktliga kopior med namn som "Kopia av ..." kan snabbt identifieras med denna metod.

Endast storlek

Välj detta alternativ för att hitta alla filer med samma storlek.

 

Sökfilter:

Ytterligare alternativ för att anpassa sökningen efter dubbletter av filer:

Uteslut filter

Gör det möjligt att aktivera, inaktivera eller anpassa de globala exkluderingsfiltren för den här sökningen.

Genom att begränsa dubblettsökningen till ett visst förval av filer kan du förhindra att filer i vissa kataloger (t.ex. dina lokala systemkataloger) listas som dubbletter. Dessutom minskar detta alternativ antalet filer som ska jämföras, vilket gör sökningen snabbare.

Ignorera NTFS-hårdlänkar

Om det här alternativet är aktiverat betraktas inte hårddisklänkar som fildubbletter. Obs: NTFS-hårdlänkar allokerar inte minne. Om du tar bort dem blir därför inte ytterligare minne tillgängligt. Dessutom  använder TreeSize hårda länkar för deduplicering.

Deduplicera:

Använd knappen "Operations > deduplicate" för att ersätta alla kontrollerade dubbletter utom en med NTFS-hårdlänkar. Mer information om deduplicering av filer finns i det här kapitlet.

I konfigurationsfönstret kan du välja en loggfil som de utförda ersättningarna ska loggas till. Du kan också definiera hur TreeSize ska hantera filer som finns på olika hårddiskar. Du kan antingen ersätta filer som finns på samma hårddisk med hårda länkar separat eller helt enkelt välja en referensenhet och ersätta alla filer som finns på andra hårddiskar med symboliska länkar.  Observera att om du inte kan få tillstånd att skapa symboliska länkar skapas istället en Windows-genväg (.LNK-fil) som reserv.

I snabbmenyn i listan över dubbletter finns en funktion som heter "Ersätt dubbletter med hårda länkar". Denna funktion fungerar precis som funktionen "Deduplicate", men hanterar alla valda filer istället för markerade filer.

TreeSize-FileSearch_Duplicates_Deduplicate