Pesquisa de arquivos duplicados¶
A pesquisa de arquivos duplicados procura por arquivos duplicados nas unidades ou compartilhamentos selecionados.
Nesse contexto, arquivos duplicados são arquivos que parecem existir mais de uma vez. Esses arquivos redundantes aumentam desnecessariamente o espaço alocado em seus discos.
Guia Contexto¶
Modo de pesquisa¶
Selecione um dos três modos de pesquisa de duplicatas. Você pode procurar arquivos duplicados, pastas duplicadas ou arquivos que não tenham duplicatas.
Arquivos duplicados¶
Procura arquivos que sejam duplicados entre si, usando o método de comparação selecionado.
Pastas duplicadas¶
Procura pastas que sejam duplicadas umas das outras. Duas pastas são consideradas duplicadas se contiverem a mesma quantidade de subpastas e arquivos. Essas subpastas e arquivos também devem ser iguais entre si, em relação ao método de comparação selecionado.
Arquivos exclusivos¶
Essa configuração procura por arquivos que não tenham duplicatas nos caminhos de pesquisa selecionados.
Método de comparação¶
Define quais critérios devem ser usados para identificar arquivos como duplicados. Aqui está uma lista das estratégias disponíveis:
Conteúdo do arquivo¶
Por padrão, essa opção usa somas de verificação MD5 para comparação.
Ao usar esse método, o chamado valor de hash é calculado com base no conteúdo de cada arquivo. Os arquivos com o mesmo conteúdo terão o mesmo valor de hash, enquanto os arquivos com conteúdo diferente quase certamente terão valores diferentes. Os arquivos vazios são ignorados, pois não há conteúdo para comparar.
Isso é mais preciso do que comparar arquivos por nome, tamanho e data, mas também é muito mais lento.
Nas opções de pesquisa de arquivos, é possível ajustar esse método para usar hashes SHA256. O algoritmo SHA256 reduz ainda mais o risco estatístico de colisões de hash em comparação com o MD5, mas também é significativamente mais lento. Essa opção só fica visível quando se usa o modo de aplicativo especializado.
Tamanho, nome e data¶
Selecione essa opção para identificar arquivos duplicados procurando por nomes, tamanhos e datas de última alteração iguais.
Isso é muito mais rápido do que usar somas de cheques para indicar duplicatas, mas também é menos preciso.
Nome e tamanho¶
Selecione essa opção para identificar arquivos duplicados procurando por nomes e tamanhos iguais.
Igual ao primeiro critério de comparação, mas sem considerar o registro de data e hora da “última modificação” dos arquivos.
Isso é útil no caso de os arquivos terem sido movidos de um local para outro, o que poderia modificar esse registro de data e hora.
Nome¶
Selecione essa opção para localizar todos os arquivos com nomes de arquivo iguais.
Esse tipo de comparação pode ser útil quando você estiver procurando por cópias indesejadas (por exemplo, documentos que foram copiados e modificados localmente).
Nome sem extensão¶
Selecione essa opção para detectar arquivos com nomes iguais, sem levar em conta a extensão do arquivo.
Isso pode ser interessante caso esteja procurando por arquivos de backup duplicados ou, por exemplo, dados de linha e arquivos compactos de imagem ou vídeo (“MyPhoto.bmp” - “MyPhoto.png”).
Tamanho e data¶
Compara os arquivos de acordo com seu tamanho e valores de data. Isso permite uma pesquisa mais rápida, porém menos precisa, de arquivos duplicados com nomes diferentes. Cópias acidentais com nomes como “Cópia de …” podem ser identificadas rapidamente usando esse método.
Somente tamanho¶
Selecione essa opção para localizar todos os arquivos com o mesmo tamanho.
Filtros de pesquisa¶
Opções adicionais para personalizar a pesquisa de arquivos duplicados:
Excluir filtro¶
Permite ativar, desativar ou personalizar os filtros de exclusão globais para essa pesquisa.
Ao restringir a pesquisa de duplicatas a uma pré-seleção específica de arquivos, você pode evitar a listagem de arquivos de determinados diretórios (por exemplo, os diretórios do sistema local) como duplicatas. Além disso, essa opção reduzirá o número de arquivos a serem comparados, o que aumenta a velocidade da pesquisa.
Ignorar hardlinks NTFS¶
Se essa opção estiver ativada, os hardlinks não serão considerados duplicatas de arquivos. Observação: os hardlinks NTFS não alocam memória. Portanto, a exclusão deles não disponibiliza memória adicional. Além disso, o TreeSize usa hard links para deduplicação.
Deduplicar¶
Use o botão “Operations > Deduplicate” para substituir todos os arquivos duplicados verificados, exceto um, por hardlinks NTFS (Como a deduplicação funciona?)
Na janela de configuração, é possível selecionar um arquivo de registro para registrar as substituições realizadas. Você também pode definir como o TreeSize tratará os arquivos localizados em diferentes discos rígidos.
Você pode substituir os arquivos localizados no mesmo disco rígido por hardlinks separadamente ou simplesmente selecionar uma unidade de referência e substituir todos os arquivos localizados em outros discos rígidos por links simbólicos.
Note
Caso a permissão para criar links simbólicos não possa ser concedida, será criado um atalho do Windows (arquivo .LNK) como alternativa.
O menu de contexto da lista de arquivos duplicados oferece um recurso chamado “Replace duplicates by hardlinks” (Substituir duplicatas por links físicos).
Essa função funciona da mesma forma que a função “Deduplicate”, mas tratará todos os arquivos selecionados em vez dos arquivos verificados.