🗑️ Remover Duplicatas
Remova linhas duplicadas de qualquer lista instantaneamente. Grátis, sem registro.
Nenhuma duplicata removida ainda.
Clique em "Remover Duplicatas" para começar.
O que cada botão realmente remove, reordena ou revela
A versão curta: dois botões removem duplicatas e mantêm a ordem original, um botão remove duplicatas e depois organiza em ordem alfabética o que resta, e um botão não remove absolutamente nada, apenas mostra o que está repetido.
john@email.com
jane@email.com
John@Email.com
bob@email.com
jane@email.comjohn@email.com
jane@email.com
John@Email.com
bob@email.com| Botão | Tratamento de maiúsculas/minúsculas | Mantém a ordem original | Passa para uma thread em segundo plano após 5.000 linhas |
|---|---|---|---|
| Remover duplicatas | Correspondência exata que diferencia maiúsculas de minúsculas | Sim | Sim |
| Ignorar maiúsculas/minúsculas | Correspondência que não diferencia maiúsculas de minúsculas | Sim | Sim |
| Ordenar + Dedup | Correspondência exata que diferencia maiúsculas de minúsculas | Não, em ordem alfabética | Não |
| Mostrar duplicatas | Correspondência exata que diferencia maiúsculas de minúsculas | Não remove nada | Não |
Cada um desses quatro botões executa o mesmo primeiro passo antes de comparar uma única linha: o texto colado é dividido nas quebras de linha, cada linha tem seus espaços em branco iniciais e finais cortados e qualquer linha que agora esteja vazia é totalmente removida da lista. O que sobrevive a essa passagem é com o que o resto da lógica do botão trabalha. Esse primeiro passo é idêntico para "Remover duplicatas" e "Ignorar maiúsculas/minúsculas", então a única diferença real entre eles é a regra de comparação única por baixo, não o corte ou tratamento de linhas em branco ao redor.
Apenas "Remover duplicatas" e "Ignorar maiúsculas/minúsculas" enviam suas linhas excluídas para o painel "Duplicatas removidas" à direita. "Ordenar + Dedup" também preenche esse painel, pois desduplica antes de classificar. "Mostrar duplicatas" nunca toca nele, porque não está removendo nada, apenas reorganizando o que fica no editor principal.
Listas grandes se comportam de forma diferente dependendo do botão. Depois de 5.000 linhas, "Remover duplicatas" e "Ignorar maiúsculas/minúsculas" passam para um Web Worker em segundo plano para que a guia permaneça responsiva. "Ordenar + Dedup" e "Mostrar duplicatas" não têm essa transferência e sempre são executados diretamente na página, portanto, uma colagem incomumente grande pode fazer a guia pausar brevemente quando você clica em qualquer um desses dois.
Sensível a maiúsculas e minúsculas por padrão: Quando Apple e apple contam como dois
Remover duplicatas trata maiúsculas e minúsculas como parte do texto. Clique em Ignorar maiúsculas/minúsculas em vez disso e apple, Apple e APPLE se reduzem a qualquer grafia que tenha sido colada primeiro.
john@email.com
jane@email.com
John@Email.com
bob@email.comjohn@email.com
jane@email.com
bob@email.comAmbas as colunas começam com a mesma lista colada: john@email.com, jane@email.com, John@Email.com, bob@email.com, jane@email.com. "Remover duplicatas" simples apenas detecta a repetição exata de jane@email.com na última linha, pois compara as linhas exatamente como estão escritas. John@Email.com sobrevive bem ao lado de john@email.com, porque para uma comparação que diferencia maiúsculas de minúsculas, as letras maiúsculas e minúsculas são simplesmente caracteres diferentes.
Esse padrão é correto para dados onde o uso de maiúsculas/minúsculas realmente tem significado: SKUs de produtos, nomes de usuários que diferenciam maiúsculas de minúsculas e códigos em que ABC123 e abc123 podem se referir a registros totalmente diferentes. É o padrão incorreto para uma lista de e-mail, já que john@email.com e John@Email.com apontam para a mesma caixa de entrada, e enviar duas vezes para o mesmo endereço é exatamente o que a desduplicação deveria evitar.
Ignorar maiúsculas/minúsculas é um botão, não uma caixa de seleção. Clicar nele converte cada linha para minúsculas apenas para fins de comparação, mantém a primeira grafia que viu para cada valor exclusivo e executa toda a remoção em um único clique. Ele não alterna uma configuração persistente que muda o que o botão Remover duplicatas simples faz da próxima vez que você o pressionar. Também não há opção parcial, não há como ignorar maiúsculas e minúsculas para parte de uma linha, ou apenas fora de um nome de domínio. A escolha é binária: compare cada linha exatamente como digitada, ou converta cada linha para minúsculas antes de comparar.
Ordenar + Dedup não tem uma versão de si mesmo que não diferencie maiúsculas de minúsculas. Ele sempre compara as linhas exatamente, assim como o botão Remover duplicatas simples. Se você precisar de um resultado que não diferencie maiúsculas de minúsculas e um em ordem alfabética, clique primeiro em Ignorar maiúsculas/minúsculas para juntar as variantes de maiúsculas e minúsculas e depois clique em Ordenar + Dedup para colocar em ordem alfabética o que sobrou. Executar Ordenar + Dedup sozinho em dados com maiúsculas e minúsculas misturadas manterá cada variante que não reconhecer como idêntica.
Por que espaços cortados corrigem algumas duplicatas e não outras
Cada comparação corta primeiro o início e o fim de cada linha. Um espaço inicial ou final perdido nunca causa uma falsa falta de correspondência. Um espaço duplo no meio de uma linha ainda conta como texto diferente.
john@email.com
john@email.comjohn@email.comAs duas linhas acima parecem idênticas, e para os seus olhos são. A segunda foi colada com um espaço final invisível, do tipo que vem de graça quando você copia um valor de uma célula de planilha ou tabela de PDF. Antes de essa ferramenta comparar qualquer coisa, ela remove espaços em branco iniciais e finais de cada linha, de modo que aquele espaço final nunca tem a chance de fazer duas linhas idênticas parecerem diferentes. O resultado é uma única linha sobrevivente, exatamente como deveria ser.
O que o corte não faz é tocar no espaço em branco dentro de uma linha. New York e New York, o segundo com dois espaços entre as palavras em vez de um, são cortados da mesma forma nas bordas, mas ainda diferem no meio, então nenhum dos quatro botões os trata como duplicatas. Reduzir espaços em branco internos automaticamente correria o risco de mesclar duas entradas de várias palavras genuinamente diferentes, então essa ferramenta deixa isso de lado de propósito. Tabulações são cortadas da mesma forma que os espaços: uma linha que começa com um caractere de tabulação em vez de um espaço é removida da mesma forma limpa, já que a etapa de corte remove todo tipo de espaço em branco de ambas as extremidades de uma linha, não apenas o caractere de espaço especificamente.
Espaçamento interno inconsistente sobrevive a todos os botões nesta página. Se seus dados têm entradas como New York e New York lado a lado, a desduplicação não as pegará, porque o corte só toca nas duas extremidades de uma linha. Normalize o espaçamento interno manualmente ou com um passe de localizar e substituir primeiro, depois execute a remoção novamente.
Qual cópia sobrevive e se a lista permanece em ordem
Remover duplicatas e Ignorar maiúsculas/minúsculas mantêm cada linha sobrevivente exatamente onde estava. Ordenar + Dedup mantém a mesma primeira ocorrência, depois organiza o resultado em ordem alfabética, então a ordem original se perde.
Banana
Apple
CherryApple
Banana
CherryCole Banana, Apple, Banana, Cherry e os dois botões concordam sobre qual cópia de Banana manter: a primeira, encontrada ao verificar a lista de cima para baixo. Onde eles discordam é no que acontece com os sobreviventes depois. Remover duplicatas deixa Banana, Apple, Cherry nessa ordem exata, já que nada na etapa de remoção reordena nada, apenas tira as linhas. Ordenar + Dedup pega os mesmos três sobreviventes e os organiza em ordem alfabética, ficando com Apple, Banana, Cherry em vez disso.
Manter a ordem original é importante sempre que a sequência de seus dados contiver informações próprias: um log cronológico, uma lista em que a primeira entrada é o registro canônico e as posteriores são colagens acidentais ou qualquer conjunto de dados no qual uma nova classificação apagaria algo sobre prioridade ou tempo. Procure o Ordenar + Dedup especificamente quando quiser uma lista de referência limpa e em ordem alfabética e a ordem em que os dados chegaram nunca tiver sido significativa. Essa regra de primeira ocorrência também é fixa em todos os botões aqui: nada nesta página mantém a última ocorrência de uma linha repetida em vez da primeira, então não há uma configuração para alternar se o que você realmente queria era a cópia mais recente.
O painel Duplicatas removidas também segue a ordem de verificação. Se você clicou em Remover duplicatas, Ignorar maiúsculas/minúsculas ou Ordenar + Dedup, as linhas que aparecem no painel da direita são listadas na ordem em que foram encontradas durante a verificação, não agrupadas pela linha sobrevivente que duplicaram e não em ordem alfabética.
Por que uma duplicata com erro de ortografia passa ilesa
Cada comparação aqui é exata. John Smith e Jon Smith, ou Acme Inc. e Acme Inc, são duas linhas diferentes para esta ferramenta, não uma duplicata e um erro de digitação do outro.
John Smith
Jon Smith
Acme Inc.
Acme IncJohn Smith
Jon Smith
Acme Inc.
Acme IncClique em Remover duplicatas nessa lista e nada muda. Todas as quatro linhas são mantidas, e a ferramenta informa você com uma mensagem "Nenhuma duplicata encontrada!", porque cada comparação que ela faz é uma correspondência de caractere por caractere na linha aparada e, opcionalmente, em letras minúsculas. Ela não tem o conceito de "perto o suficiente". Um erro de digitação de uma letra, um ponto final faltando ou um hífen trocado por um espaço, todos produzem duas linhas que simplesmente não têm relação no que diz respeito a qualquer botão aqui.
Essa é uma limitação deliberada, não um descuido. Decidir quão semelhantes duas linhas precisam ser antes de contarem como a mesma coisa, geralmente medido com algo como distância de edição, é um tipo fundamentalmente diferente de algoritmo de comparação exata e toma decisões que variam de acordo com o conjunto de dados. Errar na outra direção, fundindo dois registros que apenas se parecem, pode destruir dados reais de forma silenciosa, o que é um resultado pior do que deixar uma quase duplicata óbvia na lista para um humano detectar.
Uma maneira prática de lidar com dados confusos: execute Mostrar duplicatas primeiro para ver quantas repetições exatas já existem, padronize as diferenças óbvias de formatação à mão ou com uma passagem de localizar e substituir, uso consistente de maiúsculas/minúsculas, pontuação consistente, abreviações consistentes, e depois execute Remover duplicatas novamente. A limpeza que transforma quase duplicatas em correspondências exatas é o que permite que essa ferramenta as identifique.
O que Mostrar duplicatas realmente exibe e em que ordem
Mostrar duplicatas lista cada valor que aparece mais de uma vez, uma vez cada, sem excluir nada. Se sua lista mistura números simples com palavras, os números vêm primeiro em ordem crescente, não na ordem em que você os colou.
100
5
zebra
100
5
zebra5
100
zebra"Mostrar duplicatas" conta quantas vezes cada linha aparada aparece, mantém apenas os valores que aparecem mais de uma vez e substitui o conteúdo do editor por essa lista, uma entrada por valor duplicado em vez de uma entrada por repetição. Uma linha colada cinco vezes aparece uma vez no resultado, pois o objetivo é mostrar quais valores se repetem, e não quantas cópias existem. Nada no seu texto original é alterado ou removido por este botão.
A ordem dos números no exemplo acima não é um recurso de classificação. Ela decorre de como o objeto JavaScript que conta suas linhas ordena suas próprias chaves: entradas que parecem números inteiros simples não negativos, como 5 e 100, são sempre listadas primeiro em ordem numérica crescente, à frente de qualquer outro valor duplicado, que então aparece na ordem em que foi encontrado pela primeira vez. Isso só é perceptível quando seus dados duplicados misturam linhas numéricas com linhas de texto. Uma lista de nomes ou palavras duplicadas sem números simples retorna na ordem em que foram encontrados pela primeira vez, sem peculiaridades. O mesmo comportamento "numérico primeiro" aparece independentemente de quantas vezes um valor se repete ou do tamanho da lista, pois vem de como o objeto de contagem ordena suas chaves em vez de qualquer coisa sobre o tamanho dos seus dados.
Mostrar duplicatas nunca toca no painel Duplicatas removidas à direita. Esse painel continua mostrando o que exibiu por último, ou "Aguardando..." se você ainda não executou Remover duplicatas, Ignorar maiúsculas/minúsculas ou Ordenar + Dedup, já que Mostrar duplicatas não remove nada e nunca escreve nele.
Seis maneiras como as pessoas realmente usam esta ferramenta
Limpando uma lista de e-mail antes de uma campanha
Cole uma lista combinada de várias fontes de inscrição e clique em Ignorar maiúsculas/minúsculas em vez do botão simples. O mesmo endereço digitado com letras maiúsculas ou minúsculas diferentes continua sendo a mesma caixa de entrada, e enviar duas vezes para a mesma pessoa é exatamente o resultado que você está tentando evitar.
Revisar antes de se comprometer a excluir qualquer coisa
Clique primeiro em Mostrar duplicatas em qualquer lista sobre a qual você não tenha total certeza. Ver exatamente quais valores se repetem, sem perder seus dados originais, dá a você a chance de identificar um caso em que uma duplicata aparente seja, na verdade, significativa, antes de executar a própria remoção.
Construindo uma lista principal limpa e em ordem alfabética
Quando você está consolidando várias listas de origem em um documento de referência e a ordem original não importa, o Ordenar + Dedup faz os dois trabalhos com um clique: apenas valores exclusivos, ordenados alfabeticamente, prontos para uso como uma lista de pesquisa.
Limpando uma coluna exportada de uma planilha
As exportações de planilhas frequentemente carregam espaços finais do preenchimento das células, juntamente com o uso inconsistente de maiúsculas/minúsculas na entrada de dados manual. Como toda comparação aqui corta espaços em branco automaticamente, e Ignorar maiúsculas/minúsculas lida com a metade das maiúsculas/minúsculas, colar uma coluna exportada diretamente geralmente detecta os dois problemas de uma só vez.
Mantendo um registro cronológico limpo
Quando a ordem de seus dados é importante, um log ou uma lista em que a primeira entrada é o registro original, clique em Remover duplicatas simples ou Ignorar maiúsculas/minúsculas em vez de Ordenar + Dedup. Ambos mantêm cada linha sobreviviente exatamente onde estava, portanto, a sequência com a qual você começou ainda é legível depois, e nenhum dos dois reorganizará silenciosamente uma lista que você esperava que ficasse no lugar.
Trabalhando com exportações muito grandes
Remover duplicatas e Ignorar maiúsculas/minúsculas passam para um thread em segundo plano quando a lista passa de 5.000 linhas, de modo que a guia continue respondendo enquanto um arquivo grande é processado. Ordenar + Dedup e Mostrar duplicatas são executados diretamente na página, independentemente do tamanho. De qualquer forma, nada que você cole sai do seu dispositivo: não há etapa de upload, fila de processamento nem conta a criar.
Perguntas Frequentes
Ferramentas de Texto Relacionadas
Precisa fazer mais com seus dados? Experimente estas ferramentas complementares:
🔒 100% Privado e Seguro
A privacidade dos seus dados é nossa prioridade. Toda a remoção de duplicatas ocorre localmente no seu navegador: seu texto nunca é enviado a nenhum servidor. Não podemos ver, armazenar nem acessar seus dados. Use esta ferramenta com total confiança para informações sensíveis como listas de e-mails, dados de clientes ou documentos confidenciais.