TextSorter
Entrada (Itens Únicos)
0 linhas
0 linhas
Duplicatas Removidas
0 removidas

Nenhuma duplicata removida ainda.
Clique em "Remover Duplicatas" para começar.

Aguardando...

O que cada botão realmente remove, reordena ou revela

A versão curta: dois botões removem duplicatas e mantêm a ordem original, um botão remove duplicatas e depois organiza em ordem alfabética o que resta, e um botão não remove absolutamente nada, apenas mostra o que está repetido.

Você cola
john@email.com
jane@email.com
John@Email.com
bob@email.com
jane@email.com
Remover duplicatas mantém
john@email.com
jane@email.com
John@Email.com
bob@email.com
BotãoTratamento de maiúsculas/minúsculasMantém a ordem originalPassa para uma thread em segundo plano após 5.000 linhas
Remover duplicatasCorrespondência exata que diferencia maiúsculas de minúsculasSimSim
Ignorar maiúsculas/minúsculasCorrespondência que não diferencia maiúsculas de minúsculasSimSim
Ordenar + DedupCorrespondência exata que diferencia maiúsculas de minúsculasNão, em ordem alfabéticaNão
Mostrar duplicatasCorrespondência exata que diferencia maiúsculas de minúsculasNão remove nadaNão

Cada um desses quatro botões executa o mesmo primeiro passo antes de comparar uma única linha: o texto colado é dividido nas quebras de linha, cada linha tem seus espaços em branco iniciais e finais cortados e qualquer linha que agora esteja vazia é totalmente removida da lista. O que sobrevive a essa passagem é com o que o resto da lógica do botão trabalha. Esse primeiro passo é idêntico para "Remover duplicatas" e "Ignorar maiúsculas/minúsculas", então a única diferença real entre eles é a regra de comparação única por baixo, não o corte ou tratamento de linhas em branco ao redor.

Apenas "Remover duplicatas" e "Ignorar maiúsculas/minúsculas" enviam suas linhas excluídas para o painel "Duplicatas removidas" à direita. "Ordenar + Dedup" também preenche esse painel, pois desduplica antes de classificar. "Mostrar duplicatas" nunca toca nele, porque não está removendo nada, apenas reorganizando o que fica no editor principal.

Listas grandes se comportam de forma diferente dependendo do botão. Depois de 5.000 linhas, "Remover duplicatas" e "Ignorar maiúsculas/minúsculas" passam para um Web Worker em segundo plano para que a guia permaneça responsiva. "Ordenar + Dedup" e "Mostrar duplicatas" não têm essa transferência e sempre são executados diretamente na página, portanto, uma colagem incomumente grande pode fazer a guia pausar brevemente quando você clica em qualquer um desses dois.

Sensível a maiúsculas e minúsculas por padrão: Quando Apple e apple contam como dois

Remover duplicatas trata maiúsculas e minúsculas como parte do texto. Clique em Ignorar maiúsculas/minúsculas em vez disso e apple, Apple e APPLE se reduzem a qualquer grafia que tenha sido colada primeiro.

Remover duplicatas mantém
john@email.com
jane@email.com
John@Email.com
bob@email.com
Ignorar maiúsculas/minúsculas mantém
john@email.com
jane@email.com
bob@email.com

Ambas as colunas começam com a mesma lista colada: john@email.com, jane@email.com, John@Email.com, bob@email.com, jane@email.com. "Remover duplicatas" simples apenas detecta a repetição exata de jane@email.com na última linha, pois compara as linhas exatamente como estão escritas. John@Email.com sobrevive bem ao lado de john@email.com, porque para uma comparação que diferencia maiúsculas de minúsculas, as letras maiúsculas e minúsculas são simplesmente caracteres diferentes.

Esse padrão é correto para dados onde o uso de maiúsculas/minúsculas realmente tem significado: SKUs de produtos, nomes de usuários que diferenciam maiúsculas de minúsculas e códigos em que ABC123 e abc123 podem se referir a registros totalmente diferentes. É o padrão incorreto para uma lista de e-mail, já que john@email.com e John@Email.com apontam para a mesma caixa de entrada, e enviar duas vezes para o mesmo endereço é exatamente o que a desduplicação deveria evitar.

Ignorar maiúsculas/minúsculas é um botão, não uma caixa de seleção. Clicar nele converte cada linha para minúsculas apenas para fins de comparação, mantém a primeira grafia que viu para cada valor exclusivo e executa toda a remoção em um único clique. Ele não alterna uma configuração persistente que muda o que o botão Remover duplicatas simples faz da próxima vez que você o pressionar. Também não há opção parcial, não há como ignorar maiúsculas e minúsculas para parte de uma linha, ou apenas fora de um nome de domínio. A escolha é binária: compare cada linha exatamente como digitada, ou converta cada linha para minúsculas antes de comparar.

Ordenar + Dedup não tem uma versão de si mesmo que não diferencie maiúsculas de minúsculas. Ele sempre compara as linhas exatamente, assim como o botão Remover duplicatas simples. Se você precisar de um resultado que não diferencie maiúsculas de minúsculas e um em ordem alfabética, clique primeiro em Ignorar maiúsculas/minúsculas para juntar as variantes de maiúsculas e minúsculas e depois clique em Ordenar + Dedup para colocar em ordem alfabética o que sobrou. Executar Ordenar + Dedup sozinho em dados com maiúsculas e minúsculas misturadas manterá cada variante que não reconhecer como idêntica.

Por que espaços cortados corrigem algumas duplicatas e não outras

Cada comparação corta primeiro o início e o fim de cada linha. Um espaço inicial ou final perdido nunca causa uma falsa falta de correspondência. Um espaço duplo no meio de uma linha ainda conta como texto diferente.

Você cola, a linha 2 oculta um espaço final
john@email.com
john@email.com
Remover duplicatas mantém
john@email.com

As duas linhas acima parecem idênticas, e para os seus olhos são. A segunda foi colada com um espaço final invisível, do tipo que vem de graça quando você copia um valor de uma célula de planilha ou tabela de PDF. Antes de essa ferramenta comparar qualquer coisa, ela remove espaços em branco iniciais e finais de cada linha, de modo que aquele espaço final nunca tem a chance de fazer duas linhas idênticas parecerem diferentes. O resultado é uma única linha sobrevivente, exatamente como deveria ser.

O que o corte não faz é tocar no espaço em branco dentro de uma linha. New York e New  York, o segundo com dois espaços entre as palavras em vez de um, são cortados da mesma forma nas bordas, mas ainda diferem no meio, então nenhum dos quatro botões os trata como duplicatas. Reduzir espaços em branco internos automaticamente correria o risco de mesclar duas entradas de várias palavras genuinamente diferentes, então essa ferramenta deixa isso de lado de propósito. Tabulações são cortadas da mesma forma que os espaços: uma linha que começa com um caractere de tabulação em vez de um espaço é removida da mesma forma limpa, já que a etapa de corte remove todo tipo de espaço em branco de ambas as extremidades de uma linha, não apenas o caractere de espaço especificamente.

Espaçamento interno inconsistente sobrevive a todos os botões nesta página. Se seus dados têm entradas como New York e New  York lado a lado, a desduplicação não as pegará, porque o corte só toca nas duas extremidades de uma linha. Normalize o espaçamento interno manualmente ou com um passe de localizar e substituir primeiro, depois execute a remoção novamente.

Qual cópia sobrevive e se a lista permanece em ordem

Remover duplicatas e Ignorar maiúsculas/minúsculas mantêm cada linha sobrevivente exatamente onde estava. Ordenar + Dedup mantém a mesma primeira ocorrência, depois organiza o resultado em ordem alfabética, então a ordem original se perde.

Remover duplicatas mantém
Banana
Apple
Cherry
Ordenar + Dedup mantém
Apple
Banana
Cherry

Cole Banana, Apple, Banana, Cherry e os dois botões concordam sobre qual cópia de Banana manter: a primeira, encontrada ao verificar a lista de cima para baixo. Onde eles discordam é no que acontece com os sobreviventes depois. Remover duplicatas deixa Banana, Apple, Cherry nessa ordem exata, já que nada na etapa de remoção reordena nada, apenas tira as linhas. Ordenar + Dedup pega os mesmos três sobreviventes e os organiza em ordem alfabética, ficando com Apple, Banana, Cherry em vez disso.

Manter a ordem original é importante sempre que a sequência de seus dados contiver informações próprias: um log cronológico, uma lista em que a primeira entrada é o registro canônico e as posteriores são colagens acidentais ou qualquer conjunto de dados no qual uma nova classificação apagaria algo sobre prioridade ou tempo. Procure o Ordenar + Dedup especificamente quando quiser uma lista de referência limpa e em ordem alfabética e a ordem em que os dados chegaram nunca tiver sido significativa. Essa regra de primeira ocorrência também é fixa em todos os botões aqui: nada nesta página mantém a última ocorrência de uma linha repetida em vez da primeira, então não há uma configuração para alternar se o que você realmente queria era a cópia mais recente.

O painel Duplicatas removidas também segue a ordem de verificação. Se você clicou em Remover duplicatas, Ignorar maiúsculas/minúsculas ou Ordenar + Dedup, as linhas que aparecem no painel da direita são listadas na ordem em que foram encontradas durante a verificação, não agrupadas pela linha sobrevivente que duplicaram e não em ordem alfabética.

Por que uma duplicata com erro de ortografia passa ilesa

Cada comparação aqui é exata. John Smith e Jon Smith, ou Acme Inc. e Acme Inc, são duas linhas diferentes para esta ferramenta, não uma duplicata e um erro de digitação do outro.

Você cola quatro quase duplicatas
John Smith
Jon Smith
Acme Inc.
Acme Inc
Remover duplicatas deixa você com
John Smith
Jon Smith
Acme Inc.
Acme Inc

Clique em Remover duplicatas nessa lista e nada muda. Todas as quatro linhas são mantidas, e a ferramenta informa você com uma mensagem "Nenhuma duplicata encontrada!", porque cada comparação que ela faz é uma correspondência de caractere por caractere na linha aparada e, opcionalmente, em letras minúsculas. Ela não tem o conceito de "perto o suficiente". Um erro de digitação de uma letra, um ponto final faltando ou um hífen trocado por um espaço, todos produzem duas linhas que simplesmente não têm relação no que diz respeito a qualquer botão aqui.

Essa é uma limitação deliberada, não um descuido. Decidir quão semelhantes duas linhas precisam ser antes de contarem como a mesma coisa, geralmente medido com algo como distância de edição, é um tipo fundamentalmente diferente de algoritmo de comparação exata e toma decisões que variam de acordo com o conjunto de dados. Errar na outra direção, fundindo dois registros que apenas se parecem, pode destruir dados reais de forma silenciosa, o que é um resultado pior do que deixar uma quase duplicata óbvia na lista para um humano detectar.

Uma maneira prática de lidar com dados confusos: execute Mostrar duplicatas primeiro para ver quantas repetições exatas já existem, padronize as diferenças óbvias de formatação à mão ou com uma passagem de localizar e substituir, uso consistente de maiúsculas/minúsculas, pontuação consistente, abreviações consistentes, e depois execute Remover duplicatas novamente. A limpeza que transforma quase duplicatas em correspondências exatas é o que permite que essa ferramenta as identifique.

O que Mostrar duplicatas realmente exibe e em que ordem

Mostrar duplicatas lista cada valor que aparece mais de uma vez, uma vez cada, sem excluir nada. Se sua lista mistura números simples com palavras, os números vêm primeiro em ordem crescente, não na ordem em que você os colou.

Você cola
100
5
zebra
100
5
zebra
Mostrar duplicatas exibe
5
100
zebra

"Mostrar duplicatas" conta quantas vezes cada linha aparada aparece, mantém apenas os valores que aparecem mais de uma vez e substitui o conteúdo do editor por essa lista, uma entrada por valor duplicado em vez de uma entrada por repetição. Uma linha colada cinco vezes aparece uma vez no resultado, pois o objetivo é mostrar quais valores se repetem, e não quantas cópias existem. Nada no seu texto original é alterado ou removido por este botão.

A ordem dos números no exemplo acima não é um recurso de classificação. Ela decorre de como o objeto JavaScript que conta suas linhas ordena suas próprias chaves: entradas que parecem números inteiros simples não negativos, como 5 e 100, são sempre listadas primeiro em ordem numérica crescente, à frente de qualquer outro valor duplicado, que então aparece na ordem em que foi encontrado pela primeira vez. Isso só é perceptível quando seus dados duplicados misturam linhas numéricas com linhas de texto. Uma lista de nomes ou palavras duplicadas sem números simples retorna na ordem em que foram encontrados pela primeira vez, sem peculiaridades. O mesmo comportamento "numérico primeiro" aparece independentemente de quantas vezes um valor se repete ou do tamanho da lista, pois vem de como o objeto de contagem ordena suas chaves em vez de qualquer coisa sobre o tamanho dos seus dados.

Mostrar duplicatas nunca toca no painel Duplicatas removidas à direita. Esse painel continua mostrando o que exibiu por último, ou "Aguardando..." se você ainda não executou Remover duplicatas, Ignorar maiúsculas/minúsculas ou Ordenar + Dedup, já que Mostrar duplicatas não remove nada e nunca escreve nele.

Seis maneiras como as pessoas realmente usam esta ferramenta

Limpando uma lista de e-mail antes de uma campanha

Cole uma lista combinada de várias fontes de inscrição e clique em Ignorar maiúsculas/minúsculas em vez do botão simples. O mesmo endereço digitado com letras maiúsculas ou minúsculas diferentes continua sendo a mesma caixa de entrada, e enviar duas vezes para a mesma pessoa é exatamente o resultado que você está tentando evitar.

Revisar antes de se comprometer a excluir qualquer coisa

Clique primeiro em Mostrar duplicatas em qualquer lista sobre a qual você não tenha total certeza. Ver exatamente quais valores se repetem, sem perder seus dados originais, dá a você a chance de identificar um caso em que uma duplicata aparente seja, na verdade, significativa, antes de executar a própria remoção.

Construindo uma lista principal limpa e em ordem alfabética

Quando você está consolidando várias listas de origem em um documento de referência e a ordem original não importa, o Ordenar + Dedup faz os dois trabalhos com um clique: apenas valores exclusivos, ordenados alfabeticamente, prontos para uso como uma lista de pesquisa.

Limpando uma coluna exportada de uma planilha

As exportações de planilhas frequentemente carregam espaços finais do preenchimento das células, juntamente com o uso inconsistente de maiúsculas/minúsculas na entrada de dados manual. Como toda comparação aqui corta espaços em branco automaticamente, e Ignorar maiúsculas/minúsculas lida com a metade das maiúsculas/minúsculas, colar uma coluna exportada diretamente geralmente detecta os dois problemas de uma só vez.

Mantendo um registro cronológico limpo

Quando a ordem de seus dados é importante, um log ou uma lista em que a primeira entrada é o registro original, clique em Remover duplicatas simples ou Ignorar maiúsculas/minúsculas em vez de Ordenar + Dedup. Ambos mantêm cada linha sobreviviente exatamente onde estava, portanto, a sequência com a qual você começou ainda é legível depois, e nenhum dos dois reorganizará silenciosamente uma lista que você esperava que ficasse no lugar.

Trabalhando com exportações muito grandes

Remover duplicatas e Ignorar maiúsculas/minúsculas passam para um thread em segundo plano quando a lista passa de 5.000 linhas, de modo que a guia continue respondendo enquanto um arquivo grande é processado. Ordenar + Dedup e Mostrar duplicatas são executados diretamente na página, independentemente do tamanho. De qualquer forma, nada que você cole sai do seu dispositivo: não há etapa de upload, fila de processamento nem conta a criar.

Perguntas Frequentes

Como removo linhas duplicadas do texto?
Cole seu texto no editor e clique em "Remover Duplicatas". A ferramenta preserva a primeira ocorrência de cada linha e remove todas as repetições. Você verá exatamente o que foi removido no painel direito.
Posso ignorar as maiúsculas ao remover duplicatas?
Sim! Clique em "Ignorar Maiúsculas" para tratar "Maçã" e "maçã" como o mesmo item. Isso é útil quando seus dados têm capitalização inconsistente. A capitalização original da primeira ocorrência é preservada.
Como encontro quais itens estão duplicados sem removê-los?
Clique em "Ver Dupes" para ver apenas os itens que aparecem mais de uma vez na sua lista. Isso ajuda a identificar entradas problemáticas sem removê-las ainda, muito útil para auditar dados.
Meus dados estão seguros ao usar esta ferramenta?
Com certeza. Todo o processamento ocorre localmente no seu navegador via JavaScript. Seus dados nunca saem do seu dispositivo e nunca são enviados a nenhum servidor. É 100% privado.
Posso desfazer após remover duplicatas?
Sim! Clique no botão "Desfazer" para restaurar seu texto original. A ferramenta salva um histórico de alterações para que você sempre possa voltar atrás se precisar.
Qual é a quantidade máxima de dados que posso processar?
Como o processamento ocorre no seu navegador, o limite depende da memória do seu dispositivo. A maioria dos dispositivos modernos consegue processar centenas de milhares de linhas sem problemas. Para conjuntos de dados muito grandes (mais de 1 milhão de linhas), considere usar um aplicativo de desktop.

Ferramentas de Texto Relacionadas

Precisa fazer mais com seus dados? Experimente estas ferramentas complementares:

🔒 100% Privado e Seguro

A privacidade dos seus dados é nossa prioridade. Toda a remoção de duplicatas ocorre localmente no seu navegador: seu texto nunca é enviado a nenhum servidor. Não podemos ver, armazenar nem acessar seus dados. Use esta ferramenta com total confiança para informações sensíveis como listas de e-mails, dados de clientes ou documentos confidenciais.