TextSorter
Entrada (Elementos Únicos)
0 líneas
0 líneas
Duplicados Eliminados
0 eliminados

Aún no se han eliminado duplicados.
Haz clic en "Eliminar Duplicados" para comenzar.

Esperando...

Qué elimina, reordena o revela cada botón en realidad

La versión corta: dos botones eliminan duplicados y mantienen su orden original, un botón elimina duplicados y luego alfabetiza lo que queda, y un botón no elimina nada en absoluto, solo le muestra lo que se repite.

Pegas
john@email.com
jane@email.com
John@Email.com
bob@email.com
jane@email.com
Eliminar duplicados conserva
john@email.com
jane@email.com
John@Email.com
bob@email.com
BotónManejo de mayúsculasMantiene el orden originalPasa a un proceso en segundo plano después de 5.000 líneas
Eliminar duplicadosCoincidencia exacta sensible a mayúsculas y minúsculas
Ignorar mayúsculasCoincidencia que ignora mayúsculas y minúsculas
Ordenar + DedupCoincidencia exacta sensible a mayúsculas y minúsculasNo, alfabetizadoNo
Mostrar duplicadosCoincidencia exacta sensible a mayúsculas y minúsculasNo elimina nadaNo

Cada uno de esos cuatro botones ejecuta el mismo primer paso antes de comparar una sola línea: el texto pegado se divide en los saltos de línea, a cada línea se le recortan los espacios en blanco iniciales y finales, y cualquier línea que ahora esté vacía se elimina de la lista por completo. Lo que sobrevive a ese paso es con lo que trabaja el resto de la lógica del botón. Ese primer paso es idéntico para "Eliminar duplicados" e "Ignorar mayúsculas", por lo que la única diferencia real entre ellos es la única regla de comparación que se encuentra debajo, no el recorte o el manejo de líneas en blanco a su alrededor.

Solo "Eliminar duplicados" e "Ignorar mayúsculas" envían sus líneas eliminadas al panel "Duplicados eliminados" a la derecha. "Ordenar + Dedup" también llena ese panel, ya que deduplica antes de ordenar. "Mostrar duplicados" nunca lo toca, porque no está eliminando nada, solo está reorganizando lo que queda en el editor principal.

Las listas grandes se comportan de manera diferente según el botón. Después de 5.000 líneas, "Eliminar duplicados" e "Ignorar mayúsculas" pasan a un Web Worker en segundo plano para que la pestaña siga respondiendo. "Ordenar + Dedup" y "Mostrar duplicados" no tienen tal transferencia y siempre se ejecutan directamente en la página, por lo que un pegado inusualmente grande puede hacer que la pestaña se detenga brevemente al hacer clic en cualquiera de esos dos.

Sensible a mayúsculas y minúsculas de forma predeterminada: Cuando Apple y apple cuentan como dos

Eliminar duplicados trata las mayúsculas como parte del texto. Haga clic en Ignorar mayúsculas en su lugar y apple, Apple y APPLE colapsarán en la ortografía que se haya pegado primero.

Eliminar duplicados conserva
john@email.com
jane@email.com
John@Email.com
bob@email.com
Ignorar mayúsculas conserva
john@email.com
jane@email.com
bob@email.com

Ambas columnas comienzan con la misma lista pegada: john@email.com, jane@email.com, John@Email.com, bob@email.com, jane@email.com. "Eliminar duplicados" simple solo detecta la repetición exacta de jane@email.com en la última línea, ya que compara las líneas exactamente como están escritas. John@Email.com sobrevive justo al lado de john@email.com, porque para una comparación que distingue entre mayúsculas y minúsculas, las letras mayúsculas y minúsculas son simplemente caracteres diferentes.

Esa configuración predeterminada es correcta para datos en los que el uso de mayúsculas realmente tiene significado: SKU de productos, nombres de usuario sensibles a mayúsculas y minúsculas y códigos donde ABC123 y abc123 podrían referirse a registros completamente diferentes. Es la configuración predeterminada incorrecta para una lista de correo electrónico, ya que john@email.com y John@Email.com apuntan a la misma bandeja de entrada, y enviar dos veces a la misma dirección es exactamente lo que la deduplicación debía evitar.

Ignorar mayúsculas es un botón, no una casilla de verificación. Hacer clic en él pone cada línea en minúsculas solo para fines de comparación, conserva la primera ortografía que vio para cada valor único y ejecuta toda la eliminación en ese único clic. No cambia una configuración persistente que altere lo que hace el botón Eliminar duplicados simple la próxima vez que lo presione. Tampoco hay una opción parcial, no hay forma de ignorar las mayúsculas en parte de una línea, o solo fuera de un nombre de dominio. La opción es binaria: compare cada línea exactamente como se escribió, o convierta cada línea a minúsculas antes de comparar.

Ordenar + Dedup no tiene una versión de sí mismo que ignore las mayúsculas. Siempre compara líneas exactamente, igual que el botón Eliminar duplicados simple. Si necesita un resultado que ignore mayúsculas y minúsculas y uno alfabetizado, haga clic en Ignorar mayúsculas primero para colapsar las variantes de mayúsculas juntas, luego haga clic en Ordenar + Dedup para alfabetizar lo que queda. Ejecutar Ordenar + Dedup solo en datos con mayúsculas y minúsculas mezcladas mantendrá todas las variantes de mayúsculas que no reconozca como idénticas.

Por qué los espacios recortados solucionan algunos duplicados y no otros

Cada comparación recorta primero el inicio y el final de cada línea. Un espacio inicial o final perdido nunca causa una falsa falta de coincidencia. Un doble espacio en medio de una línea todavía cuenta como texto diferente.

Pegas, la línea 2 oculta un espacio final
john@email.com
john@email.com
Eliminar duplicados conserva
john@email.com

Ambas líneas anteriores parecen idénticas, y para sus ojos lo son. La segunda se pegó con un espacio final invisible, del tipo que viene gratis cuando copia un valor de una celda de hoja de cálculo o una tabla PDF. Antes de que esta herramienta compare algo, elimina los espacios en blanco iniciales y finales de cada línea, por lo que ese espacio final nunca tiene la oportunidad de hacer que dos líneas, por lo demás idénticas, se vean diferentes. El resultado es una sola línea sobreviviente, exactamente como debería ser.

Lo que no hace el recorte es tocar el espacio en blanco dentro de una línea. New York y New  York, el segundo con dos espacios entre las palabras en lugar de uno, se recortan de la misma manera en sus bordes pero aún difieren en el medio, por lo que ninguno de los cuatro botones los trata como duplicados. Colapsar los espacios en blanco internos automáticamente correría el riesgo de fusionar dos entradas de varias palabras genuinamente diferentes, por lo que esta herramienta lo deja en paz a propósito. Las tabulaciones se recortan de la misma manera que los espacios: una línea que comienza con un carácter de tabulación en lugar de un espacio se elimina con la misma limpieza, ya que el paso de recorte elimina todo tipo de espacios en blanco de ambos extremos de una línea, no solo el carácter de espacio específicamente.

El espaciado interno inconsistente sobrevive a todos los botones de esta página. Si sus datos tienen entradas como New York y New  York una al lado de la otra, la deduplicación no lo atrapará, porque el recorte solo toca los dos extremos de una línea. Normalice el espaciado interno a mano o con un paso de buscar y reemplazar primero, luego ejecute la eliminación nuevamente.

Qué copia sobrevive y si la lista permanece en orden

Eliminar duplicados e Ignorar mayúsculas mantienen cada línea sobreviviente exactamente donde estaba. Ordenar + Dedup mantiene la misma primera aparición, luego alfabetiza el resultado, por lo que el orden original desaparece.

Eliminar duplicados conserva
Banana
Apple
Cherry
Ordenar + Dedup conserva
Apple
Banana
Cherry

Pegue Banana, Apple, Banana, Cherry y ambos botones estarán de acuerdo sobre qué copia de Banana conservar: la primera, que se encuentra al escanear la lista de arriba a abajo. Donde difieren es en lo que les sucede a los sobreviventes después. Eliminar duplicados deja Banana, Apple, Cherry en ese orden exacto, ya que nada sobre el paso de eliminación reordena nada, solo elimina líneas. Ordenar + Dedup toma los mismos tres sobreviventes y los alfabetiza, aterrizando en Apple, Banana, Cherry en su lugar.

Mantener el orden original es importante siempre que la secuencia de sus datos tenga información propia: un registro cronológico, una lista donde la primera entrada es el registro canónico y las posteriores son repeticiones accidentales, o cualquier conjunto de datos donde volver a ordenar borraría algo sobre prioridad o tiempo. Utilice Ordenar + Dedup específicamente cuando desee una lista de referencia limpia y alfabetizada y el orden en que llegaron los datos nunca haya sido significativo para empezar. Esa regla de primera aparición también se fija en todos los botones de aquí: nada en esta página conserva la última aparición de una línea repetida en lugar de la primera, por lo que no hay una configuración para cambiar si lo que realmente quería era la copia más reciente.

El panel de Duplicados eliminados también sigue el orden de escaneo. Ya sea que haya hecho clic en Eliminar duplicados, Ignorar mayúsculas u Ordenar + Dedup, las líneas que aparecen en el panel de la derecha se enumeran en el orden en que se encontraron al escanear, no agrupadas por la línea sobreviviente que duplicaron y no alfabetizadas.

Por qué un duplicado mal escrito se escapa intacto

Cada comparación aquí es exacta. John Smith y Jon Smith, o Acme Inc. y Acme Inc, son dos líneas diferentes para esta herramienta, no un duplicado y un error tipográfico del otro.

Pegas cuatro casi duplicados
John Smith
Jon Smith
Acme Inc.
Acme Inc
Eliminar duplicados te deja con
John Smith
Jon Smith
Acme Inc.
Acme Inc

Haga clic en Eliminar duplicados en esa lista y nada cambiará. Se conservan las cuatro líneas, y la herramienta se lo dice con un mensaje "¡No se encontraron duplicados!", porque cada comparación que hace es una coincidencia de carácter por carácter en la línea recortada y, opcionalmente, en minúsculas. No tiene ningún concepto de "suficientemente cerca". Un error tipográfico de una letra, un punto final faltante o un guión cambiado por un espacio producen dos líneas que simplemente no están relacionadas en lo que respecta a cualquier botón aquí.

Esa es una limitación deliberada, no un descuido. Decidir qué tan similares deben ser dos líneas antes de que cuenten como lo mismo, generalmente medido con algo como la distancia de edición, es un tipo de algoritmo fundamentalmente diferente de la comparación exacta, y hace juicios que varían según el conjunto de datos. Equivocarse en la otra dirección, fusionar dos registros que solo se parecen, puede destruir datos reales de forma silenciosa, lo cual es un resultado peor que dejar un casi duplicado obvio en la lista para que un humano lo detecte.

Una forma práctica de manejar datos desordenados: ejecute Mostrar duplicados primero para ver cuántas repeticiones exactas ya existen, estandarice las diferencias obvias de formato a mano o con un paso de buscar y reemplazar, uso coherente de mayúsculas y minúsculas, puntuación coherente, abreviaturas coherentes, y luego ejecute Eliminar duplicados de nuevo. La limpieza que convierte los casi duplicados en coincidencias exactas es lo que permite que esta herramienta los detecte.

Qué muestra Mostrar duplicados en realidad y en qué orden

Mostrar duplicados enumera cada valor que aparece más de una vez, una vez cada uno, sin eliminar nada. Si su lista mezcla números simples con palabras, los números van primero en orden ascendente, no en el orden en que los pegó.

Pegas
100
5
zebra
100
5
zebra
Mostrar duplicados muestra
5
100
zebra

"Mostrar duplicados" cuenta cuántas veces aparece cada línea recortada, mantiene solo los valores que aparecen más de una vez y reemplaza el contenido del editor con esa lista, una entrada por valor duplicado en lugar de una entrada por repetición. Una línea pegada cinco veces aparece una vez en el resultado, ya que el objetivo es mostrar qué valores se repiten, no cuántas copias existen. Ningún elemento de su texto original se modifica ni elimina con este botón.

El orden numérico en el ejemplo anterior no es una función de clasificación. Resulta de cómo el objeto de JavaScript que cuenta sus líneas ordena sus propias claves: las entradas que parecen números enteros simples no negativos, como 5 y 100, siempre se enumeran primero en orden numérico ascendente, por delante de cualquier otro valor duplicado, que luego aparece en el orden en que se encontró por primera vez. Eso solo se nota cuando sus datos duplicados mezclan líneas numéricas simples con líneas de texto. Una lista de nombres o palabras duplicadas sin números simples se devuelve en el orden en que se encontró por primera vez, sin peculiaridades que notar. El mismo comportamiento numérico primero aparece sin importar cuántas veces se repita un valor o cuán larga sea la lista, ya que proviene de cómo el objeto de conteo ordena sus claves en lugar de cualquier cosa sobre el tamaño de sus datos.

Mostrar duplicados nunca toca el panel Duplicados eliminados de la derecha. Ese panel sigue mostrando lo que mostró por última vez, o "Esperando..." si aún no ha ejecutado Eliminar duplicados, Ignorar mayúsculas u Ordenar + Dedup, ya que Mostrar duplicados no elimina nada y nunca escribe en él.

Seis formas en que las personas realmente usan esta herramienta

Limpiar una lista de correo electrónico antes de una campaña

Pegue una lista combinada de múltiples fuentes de registro y haga clic en Ignorar mayúsculas en lugar del botón simple. La misma dirección escrita con diferentes mayúsculas y minúsculas sigue siendo la misma bandeja de entrada, y enviar dos veces a la misma persona es exactamente el resultado que está tratando de evitar.

Revisar antes de comprometerse a eliminar cualquier cosa

Haga clic en Mostrar duplicados primero en cualquier lista de la que no esté completamente seguro. Ver exactamente qué valores se repiten, sin perder sus datos originales, le da la oportunidad de detectar un caso donde un aparente duplicado sea en realidad significativo antes de ejecutar la eliminación en sí.

Crear una lista maestra limpia y alfabetizada

Cuando consolida varias listas de origen en un documento de referencia y el orden original no importa, Ordenar + Dedup hace ambos trabajos con un solo clic: solo valores únicos, ordenados alfabéticamente, listos para usar como lista de búsqueda.

Limpiar una columna exportada de una hoja de cálculo

Las exportaciones de hojas de cálculo con frecuencia llevan espacios finales del relleno de celdas, junto con un uso inconsistente de mayúsculas y minúsculas de la entrada manual de datos. Dado que cada comparación aquí recorta los espacios en blanco automáticamente, e Ignorar mayúsculas maneja la mitad de las mayúsculas y minúsculas, pegar una columna exportada directamente generalmente detecta ambos problemas en una sola pasada.

Mantener limpio un registro cronológico o de primer ganador

Cuando el orden de sus datos importa, un registro o una lista donde la primera entrada es el registro original, haga clic en Eliminar duplicados simple o Ignorar mayúsculas en lugar de Ordenar + Dedup. Ambos mantienen cada línea sobreviviente exactamente donde estaba, por lo que la secuencia con la que comenzó sigue siendo legible después, y ninguno de los dos reorganizará silenciosamente una lista con la que contaba que se quedara en su lugar.

Trabajar con exportaciones muy grandes

Eliminar duplicados e Ignorar mayúsculas pasan a un proceso en segundo plano una vez que una lista supera las 5.000 líneas, para que la pestaña siga respondiendo mientras se procesa un archivo grande. Ordenar + Dedup y Mostrar duplicados se ejecutan directamente en la página independientemente del tamaño. De cualquier manera, nada de lo que pegue sale de su dispositivo: no hay un paso de carga, ninguna cola de procesamiento y ninguna cuenta para crear.

Preguntas Frecuentes

¿Cómo elimino líneas duplicadas del texto?
Pega tu texto en el editor y haz clic en "Eliminar Duplicados". La herramienta conserva la primera aparición de cada línea y elimina todas las repeticiones. Verás exactamente qué se eliminó en el panel derecho.
¿Puedo ignorar las mayúsculas al eliminar duplicados?
¡Sí! Haz clic en "Ignorar Mayúsculas" para tratar "Manzana" y "manzana" como el mismo elemento. Esto es útil cuando tus datos tienen capitalización inconsistente. Se conserva la capitalización original de la primera aparición.
¿Cómo encuentro qué elementos están duplicados sin eliminarlos?
Haz clic en "Ver Dupes" para ver solo los elementos que aparecen más de una vez en tu lista. Esto te ayuda a identificar entradas problemáticas sin eliminarlas todavía, muy útil para auditar datos.
¿Están seguros mis datos al usar esta herramienta?
Absolutamente. Todo el procesamiento ocurre localmente en tu navegador mediante JavaScript. Tus datos nunca salen de tu dispositivo y nunca se envían a ningún servidor. Es 100% privado.
¿Puedo deshacer después de eliminar duplicados?
¡Sí! Haz clic en el botón "Deshacer" para restaurar tu texto original. La herramienta guarda un historial de cambios para que siempre puedas volver atrás si lo necesitas.
¿Cuál es la cantidad máxima de datos que puedo procesar?
Dado que el procesamiento ocurre en tu navegador, el límite depende de la memoria de tu dispositivo. La mayoría de los dispositivos modernos pueden manejar cientos de miles de líneas sin problemas. Para conjuntos de datos muy grandes (más de 1 millón de líneas), considera usar una aplicación de escritorio.

Herramientas de Texto Relacionadas

¿Necesitas hacer más con tus datos? Prueba estas herramientas complementarias:

🔒 100% Privado y Seguro

La privacidad de tus datos es nuestra prioridad. Toda la eliminación de duplicados ocurre localmente en tu navegador: tu texto nunca se sube a ningún servidor. No podemos ver, almacenar ni acceder a tus datos. Usa esta herramienta con total confianza para información sensible como listas de correos, datos de clientes o documentos confidenciales.