Text Sorter & Deduplicator
Understand Text Sorter & Deduplicator
Ordena linhas de texto em ordem alfabética, remove duplicatas, apara espaços em branco e inverte a ordem.
How it works
A entrada é dividida nas quebras de linha e cada linha é tratada como um item. A remoção de duplicatas roda antes da ordenação e mantém a primeira ocorrência de cada valor, então ela preserva a ordem original quando a ordenação está desligada. A comparação usa a colação sensível ao idioma do navegador, e não a ordem bruta de code points, e é por isso que letras acentuadas ficam junto da letra base — "ä" cai ao lado de "a", e não depois de "z", onde uma ordenação ingênua por bytes a colocaria. A distinção de maiúsculas é uma chave: quando ela está desligada, tanto a comparação quanto a checagem de duplicatas caem para minúsculas.
When to use it
- Colocar em ordem alfabética uma lista de imports, uma lista de permissões ou um conjunto de nomes de variáveis de ambiente antes de commitar
- Reduzir uma coluna colada de IDs ou e-mails aos valores únicos
- Limpar uma lista copiada de uma planilha ou de um PDF, em que toda linha carrega espaços no fim
- Produzir uma lista estável e ordenada, para que duas versões de um arquivo possam ser comparadas de forma significativa
Watch out for
- A ordenação é alfabética, não numérica. "10" vem antes de "9" porque a comparação é caractere a caractere — complete os números com zeros à esquerda primeiro se você precisa da ordem numérica.
- A remoção de duplicatas sem distinção de caixa mantém a variante que apareceu primeiro. Dê a ela "Apple" e depois "apple" e você fica com "Apple"; inverta a entrada e fica com "apple".
- A aparagem de espaços vem ligada por padrão e é destrutiva para texto sensível a indentação. Desligue-a antes de ordenar YAML, Python ou listas em Markdown.
- Colação por idioma não é ordem de bytes. Se quem consome a sua lista é um programa que compara bytes — um índice de banco, um arquivo versionado no Git, o `sort` em um script de shell —, as duas ordenações podem discordar.
Frequently Asked Questions
Como funciona a ordenação sem distinguir maiúsculas?
A ordenação sem distinção de caixa compara as linhas usando os valores em minúsculas, então "Apple" e "apple" são tratados como iguais. Se a remoção de duplicatas também estiver ligada, só uma das variantes de caixa é mantida (a primeira ocorrência na ordem original).
Como remover duplicatas de uma lista mantendo a ordem?
Ative "Remover duplicatas" e desative a ordenação. As linhas são processadas em ordem; a primeira ocorrência de cada linha única é mantida e as duplicatas seguintes são removidas. A distinção de maiúsculas afeta o que conta como "duplicata".
Dá para ordenar numericamente?
A ordenação atual é lexicográfica. "10" vem antes de "9" porque "1" < "9". Para uma ordenação numérica correta, complete os números com zeros à esquerda antes de ordenar e remova o preenchimento depois. Versões futuras terão um modo numérico nativo.
How to Use Text Sorter & Deduplicator
- Paste or type your input in the input area above.
- The tool processes your input automatically or click Run.
- Copy or download the result using the action buttons.
- Use Ctrl+Enter to run quickly from the keyboard.