Text Sorter & Deduplicator
Understand Text Sorter & Deduplicator
Sortiert Textzeilen alphabetisch, entfernt Duplikate, schneidet Leerraum ab und kehrt die Reihenfolge um.
How it works
Die Eingabe wird an Zeilenumbrüchen aufgeteilt, und jede Zeile gilt als ein Element. Das Entfernen von Duplikaten läuft vor dem Sortieren und behält das erste Vorkommen jedes Werts, bei abgeschalteter Sortierung bleibt die ursprüngliche Reihenfolge also erhalten. Der Vergleich nutzt die gebietsschema-abhängige Kollation des Browsers statt der reinen Codepoint-Reihenfolge, und deshalb sortieren Buchstaben mit Akzent neben ihrem Grundbuchstaben – "ä" landet neben "a" statt hinter "z", wo eine naive Byte-Sortierung es ablegen würde. Die Beachtung der Groß- und Kleinschreibung ist ein Schalter: Ist er aus, arbeiten sowohl der Vergleich als auch die Duplikatprüfung mit Kleinschreibung.
When to use it
- Eine Importliste, eine Allowlist oder einen Satz Namen von Umgebungsvariablen vor dem Commit alphabetisch ordnen
- Eine eingefügte Spalte aus IDs oder E-Mail-Adressen auf die eindeutigen Werte zusammenfalten
- Eine aus einer Tabelle oder einem PDF kopierte Liste säubern, in der jede Zeile Leerzeichen am Ende trägt
- Eine stabile, sortierte Liste erzeugen, damit sich zwei Fassungen einer Datei sinnvoll vergleichen lassen
Watch out for
- Die Sortierung ist alphabetisch, nicht numerisch. "10" steht vor "9", weil Zeichen für Zeichen verglichen wird – füllen Sie Zahlen zuerst mit führenden Nullen auf, wenn Sie numerische Reihenfolge brauchen.
- Beim Entfernen von Duplikaten ohne Beachtung der Groß- und Kleinschreibung bleibt die zuerst aufgetretene Variante erhalten. Geben Sie "Apple" und dann "apple" ein, behalten Sie "Apple"; drehen Sie die Eingabe um, behalten Sie "apple".
- Das Abschneiden von Leerraum ist voreingestellt und für einrückungsempfindlichen Text zerstörerisch. Schalten Sie es ab, bevor Sie YAML, Python oder Markdown-Listen sortieren.
- Kollation nach Gebietsschema ist keine Byte-Reihenfolge. Wenn der Abnehmer Ihrer Liste ein Programm ist, das Bytes vergleicht – ein Datenbankindex, eine von Git verwaltete Datei, `sort` in einem Shell-Skript –, können die beiden Ordnungen auseinandergehen.
Frequently Asked Questions
Wie funktioniert die Sortierung ohne Beachtung der Groß- und Kleinschreibung?
Bei dieser Sortierung werden Zeilen anhand ihrer kleingeschriebenen Form verglichen, "Apple" und "apple" gelten also als gleich. Ist zusätzlich das Entfernen von Duplikaten aktiv, bleibt nur eine der Schreibvarianten erhalten (das erste Vorkommen in der ursprünglichen Reihenfolge).
Wie entferne ich Duplikate aus einer Liste, ohne die Reihenfolge zu ändern?
Aktivieren Sie „Duplikate entfernen“ und deaktivieren Sie die Sortierung. Die Zeilen werden der Reihe nach verarbeitet; das erste Vorkommen jeder eindeutigen Zeile bleibt erhalten, spätere Duplikate werden entfernt. Ob die Groß- und Kleinschreibung beachtet wird, bestimmt, was als „Duplikat“ gilt.
Kann ich numerisch sortieren?
Die aktuelle Sortierung ist lexikografisch. "10" steht vor "9", weil "1" < "9" ist. Für eine echte numerische Sortierung füllen Sie die Zahlen vorher mit führenden Nullen auf und entfernen die Auffüllung danach wieder. Künftige Versionen erhalten einen eigenen numerischen Sortiermodus.
How to Use Text Sorter & Deduplicator
- Paste or type your input in the input area above.
- The tool processes your input automatically or click Run.
- Copy or download the result using the action buttons.
- Use Ctrl+Enter to run quickly from the keyboard.