Aussi disponible en : English · Español · Português · العربية
Trier du texte en ligne
Classez une liste par ordre alphabétique, par longueur ou dans son ordre d'origine, en retirant au passage doublons, espaces superflus et lignes vides.
Qu'est-ce qu'un outil de tri de texte ?
Un outil de tri de texte prend une liste de lignes — des noms, des mots-clés, des références produit, n’importe quoi collé les uns en dessous des autres — et les range dans un ordre choisi : alphabétique, par longueur, ou simplement débarrassé des doublons et des lignes vides sans toucher à l’ordre d’origine. C’est la tâche qu’on confie sinon à un tableur pour trois lignes, ou à un éditeur de texte qui ne connaît que l’ordre des caractères informatiques — pas celui d’une vraie langue. Ici, tout se passe en collant le texte : le tri, les compteurs et le résultat se mettent à jour à chaque frappe, sans bouton « valider ».
Trier une liste par ordre alphabétique, la trier par longueur ou simplement retirer les doublons sont trois réglages parmi d’autres, combinables entre eux : rien n’est irréversible et rien n’est envoyé où que ce soit.
Comment utiliser l'outil
- Collez votre liste. Une ligne par élément, dans la première zone — un tableur, un fichier texte ou une liste tapée à la main conviennent tous.
- Choisissez le mode et la langue de tri. Alphabétique, par longueur ou conservation de l’ordre, puis la langue dans laquelle les accents doivent se ranger, et activez au besoin la casse, l’ordre décroissant, l’ordre numérique naturel, la suppression des doublons, des espaces ou des lignes vides.
- Copiez le résultat. La liste triée apparaît dans la seconde zone avec les compteurs de lignes et de doublons ; un clic sur « Copier » la place dans le presse-papiers.
Le tri naïf est faux : ce qui change d'une langue à l'autre
Le tri « par défaut » de la plupart des outils, y compris celui intégré à JavaScript, ne trie pas comme un être humain lirait un dictionnaire : Array.prototype.sort() compare les unités de code UTF-16 des caractères, c’est-à-dire leur numéro dans la table Unicode. Résultat : toute lettre accentuée atterrit après le z — « äpple » se retrouve derrière « zebra », alors qu’aucune langue au monde ne classe ses mots ainsi. Cet outil utilise à la place Intl.Collator, l’API qui s’appuie sur les données de collation CLDR déjà présentes dans le navigateur, pour que l’ordre corresponde à celui d’un vrai dictionnaire dans la langue choisie.
Ces règles varient réellement d’une langue à l’autre, d’où la liste déroulante de langue de tri. En suédois, å, ä et ö se rangent après le z, tout à la fin de l’alphabet ; en allemand comme en anglais, ces mêmes lettres se mêlent au a et au o, ce qui donne un classement complètement différent pour des mots pourtant écrits pareil. En espagnol, le ñ se trie juste après le n, si bien que « ñu » suit « nunca ». En turc, le ı sans point se place avant le i pointé. Pour le français en particulier, la règle à retenir est presque l’inverse : les accents ne changent pas le rang des lettres. É, è et ê se trient avec le e, ç se trie avec le c — exactement ce que fait une vraie collation, et exactement ce qu’un tri au code de caractère casse.
Le passage en minuscules obéit lui aussi à des règles dépendantes de la langue, ce qui a une conséquence directe sur la suppression des doublons. En turc, un « I » majuscule devient « ı » sans point (et non « i »), donc les lignes « I » et « ı » désignent la même lettre et fusionnent quand la déduplication est active — alors qu’en français, ce sont deux lignes distinctes qui restent toutes les deux dans le résultat.
Le tri par longueur compte les caractères comme les voit un humain, pas comme les stocke l’ordinateur. L’émoji de famille 👨👩👧, par exemple, s’affiche comme un seul caractère bien qu’il occupe huit unités UTF-16 en mémoire ; ici, il compte pour un seul caractère. Quand deux lignes ont la même longueur, l’ordre alphabétique départage l’égalité, pour que le résultat soit toujours identique d’un essai à l’autre. Quand plusieurs options sont cochées à la fois, l’ordre des opérations est fixe : les espaces superflus sont retirés en premier, puis les lignes vides, puis les doublons (la première occurrence rencontrée est celle qui reste), puis vient le tri, et enfin l’inversion si l’ordre décroissant est demandé. Les fins de ligne Windows (CRLF), Mac classique (CR) et Unix (LF) sont toutes reconnues. Le moteur est couvert par 37 assertions automatiques.
L’outil a aussi des limites qu’il vaut mieux connaître. Il trie des lignes entières, pas des colonnes : il ne réordonnera pas un CSV sur son deuxième champ. L’« ordre numérique naturel » ne comprend que des suites de chiffres (« item2 » avant « item10 ») — pas les dates, les chiffres romains ni les numéros de version comportant des lettres. La collation vient des données Unicode embarquées dans le navigateur, donc un navigateur très ancien peut trier très légèrement différemment. Le tri par longueur compte des caractères, pas la largeur réellement affichée. Et comme tout se passe dans le navigateur, la seule limite sur un très gros texte est la mémoire de votre appareil, jamais un serveur distant.
Pourquoi cet outil est-il gratuit ?
Cette page est statique : aucun serveur ne reçoit votre texte, ne le stocke ni ne le traite. Le tri, le comptage des doublons et la déduplication tournent entièrement dans votre navigateur grâce à Intl.Collator, une API déjà intégrée à tous les navigateurs modernes. Il n’y a donc rien à faire tourner côté serveur, pas de compte à créer, pas de fichier à téléverser, et pas de filigrane à retirer du résultat copié.