Posté par gouttegd .
En réponse au journal Unicode.
Évalué à 6.
Oui, le problème de grep est connu depuis longtemps, mais doit être lié à la manière dont la commande est codée, de telle sorte qu'il n'est pas simple de le résoudre.
Apparemment, il est résolu. Je viens de compiler grep 2.7 et de refaire les tests, j’obtiens peu ou prou la même chose qu’avec sed : le temps d’exécution est plus long avec LANG=en_US.UTF-8 mais reste dans le même ordre de grandeur qu’avec LANG=C (et non trois ordres de grandeur au-dessus comme avec grep 2.5.4).
En fait, ma position ici vient du fait que je suis passé de Latin9 à UTF-8 et que, rétrospectivement, je trouve que ça m'a apporté (relativement) plus de complications que d'avantages concrets.
Après être passé de latin-1 à UTF-8, je pense exactement le contraire. :)
J’admets volontiers que la période de transition, quand on a des trucs déjà en UTF-8 d’un côté et d’autres trucs encore en latin-1 de l’autre, est délicate, surtout quand le support d’UTF-8 par les logiciels est encore fragmentaire (de mémoire, c’est LaTeX et surtout BibTeX qui m’avait posé le plus de problèmes). Mais après, quand tout est en UTF-8, depuis les noms de fichiers jusqu’aux contenus des documents en passant par les tags des fichiers Vorbis, et qu’on n’a plus à se poser la question de l’encodage... je ne le regrette pas.
[^] # Re: Utilité
Posté par gouttegd . En réponse au journal Unicode. Évalué à 6.
Apparemment, il est résolu. Je viens de compiler grep 2.7 et de refaire les tests, j’obtiens peu ou prou la même chose qu’avec sed : le temps d’exécution est plus long avec
LANG=en_US.UTF-8mais reste dans le même ordre de grandeur qu’avecLANG=C(et non trois ordres de grandeur au-dessus comme avec grep 2.5.4).Après être passé de latin-1 à UTF-8, je pense exactement le contraire. :)
J’admets volontiers que la période de transition, quand on a des trucs déjà en UTF-8 d’un côté et d’autres trucs encore en latin-1 de l’autre, est délicate, surtout quand le support d’UTF-8 par les logiciels est encore fragmentaire (de mémoire, c’est LaTeX et surtout BibTeX qui m’avait posé le plus de problèmes). Mais après, quand tout est en UTF-8, depuis les noms de fichiers jusqu’aux contenus des documents en passant par les tags des fichiers Vorbis, et qu’on n’a plus à se poser la question de l’encodage... je ne le regrette pas.