D'un certain côté non, car l'UTF-8 et les wide chars sont censés être traités en dessous de l'expression régulière elle-même. D'un autre, effectivement, tous les [A-Za-z0-9-_] risquent d'être pris en défaut. Mais bon, il s'agit d'une migration. Comme lors de toute migration, il y aura des choses à adapter, et une période de transition. C'est normal.
Par contre, sur le plan formel, définir ce qu'est un « caractère alphanumérique » risque de devenir assez chiant, en effet. La classe [:alpha:] va commencer à être assez chargée. Et puis générer un automate sur un vocabulaire de 256 caractères, c'est faisable. Sur l'Unicode entier, ça peut devenir musclé.
[^] # Re: Cauchemar de regexps
Posté par Obsidian . En réponse au journal L'internationalisation des adresses internet. Évalué à 4.
Par contre, sur le plan formel, définir ce qu'est un « caractère alphanumérique » risque de devenir assez chiant, en effet. La classe [:alpha:] va commencer à être assez chargée. Et puis générer un automate sur un vocabulaire de 256 caractères, c'est faisable. Sur l'Unicode entier, ça peut devenir musclé.