Utiliser les expressions régulières

GOFR propose 2 façons différentes de rechercher des motifs : soit avec des caractères génériques (les mêmes que ceux de Microsoft Office), soit avec des expressions régulières.

Les caractères génériques sont plus simples mais moins puissants ; nous recommandons d'utiliser les expressions régulières. En interne, GOFR convertit les caractères génériques en expressions régulières.

Pour utiliser les expressions régulières dans GOFR, dans la page de saisie de plusieurs paramètres, cliquez sur le menu Option (OPT) situé à côté de la zone du texte à rechercher ou du texte de remplacement et sélectionnez « Expressions régulières ». La couleur de la zone de saisie devient verte.

Vous pouvez utiliser les expressions régulières pour transformer le résultat en fonction du motif recherché. Par exemple, vous pouvez transformer un motif <Prénom> <Nom> en <Nom> <Prénom>, corriger la mise en forme des nombres, etc. Consultez absolument le lien ci-dessous.

Nous avons également rédigé un fichier d'aide sur la transformation ici : « Transformer du texte avec des caractères génériques et des expressions régulières »

De nombreuses ressources en ligne vous aident à comprendre les expressions régulières. GOFR utilise les expressions régulières .NET. Nous apprécions la page de Microsoft elle-même, qui est très complète :

https://learn.microsoft.com/dotnet/standard/base-types/regular-expression-language-quick-reference

Voici un tableau des bases pour bien démarrer :

Métacaractère Comportement Exemple
* Correspond au caractère ou à la sous-expression précédente zéro fois ou plus.
Équivalent à {0,}.
zo* correspond à « z » et « zoo ».
+ Correspond au caractère ou à la sous-expression précédente une fois ou plus.
Équivalent à {1,}.
zo+ correspond à « zo » et « zoo », mais pas à « z ».
? Correspond au caractère ou à la sous-expression précédente zéro ou une fois.
Équivalent à {0,1}.
Lorsque ? suit immédiatement un autre quantificateur (*, +, ?, {n}, {n,} ou {n,m}), le motif de correspondance est non gourmand. Un motif non gourmand correspond à la plus petite portion possible de la chaîne recherchée. Le motif gourmand par défaut correspond à la plus grande portion possible de la chaîne recherchée.
zo? correspond à « z » et « zo », mais pas à « zoo ».
o+? correspond à un seul « o » dans « oooo », et o+ correspond à tous les « o ».
do(es)? correspond à « do » dans « do » ou « does ».
^ Correspond à la position au début de la chaîne recherchée. Si l'option multiligne (?m) est placée au début du motif, ^ correspond aussi à la position qui suit \n.
Lorsqu'il est utilisé comme premier caractère d'une expression entre crochets, ^ inverse le jeu de caractères.
^\d{3} correspond à 3 chiffres au début de la chaîne recherchée.
[^abc] correspond à tout caractère sauf a, b et c.
$ Correspond à la position à la fin de la chaîne recherchée. Si l'option multiligne (?m) est placée au début du motif, $ correspond aussi à la position qui précède \n. \d{3}$ correspond à 3 chiffres à la fin de la chaîne recherchée.
. Correspond à n'importe quel caractère unique sauf le caractère de saut de ligne \n. Pour correspondre à n'importe quel caractère, y compris \n, utilisez un motif tel que [\s\S]. a.c correspond à « abc », « a1c » et « a-c ».
[] Marque le début et la fin d'une expression entre crochets. [1-4] correspond à « 1 », « 2 », « 3 » ou « 4 ». [^aAeEiIoOuU] correspond à tout caractère qui n'est pas une voyelle.
{} Marque le début et la fin d'une expression de quantificateur. a{2,3} correspond à « aa » et « aaa ».
() Marque le début et la fin d'une sous-expression. Les sous-expressions peuvent être enregistrées pour une utilisation ultérieure. A(\d) correspond à « A0 » à « A9 ». Le chiffre est enregistré pour une utilisation ultérieure ($1 dans le texte de remplacement).
| Indique un choix entre deux éléments ou plus. z|food correspond à « z » ou « food ». (z|f)ood correspond à « zood » ou « food ».
\ Marque le caractère suivant comme caractère spécial, littéral, référence arrière ou séquence d'échappement octale. \n correspond à un caractère de saut de ligne. \( correspond à « ( ». \\ correspond à « \ ».