Que sont les expressions régulières ?
Les expressions régulières (Regex) sont des modèles utilisés pour identifier des combinaisons de caractères dans des chaînes de caractères. Elles sont prises en charge par pratiquement tous les langages de programmation et sont indispensables pour le traitement de texte, la validation des entrées, la recherche et le remplacement, ainsi que l'analyse des fichiers journaux.
Indicateurs Regex JavaScript
- g — Global : recherche toutes les occurrences, pas seulement la première
- i — Correspondance sans distinction de majuscules et minuscules
- m — Multiligne : ^ et $ correspondent aux fins de ligne
- s — Dotall : « . » correspond aux caractères de fin de ligne
Cas d'utilisation courants
- Validation des adresses e-mail, des numéros de téléphone et des URL
- Extraction de données à partir de fichiers journaux et de textes structurés
- Recherche et remplacement dans les éditeurs de code et les IDE
- Création de masques de saisie et de validateurs de formulaire
- Analyse et transformation de données au format CSV, JSON et XML
Quand recourir au Regex ?
Les expressions régulières sont particulièrement efficaces pour les motifs courts et bien définis, lorsqu'il s'agit de rechercher, d'extraire ou de remplacer du texte : analyse de lignes de journal, règles de routage d'URL, validation des champs de formulaire et opérations de recherche et de remplacement dans un éditeur. Elles deviennent en revanche un frein lorsque les données d’entrée constituent en réalité un langage structuré : HTML, JSON, code source ou tout autre format comportant des délimiteurs imbriqués. Dans ces cas-là, utilisez un véritable analyseur syntaxique ; le Regex que vous écrivez aujourd’hui cessera de fonctionner sans crier gare dès le prochain cas limite.