Regulární výraz
Regulární výrazy v pravidlech zpracování e-mailů umožňují vyizolovat požadovaný úsek textu při extrakci dat z e-mailu.
Důležité
- Použití regulárních výrazů obvykle vyžaduje programátorské dovednosti. Pokud neovládáte žádné programovací jazyky, požádejte o pomoc.
- V Planfixu regulární výrazy pracují s volbami Pattern.DOTALL a Pattern.MULTILINE. Pro ověření můžete použít online validator — gms
- Regulární výrazy lze také použít v Funkce REGEXPFIND.
Formátování regulárních výrazů
Planfix používá formát regulárních výrazů používaný v Javě. Syntaxe regulárních výrazů využívá symboly <([{\^-=$!|]})?*+.>, které lze kombinovat s písmeny pro vytvoření metaznaků. Nejčastěji používané metaznaky jsou uvedeny v této tabulce:
| Metaznak | Význam |
|---|---|
| ^ | začátek vstupu |
| $ | konec vstupu |
| \d | cifra |
| \D | znak, který není cifra |
| \s | mezerný znak |
| \S | znak, který není mezerou |
| \w | alfa-numerický znak nebo podtržítko |
| \W | libovolný znak kromě alfanumerických znaků a podtržítek |
| . | libovolný znak |
| \t | tabulátor |
| \n | značka nového řádku |
| \r | značka návratu vozíku |
| [abc] | libovolný z uvedených znaků (a, b nebo c) |
| [^abc] | libovolný znak kromě uvedených (ne a, ne b ani c) |
| [a-zA-Z] | více rozsahů (latinské znaky od A do Z, rozlišování velkých a malých) |
| [a-d[m-p]] | zkombinované množiny (od a do d a od m do p) |
| [a-z&&[def]] | překrývající se množiny (d, e, f) |
| [a-z&&[^bc]] | odečítání znaků (a, d-z) |
| ? | jeden nebo žádný |
| * | shoda nula nebo vícekrát |
| + | jednou nebo vícekrát |
| {n} | n-krát |
| {n,} | n nebo vícekrát |
| {n,m} | alespoň n krát a nejvýše m krát |
Užitečné informace
- Výsledek zpracování textu pomocí regulárního výrazu se stává první zachycující skupinou. Podstatné části výsledku proto uzavřete do závorek, a ostatní skupiny udělejte nezachycujícími pomocí (?:).