Regex
my crib for regular expression
by tema1302
HTML
Regex
. - любой одиночный символ. Например, i. найдет все варианты с i вначале и любым следующим символом перед ним.
Если нужно использовать конкретно точку, то делаем экранирование - обратный слэш \
[ ] - любой из символов, задаем диапазон. Например, нужно найти и большую S, и маленькую s. Тогда пишем [Ss].
Или же нужно найти все символы от a до d, то есть a,b,c,d. Тогда пишем [a-d] и он равен [a,b,c,d].
Также можно [0-9] т.е. любое число.
Дробное число, например, 4.5 ищем так: [0-9]\.[0-9]
$ - конец строки. Например, добавить всем странам кавычки и запятую в конце строки, а в начале - просто кавычки.
^ - начало строки.
Но если знак ^ стоит вначале квадратных кавычек, то это означает отрицание. ^[^b] - находим символ, который стоит в начале строки и НЕ ЯВЛЯЕТСЯ b.
\n - перенос строки. Мы его тоже можем заменить на пустое место или пробел, чтобы создать, напрмиер, массив.
\ - экранирование.
\d - любую цифру. Приравнивается к рег.выр. [0-9]
\D - любой символ, кроме чисел.
\s - пустые символы (пробелы, символы новой строки, табуляция).
\S - все кроме пробелов
\w - буква (числа сюда тоже входят)
\W - все кроме букв и чисел
\b - граница слова. Например. слово, состоящее из четырех букв, будет выглядеть так: \b\w\w\w\w\b
\B - всё, кроме границ
Квантификация - позволяет не вводить большое количество символов подряд.
\b\w\w\w\w\b с учетом Квантификации будет выглядеть так: \b\w(4)\b
n{4} - искать n подряд 4 раза
n{4,6} - искать n от 4 до 6
* - искать от нуля и выше. Например, be* - будет искать слова, в которых есть первый символ b и второй и последующие символы e (либо отсутствие символа).
+ - от 1 и выше. Т.е. в случае be+ символ e обязательно должен входить в слово. Если его не будет, то и выделяться слово не будет.
? - ноль или 1 раз
( ) - группировка. Либо одно, либо другое.
(\s|-) - либо пробел, либо дефис