Regex

my crib for regular expression

by tema1302

HTML

Regex

. - любой одиночный символ. Например, i. найдет все варианты с i вначале и любым следующим символом перед ним.
Если нужно использовать конкретно точку, то делаем экранирование - обратный слэш \

[ ] - любой из символов, задаем диапазон. Например, нужно найти и большую S, и маленькую s. Тогда пишем [Ss].
Или же нужно найти все символы от a до d, то есть a,b,c,d. Тогда пишем [a-d] и он равен [a,b,c,d].
Также можно [0-9] т.е. любое число.
Дробное число, например, 4.5 ищем так: [0-9]\.[0-9]

$ - конец строки. Например, добавить всем странам кавычки и запятую в конце строки, а в начале - просто кавычки.

^ - начало строки.

Но если знак ^ стоит вначале квадратных кавычек, то это означает отрицание. ^[^b] - находим символ, который стоит в начале строки и НЕ ЯВЛЯЕТСЯ b.

\n - перенос строки. Мы его тоже можем заменить на пустое место или пробел, чтобы создать, напрмиер, массив.

\ - экранирование.

\d - любую цифру. Приравнивается к рег.выр. [0-9]

\D - любой символ, кроме чисел.

\s - пустые символы (пробелы, символы новой строки, табуляция).

\S - все кроме пробелов

\w - буква (числа сюда тоже входят)

\W - все кроме букв и чисел

\b - граница слова. Например. слово, состоящее из четырех букв, будет выглядеть так: \b\w\w\w\w\b

\B - всё, кроме границ


Квантификация - позволяет не вводить большое количество символов подряд.

\b\w\w\w\w\b с учетом Квантификации будет выглядеть так: \b\w(4)\b

n{4} - искать n подряд 4 раза

n{4,6} - искать n от 4 до 6

* - искать от нуля и выше. Например, be* - будет искать слова, в которых есть первый символ b и второй и последующие символы e (либо отсутствие символа).

+ - от 1 и выше. Т.е. в случае be+ символ e обязательно должен входить в слово. Если его не будет, то и выделяться слово не будет.

? - ноль или 1 раз

( ) - группировка. Либо одно, либо другое.
(\s|-) - либо пробел, либо дефис