Частота символов
Частота символа — это количество его вхождений в строку. Подсчёт частот позволяет узнать, какие символы и сколько раз встречаются в тексте, например при проверке анаграмм или построении таблицы частот.
Как выполняется подсчёт
Строку просматривают слева направо, то есть выполняют перебор строки. Для каждого встреченного символа увеличивают его счётчик на единицу. Счётчики удобно хранить в массиве или словаре: символ является ключом, а его частота — значением.
Здесь \(s\) — строка длины \(n\), \(c\) — выбранный символ, а выражение в квадратных скобках равно \(1\), если условие истинно, и \(0\) в противном случае. Поэтому сумма показывает, сколько раз символ \(c\) встретился в строке.
s = "банан" count = {} for symbol in s: count[symbol] = count.get(symbol, 0) + 1 print(count)
Для строки «банан» получаем: б — 1, а — 2, н — 2. Пробел также является символом, поэтому при подсчёте его учитывают, если условие задачи не требует обратного.
Какова частота символа «а» в строке «абракадабра»?
Частота показывает, сколько раз встретился конкретный символ. Число различных символов показывает, сколько разных символов есть в строке. Например, в «банан» частоты равны 1, 2 и 2, а различных символов всего 3.
Если нужно получить частоты сразу для всех символов, результат называют таблицей частот символов. При сравнении символов учитывайте регистр: «А» и «а» обычно считаются разными символами.
Главное
- Частота символа — число его вхождений в строку.
- Частоты считают полным просмотром строки и хранят в массиве или словаре.
- Регистр и пробелы учитываются, если это не запрещено условием задачи.