Регулярные выражения егэ информатика

В этом уроке по подготовке к ЕГЭ по информатике 2022 разберём задание номер 10.

Это задание, как и предыдущее, решается с помощью компьютера. Нужно будет провести поиск в тексте по определённому критерию и ответить на поставленный вопрос.

Информационный поиск нужно сделать с помощью текстового редактора. Мы в наших задачах будем использовать текстовый редактор Word от компании Microsoft.

Задача (Классическая)

С помощью текстового редактора определите, сколько раз встречается слово «рад» или «Рад» в тексте А.С. Пушкина «Руслан и Людмила».Такие слова как «радостный», «радость» и т.д., учитывать не следует. В ответе укажите только
число.

Решение:

После открытия файла нужно открыть окно «Расширенный поиск«.

На вкладке «Главная» находится кнопка «Найти«. Кликаем по чёрному треугольнику возле этой кнопки и выбираем «Расширенный поиск«.

ЕГЭ по информатике - задание 10 (Расширенный поиск в текстовом редакторе)

Далее, нажимаем кнопку «Больше>>«.

ЕГЭ по информатике - задание 10 (Расширенный поиск)

Теперь у нас есть все инструменты, чтобы решить 10 задание из ЕГЭ по информатике 2022.

В поле «Найти» пишем наше слово «рад».

ЕГЭ по информатике - задание 10 (Расширенный поиск, параметры)

Рассмотрим некоторые параметры, которые присутствуют в этом окне.

Учитывать регистр. Если не ставить эту галочку, то программа будет игнорировать регистр. Т.е. не важно, как мы написали в строке поиске, программа будет искать слова с большими буквами и с маленькими буквами. Нам в этой задаче не нужно ставить эту галочку.

Только слово целом. Если поставить эту галочку, то программа будет игнорировать слова, куда наше искомое слово входит. Это то, что нам нужно в этой задаче. Поставим галочку в этой задаче.

После того, как мы сделали нужные настройки нажимаем на кнопку «Найти в» (В некоторых версиях Word эта кнопка может называться «Область поиска» или как-то ещё.) и нажимаем «Основной документ«.

ЕГЭ по информатике - задание 10 (Поиск по всему документу)

После того, как мы это сделаем, нам программа напишет ответ к нашей задаче.

ЕГЭ по информатике - задание 10 (Ответ к задаче 1)

Ответ: 2.

Ещё одна задача при подготовке к 10 заданию ЕГЭ по информатике 2022.

Задача (Разные падежи)

Определите, сколько раз в тексте произведения А. С. Пушкина «Капитанская дочка» встречается имя Емельян в любом падеже.

Источник задачи: https://inf-ege.sdamgia.ru/

Решение:

Вобьём в строку поиска слово Емельян. Будем нажимать на кнопку Найти далее и по очереди проверим каждый случай.

Первый случай не подходит, т.к. это слово находится в аннотации до основного произведения А.С. Пушкина. Нас просили найти именно слова, которые в тексте самого произведения.

Остальные случаи подходят. Всего получается два слова.

Ответ: 2

Ещё один пример из примерных задач ЕГЭ по информатике 2022, где мы составим маску для поиска.

Задача (Маска поиска)

С помощью текстового редактора определите, сколько раз, не считая сносок, встречается слово, которое начинается на букву «С» или на «с» в предложенном файле. Предлог «C» или «с» учитывать не нужно. В ответе укажите только число.

Решение:

Эту задачу можно решить с помощью «Подстановочных знаков«, чтобы можно было использовать маску (шаблон).

Ставим галочку «Подстановочные знаки».

Основные правила для составления маски в программе Word:

Спец. знаки Что обозначают Пример строки поиска Что будет находить
? Один любой символ р?к рак, рок, рик, рык и т.д.
* Любое число любых символов р*к риск, рок, ребёнок и т.д.
[] Один из указанных символов б[аоу]к бак, бок, бук
[-] Один символ из диапазона.
Диапазон должен быть указан в порядке
возрастания кодов символов.
[а-яё] Любая строчная русская
буква
[А-ЯЁ] Любая прописная русская
буква
[0-9] Любая цифра
буква
[!] Один любой символ не указанный после
восклицательного знака
б[!ы]к бак, бок и т. п., но не бык
[!x-z] Один любой символ, не входящий в диапазон указанный после восклицательного знака [!а-яё]ок Бок, Док и т. п., но
не бок, док
[!0-9] Любой символ кроме цифр
{n} Строго n штук предыдущего символа или
выражения. Выражением является все то, что заключено в круглые скобки. Выражение может состоять как из конкретных символов, так и
содержать спец. знаки.
10{3} 1000, но не 100, 10000
10(20){2} 102020, но
не 1020, 10202020
{n;} n и более штук предыдущего символа или
выражения
10{3;} 1000, 10000, 100000 и
т. д., но не 100
{n;m} От n до m штук предыдущего символа или
выражения
10{3;4} 1000, 10000, но
не 100, 100000
@ Один или более штук предыдущего символа
или выражения
10@ 10, 100, 1000, 10000 и т. д.
< Начало слова <бок боксер, но не колобок
> Конец слова бок> колобок, но не боксер

Сначала в поле «Найти» в нашей задаче нужно написать следующую маску:

<[Сс][а-яё]@>

Знак «<» обозначает начало слова. Затем должна идти большая или маленькая буква «С», затем должна идти хотя бы одна маленькая буква русского алфавита. Знак «>» обозначает конец слова.

В этой задачке нужно игнорировать сноски, поэтому нажмём «Найти в» -> «Основной документ«. Это даст возможность не искать в сносках.

ЕГЭ по информатике - задание 10 (Составляем маску)

Нашлось 287 слов.

Ответ: 287

Счастливых экзаменов!

Слайд 1

Задача 24 ЕГЭ Обработка символьных строк Что проверяется: Умение создавать собственные программы (10–20 строк) для обработки символьной информации. Дрынова Светлана Викторовна

Слайд 2

Что нужно знать : сначала нужно прочитать строку из файла; эта задача в разных языках программирования решается несколько по-разному в языке Python удобнее всего использовать такую конструкцию: with open(«k7.txt», «r») as F: s = F.readline () конструкция with-as – это контекстный менеджер , в данном случае он открывает указанный файл в режиме чтения (второй аргумент « r » при вызове функции open ), записывает ссылку на него в файловую переменную F , выполняет тело блока (читает первую строку файла в переменную s ) и закрывает (освобождает) файл. 1. Самая длинная цепочка символов «С» пусть требуется найти самую длинную цепочку символов С (или каких-то других, в соответствии с заданием) в символьной строке s ; можно использовать такой алгоритм: for c in s : обработать символ c

Слайд 3

будем использовать переменные cLen – длина текущей цепочки букв C maxLen – максимальная длина цепочки букв C на данный момент рассмотрим очередной символ строки; если это буква C, увеличиваем cLen на 1 и, если нужно запоминаем новую максимальную длину; если это не буква C, просто записываем с cLen ноль: maxLen = 0 cLen = 0 for c in s: if c == ‘C’: cLen += 1 # ещё одна буква C if cLen > maxLen : # возможно, новая максимальная длина maxLen = cLen else: cLen = 0 # цепочка букв C кончилась

Слайд 4

2. Самая длинная цепочка любых символов теперь поставим задачу найти самую длинную цепочку символов в символьной строке s ; сложность состоит в том, что мы (в отличие от предыдущей задачи) не знаем, из каких именно символов состоит самая длинная цепочка если символов в алфавите немного (скажем, A, B и С), то можно с помощью описанного выше алгоритма найти самые длинные цепочки из букв A, B и C, а затем выбрать из них «длиннейшую»; такая идея может сработать при аккуратной реализации, но плохо обобщается на случай, когда возможных символов много (например, используются все заглавные латинские буквы и цифры) будем использовать переменные curLen – длина текущей цепочки одинаковых символов maxLen – максимальная длина цепочки одинаковых символов на данный момент c – символ, из которого строится самая длинная подцепочка в начальный момент рассмотрим один первый символ (цепочка длины 1 есть всегда!): maxLen = 1 curLen = 1 c = s[0]

Слайд 5

будем перебирать в цикле все символы, начиная с s[1] (второго по счёту) до конца строки, постоянно «оглядываясь назад», на предыдущий символ for i in range(1,len(s)): обработать пару символов s [ i -1] и s [ i ] если очередной символ s[i] такой же, как и предыдущий, цепочка одинаковых символов продолжается, и нужно увеличить значение переменной cu r Len ; если значение cu r Len стало больше maxLen , обновляем maxLen и запоминаем новый базовый символ в переменной c : если очередной символ не совпал с предыдущим, началась новая цепочка, и её длина пока равна 1 (это значение записывается в переменную cu r Len )

Слайд 6

maxLen , curLen , c = 1, 1, s[0] for i in range(1, len (s)): if s[ i ] == s[i-1]: # цепочка продолжается curLen += 1 # увеличиваем длину if curLen > maxLen : # если цепочка побила рекорд maxLen = curLen # запоминаем её длину c = s[ i ] # и образующий символ else : curLen = 1 # началась новая цепочка

Слайд 7

2510) В текстовом файле k7a-2.txt находится цепочка из символов латинского алфавита A, B, C, D, E. Найдите длину самой длинной подцепочки, состоящей из символов A, B или C (в произвольном порядке). сначала нужно открыть файл и прочитать все символы в символьную строку: потом можно в цикле перебрать все символы строки s: определить наибольшую подстроку, состоящей из символов A, B или C, в символьной строке s . Проверку того, что символ – один из набора A, B, C удобно записывать с помощью условия if char in ‘ABC’: s=open(‘k7a-2.txt’).read() count = 0 maxCount = 0 for char in s: if char in ‘ABC’: count += 1 if count> maxCount : maxCount = count else: count=0 print( maxCount )

Слайд 8

Решаем номера 2516, 2518, 2520 Использованы задачи с сайта Полякова К.Ю.

ЕГЭ информатика 24 задание разбор, теория, как решать.

Создание программы для обработки символьной информации, (В) — 1 балл

Е24.34 Определите максимальное количество идущих подряд пар символов вида согласная + гласная

Текстовый файл состоит из символов A, C, D, F и O. Определите максимальное количество идущих подряд пар символов вида согласная + гласная в прилагаемом файле. Для выполнения этого задания следует написать программу. Ответ: TXT     ZIP Демонстрационный вариант ЕГЭ 2023 г.  – задание №24

Читать далее

Е24.33 Определите количество групп из идущих подряд не менее 10 символов

Текстовый файл содержит только заглавные буквы латинского алфавита (ABC…Z). Определите количество групп из идущих подряд не менее 10 символов, которые начинаются и заканчиваются буквой D, не содержат других букв D (кроме первой и последней) и содержат не меньше двух букв C. Ответ: TXT     ZIP СтатГрад Вариант ИН2110402 30.03.2022 – задание №24

Читать далее

Е24.32 Определите максимальное количество идущих подряд пар символов AB или CB в прилагаемом файле

Текстовый файл состоит из символов A, B и C. Определите максимальное количество идущих подряд пар символов AB или CB в прилагаемом файле. Искомая подпоследовательность должна состоять только из пар AB, или только из пар CB, или только из пар AB и CB в произвольном порядке следования этих пар. Для выполнения этого задания следует написать программу. …

Читать далее

Е24.31 Определите максимальное количество идущих подряд пар символов АВ или АС

Текстовый файл состоит из символов А, В и С. Определите максимальное количество идущих подряд пар символов АВ или АС в прилагаемом файле. Для выполнения этого задания следует написать программу. TXT     ZIP Апробация ЕГЭ по информатике 19 февраля 2022 – задание №24 Тренировочный экзамен по информатике и ИКТ (КЕГЭ) в компьютерной форме

Читать далее

Е24.30 не содержат других букв E (кроме первой и последней) и букв F

Текстовый файл содержит только заглавные буквы латинского алфавита (ABC…Z). Определите количество групп из идущих подряд не менее 12 символов, которые начинаются и заканчиваются буквой E и не содержат других букв E (кроме первой и последней) и букв F. TXT СтатГрад Вариант ИН2110301 08.02.2022 – задание №24

Читать далее

Е24.29 максимальное количество идущих подряд символов, среди которых не более двух букв D

Текстовый файл содержит только заглавные буквы латинского алфавита(ABC…Z). Определите максимальное количество идущих подряд символов, среди которых не более двух букв D. Ответ: TXT «Некрыловские варианты» от Евгения Джобса — Вариант 5

Читать далее

Е24.28 среди которых нет ни одной буквы B и при этом не менее трёх букв A.

Текстовый файл содержит только заглавные буквы латинского алфавита (ABC…Z). Определите максимальное количество идущих подряд символов, среди которых нет ни одной буквы B и при этом не менее трёх букв A. Ответ: TXT informatikaexpert.ru

Читать далее

Е24.27 Необходимо найти строку, содержащую наименьшее количество букв N

Текстовый файл содержит строки различной длины. Общий объём файла не превышает 1 Мбайт. Строки содержат только заглавные буквы латинского алфавита (ABC…Z). Необходимо найти строку, содержащую наименьшее количество букв N (если таких строк несколько, надо взять ту, которая находится в файле раньше), и определить, какая буква встречается в этой строке чаще всего.  Если таких букв несколько, …

Читать далее

Е24.26 максимальное расстояние между одинаковыми буквами в одной строке

Текстовый файл содержит строки различной длины. Общий объём файла не превышает 1 Мбайт. Строки содержат только заглавные буквы латинского алфавита (ABC…Z). В строках, содержащих менее 25 букв A, нужно определить и вывести максимальное расстояние между одинаковыми буквами в одной строке. Пример. Исходный файл: GIGA GABLAB NOTEBOOK AGAAA В этом примере во всех строках меньше 25 …

Читать далее

Е24.25 среди которых не более одной буквы A.

Текстовый файл содержит только заглавные буквы латинского алфавита (ABC…Z). Определите максимальное количество идущих подряд символов, среди которых не более одной буквы A. Ответ:   24.TXT СтатГрад Вариант ИН2110101 27.10.2021– задание №24

Читать далее

Описание презентации по отдельным слайдам:

  • Регулярные выраженияРоман В.Н.

    1 слайд

    Регулярные выражения
    Роман В.Н.

  • Регулярные выражения - выражения для поиска и замены части текста в строке ил...

    2 слайд

    Регулярные выражения — выражения для поиска и замены части текста в строке или файле. Для работы с ними необходимо подключить модуль «re» из стандартной библиотеки Python.
    Для поиска в строке, разбиения строк, замены части строк часто используются регулярные выражения. 

    Некоторые методы для работы с регулярными выражениями:
    re.match(шаблон, строка) — ищет заданный шаблон с самого начала строки.

  • re.search(шаблон, строка) - ищет заданный шаблон по всей строке, возвращает р...

    3 слайд

    re.search(шаблон, строка) — ищет заданный шаблон по всей строке, возвращает результат при первом совпадении.

    re.findall(шаблон, строка) — ищет заданный шаблон и возвращает все совпадения в виде списка.

  • re.split(шаблон, строка) - разделяет строку по заданному шаблону
re.compile(ш...

    4 слайд

    re.split(шаблон, строка) — разделяет строку по заданному шаблону

    re.compile(шаблон) — позволяет собирать регулярное выражение в отдельный объект для последующего использования

  • Представьте, что вам необходимо произвести чтение &quot;грязного&quot; файла и убрать и...

    5 слайд

    Представьте, что вам необходимо произвести чтение «грязного» файла и убрать из него все лишнее, но при этом вы не можете сказать точно, что необходимо убрать. Эту задачу можно решить используя специальные символы:

Понравилась статья? Поделить с друзьями:

Новое и интересное на сайте:

  • Регулирующая функция налогов примеры егэ обществознание
  • Регулировщик пдд экзамен билеты
  • Регулировщик онлайн экзамен
  • Регулировка егэ математика профиль
  • Регулировка егэ биология

  • Добавить комментарий

    ;-) :| :x :twisted: :smile: :shock: :sad: :roll: :razz: :oops: :o :mrgreen: :lol: :idea: :grin: :evil: :cry: :cool: :arrow: :???: :?: :!: