Чему вы научитесь
- понимать структуру HTML-документов;
- находить нужные элементы с помощью BeautifulSoup;
- выполнять HTTP-запросы библиотекой Requests;
- работать с пагинацией различных типов;
- сохранять данные в CSV и JSON;
- использовать API для получения данных;
- автоматизировать браузер с помощью Playwright;
- обходить ограничения сайтов;
- работать с авторизацией;
- ускорять парсеры с помощью асинхронности;
- создавать собственные парсеры для реальных сайтов.
О курсе
Курс, в котором вы научитесь получать данные с веб-сайтов, обрабатывать их и сохранять в различные форматы. В ходе обучения вы освоите три основных подхода к парсингу: извлечение данных из HTML, работу с API и автоматизацию браузера с помощью Playwright. Все темы сопровождаются практическими примерами и заданиями.
Для кого этот курс
Курс подойдет тем, кто уже знает основы Python и хочет научиться получать данные с веб-сайтов.
Начальные требования
Для прохождения курса достаточно базовых знаний Python: понимания переменных, условий, циклов, функций, классов и работы со списками и словарями. Специальных знаний в области веб-разработки или парсинга не требуется.
Преподаватели курса
Сертификат
Успешно завершив курс, вы получите сертификат от платформы Stepik. Уже 2 учеников получили сертификат.
Что вы получите
- Сертификат о прохождении курса.
- Знания современных библиотек: Requests, BeautifulSoup, Playwright, Selenium, Aiohttp, Asyncio.
- Практические навыки создания парсеров на Python.
- Набор готовых проектов, которые можно использовать как основу для собственных решений.
- Опыт оптимизации парсеров с помощью асинхронности.
Нагрузка
10-15 минут в день