Чему вы научитесь
- Выбирать ETL, ELT или EtLT под требования бизнеса.
- Извлекать и нормализовать данные на Python.
- Готовить первый пайплайн к загрузке в аналитическое хранилище.
- Проектировать устойчивые пайплайны данных.
- Разделять бизнес-логику и инфраструктуру через Resources и IOManagers.
- Запускать локальный проект Dagster и настраивать проверки качества.
- Проектировать связанные цепочки ассетов.
- Управлять контекстом выполнения и логированием.
- Внедрять Asset Checks, чтобы останавливать обработку при ошибках.
- Деплоить пайплайны и работать с интеграциями
О курсе
Для кого этот курс
Начальные требования
Курс рассчитан на начинающих в оркестрации данных, но предполагает наличие базовых навыков. Убедитесь, что до старта у вас есть:
-
Базовое знание Python. Вам не нужно быть экспертом, но вы должны уверенно читать и понимать код на Python, знать основы синтаксиса и работы с функциями. В ходе курса вы будете писать код для ETL-пайплайнов, поэтому эти навыки необходимы для старта.
-
Понимание основ SQL. Вы будете работать с данными в аналитических хранилищах, поэтому важно понимать, что такое таблицы, и уметь читать простые
SELECT-запросы. Сложные запросы мы будем писать вместе, но база должна быть. -
Базовые навыки работы с командной строкой (терминалом). В курсе мы будем устанавливать пакеты, запускать проект Dagster и выполнять другие команды. Вам не нужно быть гуру командной строки, но вы должны уметь открыть терминал, перейти в нужную папку и выполнить готовую команду.
-
Общее понимание ETL-процессов. Будет плюсом, если вы уже знакомы с концепцией ETL (Extract, Transform, Load). Если нет — не страшно, в первом же уроке мы подробно разбираем эту тему.
Преподаватели курса
Как проходит обучение
Это не просто курс, а практикум. Каждый шаг в тренажере — это новая вводная от лида или правка от заказчика.
Что вы получите
- Практические навыки в первой миссии. Вы пройдете полноценный блок «Теория ETL», где:
- Разберетесь, как сырые данные превращаются в бизнес-ценность через ETL-процессы.
- Узнаете, чем отличаются ETL, ELT и EtLT, и научитесь выбирать подход под разные бизнес-задачи.
- Напишете свой первый Python-скрипт для извлечения и нормализации данных.
- Создадите первый пайплайн и подготовите его к загрузке в аналитическое хранилище.
- Знакомство с экосистемой Dagster. Вы не просто прочитаете про инструмент, а сразу начнете с ним работать в реальной среде:
- Поймете концепцию Software Defined Assets (SDA).
- Увидите, как выглядит граф данных в UI Dagster.
- Научитесь запускать локальный проект Dagster и настраивать первые проверки качества.
- Возможность оценить формат обучения. Это ключевая цель демо. Вы сможете:
- Поработать в нашей облачной IDE, где всё уже настроено для работы.
- Оценить, насколько вам подходит формат «сюжетного симулятора» с заданиями по реальным бизнес-кейсам.
- Понять логику и сложность курса, чтобы принять взвешенное решение о покупке полной версии.