Чему вы научитесь
- писать Trino SQL для структурных и полуструктурированных данных
- подключать PostgreSQL, Hive, S3, Iceberg и Delta Lake через коннекторы
- читать distributed query plan, stages, tasks, splits и exchanges
- оптимизировать JOIN, dynamic filtering, статистику, spill, skew и compaction
- настраивать безопасность, resource groups, мониторинг и отказоустойчивость
- проектировать production-кластер и обосновывать выбор Trino или PrestoDB
О курсе
Trino 482 и PrestoDB для дата-инженеров: распределённый SQL, федерация, PostgreSQL, S3, Hive, Iceberg, Delta Lake, оптимизация, безопасность и эксплуатация.
Для кого этот курс
дата-инженеры, строящие lakehouse и федеративную аналитику; SQL- и BI-разработчики, которым нужно понимать распределённое выполнение запросов; платформенные инженеры, отвечающие за Trino, Presto, S3 и Kubernetes; архитекторы данных, выбирающие движок для cloud или on-prem аналитики.
Начальные требования
уверенное владение базовым SQL: SELECT, JOIN, GROUP BY и оконные функции Docker Compose, терминал и базовое понимание баз данных и object storage Java и Kubernetes полезны для production-модулей, но обязательного опыта не требуется
Преподаватели курса
Как проходит обучение
Каждый урок проходится по циклу: понять идею, запустить и изменить пример, ответить на тест, самостоятельно решить практику и только затем свериться с разбором.
Материал выстроен последовательно, без обязательных дедлайнов. Рекомендуется вести учебный репозиторий и журнал ошибок.
Формат курса
Самостоятельный текстовый курс: подробная теория, запускаемые примеры, тесты для самопроверки, практические задачи с решениями и итоговый проект.
Что вы получите
- полный текстовый конспект курса с рабочими примерами
- 666 тестовых вопросов для самопроверки
- 468 практических задач с решениями
- итоговый проект: Production-платформа Trino: федеративные источники, Iceberg-слой в object storage, оптимизированные запросы, разграничение доступа, resource groups, метрики, SLO и сценарий восстановления.
Нагрузка
110-170 часов