Основы инженерии данных: построение конвейеров ETL с Hadoop
Освоить основы конвейеров данных, процессов ETL и Hadoop для приема, преобразования и хранения крупномасштабных наборов данных для современных аналитических систем.
-
💬
ИИ инструктор
Задавайте вопросы по любому уроку — понятный ответ придёт мгновенно, в любой момент. -
🕐
Начните в любое время
Без расписаний и дедлайнов — учитесь в своём темпе, когда удобно. -
🌐
На русском языке
Уроки, задания и сертификат — всё полностью на вашем языке.
О курсе
В современном мире, основанном на данных, организации полагаются на чистые, доступные и структурированные данные для принятия важных решений. Этот текстовый курс поможет вам освоить основные концепции инженерии данных и научиться управлять ими и перемещать их в масштабе. Вы пройдете путь от понимания основных концепций данных до разработки и выполнения собственных конвейеров Extract, Transform, Load (ETL). Освоив основные структуры больших данных и современные методы хранения, вы приобретете навыки, необходимые для обработки массивных наборов данных, и подготовите их для последующего анализа. Вы узнаете: Понимание основной терминологии по обработке данных, включая пакетную обработку в сравнении с обработкой в реальном времени и архитектурой конвейера; Извлечение необработанных данных из различных источников и их очистка с помощью современных методов преобразования; Эффективная загрузка структурированных данных в хранилища данных и распределенные системы хранения; Настройка Hadoop и Концепции MapReduce для обработки крупномасштабных наборов данных в распределенных средах; Применение современных форматов хранения, таких как Parquet и Delta Lake, для оптимизации производительности конвейера; Разработка автоматизированных рабочих процессов конвейеров для обеспечения последовательной доставки данных и контроля качества. Курс начинается с основных определений и принципов архитектуры, а затем переходит к поэтапным письменным учебникам по извлечению, преобразованию и загрузке данных. Затем вы изучите распределенные вычисления с Hadoop и современные стратегии хранения данных с помощью практических письменных упражнений. Этот курс предназначен для начинающих, начинающих инженеров данных и аналитиков, которые хотят понять бэк-энд систем данных. Не требуется предыдущий опыт инженерии данных или сложное программирование. Начните свое путешествие в мир больших данных, и построить свой первый трубопровод данных сегодня.
Что вы получите
-
📜
Сертификат об окончании
Добавьте в профиль LinkedIn -
💬
Личный AI-наставник
Застрял на уроке? Спроси встроенного наставника о чём угодно, в любой момент. -
🎧
Аудиоверсия включена
Учитесь в дороге — экран не нужен -
♾️
Пожизненный доступ
Возвращайтесь в любое время, без срока -
📱
Телефон или компьютер
Работает везде и на любом устройстве -
💸
Возврат в течение 14 дней
Без вопросов -
⚡
Кратко и по делу
2 ч 48 мин практического материала
Отзывы
Отзывов пока нет — поделитесь своим первым.
Студенты также прошли
🏆 Самый популярный
🎓 С сертификатом
Основы управления данными с Python, SQL и Big Data
Сертификат
Практика
299 ₽
→
🎓 С сертификатом
Методы реляционных баз данных для хранения данных
Сертификат
Практика
299 ₽
→
🌟 Выбор студентов
🎓 С сертификатом
Основы системной аналитики и хранения данных
Сертификат
Практика
299 ₽
→
⚡ Лучший для старта
🎓 С сертификатом
Основы анализа данных и больших данных
Сертификат
Практика
299 ₽
→
Часто спрашивают
Что нужно для прохождения курса? +
Только смартфон или компьютер с доступом в интернет. Никаких установок и оборудования.
Как оплатить? +
Банковской картой через Stripe. Данные карты обрабатывает Stripe — мы их не храним.
Можно ли вернуть деньги? +
Да — полный возврат в течение 14 дней, без вопросов.
Как долго будут доступны материалы? +
Навсегда. После покупки курс остаётся с вами — возвращайтесь в любое время.
Получу ли я сертификат? +
Да. По окончании выдаётся сертификат, который можно добавить в профиль LinkedIn.
Подходит для специалистов в
IT
Дизайн
Финансы
Маркетинг
Медицина
Образование
HoReCa
Производство