Vendetta
Администратор
- Регистрация
- 16 Сен 2015
- Сообщения
- 246.726
- Реакции
- 426.072
Курс по Data Engineering [SkillFactory] [М. Королев] Часть 1 из 2
Научитесь строить пайплайны данных в реальном времени
В современных компаниях накапливается большой объем данных, из которых можно извлекать важную аналитику, строить гипотезы или прогнозные модели.
Data Engineer — это специалист, который собирает данные из разных источников, очищает их и передает в удобном виде аналитикам для принятия бизнес-решений.
Аналитикам данных нужно знать, как работает хранилище данных, в каком виде там хранятся данные, как они обрабатываются и как их можно получить для анализа.
Курс ориентирован на практику и основные инструменты, подходит для тех, кто имеет базовые знания языка Python.
За два месяца вы освоите все важные этапы Data Engineering.
Программа курса
МОДУЛИ
1 Введение, практический linux
Кто такой Data Engineer и зачем ему Linux?
2 Современные хранилища данных
Разнообразие баз данных и их особенности
3 Экосистема Hadoop
Что такое Hadoop, что он умеет и как им пользоваться
4 Источники данных и работа с ними
Файлы как источники данных, JDBC — структурированные данные, SQL для выгрузки данных
5 Apache Spark и обработка данных
Зачем нужен Apache Spark и как с ним работать
6 Hadoop как хранилище данных
Особенности и нюансы hdfs
7 Apache Airflow для оркестрации конвейеров
Настройка data pipelines
8 Обзор облачных хранилищ
Особенности и нюансы работы с облачными хранилищами: Google, Amazon, Azure
Этот курс входит в программу Профессия «Data Scientist»
Научитесь строить пайплайны данных в реальном времени
В современных компаниях накапливается большой объем данных, из которых можно извлекать важную аналитику, строить гипотезы или прогнозные модели.
Data Engineer — это специалист, который собирает данные из разных источников, очищает их и передает в удобном виде аналитикам для принятия бизнес-решений.
Аналитикам данных нужно знать, как работает хранилище данных, в каком виде там хранятся данные, как они обрабатываются и как их можно получить для анализа.
Курс ориентирован на практику и основные инструменты, подходит для тех, кто имеет базовые знания языка Python.
За два месяца вы освоите все важные этапы Data Engineering.
Программа курса
МОДУЛИ
1 Введение, практический linux
Кто такой Data Engineer и зачем ему Linux?
2 Современные хранилища данных
Разнообразие баз данных и их особенности
3 Экосистема Hadoop
Что такое Hadoop, что он умеет и как им пользоваться
4 Источники данных и работа с ними
Файлы как источники данных, JDBC — структурированные данные, SQL для выгрузки данных
5 Apache Spark и обработка данных
Зачем нужен Apache Spark и как с ним работать
6 Hadoop как хранилище данных
Особенности и нюансы hdfs
7 Apache Airflow для оркестрации конвейеров
Настройка data pipelines
8 Обзор облачных хранилищ
Особенности и нюансы работы с облачными хранилищами: Google, Amazon, Azure
Этот курс входит в программу Профессия «Data Scientist»
Для просмотра скрытого содержимого вы должны зарегистрироваться
Возможно, Вас ещё заинтересует:
- Покупка вторичного жилья без подводных камней [Наталья Литовская]
- [ИИ] Чат-бот с искусственным интеллектом ChatGPT [Pro №6, на 3 месяца до 20 человек] [chatgpt.com]
- Практическое руководство по изучению книг Франца Бардона [Рон Кларк]
- [Шитье] Осенний курс-сюрприз [Сантюр] [Наталья Моргунова]
- [ИИ] Чат-бот с искусственным интеллектом ChatGPT [Pro №1, на 1 месяц до 10 человек] [chatgpt.com]
- [Вязание] Воздушный пуловер-худи с японским плечом из тонкой мохеровой пряжи Rye спицами сверху [Вяжи.ру] [Alice Hoyle]
- [Вязание] Фактурный кардиган рельефным узором Puro [Вяжи.ру] [Jenny Ansah]
- [WP] Bricks & WordPress Tutorials — статьи о Bricks Builder и Wordpress [brickslabs.com] [2026—2027]