Apache Spark для машинного обучения и обработки больших данных | AWS Certified ML Engineer Associate
G Tech
0:00 / 0:00
Apache Spark для машинного обучения и обработки больших данных | AWS Certified ML Engineer Associate
15 просмотров · 3 мес. назад
G Tech
42 подписчика
15 просмотров · 3 мес. назад
В этом видео я рассказываю об Apache Spark, одной из наиболее широко используемых платформ распределенных вычислений для анализа больших данных, инженерии данных и машинного обучения.
Темы, рассматриваемые в этой презентации:
• Введение в Apache Spark
• Ключевые особенности и преимущества Spark
• Архитектура Spark (драйвер, менеджер кластера, рабочие процессы, исполнители)
• Основные компоненты экосистемы Spark
• Spark SQL, Spark Streaming, MLlib и GraphX
• Apache Spark для рабочих процессов машинного обучения
• Распределенная обработка данных и обучение моделей
• Преимущества Apache Spark
• Комплексный конвейер машинного обучения с использованием Spark и сервисов AWS
Apache Spark — это мощная платформа с открытым исходным кодом, которая позволяет организациям эффективно обрабатывать большие наборы данных с помощью распределенных вычислений и обработки в оперативной памяти. Она стала основополагающей технологией для инженеров данных, специалистов по анализу данных и инженеров машинного обучения, работающих с большими данными.
#ApacheSpark #БольшиеДанные #МашинноеОбучение #ИнженерияДанные #AWS #PySpark #MLlib #ОблачныеВычисления #ИскусственныйИнтеллект #AWSMLA