Перейти к содержимому

Apache Spark для машинного обучения и обработки больших данных | AWS Certified ML Engineer Associate

G Tech

0:00 / 0:00

Apache Spark для машинного обучения и обработки больших данных | AWS Certified ML Engineer Associate

15 просмотров · 3 мес. назад
G Tech
42 подписчика
15 просмотров · 3 мес. назад
В этом видео я рассказываю об Apache Spark, одной из наиболее широко используемых платформ распределенных вычислений для анализа больших данных, инженерии данных и машинного обучения. Темы, рассматриваемые в этой презентации: • Введение в Apache Spark • Ключевые особенности и преимущества Spark • Архитектура Spark (драйвер, менеджер кластера, рабочие процессы, исполнители) • Основные компоненты экосистемы Spark • Spark SQL, Spark Streaming, MLlib и GraphX • Apache Spark для рабочих процессов машинного обучения • Распределенная обработка данных и обучение моделей • Преимущества Apache Spark • Комплексный конвейер машинного обучения с использованием Spark и сервисов AWS Apache Spark — это мощная платформа с открытым исходным кодом, которая позволяет организациям эффективно обрабатывать большие наборы данных с помощью распределенных вычислений и обработки в оперативной памяти. Она стала основополагающей технологией для инженеров данных, специалистов по анализу данных и инженеров машинного обучения, работающих с большими данными. #ApacheSpark #БольшиеДанные #МашинноеОбучение #ИнженерияДанные #AWS #PySpark #MLlib #ОблачныеВычисления #ИскусственныйИнтеллект #AWSMLA