Все продукты
Все сервисы VK Cloud

Вебинар

Онлайн

Разворачиваем приложение на Apache Spark в Kubernetes. Пошаговый рецепт

4 февраля 2021 г.
17:00
<link rel="preload" as="image" href="https://events.vkcloud-static.ru/static/images/icons/LocationMapIcon_28.svg"/><div class="EventPageDateAndTime_location__uQjGW"><img src="https://events.vkcloud-static.ru/static/images/icons/LocationMapIcon_28.svg" alt="" class="EventPageDateAndTime_locationIcon__AS6PF"/><p class="typography_23498 bodyM_055b7">Онлайн</p></div>

О мероприятии

Для частого запуска приложений на Spark, особенно в промышленной эксплуатации, необходимо максимально упростить сам процесс регулярного запуска Spark-задач, а также уметь гибко настраивать их конфигурации. В этом поможет современный DevOps-подход к работе со Spark, связанный с использованием Kubernetes. Spark на Kubernetes позволяет решать задачи изоляции рабочих сред, гибкого управления ресурсами и масштабирования. Популярные материалы останавливаются на запуске тестового приложения в K8s, которое считает число пи. В своем вебинаре мы пошли дальше: даже начинающие научатся обрабатывать данные с помощью Spark в облаке. В рамках мероприятия мы собрали свой образ со своим кодом, добавили необходимые библиотеки, креды для доступа к S3-хранилищу, научились читать из S3 и записывать в него. Все это стало возможно с помощью Kubernetes как сервис, который максимально упрощает базовую работу с технологией Kubernetes, порог входа в которую для Data Scientists все еще очень высокий. В описании к записи вебинара на YouTube вы можете найти готовый репозиторий в Github с инструкцией, всеми командами, примерами кода, готовыми приложениями, чтобы самостоятельно повторить все действия, которые были продемонстрированы спикером в рамках вебинара.

Трансляция

В программе

11zon_cropped - 2025-04-07T155008.037.png
Александр ВолынскийТехнический менеджер продукта, VK Cloud
1. Развернем Kubernetes-кластер в облаке VK Cloud; 2. Установим Kubernetes Operator for Apache Spark (Spark Operator); 3. Запустим тестовый пример Spark-задачи/приложения; 4. Соберем свой Docker-образ со Spark и кастомным приложением; 5. Протестируем Docker-образ в работе, получим доступ из Spark к сервисам облака (S3-хранилищу); 6. В процессе познакомимся с дебагом Spark в Kubernetes ;)

Хотите стать спикером на нашем мероприятии?

Напишите нам о вас и теме вашего выступления, мы с вами обязательно свяжемся.
0ad2cf255cfe773215f636d967e1d51f5e08365f 2.png