<link rel="preload" as="image" href="https://events.vkcloud-static.ru/static/images/icons/LocationMapIcon_28.svg"/><div class="EventPageDateAndTime_location__uQjGW"><img src="https://events.vkcloud-static.ru/static/images/icons/LocationMapIcon_28.svg" alt="" class="EventPageDateAndTime_locationIcon__AS6PF"/><p class="typography_23498 bodyM_055b7">Онлайн</p></div>
О мероприятии
Для частого запуска приложений на Spark, особенно в промышленной эксплуатации, необходимо максимально упростить сам процесс регулярного запуска Spark-задач, а также уметь гибко настраивать их конфигурации. В этом поможет современный DevOps-подход к работе со Spark, связанный с использованием Kubernetes. Spark на Kubernetes позволяет решать задачи изоляции рабочих сред, гибкого управления ресурсами и масштабирования.
Популярные материалы останавливаются на запуске тестового приложения в K8s, которое считает число пи. В своем вебинаре мы пошли дальше: даже начинающие научатся обрабатывать данные с помощью Spark в облаке. В рамках мероприятия мы собрали свой образ со своим кодом, добавили необходимые библиотеки, креды для доступа к S3-хранилищу, научились читать из S3 и записывать в него.
Все это стало возможно с помощью Kubernetes как сервис, который максимально упрощает базовую работу с технологией Kubernetes, порог входа в которую для Data Scientists все еще очень высокий.
В описании к записи вебинара на YouTube вы можете найти готовый репозиторий в Github с инструкцией, всеми командами, примерами кода, готовыми приложениями, чтобы самостоятельно повторить все действия, которые были продемонстрированы спикером в рамках вебинара.
Трансляция
В программе

Александр ВолынскийТехнический менеджер продукта, VK Cloud
1. Развернем Kubernetes-кластер в облаке VK Cloud;
2. Установим Kubernetes Operator for Apache Spark (Spark Operator);
3. Запустим тестовый пример Spark-задачи/приложения;
4. Соберем свой Docker-образ со Spark и кастомным приложением;
5. Протестируем Docker-образ в работе, получим доступ из Spark к сервисам облака (S3-хранилищу);
6. В процессе познакомимся с дебагом Spark в Kubernetes ;)
Хотите стать спикером на нашем мероприятии?
Напишите нам о вас и теме вашего выступления, мы с вами обязательно свяжемся.
