Доклады по темам SRE, K8s, Cloud, MLOps

Доклады по темам SRE, K8s, Cloud, MLOps, image #1

Навигация по статье:

— Доклады про SRE
— Доклады про K8s
— Доклады про Cloud
— Доклады про MLOps

SRE

• Александр Поломодов и Салих Фахрутдинов, Тинькофф — Публичное интервью по troubleshooting для SRE-инженеров

Что будет, если лид уедет на конфу, а джун останется за главного? В формате трабл-шутинга спикеры покажут, как проходит интервью в Тинькофф.

• Максим Гусев, Southbridge — Инструменты и практики SRE, которые помогают освободиться от рутины и добиться гладкой работы систем

Мы часто сталкиваемся со сложностями в применении некоторых практик SRE. Например, сложно применить на практике подход к дежурствам. Но команде Максима это удалось, и он представит реальный кейс, как они адаптировали практики, вовлекая обычных дежурных администраторов.

Другие доклады про SRE

K8s

• Александр Лукьянченко, Авито — Скрывая Kubernetes: подходы к конфигурированию

Как соблюсти баланс между свободой разработчиков в управлении инфраструктурой приложения и демократией стабильностью в проде, особенно, когда компания растет? Александр опишет путь эволюции конфигурирования сервисов и взаимодействия разработчиков с K8s в Авито и покажет, на каких инструментах можно реализовать механики и подходы, к которым они пришли.

• Андрей Синицын, VK tech — Побег из курятника контейнера

Мы все привыкли к контейнерам, как к удобному и безопасному способу запуска приложений. Настолько привыкли, что забываем, что по факту работаем в хостовой ОС. Спикер приведет примеры провалов контейнеров и покажет много примеров, как порвать периметр и как с этим бороться.

Другие доклады про K8s

Cloud

• Иван Гулаков, МТС — Опыты с IaC: как мы научились запускать зоны доступности облака за пару дней

Доклад о том, что делать облачному бизнесу, который хочет расширяться, а затраты на развертывание новых площадок и их обслуживание постоянно растут. Спикер покажет, как единый инструмент управления регионом для devops/network/virtualization-команд помог снизить T2M развертывания в 10 раз.

• Константин Малов, Яндекс — Пирамида потребностей multitenant-системы

Как при меньшем количестве людей начать обслуживать большее число машин? YTsaurus — основная платформа для хранения и обработки данных Яндекса, ad hoc-аналитики и регулярных батч-процессов. Этот доклад — взгляд внутрь Яндекса, рассказ про путь автоматизации, который прошла команда YTsaurus, и про получившийся набор инструментов.

Другие доклады про Cloud

MLOps

• Олег Вознесенский, Газпромбанк — Что такое MLOps

MLOps — еще одно buzzword с суффиксом -ops, которое ворвалось в тренды среди DevOps-комьюнити. Разберемся, какой набор задач и технологий скрывается под этим термином на примере департамента машинного обучения Газпромбанка.

• Миржан Иркегулов, Kolesa Group — Что я хотел бы знать об MLOps год назад

Подключение в базовую «железную» инфраструктуру видеокарт сильно влияет на стандартные подходы к управлению ресурсами облака, скейлингу, управлению нагрузкой и т. п. За год работы с MLOps спикер столкнулся с рядом неоднородных задач, на которых нет каноничных ответов. Приходилось прокладывать путь самому, набивая шишки. Об этом пути и расскажет спикер, чтобы вы смогли научиться на чужих ошибках. Доклад будет интересен всем, кто разрабатывает и деплоит ML-модели, а также тем, кто только планирует внедрять ML.

Другие доклады про MLOps
24 views·1 share