Доклады по темам SRE, K8s, Cloud, MLOps
Навигация по статье:
— Доклады про SRE
— Доклады про K8s
— Доклады про Cloud
— Доклады про MLOps
SRE
• Александр Поломодов и Салих Фахрутдинов, Тинькофф — Публичное интервью по troubleshooting для SRE-инженеров
Что будет, если лид уедет на конфу, а джун останется за главного? В формате трабл-шутинга спикеры покажут, как проходит интервью в Тинькофф.
• Максим Гусев, Southbridge — Инструменты и практики SRE, которые помогают освободиться от рутины и добиться гладкой работы систем
Мы часто сталкиваемся со сложностями в применении некоторых практик SRE. Например, сложно применить на практике подход к дежурствам. Но команде Максима это удалось, и он представит реальный кейс, как они адаптировали практики, вовлекая обычных дежурных администраторов.
Другие доклады про SREK8s
• Александр Лукьянченко, Авито — Скрывая Kubernetes: подходы к конфигурированию
Как соблюсти баланс между свободой разработчиков в управлении инфраструктурой приложения и демократией стабильностью в проде, особенно, когда компания растет? Александр опишет путь эволюции конфигурирования сервисов и взаимодействия разработчиков с K8s в Авито и покажет, на каких инструментах можно реализовать механики и подходы, к которым они пришли.
• Андрей Синицын, VK tech — Побег из курятника контейнера
Мы все привыкли к контейнерам, как к удобному и безопасному способу запуска приложений. Настолько привыкли, что забываем, что по факту работаем в хостовой ОС. Спикер приведет примеры провалов контейнеров и покажет много примеров, как порвать периметр и как с этим бороться.
Другие доклады про K8sCloud
• Иван Гулаков, МТС — Опыты с IaC: как мы научились запускать зоны доступности облака за пару дней
Доклад о том, что делать облачному бизнесу, который хочет расширяться, а затраты на развертывание новых площадок и их обслуживание постоянно растут. Спикер покажет, как единый инструмент управления регионом для devops/network/virtualization-команд помог снизить T2M развертывания в 10 раз.
• Константин Малов, Яндекс — Пирамида потребностей multitenant-системы
Как при меньшем количестве людей начать обслуживать большее число машин? YTsaurus — основная платформа для хранения и обработки данных Яндекса, ad hoc-аналитики и регулярных батч-процессов. Этот доклад — взгляд внутрь Яндекса, рассказ про путь автоматизации, который прошла команда YTsaurus, и про получившийся набор инструментов.
Другие доклады про CloudMLOps
• Олег Вознесенский, Газпромбанк — Что такое MLOps
MLOps — еще одно buzzword с суффиксом -ops, которое ворвалось в тренды среди DevOps-комьюнити. Разберемся, какой набор задач и технологий скрывается под этим термином на примере департамента машинного обучения Газпромбанка.
• Миржан Иркегулов, Kolesa Group — Что я хотел бы знать об MLOps год назад
Подключение в базовую «железную» инфраструктуру видеокарт сильно влияет на стандартные подходы к управлению ресурсами облака, скейлингу, управлению нагрузкой и т. п. За год работы с MLOps спикер столкнулся с рядом неоднородных задач, на которых нет каноничных ответов. Приходилось прокладывать путь самому, набивая шишки. Об этом пути и расскажет спикер, чтобы вы смогли научиться на чужих ошибках. Доклад будет интересен всем, кто разрабатывает и деплоит ML-модели, а также тем, кто только планирует внедрять ML.
Другие доклады про MLOps