Город: Минск
Занятость: Полная, 5/2
Опыт работы: От 3 до 6 лет
-
Управление инцидентами (L2/L3), эскалация и оперативное решение проблем
-
Анализ логов и метрик (ELK, Zabbix и др.)
-
Поддержка сервисов и участие в разборе инцидентов в продакшене
-
Сопровождение релизов, контроль изменений
-
Работа с PostgreSQL (диагностика, анализ данных, SQL-запросы)
-
Настройка мониторинга, определение критичных метрик и алертов
-
Контроль и участие в формировании SLI / SLO
-
Взаимодействие с разработчиками при поиске причин инцидентов
-
Проведение постмортеманализа и улучшение стабильности систем
-
Ведение задач в Jira, документации в Confluence
-
Опыт работы в роли SRE / Production Support / L2-L3 Engineer от 2 лет
-
Понимание принципов SLI / SLO и incident management
-
Опыт работы с мониторингом (Zabbix, Prometheus или аналогичные системы)
-
Уверенную работу с реляционными БД (PostgreSQL)
-
Опыт работы с облаками (AWS / Yandex Cloud / Selectel)
Будет плюсом
- Опыт настройки и администрирования Zabbix
- Опыт работы с Elasticsearch / ELKстеком (настройка индексов, алертов, дашбордов)
- Опыт работы с Kubernetes (на уровне понимания)
- Опыт работы с Helm / Terraform (на уровне понимания)
- Опыт в финтехе или высоконагруженных системах
- Официальное трудоустройство
-
Дежурства (без ночных смен, раз в 3 недели)
Адрес: Минск
Похожие вакансии