SRE-инженер применяет инженерный подход к эксплуатации: описывает целевые показатели доступности, строит мониторинг, разбирает инциденты и автоматизирует всё, что повторяется вручную.
От DevOps отличается фокусом: DevOps выстраивает процесс поставки, SRE отвечает за то, чтобы работающая система не падала и восстанавливалась быстро.
Должностные обязанности
- Определяет и контролирует целевые показатели надёжности сервисов
- Строит мониторинг, оповещения и дашборды
- Участвует в дежурствах и разборе инцидентов
- Автоматизирует рутинные операции эксплуатации
- Проводит нагрузочное тестирование и планирует ёмкость
- Вносит изменения в архитектуру для повышения отказоустойчивости
Эти обязанности уже сведены в готовую должностную инструкцию
Требования и навыки
- Опыт в эксплуатации или разработке от трёх лет
- Глубокое знание Linux и сетевого стека
- Опыт работы с системами мониторинга и трассировки
- Навыки программирования на Python или Go
- Опыт участия в разборе инцидентов
Сколько зарабатывает в Москве
Вилка по этой профессии сильно зависит от отрасли, графика и объёма задач.
Назовём актуальный диапазон по вашему городу и требованиям на брифе -
он занимает 40 минут и ни к чему не обязывает.
Где искать таких специалистов работодателю
Узкий и дорогой сегмент: подходящих людей на рынке немного, и почти все трудоустроены. Работает только прямой поиск через IT-сообщества и рекомендации.
На интервью спрашивайте про конкретные инциденты: что упало, как чинили, что сделали, чтобы не повторилось. Ответ показывает разницу между администратором и инженером надёжности.