Используем cookie — чтобы сайт работал и чтобы считать посещаемость. Нажимая «Хорошо», вы разрешаете ещё и запись сессий Вебвизором. Подробнее и как отказаться
Senior Site Reliability Engineer (Remote Build) | RocketHunt
Контакты
Свяжитесь напрямую по этой вакансии
Описание
Что вы будете делать
Инфраструктура как код в масштабе. Разрабатывайте, внедряйте и поддерживайте паттерны инфраструктуры как кода с использованием Terraform и Kubernetes, которые поддерживают как стандартные коннекторы, так и пользовательские сборки. Обеспечьте инженерам простоту развертывания и уверенность в работе.
Наблюдаемость и реагирование на инциденты. Создавайте и поддерживайте комплексные системы мониторинга, логирования и оповещения. Руководите действиями по реагированию на инциденты, проводите пост-мортемы и добивайтесь постоянного улучшения надежности системы.
Безопасность и соответствие требованиям в движении. Работайте с нашей командой по безопасности, чтобы внедрить безопасность на каждом уровне инфраструктуры сборки. Убедитесь, что мы соответствуем требованиям соответствия в более чем 100 юрисдикциях, не создавая препятствий для разработчиков или клиентов.
Оптимизация производительности и затрат. Постоянно оптимизируйте производительность системы, использование ресурсов и затраты на облачные сервисы. Делайте рекомендации, которые улучшают как надежность, так и экономику единицы продукции.
Автоматизация и операционная эффективность. Выявляйте рутинные ручные операции и систематически устраняйте их. Создавайте инструменты и процессы, которые позволяют командам работать эффективно без увеличения численности персонала.
Надежность платформы и опыт разработчика. Сотрудничайте с командами платформы, чтобы обеспечить устойчивость и наблюдаемость API, MCP и CLI. Предоставляйте обратную связь по инфраструктуре, которая формирует развитие платформы.
Что вы принесете
Опыт SRE уровня Senior: подтвержденный опыт работы на должности инженера по надежности сайта (Site Reliability Engineering), DevOps Engineering или SysOps. Вы создавали и эксплуатировали продакшн-системы в масштабе.
Kubernetes и AWS: глубокий практический опыт эксплуатации Kubernetes в продакшене. Прочные основы AWS в области вычислительных ресурсов, сетей, хранения данных и управляемых сервисов.
Инфраструктура как код: владение Terraform или аналогичными инструментами IaC. Вы пишете код для определения инфраструктуры; вы не нажимаете кнопки в консоли.
CI/CD и автоматизация развертывания: реальный опыт настройки и эксплуатации GitLab, GitHub Actions, Jenkins или аналогичных систем. Вы понимаете стратегии развертывания, механизмы отката и системы безопасности.
Скриптинг и знание систем: сильное владение bash-скриптингом. Уверенность в отладке системных проблем, чтении логов и понимании основ ядра Linux.
Отличные коммуникативные навыки: вы четко объясняете сложные инфраструктурные решения как инженерам, так и нетехническим заинтересованным сторонам. Вы пишете понятные руководства и документацию.
Приветствуется:
Опыт работы с 1+ языком программирования бэкенда (Elixir, Python, Go, Java, Node.js и т.д.).
Опыт работы в консалтинге.
Реестры контейнеров и управление артефактами (ECR, Docker Hub и т.д.).
Глубокое знание стека наблюдаемости (Datadog, Prometheus, ELK, Grafana или аналогичных).
Опыт работы с многопользовательскими платформами или их масштабирования.
Практические моменты
Вы будете подчиняться: Engineering Manager
Команда: Engineering
Местоположение: В любой точке мира
Командировки: Около 10% командировок для взаимодействия с клиентами
Дата начала: Как можно скорее
Преимущества
Работайте из любой точки мира
Гибкий оплачиваемый отпуск
Гибкий график работы (асинхронный)
16 недель оплачиваемого отпуска по уходу за ребенком
Услуги поддержки психического здоровья
Опционы на акции
Бюджет на обучение
Бюджет на домашний офис и ИТ-оборудование
Бюджет на локальные очные социальные мероприятия или коворкинги