Старший DevOps инженер - Удаленно
Мы ищем Старшего DevOps инженера в нашу команду для удаленной работы. Эта роль идеально подходит для опытного профессионала, увлеченного созданием надежных платформ для обеспечения качества, надежности и автоматизации. Вы будете играть ключевую роль в проектировании, создании, тестировании и поддержке инфраструктуры, CI/CD и платформ самообслуживания, которые делают выпуск продуктов и управление средами предсказуемыми и обратимыми.
Ключевые обязанности
- Обеспечение и улучшение наблюдаемости критически важных торговых путей посредством централизованного логирования, метрик, трассировки, оповещений и руководств для сокращения среднего времени обнаружения и восстановления.
- Создание документации и ресурсов для обеспечения эффективного использования инженерными командами инструментов платформы.
- Тесное сотрудничество с техническим руководством для планирования и приоритизации инициатив по надежности платформы и улучшению опыта разработчиков.
- Партнерство с Core и Ops командами по вопросам готовности к производству, включая мощности, отказоустойчивость, соответствие сред и безопасные рабочие процессы.
- Разработка надежной практики непрерывной поставки в команде, приоритизируя циклы быстрой обратной связи без увеличения риска для текущей торговли.
- Руководство техническими проектами, включая архитектурные и проектные решения, проверку кода/парное программирование и наставничество менее опытных инженеров.
- Оказание помощи в практической реализации и поддержке в стиле стажировки при развертывании изменений платформы в различных командах.
Требования / Навыки
Вы должны иметь более 5 лет опыта в разработке программного обеспечения, в том числе на позиции инженера по надежности сайтов (SRE) или DevOps, с сильным акцентом на наблюдаемость и надежность производства. Отличные коммуникативные навыки — письменные и устные — имеют решающее значение, поскольку вам нужно будет четко представлять идеи и влиять на технические и нетехнические заинтересованные стороны.
- Глубокая экспертиза в практиках наблюдаемости, включая централизованное логирование, распределенную трассировку и сбор метрик — предпочтительно Datadog, или знакомство с Prometheus, Grafana, OpenTelemetry, ELK и аналогичными стеками.
- Практический опыт проектирования, внедрения и поддержки конвейеров логирования и стратегий мониторинга для надежных, масштабируемых, безопасных систем.
- Владение инструментами Infrastructure as Code и автоматизации, такими как Terraform, CloudFormation или CDK.
- Подтвержденный опыт проектирования и управления облачными приложениями и сервисами на AWS.
- Глубокое понимание практик DevOps, автоматизации, оркестрации, контейнеров и бессерверных архитектур.
- Опыт поддержки производственных сервисов Java / JVM является большим плюсом.
- Знакомство с практиками непрерывной поставки, включая CI, автоматизацию тестирования и безопасные стратегии развертывания.
- Комфортная работа с распределенными, глобальными командами и асинхронное взаимодействие.
- Умение быстро принимать качественные решения в быстро меняющихся условиях, с ориентацией на действие и ответственность.
Если вы привержены непрерывному обучению, особенно в области наблюдаемости, инженерии надежности и опыта разработчиков, мы будем рады услышать от вас.