MEDvidi — это платформа для оказания психиатрической помощи на основе ИИ, устанавливающая новый стандарт безопасной, эффективной и масштабируемой психиатрической помощи в Соединенных Штатах.
Мы объединяем лицензированных специалистов с проприетарными инструментами ИИ для обеспечения последовательного, ориентированного на результат лечения таких состояний, как СДВГ, тревожность, депрессия и других. Технология MEDvidi автоматизирует ведение документации, последующее наблюдение и планирование лечения, позволяя специалистам сосредоточиться на уходе за пациентами, одновременно повышая эффективность и клиническое качество.
В качестве нашего Staff DevOps Engineer вы будете определять будущее нашей инфраструктуры и направлять туда остальную часть инженерной команды. Это по-настоящему практическая роль: вы будете устанавливать техническое направление, реализовывать его своими руками и нести ответственность за результаты в области надежности, стоимости, безопасности и опыта разработчиков в масштабах всей компании. Вы будете напрямую сотрудничать с нашими командами продуктовой разработки, встраиваясь в то, что они создают, устраняя инфраструктурные препятствия и формируя инфраструктуру в соответствии с реальными потребностями продукта.
Почему эта роль
- Реальная ответственность, от начала до конца. Вы отвечаете за результаты, а не за задачи, включая ваши метрики. Надежность, стоимость, производительность, состояние развертывания и скорость разработки — всё это ваше: вы устанавливаете цели и проактивно предоставляете данные.
- Техническое лидерство без управленческих издержек. Руководите благодаря экспертизе и инициативе, где самые старшие инженеры также являются теми, кто работает с кодом. Вы задаете направление и повышаете планку, оставаясь вовлеченным в процесс.
- AI-native по умолчанию. Агентный ИИ является первоклассной частью нашей работы. Вы будете делегировать задачи автономным агентам, интегрировать их результаты в производственные изменения и помогать формировать то, как вся организация работает с ИИ.
Обязанности
- Проактивно устанавливать и продвигать техническое видение и квартальный план развития нашей инфраструктуры с четкими компромиссами и измеримыми целями.
- Управлять и развивать нашу инфраструктуру AWS + Kubernetes (EKS): управление кластерами, автомасштабирование (Karpenter), применение политик (Kyverno) и операции с нулевым временем простоя.
- Полностью отвечать за Infrastructure as Code (Terraform, AWS CDK на TypeScript) и наш GitLab CI/CD (переиспользуемые/общие шаблоны, OIDC, саморазмещенный GitLab).
- Создавать и поддерживать системы наблюдаемости, которые реально используют команды (Prometheus, Grafana, OpenTelemetry, OpenSearch, CloudWatch; конвейеры журналов, APM) — общий взгляд на состояние системы, а не дашборд, который никто не открывает.
- Обеспечивать быстроту и надежность развертываний blue-green и автоматического отката с проверкой работоспособности; управлять миграциями схемы PostgreSQL с нулевым временем простоя (расширение/сжатие) и проверками миграций в CI.
- Отвечать за безопасность в среде HIPAA: гигиена секретов (ротация, краткосрочные учетные данные, сканирование на утечки), обработка журналов и данных с учетом PHI и управление Vault как кодом.
- Напрямую сотрудничать с продуктовыми командами для устранения инфраструктурных препятствий и улучшения опыта разработчиков за счет дизайна.
- Использовать агентный ИИ как основную часть рабочего процесса, интегрируя результаты работы автономных агентов в производственную среду.
Требования
- 6+ лет опыта работы в DevOps/инфраструктурной инженерии, с глубокими знаниями систем и солидным опытом администрирования и устранения неполадок в Linux (анализ производительности, управление ресурсами, отладка процессов).
- Практический опыт работы с AWS (EC2, EKS, RDS, ElastiCache, Lambda, SQS, EventBridge, API Gateway, ALB, S3) и производственными Kubernetes/EKS (управление кластером, масштабирование узлов, применение политик; Karpenter, Kyverno или аналогичные).
- Глубокий опыт работы с Infrastructure as Code (Terraform и AWS CDK на TypeScript) и CI/CD (GitLab CI/CD: переиспользуемые/общие шаблоны, OIDC id_tokens, саморазмещенный GitLab).
- Мониторинг и наблюдаемость на практике (Prometheus, Grafana, OpenTelemetry, OpenSearch, CloudWatch; отправка журналов и отслеживание ошибок/APM).
- Практический опыт инженерии безопасности (ротация секретов, краткосрочные учетные данные, сканирование на утечки, журналирование с учетом PHI) и опыт работы с HashiCorp Vault как кодом (KV, аутентификация JWT/OIDC для CI).