MEDvidi — это платформа для оказания помощи в области психического здоровья с использованием ИИ, устанавливающая новый стандарт безопасной, эффективной и масштабируемой психиатрической помощи в Соединенных Штатах.
Мы объединяем лицензированных специалистов с проприетарными инструментами ИИ для обеспечения последовательного, ориентированного на результат лечения таких состояний, как СДВГ, тревожность, депрессия и других. Технология MEDvidi автоматизирует ведение документации, последующее наблюдение и планирование лечения, позволяя специалистам сосредоточиться на уходе за пациентами, повышая при этом эффективность и клиническое качество.
В качестве Staff DevOps Engineer вы будете определять дальнейшее развитие нашей инфраструктуры и направлять туда остальную часть инженерного отдела. Это чисто практическая роль: вы устанавливаете техническое направление, внедряете его своими руками и несете ответственность за надежность, затраты, безопасность и опыт разработчиков во всей компании. Вы будете напрямую сотрудничать с нашими командами продуктовых инженеров, будучи вовлеченными в то, что они создают, устраняя инфраструктурные препятствия и формируя инфраструктуру в соответствии с реальными потребностями продукта.
Почему эта роль
- Реальная ответственность, от начала до конца. Вы несете ответственность за результаты, а не за задачи, включая ваши метрики. Надежность, затраты, производительность, состояние развертывания и скорость разработки — всё это принадлежит вам: вы устанавливаете цели и проактивно предоставляете цифры.
- Техническое лидерство без управленческих накладных расходов. Лидируйте благодаря опыту и инициативе, где самые старшие инженеры также являются теми, кто работает с кодом. Вы устанавливаете направление и повышаете планку, оставаясь в команде.
- ИИ-нативность по умолчанию. Агентный ИИ является первоклассной частью нашей работы. Вы будете делегировать задачи автономным агентам, интегрировать их результаты в производственные изменения и помогать формировать то, как вся организация работает с ИИ.
Обязанности:
- Проактивно устанавливайте и управляйте техническим видением и квартальным планом развития нашей инфраструктуры, с четким определением компромиссов и измеримых целей.
- Управляйте и развивайте нашу инфраструктуру AWS + Kubernetes (EKS): управление кластерами, автомасштабирование (Karpenter), обеспечение соблюдения политик (Kyverno) и операции с нулевым временем простоя.
- Полностью отвечайте за Infrastructure as Code (Terraform, AWS CDK на TypeScript) и наш GitLab CI/CD (повторно используемые/общие шаблоны, OIDC, саморазмещенный GitLab).
- Создавайте и управляйте средствами наблюдения, которые команды действительно используют (Prometheus, Grafana, OpenTelemetry, OpenSearch, CloudWatch; конвейеры журналов, APM) — общим представлением о состоянии системы, а не дашбордом, который никто не открывает.
- Обеспечьте быстрые и предсказуемые сине-зеленые развертывания и автоматический откат с проверкой работоспособности; отвечайте за миграции схемы PostgreSQL с нулевым временем простоя (расширение/сжатие) и проверку миграций в CI.
- Отвечайте за безопасность в среде HIPAA: гигиена секретов (вращение, краткосрочные учетные данные, сканирование на утечки), обработка журналов и данных с учетом PHI, управление Vault как кодом.
- Напрямую сотрудничайте с продуктовыми командами для устранения инфраструктурных препятствий и улучшения опыта разработчиков по дизайну.
- Используйте агентный ИИ как основную часть вашего рабочего процесса, интегрируя выходные данные автономных агентов в производственную среду.
Требования:
- Более 6 лет опыта работы в DevOps/инженерной инфраструктуре, с глубокими фундаментальными знаниями систем и уверенным администрированием и устранением неполадок в Linux (анализ производительности, управление ресурсами, отладка процессов).
- Опыт работы с AWS (EC2, EKS, RDS, ElastiCache, Lambda, SQS, EventBridge, API Gateway, ALB, S3) и производственными Kubernetes/EKS (управление кластерами, масштабирование узлов, обеспечение соблюдения политик; Karpenter, Kyverno или аналогичные).
- Глубокие знания Infrastructure as Code (Terraform и AWS CDK на TypeScript) и владение CI/CD (GitLab CI/CD: повторно используемые/общие шаблоны, OIDC id_tokens, саморазмещенный GitLab).
- Мониторинг и средства наблюдения на практике (Prometheus, Grafana, OpenTelemetry, OpenSearch, CloudWatch; передача журналов и отслеживание ошибок/APM).
- Практическая инженерная безопасность (вращение секретов, краткосрочные учетные данные, сканирование на утечки, журналирование с учетом PHI) и HashiCorp Vault как код (KV, аутентификация JWT/OIDC для CI, дизайн политик).
- Сине-зеленые развертывания с автоматическим откатом с проверкой работоспособности; миграции схемы PostgreSQL с нулевым временем простоя (расширение/сжатие) и проверка миграций в CI.
- Контейнеры (Docker, ECR, неизменяемые теги, жизненный цикл образов) и основы сети/протоколов (балансировка нагрузки, TLS, DNS).
- Практический опыт работы с агентными ИИ-рабочими процессами (Claude Code или аналогичные): делегирование задач автономным агентам и интеграция их результатов в производственную среду.
- Ориентация на разработчика, навыки решения сложных системных проблем и сильные навыки технического письма (документация как код, ADR, проектная документация через MR).
- Свободное владение русским и английским языками (B2).
- Опыт эффективной работы в удаленных, распределенных командах.
Будет плюсом:
- Опыт работы в регулируемой среде с высокими требованиями к соответствию (HIPAA, SOC 2 или аналогичные).
- Управление конфигурацией (Ansible) для управления парком виртуальных машин.
- Эксплуатация приложений Node.js (pm2, npm), наш стек — Node.js + TypeScript.
- Инструменты GitOps (ArgoCD, Flux) и более глубокое администрирование баз данных PostgreSQL.
- Сертификаты AWS.
Что мы предлагаем:
- Среда с высоким влиянием: Возможность внести вклад в продуктоориентированную компанию в сфере медицинских технологий.
- Рост и компенсация: Четкие возможности для роста и конкурентоспособный пакет вознаграждений.
- Remote-first: Полностью удаленное долгосрочное сотрудничество по модели B2B.
- Здоровье и благополучие: Медицинская страховка после испытательного срока, а также компенсация расходов на спорт и оздоровление.
- Карьерное развитие: Четкие возможности для роста, включая персонализированные уроки английского языка через Preply.
- Отдых: 19 оплачиваемых дней отпуска ежегодно, 4 дополнительных дня на оздоровление каждый год и оплачиваемый больничный в течение первых 5 рабочих дней.
- Культура: Ценные подарки к ключевым жизненным событиям и офлайн-корпоративные мероприятия.