Engineering Team Lead - Email Security
CloudLinux ищет инженера, который возглавит команду, разрабатывающую и управляющую этим продуктом. Вы будете руководить небольшой, состоящей из опытных специалистов, полностью удаленной командой (в настоящее время 7–8 человек: инженеры Go и Python, инженер по доставляемости, инженер по борьбе со спамом и специалист по анализу/аннотированию данных) и будете нести ответственность за то, что выпускает команда, насколько надежно работает продукт и как растут сотрудники.
Это практическая руководящая роль, а не чисто управленческая. Ожидается примерно 60% руководства (поставка, техническое направление, обучение, управление инцидентами) и 40% практической инженерной работы (обзоры дизайна, обзоры кода, исследования, отладка продакшена). Вы не обязаны быть лучшим индивидуальным участником команды — вы должны уметь разбираться в каждой части системы и иметь обоснованное техническое мнение о ней.
Вам не нужно быть экспертом по электронной почте. Если вы руководили инженерами в смежной технической области — инфраструктуре, сетях, безопасности, обмене сообщениями, борьбе со злоупотреблениями — и у вас есть опыт быстрого погружения в сложный технический материал, мы научим вас аспектам работы с электронной почтой.
Система, которую вы унаследуете
- Входящая фильтрация: движок на базе Rspamd с обученной моделью/ML-моделью, выпускаемый в рамках регулярного цикла переобучения и измеряемый по уровню обнаружения спама и частоте ложных срабатываний.
- Исходящий шлюз: SMTP-реле на базе Halon с настройками для каждого домена (warm-up ladders), ограничением скорости, карантином, обработкой обратной связи (ARF) и клиентским порталом — сервисы Go на bare metal.
- Интеграции с панелями управления: cPanel/WHM, Plesk, DirectAdmin, а также развертывания Debian/Postfix для крупных хостинг-партнеров.
- Плоскость данных: Elasticsearch, Redis, дашборды Grafana и оповещения, конвейеры корпусов и аннотаций для обучения моделей.
- Доставка: GitLab, Jenkins, Jira, еженедельный цикл выпуска, post-mortem без обвинений в течение 24 часов.
Что будет в вашей зоне ответственности
Поставка:
- Преобразование бэклога продукта в надежный, последовательный инженерный план — оценки, зависимости и график выпуска, которого придерживается команда.
- Управление еженедельным процессом команды: планирование, готовность к выпуску, отчетность о статусе с реальными цифрами, а не прилагательными.
- Управление качественными показателями выпуска моделей: ни одна модель обнаружения не выпускается без измеренных изменений уровня обнаружения и ложных срабатываний по сравнению с предыдущей моделью, а также без пути отката.
- Обеспечение видимости технического долга и его финансирования — включение его в дорожную карту, а не молчаливое поглощение.
- Еженедельная отчетность о статусе поставки и рисках руководству отдела разработки; каждый пункт имеет владельца и срок выполнения.
Техническое направление:
- Управление архитектурой стека электронной почты совместно с архитектурной группой: обзор дизайнов, написание и утверждение ADR, принятие решений о покупке или разработке с явным указанием компромиссов.
- Обзор кода и дизайнов на критическом пути — потоки почты, ограничение скорости, карантин, аутентификация — и установка стандартов для тестов, наблюдаемости и безопасного развертывания.
- Ответственность за работоспособность продакшена: SLO, оповещения, мощности и состояние доставляемости нашей исходящей инфраструктуры (репутация IP-адресов, SPF/DKIM/DMARC, rDNS, списки RBL).
- Действие в качестве руководителя инцидентов при событиях, влияющих на продукт: координация мер по устранению последствий между командами, информирование партнеров и подготовка post-mortem в течение 24 часов с указанием имен владельцев и дат.
Люди:
- Руководство распределенной командой по всему миру: 1:1, постановка целей, оценка производительности и развитие карьеры.
- Наем: определение профиля, проведение технических собеседований, адаптация и наставничество инженеров.
- Установление рабочих соглашений, которые делают асинхронную работу эффективной — письменные решения, коммуникация по умолчанию публичная, долговечные артефакты вместо встреч.
Инженерия с поддержкой ИИ:
- Мы оцениваем инженеров отчасти по тому, насколько эффективно они работают с кодирующими агентами. Как руководитель, вы должны демонстрировать и обучать этому: точность запросов, качество обзора сгенерированного агентом кода, осведомленность о границах инструментов, предоставление контекста, эффективность итераций, восстановление после ошибок и выполнение сквозных задач.
Работа с владельцем продукта:
- Владелец продукта устанавливает приоритеты, отвечает за обязательства перед партнерами и повествование о дорожной карте. Вы отвечаете за план их реализации и связанные с этим технические риски. Раннее и письменное эскалирование конфликтов объема работ и мощностей с предоставлением как минимум двух вариантов смягчения.
Первые 90 дней:
- 30 дней: Возьмите на себя ответственность за график выпуска и еженедельный статус; будьте способны отследить входящее и исходящее сообщение сквозным образом через стек; проведите 1:1 со всеми членами команды и подготовьте письменный отчет о сильных сторонах и пробелах команды.
- 60 дней: Возьмите на себя ответственность за дежурства и управление инцидентами для продуктовой линейки; опубликуйте текущие SLO и три основных риска надежности с планами их устранения; самостоятельно внесите как минимум одно нетривиальное изменение.
- 90 дней: Представьте техническую дорожную карту для стека электронной почты, согласованную с владельцем продукта и архитектурной группой, включая пункт о сокращении технического долга и рекомендацию по штатному расписанию.
Требования
Обязательно:
- 5+ лет опыта работы в качестве инженера-программиста, из них 2+ года руководства командой инженеров (team lead, tech lead с управлением людьми или engineering manager) в продуктовой компании.
- Хороший практический опыт работы с Linux; умение читать и рецензировать продакшн-код на Go и/или Python, а также отлаживать живые системы.
- Опыт выпуска и эксплуатации распределенных бэкенд-сервисов под реальной нагрузкой — вы несли ответственность за дежурства (pager) и участвовали в устранении инцидентов.
- Опыт быстрого освоения сложной технической области и принятия в ней обоснованных архитектурных решений.
- Практическое владение инструментами наблюдаемости и данными для самостоятельной оценки качества, а не через отчеты (Grafana, Kibana/Elasticsearch, Redash или аналоги).
- Демонстрируемые навыки управления людьми: 1:1, оценка производительности, найм и развитие инженеров.
- Опыт работы в среде разработки с использованием ИИ-ассистентов или явное желание руководить такой средой.
- Профессиональное владение английским языком, письменным и устным.
- Готовность работать в европейском часовом поясе.
Желательно:
- Рабочее знание инфраструктуры электронной почты: SMTP, SPF/DKIM/DMARC, rDNS, репутация IP-адресов и warm-up, RBL, обратная связь.
- Опыт работы с почтовыми стеками с открытым исходным кодом — Rspamd, SpamAssassin, Postfix, Exim, Halon — или экосистемой веб-хостинга (cPanel/WHM и другие панели управления).
- Опыт работы с жизненным циклом ML-моделей: качество обучающих данных, метрики оценки и компромиссы при настройке систем обнаружения.
- Опыт управления инцидентами и эскалацией с внешними партнерами.
Преимущества
- Фокус на профессиональном развитии
- Интересные и сложные проекты
- Полностью удаленная работа с гибким графиком — планируйте свой день и работайте из любой точки мира
- Оплачиваемый отпуск 24 дня в году, 10 национальных праздников и неограниченный больничный
- Компенсация частной медицинской страховки
- Компенсация коворкинга и спортзала/спортивных мероприятий
- Бюджет на обучение
- Возможность получить вознаграждение за самую инновационную идею, которую компания может запатентовать