Удаленно
Мы создаем и эксплуатируем вычислительную инфраструктуру, на которой работают наши исследователи, поддерживая крупномасштабную обработку исторических рыночных данных и обучение моделей на нашем собственном оборудовании в нескольких дата-центрах. Наша среда включает bare-metal Linux, виртуализацию, хранилища данных и GPU-кластеры, где производительность, надежность и предсказуемое поведение системы имеют решающее значение.
Наша команда инфраструктуры занимается мониторингом и автоматизацией, распределенными хранилищами данных, предоставлением оборудования и ОС, GPU-кластерами и планированием рабочих нагрузок, высокоскоростными сетями, поддержкой L2/L3 Linux и инжинирингом безопасности. Инженеры здесь полностью отвечают за свои задачи, поэтому есть возможность углубиться в свою область и освоить новые для себя части.
Мы ищем Linux Infrastructure Engineer, который сможет работать с серверными и кластерными средами, от развертывания и настройки до оптимизации производительности, устранения неполадок и постоянного совершенствования.
Что вы будете делать:
- Развертывать, настраивать и поддерживать bare-metal серверы на базе Linux в наших дата-центрах
- Создавать и эксплуатировать кластерные среды, включая виртуализацию, хранилища данных, GPU-вычисления и кластеры баз данных
- Устранять сложные проблемы, связанные с Linux, оборудованием, сетями и кластерами
- Оптимизировать производительность для пропускной способности, задержки, стабильности и использования ресурсов
- Мониторить состояние и производительность инфраструктуры, выявлять узкие места и предотвращать повторные проблемы
- Поддерживать полный жизненный цикл серверов: предоставление ресурсов, настройка, обновления и обслуживание
- Повышать надежность и предсказуемость во время сбоев, обслуживания и масштабирования
- Автоматизировать задачи предоставления ресурсов, настройки и операционные задачи, в основном с использованием Ansible и скриптов
Что мы ищем в вас:
- Значительный опыт администрирования и устранения неполадок в Linux
- Опыт работы с локальной (on-premise), bare-metal инфраструктурой в производственной среде
- Хорошее понимание производительности Linux и анализа узких мест
- Опыт в:
- мониторинге инфраструктуры и устранении производственных проблем,
- предоставлении ресурсов, настройке и управлении жизненным циклом серверов,
- автоматизации инфраструктуры, желательно с использованием Ansible
Желательно:
- Опыт работы с оборудованием и управлением его жизненным циклом: BMC/IPMI, прошивки, настройка BIOS и автоматизированное предоставление ОС (PXE/netboot)
- Опыт работы с кластерами виртуализации, включая live migration и HA
- Опыт работы с распределенными хранилищами данных, включая репликацию, ребалансировку и восстановление после сбоев дисков и узлов
Почему стоит присоединиться к нашей команде?
- Интересные задачи с множеством возможностей проявить себя
- Дружелюбная команда высококвалифицированных международных специалистов
- Современное оборудование и технологии
- Удаленная работа из любой точки мира
- Доступ в любой из наших глобальных офисов в любое время
- Гибкий график
- 40 оплачиваемых дней отпуска
- Конкурентная заработная плата