Ищем инженера, который будет отвечать за инфраструктуру хранения данных, виртуализацию, Linux и сети MLOps-платформы.
Основной фокус роли - Ceph, Proxmox, Linux и сети. Около 30% задач будут связаны с Kubernetes и DevOps.
Обязанности:
- Развивать и сопровождать Ceph: OSD, PG, CRUSH, RBD, RGW/S3, Erasure Coding.
- Заниматься балансировкой, производительностью и планированием ёмкости Ceph.
- Диагностировать проблемы с дисками, сетью, восстановлением и распределением данных.
- Развивать кластеры Proxmox/KVM и инфраструктуру виртуализации.
- Работать с физическими серверами, SSD/NVMe, файловыми системами и блочными устройствами.
- Развивать и диагностировать сети: VLAN, bonding, маршрутизация, MTU, 10/25/100 GbE.
- Диагностировать и оптимизировать производительность Linux, сети и дисковой подсистемы.
- Планировать обновления и миграции с учётом отказоустойчивости и возможности отката.
- Автоматизировать типовые инфраструктурные операции.
- Участвовать в эксплуатации Kubernetes и подхватывать DevOps-задачи команды.
- Сильные знания Linux и опыт эксплуатации производственной инфраструктуры.
- Практический опыт эксплуатации Ceph.
- Хорошее понимание архитектуры Ceph: OSD, PG, CRUSH, MON, MGR.
- Опыт работы с RBD и RGW/S3.
- Опыт эксплуатации Ceph Erasure Coding.
- Опыт работы с Proxmox VE/KVM и кластерами Proxmox.
- Хорошее понимание блочных устройств, файловых систем, SSD/NVMe.
- Хорошее понимание TCP/IP, VLAN, bonding, MTU и маршрутизации.
- Опыт диагностики производительности Linux, сети и хранилищ.
- Практический опыт работы с Kubernetes.
- Опыт автоматизации инфраструктуры с Ansible.
- Умение работать с мониторингом инфраструктуры и метриками Prometheus/Grafana.
Будет плюсом:
- Опыт эксплуатации сетей 25/40/100 GbE.
- Опыт с Terraform.
- Опыт работы с Cilium.
- Опыт эксплуатации GPU-серверов.
- Опыт глубокой оптимизации Linux, сетевой и дисковой подсистем.
- Опыт построения резервного копирования и аварийного восстановлени.
- Опыт работы с инфраструктурой для Spark, Data Platform или ML Platform.
Что важно для нас:
Ищем не только администратора Ceph и не только Kubernetes/DevOps-инженера. Нужен специалист, способный видеть инфраструктуру целиком:
серверы -> сеть -> Linux -> виртуализация -> хранилище -> Kubernetes
и самостоятельно находить причины сложных инфраструктурных проблем, оценивать риски и предлагать надёжные решения.
Условия:- Команду инженеров, которые умеют решать сложные задачи и делиться опытом.
- Официальное трудоустройство в соответствии с ТК РФ в аккредитованную IT-компанию.
- ДМС и страхование от несчастных случаев с первой рабочей недели, оплату больничных за первые 10 дней до 100% от оклада.
- Гибкий формат работы: Удаленная работа по РФ, либо гибридный формат работы в самом центре Москвы, в офисе по ул. Мясницкая, 16.
- Современная техника для работы (Macbook, мониторы, и все что вам нужно для комфортной работы.
- Возможность поработать в атмосфере небольшой уютной дружной компании, где все решается быстро, в дружеской обстановке и без бюрократии.
- Ежегодные корпоративы с компенсацией дороги и проживания.
- Конкурентную зарплату по результатам собеседования.