Финфрейм

Senior Infrastructure & Storage Engineer

Не указана
  • Москва
  • От 3 до 6 лет

Ищем инженера, который будет отвечать за инфраструктуру хранения данных, виртуализацию, Linux и сети MLOps-платформы.

Основной фокус роли - Ceph, Proxmox, Linux и сети. Около 30% задач будут связаны с Kubernetes и DevOps.

Обязанности:

  • Развивать и сопровождать Ceph: OSD, PG, CRUSH, RBD, RGW/S3, Erasure Coding.
  • Заниматься балансировкой, производительностью и планированием ёмкости Ceph.
  • Диагностировать проблемы с дисками, сетью, восстановлением и распределением данных.
  • Развивать кластеры Proxmox/KVM и инфраструктуру виртуализации.
  • Работать с физическими серверами, SSD/NVMe, файловыми системами и блочными устройствами.
  • Развивать и диагностировать сети: VLAN, bonding, маршрутизация, MTU, 10/25/100 GbE.
  • Диагностировать и оптимизировать производительность Linux, сети и дисковой подсистемы.
  • Планировать обновления и миграции с учётом отказоустойчивости и возможности отката.
  • Автоматизировать типовые инфраструктурные операции.
  • Участвовать в эксплуатации Kubernetes и подхватывать DevOps-задачи команды.
Требования:
  • Сильные знания Linux и опыт эксплуатации производственной инфраструктуры.
  • Практический опыт эксплуатации Ceph.
  • Хорошее понимание архитектуры Ceph: OSD, PG, CRUSH, MON, MGR.
  • Опыт работы с RBD и RGW/S3.
  • Опыт эксплуатации Ceph Erasure Coding.
  • Опыт работы с Proxmox VE/KVM и кластерами Proxmox.
  • Хорошее понимание блочных устройств, файловых систем, SSD/NVMe.
  • Хорошее понимание TCP/IP, VLAN, bonding, MTU и маршрутизации.
  • Опыт диагностики производительности Linux, сети и хранилищ.
  • Практический опыт работы с Kubernetes.
  • Опыт автоматизации инфраструктуры с Ansible.
  • Умение работать с мониторингом инфраструктуры и метриками Prometheus/Grafana.

Будет плюсом:

  • Опыт эксплуатации сетей 25/40/100 GbE.
  • Опыт с Terraform.
  • Опыт работы с Cilium.
  • Опыт эксплуатации GPU-серверов.
  • Опыт глубокой оптимизации Linux, сетевой и дисковой подсистем.
  • Опыт построения резервного копирования и аварийного восстановлени.
  • Опыт работы с инфраструктурой для Spark, Data Platform или ML Platform.

Что важно для нас:

Ищем не только администратора Ceph и не только Kubernetes/DevOps-инженера. Нужен специалист, способный видеть инфраструктуру целиком:

серверы -> сеть -> Linux -> виртуализация -> хранилище -> Kubernetes

и самостоятельно находить причины сложных инфраструктурных проблем, оценивать риски и предлагать надёжные решения.

Условия:
  • ​​​​Команду инженеров, которые умеют решать сложные задачи и делиться опытом.
  • Официальное трудоустройство в соответствии с ТК РФ в аккредитованную IT-компанию.
  • ДМС и страхование от несчастных случаев с первой рабочей недели, оплату больничных за первые 10 дней до 100% от оклада.
  • Гибкий формат работы: Удаленная работа по РФ, либо гибридный формат работы в самом центре Москвы, в офисе по ул. Мясницкая, 16.
  • Современная техника для работы (Macbook, мониторы, и все что вам нужно для комфортной работы.
  • Возможность поработать в атмосфере небольшой уютной дружной компании, где все решается быстро, в дружеской обстановке и без бюрократии.
  • Ежегодные корпоративы с компенсацией дороги и проживания.
  • Конкурентную зарплату по результатам собеседования.