Фокскод

Руководитель отдела инфраструктуры

Не указана
  • Санкт-Петербург
  • Более 6 лет
  • bare-metal
  • Linux
  • Proxmox
  • KVM
  • VMware
  • PostgreSQL
  • RabbitMQ
  • Prometheus
  • Grafana
  • Ansible
  • Terraform
Продуктовая IT-компания. Делаем B2C-сервисы на базе AI, которыми пользуются люди в России, СНГ и за рубежом. Создаем веб-приложения и зарабатываем на подписке.
Ищем сильного инженера с опытом управления небольшой командой, который возьмёт на себя инфраструктуру, надёжность, наблюдаемость и безопасность компании.

Это роль играющего тренера: около 60–70% времени предстоит работать руками, остальное — управлять командой из 2–3 человек, планировать развитие инфраструктуры и взаимодействовать с бизнесом. Подчинение напрямую генеральному директору, ключевой партнёр — CTO.
Задачи:
  • Обеспечивать стабильность bare-metal серверов, виртуализации, сетей, PostgreSQL, RabbitMQ и S3-хранилищ.
  • Развивать мониторинг, логирование, трейсинг, алертинг и on-call.
  • Управлять инцидентами, проводить постмортемы и учения по восстановлению.
  • Отвечать за бэкапы, репликацию, DR-планы и регулярную проверку восстановления.
  • Управлять доступами, секретами, VPN, патчами и инфраструктурной безопасностью.
  • Автоматизировать инфраструктуру с помощью Ansible, Terraform и скриптов.
  • Поддерживать GitLab, CI-раннеры, SSO, wiki и другие внутренние сервисы.
  • Планировать мощности, бюджет и работу с провайдерами и подрядчиками.
  • Руководить небольшой командой: ставить задачи, развивать сотрудников и не становиться единственной точкой отказа.
  • Формировать требования к эксплуатации сервисов и договариваться с разработкой об их реализации.
Что важно:
  • От 6 лет опыта в эксплуатации и инфраструктуре.
  • От 1–2 лет руководства небольшой инженерной командой.
  • Глубокое знание Linux, сетей и диагностики производительности.
  • Практический опыт с bare-metal, RAID, IPMI и виртуализацией — Proxmox, KVM или VMware. Опыт только с облаками не подойдёт.
  • Эксплуатация PostgreSQL: репликация, PITR, Patroni или аналоги, pgBackRest/WAL-G, анализ производительности.
  • Работа с RabbitMQ и S3-совместимыми хранилищами.
  • Prometheus, Grafana, Loki/Alloy или аналогичный стек наблюдаемости.
  • Ansible обязательно, Terraform желательно.
  • Docker и docker compose; понимание, когда Kubernetes действительно нужен.
  • Vault, SSO/LDAP, принцип минимальных привилегий и аудит доступов.
  • Bash и Python или Go.
  • Понимание эксплуатации PHP/Laravel: php-fpm, OPcache, воркеры и типичные узкие места.
  • Способность спокойно действовать во время инцидентов и объяснять технические риски на языке денег и последствий.
Работа с AI
AI-ассистенты — обязательная часть инженерной практики. Ожидаем ежедневное использование Claude Code, Cursor или аналогов для работы с IaC, скриптами, логами, runbook’ами и постмортемами.
Важно уметь внедрять AI-сценарии в процессы команды, критически проверять результат и понимать ограничения безопасности: какие данные можно передавать моделям и какой доступ допустимо давать агентам.

Будет плюсом:
  • Опыт аудитов ИБ, PCI DSS, требований ЦБ, ФСТЭК и 152-ФЗ.
  • Работа с SIEM, IDS и WAF.
  • Миграция между дата-центрами без простоя.
  • FinOps и оптимизация инфраструктурных расходов.
Мы предлагаем:
  • Оклад и квартальная премия, детальнее обсуждаем на собеседовании
  • Самописная аналитическая система в реальном времени — все показатели по всем кампаниям, без выгрузок и ожидания отчётов
  • Доступ к корпоративному Claude и другим ИИ-ассистентам — без лимитов и заявок
  • Предоставляем сервисы, необходимые для работы — аналитика, парсеры, подписки, доступы к профильным платформам
  • Быстрые согласования гипотез и большой простор для тестирования — идея проверяется, а не защищается месяцами
  • ДМС — после года сотрудничества
  • Оплачиваемый отгул — 28 дней в год
  • Day-off — 1 день в месяц без отработки
  • Команда ~ 35 человек, полностью распределённая — работаем на результат, а не на присутствие в календаре