Фокскод
Руководитель отдела инфраструктуры
Не указана
- bare-metal
- Linux
- Proxmox
- KVM
- VMware
- PostgreSQL
- RabbitMQ
- Prometheus
- Grafana
- Ansible
- Terraform
Продуктовая IT-компания. Делаем B2C-сервисы на базе AI, которыми пользуются люди в России, СНГ и за рубежом. Создаем веб-приложения и зарабатываем на подписке.
Ищем сильного инженера с опытом управления небольшой командой, который возьмёт на себя инфраструктуру, надёжность, наблюдаемость и безопасность компании.
Это роль играющего тренера: около 60–70% времени предстоит работать руками, остальное — управлять командой из 2–3 человек, планировать развитие инфраструктуры и взаимодействовать с бизнесом. Подчинение напрямую генеральному директору, ключевой партнёр — CTO.
Задачи:
- Обеспечивать стабильность bare-metal серверов, виртуализации, сетей, PostgreSQL, RabbitMQ и S3-хранилищ.
- Развивать мониторинг, логирование, трейсинг, алертинг и on-call.
- Управлять инцидентами, проводить постмортемы и учения по восстановлению.
- Отвечать за бэкапы, репликацию, DR-планы и регулярную проверку восстановления.
- Управлять доступами, секретами, VPN, патчами и инфраструктурной безопасностью.
- Автоматизировать инфраструктуру с помощью Ansible, Terraform и скриптов.
- Поддерживать GitLab, CI-раннеры, SSO, wiki и другие внутренние сервисы.
- Планировать мощности, бюджет и работу с провайдерами и подрядчиками.
- Руководить небольшой командой: ставить задачи, развивать сотрудников и не становиться единственной точкой отказа.
- Формировать требования к эксплуатации сервисов и договариваться с разработкой об их реализации.
Что важно:
- От 6 лет опыта в эксплуатации и инфраструктуре.
- От 1–2 лет руководства небольшой инженерной командой.
- Глубокое знание Linux, сетей и диагностики производительности.
- Практический опыт с bare-metal, RAID, IPMI и виртуализацией — Proxmox, KVM или VMware. Опыт только с облаками не подойдёт.
- Эксплуатация PostgreSQL: репликация, PITR, Patroni или аналоги, pgBackRest/WAL-G, анализ производительности.
- Работа с RabbitMQ и S3-совместимыми хранилищами.
- Prometheus, Grafana, Loki/Alloy или аналогичный стек наблюдаемости.
- Ansible обязательно, Terraform желательно.
- Docker и docker compose; понимание, когда Kubernetes действительно нужен.
- Vault, SSO/LDAP, принцип минимальных привилегий и аудит доступов.
- Bash и Python или Go.
- Понимание эксплуатации PHP/Laravel: php-fpm, OPcache, воркеры и типичные узкие места.
- Способность спокойно действовать во время инцидентов и объяснять технические риски на языке денег и последствий.
Работа с AI
AI-ассистенты — обязательная часть инженерной практики. Ожидаем ежедневное использование Claude Code, Cursor или аналогов для работы с IaC, скриптами, логами, runbook’ами и постмортемами.
Важно уметь внедрять AI-сценарии в процессы команды, критически проверять результат и понимать ограничения безопасности: какие данные можно передавать моделям и какой доступ допустимо давать агентам.
Будет плюсом:
- Опыт аудитов ИБ, PCI DSS, требований ЦБ, ФСТЭК и 152-ФЗ.
- Работа с SIEM, IDS и WAF.
- Миграция между дата-центрами без простоя.
- FinOps и оптимизация инфраструктурных расходов.
Мы предлагаем:
- Оклад и квартальная премия, детальнее обсуждаем на собеседовании
- Самописная аналитическая система в реальном времени — все показатели по всем кампаниям, без выгрузок и ожидания отчётов
- Доступ к корпоративному Claude и другим ИИ-ассистентам — без лимитов и заявок
- Предоставляем сервисы, необходимые для работы — аналитика, парсеры, подписки, доступы к профильным платформам
- Быстрые согласования гипотез и большой простор для тестирования — идея проверяется, а не защищается месяцами
- ДМС — после года сотрудничества
- Оплачиваемый отгул — 28 дней в год
- Day-off — 1 день в месяц без отработки
- Команда ~ 35 человек, полностью распределённая — работаем на результат, а не на присутствие в календаре