Наша команда предоставляет и развивает платформенные сервисы группы компаний YADRO и отвечает за организацию процесса разработки и поставки ПО. Мы развиваем сервисы внутреннего enterprise cloud: виртуальные ресурсы, хранилища данных, инструменты автоматизации (Jenkins), хранилища конфиденциальных данных и другие. Пользователи наших сервисов — прежде всего DevOps-инженеры, которые строят CI/CD для своих команд, а также все участники RnD-цикла: разработчики, QA- и ML-инженеры, которым мы помогаем выпускать продукты стабильно и без лишней рутины.
Обязанности:
- Организация CI/CD для внутренней разработки OpenStack: проектирование сборочных конвейеров в Jenkins; автоматизация сборки, тестирования и публикации артефактов на Python/Go; взаимодействие с командами разработки и эксплуатации для интеграции сборки OpenStack в общие CI/CD-процессы департамента.
- Исследование, проектирование и внедрение единой схемы доставки приложений в k8s через ArgoCD с использованием подхода GitOps и Apps of Apps.
- Участие в составе команды в разработке, администрировании и развитии внутренних платформенных сервисов компании (PaaS, 3000+ пользователей), таких как хранилище артефактов, объектное хранилище, хранилище секретов, платформы автоматизации: автоматизация разворачивания, настройка мониторинга, обеспечение отказоустойчивости, развитие self-service, взаимодействие с пользователями.
Требования:
- Опыт работы в области DevOps / Platform Engineering от 4 лет;
- Опыт разработки и сопровождения CI/CD-конвейеров (предпочтительнее Jenkins)
- Практический опыт работы с Docker, Kubernetes;
- Опыт работы с доставкой приложений в k8s с помощью ArgoCD (или аналогами);
- Умение разрабатывать и администрировать инфраструктурные сервисы (PaaS, SaaS);
- Базовый опыт администрирования и настройки Linux.
Дополнительно приветствуем:
- Опыт разработки промышленного ПО на языках Python или Go;
- Опыт настройки мониторинга (Prometheus/VictoriaMetrics, Grafana);
- Опыт настройки приложений под высокие нагрузки;
- Знание концептов Infrastructure-as-Code, Observability, Fault Tolerance, High availability и умение строить системы с такими характеристиками.