ICON GROUP

Технический руководитель проектов | Технический инженер проектов (GPU-кластеры)

Не указана
  • Москва
  • Более 6 лет
  • Техническая документация
  • Деловая коммуникация
  • GPU
  • DELL
  • NVIDIA
  • InfiniBand
  • NVLink
  • RoCE
  • Английский — B2 — Средне-продвинутый

ICON GROUP — надёжный партнёр в области IT и Telecom с более чем 17-летним опытом работы на рынке.

Чем занимаемся:

Подбираем и поставляем высокотехнологичное оборудование ведущих иностранных вендоров на российский рынок;

  • Оказываем сервис по технической поддержке IT и телекоммуникационного оборудования, выполняем ремонт IT-оборудования различной сложности;
  • Проектируем инфраструктуру для наших клиентов;
  • Выполняем строительно-монтажные и пуско-наладочные работы IT- и телеком-инфраструктуры для наших клиентов.

Создаём открытую атмосферу, в которой поощряется инициатива и амбициозность. Это позволяет нам быстро и эффективно решать задачи без лишней бюрократии.

Ищем технического инженера проектов в департамент AI-инфраструктуры — человека, который одинаково уверенно чувствует себя и в технике, и в управлении проектами.

Мы строим и обслуживаем GPU-кластеры класса HGX (H200, B200, B300 и другие топовые платформы) для крупных заказчиков, и нам нужен человек, который сможет вести эти проекты.

Наша команда — сертифицированные и опытные в AI-инфраструктуре инженеры и руководители, готовые делиться опытом. Очень дружный коллектив.


Чем предстоит заниматься:

- Технически вести зарубежные проекты по строительству GPU-кластеров (HGX B200/B300 и новее, масштаб — десятки узлов) в ЦОД партнёров, от проектирования до сдачи;
- Представлять техническую сторону заказчика перед иностранными партнёрами: проверять проектные документы, SOW и спецификации, давать комментарии, отстаивать требования;
-Участвовать в проработке решения совместно с нашими специалистами: состав узлов, сеть кластера (InfiniBand / RoCE, OOB, storage-сеть) выбор СХД под AI-нагрузки питание и охлаждение (высокоплотные стойки 50+ кВт, RDHx / жидкостное охлаждение) раскладка стоек в зале;
- Контролировать подготовку площадки ЦОД партнёрами и ЦОД: питание, охлаждение, стойки, кабельная инфраструктура;
- Организовывать и контролировать запуск кластера: монтаж, bring-up, обновление прошивок, ПНР, нагрузочные и приёмочные тесты
- Проводить регулярные переговоры на английском языке с партнерами;
- Вести задачи в трекере проекта, контролировать сроки, докладывать статус.


Что нам важно:


- Понимание AI-железа класса HGX: серверы, GPU (H200/B200/B300 и аналоги), сетевая инфраструктура кластеров (InfiniBand/NVLink/RoCE и т.п.) — на уровне «могу разобраться в спецификации и объяснить заказчику, что мы ставим и зачем»;
- Опыт работы с серверным/сетевым оборудованием, дата-центрами или HPC, NVIDIA/Dell/Supermicro/GIGABYTE и аналог;
- Сильные организационные качества: умение вести несколько проектов одновременно, не терять сроки, доводить дело до конца;
- Управленческие амбиции — готовность и желание расти в руководителя, а не просто исполнять задачи;
- Ответственность и самостоятельность: с вами можно оставить проект и не переживать;
- Готовность учиться и проходить сертификацию у мировых производителей;
- Английский на уровне понимания речи и ведение переговоров;
- Техническое или инженерное образование приветствуется, но важнее реальное понимание техники.

Идеально, если вы — инженер, который уже готов или хочет вырасти в руководителя.


Что мы предлагаем:


- Участие в самых передовых проектах в области AI-инфраструктуры — кластеры на топовом оборудовании, интересные и нетривиальные задачи;
- Очень дружный коллектив профессионалов в области AI-инфраструктуры;
- Сертификация у мировых производителей за счёт компании;
- Реальную возможность карьерного роста до руководящей позиции;
- Точный размер оклада обсуждается по итогам собеседования.