Ozon

Data Scientist, Базовые модели и инструменты

Не указана
  • Москва
  • От 1 года до 3 лет
  • IT
  • торговая площадка
  • Python

Привет! Это команда Базовые модели и инструменты.

Наша команда создаёт ядро системы модерации контента. Мы разрабатываем и оптимизируем высоконагруженные модели компьютерного зрения и обработки речи/текста (OCR, ASR, TTS), которые становятся «глазами и ушами» всей платформы. Результаты нашей работы напрямую влияют на скорость, точность и стоимость модерации миллионов единиц контента ежедневно.

Параллельно мы строим внутренние ML-инструменты на базе LLM, автоматизированных пайплайнов и self-service интерфейсов. Они позволяют сократить количество рутинных задач у DS-специалистов и продуктовых команд.

Ищем Data Scientist , который готов проектировать production-архитектуру сервисов под высокие нагрузки, адаптировать SOTA-модели к реальным ограничениям и влиять на техническую стратегию команды.

Вы будете

  • Проектировать, обучать и выводить в production модели NLP/CV.
  • Участвовать в перестройке архитектуры модерации: выделять общие backbone, разрабатывать adapters под конкретные домены и задачи.
  • Оптимизировать модели под high-load: квантизация, ONNX/TensorRT, batching, динамический routing,
  • Разрабатывать внутренние ML-инструменты и пайплайны: автоматический запуск переобучения, валидация, мониторинг дрейфа, self-service для смежных команд.
  • Проводить code review, выстраивать стандарты качества кода и документации.

Нам важно

  • Опыт работы с NLP/СV от 2 лет.
  • Опыт создания решений для реалтайм оценки ML-моделей.
  • Способность строить процессы, а не только запускать отдельные эксперименты.
  • Умение соблюдать баланс между строгостью оценки и скоростью доставки решений в продакшен.
  • Умение обосновывать решения на основе данных.
  • Умение объяснять сложные метрики простым языком.