Привет! Это команда Базовые модели и инструменты.
Наша команда создаёт ядро системы модерации контента. Мы разрабатываем и оптимизируем высоконагруженные модели компьютерного зрения и обработки речи/текста (OCR, ASR, TTS), которые становятся «глазами и ушами» всей платформы. Результаты нашей работы напрямую влияют на скорость, точность и стоимость модерации миллионов единиц контента ежедневно.
Параллельно мы строим внутренние ML-инструменты на базе LLM, автоматизированных пайплайнов и self-service интерфейсов. Они позволяют сократить количество рутинных задач у DS-специалистов и продуктовых команд.
Ищем Data Scientist , который готов проектировать production-архитектуру сервисов под высокие нагрузки, адаптировать SOTA-модели к реальным ограничениям и влиять на техническую стратегию команды.
Вы будете
- Проектировать, обучать и выводить в production модели NLP/CV.
- Участвовать в перестройке архитектуры модерации: выделять общие backbone, разрабатывать adapters под конкретные домены и задачи.
- Оптимизировать модели под high-load: квантизация, ONNX/TensorRT, batching, динамический routing,
- Разрабатывать внутренние ML-инструменты и пайплайны: автоматический запуск переобучения, валидация, мониторинг дрейфа, self-service для смежных команд.
- Проводить code review, выстраивать стандарты качества кода и документации.
Нам важно
- Опыт работы с NLP/СV от 2 лет.
- Опыт создания решений для реалтайм оценки ML-моделей.
- Способность строить процессы, а не только запускать отдельные эксперименты.
- Умение соблюдать баланс между строгостью оценки и скоростью доставки решений в продакшен.
- Умение обосновывать решения на основе данных.
- Умение объяснять сложные метрики простым языком.