Вакансия из официального источника
CUDA-разработчик (инфраструктура и ускорение вычислений) в Автономный транспорт
Яндекс · Москва
Описание вакансии
Наша команда разрабатывает вычислительное ядро для направления автономного транспорта. В рамках проекта требуется эффективная реализация сложных математических алгоритмов и моделей машинного обучения на GPU, поэтому мы в поиске сильного разработчика с глубоким пониманием архитектуры вычислительных систем.
Какие задачи вас ждут
Повышение эффективности алгоритмов
Вам предстоит оптимизировать алгоритмы, учитывая аппаратные особенности платформ, автоматизировать тестирование алгоритмов и их адаптацию к платформе.
Оптимизация инференса ML-моделей
Совместно с МL-командой вы будете ускорять вывод моделей машинного обучения через ONNX за счёт комплексного применения методов квантизации моделей, анализа и оптимизации структуры вычислительных графов и учётом аппаратных возможностей бортовых ускорителей.
Управление загрузкой GPU и инфраструктурой вычислений
Вам предстоит обеспечивать эффективное использование GPU: разрабатывать механизмы планирования вычислений, создавать инфраструктуру для запуска нагрузок и настраивать мониторинг распределения ресурсов.
Больше о бэкенде в Яндексе — в канале Yandex for Backend
Мы ждём, что вы
- Профессионально пишете на CUDA и C++
- Глубоко понимаете модель исполнения GPU и иерархию памяти
- Умеете измерять и объяснять, где теряется производительность
- Способны довести оптимизацию от идеи до измеримого результата
Будет плюсом, если вы
- Работали с TensorRT, Triton, cuDNN или собственными kernel
- Оптимизировали пайплайны обработки облаков точек или изображений
- Знакомы с Python и ML-фреймворками (PyTorch)
Узнать больше
-
Автономный транспорт
-
Офисы в Москве
-
Как в Яндексе проходят алгоритмические секции собеседований
-
Как мы нанимаем бэкенд-разработчиков
-
Задачи для подготовки к собеседованиям
Откликнуться на сайте компании
Источник: официальный сайт Яндекс. Актуальность проверена 14.09.2026 13:31 (Екатеринбург).
