MLOps-инженер
з/п не указана
Обязанности Развернуть и настроить сервер инференса (vLLM, при необходимости SGLang) на GPU-узле; Подобрать режим работы под нагрузку: квантизация, размер батча, длина контекста, распределение моделей по картам, реплики …
4 дня назад