Векторный поиск: деплой без GPU на Triton Inference Server
Перед каждым ML-разработчиком, после обучения прекрасной модели, которая поднимет бизнесу метрики, а тебе годовую премию, возникает вопрос: а как ее задеплоить в сервисе, чтоб она начала работать? А ты пошел отдыхать. Читать далее
