Описание
♠️ Full-Stack · Telegram
🎴 Шукаємо 🔧 ML/Інженер з інфраструктури (LLM + генерація зображень)
Шукаємо інженера, який підніме і підтримуватиме LLM та генерацію зображень на власних GPU. Це ядро продукту - без цієї ролі нічого не працює, тому наймання №1 у пріоритеті.
Задачі:
— Деплой і оптимізація інференсу LLM (квантування, батчинг, швидкість/вартість токена)
— Pipeline генерації зображень (Stable Diffusion та подібні), тюнінг під персонажів
— GPU-інфраструктура «з нуля»: моніторинг, відмовостійкість, оптимізація витрат
— Файнтюнинг моделей під кейси продукту (LoRA тощо — плюс)
Очікуємо:
— Продакшн-досвід деплою LLM (vLLM, TGI, TensorRT-LLM тощо)
— Досвід із диффузійними моделями саме в проді
— Самостійність — на старті це ви й результат
Чекаю в лс 📩
🃏 телеграм ↗
Контакты работодателя (email/phone/telegram) скрыты из публичного превью —
отправьте резюме, чтобы мы связали вас напрямую.