Description
Шукаємо 🔧 ML/Інженер з інфраструктури (LLM + генерація зображень)
Шукаємо інженера, який підніме і підтримуватиме LLM та генерацію зображень на власних GPU. Це ядро продукту - без цієї ролі нічого не працює, тому наймання №1 у пріоритеті.
Задачі:
— Деплой і оптимізація інференсу LLM (квантування, батчинг, швидкість/вартість токена)
— Pipeline генерації зображень (Stable Diffusion та подібні), тюнінг під персонажів
— GPU-інфраструктура «з нуля»: моніторинг, відмовостійкість, оптимізація витрат
— Файнтюнинг моделей під кейси продукту (LoRA тощо — плюс)
Очікуємо:
— Продакшн-досвід деплою LLM (vLLM, TGI, TensorRT-LLM тощо)
— Досвід із диффузійними моделями саме в проді
— Самостійність — на старті це ви й результат
Чекаю в лс 📩
Employer contacts (email/phone/telegram) are hidden from the public preview —
send your CV, and we will connect you directly.