Description
Проектирование и разработка AI-агентов — создание многошаговых автономных и полуавтономных агентов на базе LLM (ReAct, Tool-Use, Planning, Multi-Agent)
Чем предстоит заниматься
Проектирование и разработка AI-агентов — создание многошаговых автономных и полуавтономных агентов на базе LLM (ReAct, Tool-Use, Planning, Multi-Agent) Разработка GenAI-решений — промпт-инжиниринг, RAG-пайплайны, работа с эмбеддингами и векторными БД Интеграция LLM — подключение и оркестрация моделей через API Создание сервисов и API на Python для интеграции ИИ-компонентов в продуктовую среду Проектирование архитектуры — выбор паттернов взаимодействия агентов, проектирование пайплайнов обработки данных, обеспечение масштабируемости Настройка оценки качества генерации, снижение количества «галлюцинаций», оптимизация задержек Деплой и эксплуатация AI-сервисов в Kubernetes — написание Helm-чартов, манифестов, настройка resource-лимитов (CPU/GPU), HPA/VPA для автомасштабирования инференса Мониторинг и обсервабилити AI-сервисов — настройка метрик (Prometheus + Grafana), логирование (ELK / Loki), трейсинг (LangFuse / Jaeger / OpenTelemetry), алерты на деградацию качества генерации и latency Обеспечение безопасности AI-сервисов Что мы ждем от вас: Опыт разработки AI-агентов от 1 года: понимание паттернов ReAct, Tool-Use, Planning, Multi-Agent; умение проектировать многошаговые сценарии с контролем состояния Практический опыт построения RAG-пайплайнов: индексация, чанкинг, ретрив, реранкинг, работа с эмбеддингами и векторными БД (Milvus, Qdrant, Weaviate, pgvector — хотя бы одна) Уверенный промпт-инжиниринг: chain-of-thought, few-shot, системные промпты, управление контекстом Опыт интеграции LLM через API (OpenAI, Anthropic, локальные модели через vLLM / SGLang / TGI) Фреймворки оркестрации AI-пайплайнов: LangChain / LlamaIndex / CrewAI / AutoGen (хотя бы один) Практический опыт оценки качества генерации: метрики (RAGAS, BLEU, ROUGE, LLM-as-a-Judge), A/B-тестирование промптов Понимание природы галлю
Employer contacts (email/phone/telegram) are hidden from the public preview —
send your CV, and we will connect you directly.