Pheon
Обязанности: Сбор и подготовка обучающих датасетов, fine-tuning и адаптация LLM для ролевых диалогов; Проектирование систем долгосрочной памяти, управления контекстом и состояниями персонажей; Построение evaluation pipelines для оценки согласованности персонажей, удержания памяти, связности повествования и вовлечённости пользователей; Оптимизация LLM inference по показателям latency, throughput и стоимости. Требования: Практический опыт LLM fine-tuning (SFT, LoRA, QLoRA, DPO, RLHF); Опыт проектирования и внедрения RAG-систем; Разработка LLM evaluation pipelines, бенчмарков и метрик качества; Работа с Context / Memory (long-term memory, dialogue state, personalization); Inference optimization (vLLM, TensorRT-LLM, batching, latency, throughput, GPU cost). Условия: Фиксированная заработная плата в стабильной валюте; Оформление по договору Service agreement в юрисдикции Кипра (не РФ, не РБ); Полная удалёнка (часовой пояс CET); Полная автономность и возможность влиять на продукты компании; Сильная международная команда и прямое влияние на рост и масштабирование бизнеса.
⚠️ Будьте внимательны: вакансия размещена из открытых источников и может быть недостоверна.
Зарплата
Не указано