N
Компания под NDA
сегодняML Engineer / LLM Engineer (fine-tuning, post-training, RL)
Сгенерировать отклик под эту вакансию с ИИ
Аврора подстроит резюме и напишет сопроводительное за 30 секунд
Чем предстоит заниматься
- Развивать и совершенствовать пайплайн post-training для LLM: SFT, preference optimization, Offline и Online RL.
- Повышать качество instruction following и выстраивать систему benchmarking и evaluation.
- Обучать LoRA / QLoRA-адаптеры под разные домены и задачи.
- Работать с reward models, verifiers и reward functions для RL.
- Создавать RAG-системы: retrieval, reranking, конструирование контекста и оценка качества.
- Обучать и интегрировать tool use, function calling и structured outputs.
- Оптимизировать inference и serving моделей с помощью vLLM / SGLang.
Требования
- Практический опыт fine-tuning / post-training LLM
- Опыт с SFT и preference optimization: DPO / IPO / ORPO / SimPO или аналогами
- Опыт или хорошее практическое понимание Online RL для LLM: GRPO / GSPO или аналогичных методов
- Понимание reward models, preference data и LLM evaluation
- Уверенное владение Python, PyTorch, Hugging Face Transformers
- Опыт с TRL и/или verl
- Опыт с LoRA / QLoRA / PEFT
- Опыт inference / serving через vLLM и/или SGLang
- Опыт разработки RAG, tool use или structured generation
- Понимание архитектуры современных LLM и особенностей их обучения и inference
- Опыт работы с GPU, distributed training и Linux / Docker / Git
- Умение самостоятельно ставить эксперименты, выбирать метрики и анализировать результаты
Стек
Контакт работодателя
Прямой контакт рекрутёра в Telegram, без посредников
@recruiter_hidden
Бесплатно — за подписку на наш Telegram-канал
@recruiter
Telegram · прямой контакт
Аврора откликнется за вас. Пока вы пишете одному рекрутёру, автопилот отправляет отклики на все подходящие.
Попробовать →Безлимит будет в подписке Авроры — скоро.
Узнать первым →Вакансия в архиве — отклик недоступен. Посмотрите похожие активные вакансии ниже.
Похожие вакансии
A
AGIMA
сегодня
Стажер AI-разработчик
зп не указана
СтажёрУдалённопрямой контакт
Я
Яндекс
вчера
Руководитель ML-команды системных промптов Alice AI
зп не указана
LeadГибридпрямой контакт
С
Сбер
вчера
Senior DS/ML Engineer для AI Safety в Сбер
зп не указана
Senior
И
Инвестиционная компания (публичные рынки США)
вчера
Senior Quantitative Researcher & AI Engineer
зп не указана
SeniorУдалённопрямой контакт
A
AI-продукт (не указано)
3 дня назад
Team Lead ML Engineer (Gen AI)
4 500–4 500 $
LeadУдалённопрямой контакт
N
Компания под NDA
4 дня назад
Geo ML-инженер (маршрутизация и геопространственные данные)
зп не указана
прямой контакт