AIRI · Россия · по договорённости
Обязанности
- Разработка и внедрение Data Science решений на основе LLM и классических NLP-подходов.
- Построение движка RAG на документах разного типа.
- Сбор, очистка, разметка и синтез тренировочных датасетов.
- Оценка качества моделей, cоздание и поддержка бенчмарков для проверки отдельных компонентов системы.
- Оптимизация скорости инференса и работа с REST API для интеграции моделей в продукты.
- Подготовка публикаций по результатам работы (Industry Track).
Требования
- Глубое понимание построение RAG систем.
- Опыт создания и отладки пайплайнов под обучение slm и llm.
- Глубокое понимание метрик качества: Precision, Recall, F1, BLEU, ROUGE, CER/WER, а также специфических метрик для RAG (Faithfulness, Answer Relevancy).
- Математическая база: уверенное владение статистикой и теорией вероятностей.
- Классика ML/NLP: понимание алгоритмов (RF, XGB, BoW, TF-IDF, Word2Vec, классификаторы), умение применять их там, где LLM избыточна.
- Опыт работы с поисковиками (Lucene, FAISS).
- Высшее образование (бакалавр+).
Будет плюсом:
- Опыт работы с IDP (Intelligent Document Processing) и OCR-системами (извлечение данных из сканов/PDF).
- Опыт создания Agentic RAG.
- Опыт работы с docker, docker compose.
- Степень магистра/кандидата наук по точным или естественным наукам.
Отклик ведёт на сайт работодателя. Бесплатная регистрация открывает отклик и разбор резюме.