SimbirSoft · Удалённо · по договоренности
Вам предстоит:
- Проектировать архитектуру LLM-фичей: single-prompt решения, цепочки промптов, сложные пайплайны;
- Управлять поведением модели через промпт-инжиниринг (CoT, few-shot, structured outputs, tool calling и др.), подбор параметров и работу с контекстом — без fine-tuning;
- Совместно с продактами продумывать логику диалогов и пользовательские сценарии;
- Выстраивать систему оценки качества: golden-сеты, валидационные выборки, метрики, бенчмарки, LLM-as-a-judge;
- Анализировать продакшн-логи и фидбек пользователей, находить системные проблемы и улучшать решения;
- Участвовать в организации разметки данных — писать гайды, проверять результаты, при необходимости размечать самостоятельно.
Для нас важно:
- Практический опыт работы с LLM от 1 года: реальные бизнес-кейсы, а не только эксперименты.
- Уверенный Python и привычка работать с данными (Jupyter, pandas, визуализация).
- SQL и понимание, как собрать датасет под задачу и проверить гипотезу.
- Опыт работы с OpenAI API или аналогами.
- Понимание, как тестировать LLM-решения: регресс-проверки, offline-метрики, human eval, A/B-тесты.
Будет плюсом:
- Автоматическая оптимизация промптов (GEPA и другие подходы).
- Опыт выстраивания процессов разметки и автоматизации evaluation.
- Работа с observability и eval-инструментами (LangFuse, MLflow, LangSmith, DeepEval и др.).
- Опыт построения агентных систем и RAG-архитектур.
- Знакомство с фреймворками оркестрации (LangChain, LangGraph или аналоги).
Мы предлагаем:
- Работу в команде экспертов.
- Широкий технологический стек, сотни проектов.
- Гибкий график работы, который позволяет высыпаться и выделять время на хобби.
- Льготы и меры господдержки, предусмотренные для IT-компаний.
Отклик ведёт на сайт работодателя. Бесплатная регистрация открывает отклик и разбор резюме.