Яндекс · Россия · по договорённости
Мы ищем DL-разработчика, который уже работал с аудио или готов погрузиться в эту тему, чтобы вместе исследовать базовое качество наших моделей. Цель — сделать Алису умнее и естественнее за счёт голосовой активации, чтобы голосовое взаимодействие было максимально человечным и бесшовным.
Благодаря большому количеству GPU и CPU мы можем проводить масштабные эксперименты, чтобы добиваться максимального качества распознавания. У вас будет возможность влиять на продукт с многомиллионной аудиторией.
Что предстоит делать:
Улучшение качества текущих моделей голосовой активации
Вы будете работать над задачами по улучшению текущих моделей голосовой активации, чтобы они пропускали всё меньше ключевых фраз и не активировались, когда этого не требуется. Для этого нужно будет проверять и внедрять разработки из актуальных научных статей, а также придумывать собственные подходы.
Оптимизация моделей для работы на embedded-устройствах
Чтобы модель могла быстро работать на пользовательском устройстве, она должна быть достаточно маленькой и оптимизированной. Оптимизации могут касаться нетривиальных методов обучения и инференса.
Создание моделей для новых устройств и обучение их новым языкам и фразам
Помимо улучшения уже существующих моделей и устройств, мы активно развиваем новые сценарии голосовой активации: создаём модели для новых устройств и адаптируем пайплайны под новые языки. Вам предстоит заниматься внедрением таких решений целиком — от идеи до продукта.
Больше об ML в Яндексе — в канале Yandex for ML
Требования:
• Работали с DL (например, связанным с CV или NLP)
• Умеете писать на Python и C++
• Знаете PyTorch
• Владеете английским на уровне, необходимом для чтения научных статей
Будет плюсом:
• Знаете инфраструктуру Яндекса: YT, YQL, Valhalla, Нирвана
• Работали со звуком
Отклик ведёт на сайт работодателя. Бесплатная регистрация открывает отклик и разбор резюме.