Исследователи Яндекса разработали инновационный метод обновления систем голосового управления, который решает проблему «катастрофического забывания». Разработка была официально принята к публикации для презентации на международной конференции Interspeech 2026, которая пройдет в Сиднее в период с 27 сентября по 1 октября.

В процессе стандартного дообучения моделей голосового управления умные устройства зачастую начинают хуже распознавать старые, уже привычные команды — это явление в индустрии получило название «катастрофическое забывание». Предложенная Яндексом технология исключает этот эффект за счет внедрения компактного обучаемого модуля. Он берет на себя распознавание только новых команд, при этом параметры основной нейросети остаются неизменными. Такая архитектура обеспечивает сохранение исходного качества работы системы, а итоговый вес модели увеличивается менее чем на 10%.
Результаты тестирования
Эффективность нового подхода была подтверждена тестами на открытом наборе данных Google Speech Commands. Статистика показала, что уровень пропуска новых команд удалось снизить до 4,37%, в то время как аналогичные модели без использования данной технологии демонстрируют показатель в 6,46%. Кроме того, традиционные методы полного дообучения приводили к заметной деградации точности распознавания старых фраз, чего удалось избежать в новой разработке.
По мнению экспертов, данная технология имеет большой потенциал для интеграции в широкий спектр устройств с ограниченными вычислительными мощностями. Среди них умные колонки, бытовая техника, автомобильные системы голосового управления и другие интеллектуальные гаджеты.






