Лаборатория речевых и многомодальных интерфейсов

Аксёнов Александр Александрович

Аксёнов Александр Александрович
Должность
Старший научный сотрудник
Ученая степень
Кандидат технических наук

Публикации

2025

Ryumina Elena, Ryumin Dmitry, Axyonov Alexandr, Ivanko Denis, Karpov Alexey. Multi-Corpus Emotion Recognition Method based on Cross-Modal Gated Attention Fusion // Pattern Recognition Letters. 2025. vol. 190. pp. 192–200.
Подробнее
Ryumina Elena, Axyonov Alexandr, Abdulkadirov Timur, Koryakovskaya Darya, Ryumin Dmitry. Cross-Lingual Bimodal Emotion Recognition with LLM-Based Label Smoothing // Big Data and Cognitive Computing. 2025. vol. 9, 285.
Подробнее
Аксёнов А.А., Рюмина Е.В., Рюмин Д.А. Метод генерации анимации цифрового аватара с речевой и невербальной синхронизацией на основе бимодальных данных // Научно-технический вестник информационных технологий, механики и оптики. 2025. Т. 25, № 4. С. 651–662.
Подробнее
Axyonov Alexandr, Dolgushin Mikhail, Ryumin Dmitry. NeRF-LipSync: A Diffusion Model for Speech-Driven and View-Consistent Lip Synchronization in Digital Avatars // The International Archives of the Photogrammetry, Remote Sensing and Spatial Information Sciences / Proc. 6th International Workshop PSBB 2025. Moscow, 2025. vol. XLVIII-2/W9-2025. pp. 25–31.
Подробнее
Ryumina Elena, Markitantov Maxim, Axyonov Alexandr, Ryumin Dmitry, Dolgushin Mikhail, Karpov Alexey. Zero-Shot Multimodal Compound Expression Recognition Approach using Off-the-Shelf Large Visual-Language Models // Proc. IEEE/CVF International Conference on Computer Vision (ICCV 2025) Workshops, 9th ABAW Workshop, USA, 2025. pp. 71–79.
Подробнее
Аксёнов А.А. Многомодальная генерация речи, мимики и жестов в цифровых аватарах: современные методы и перспективы // Вестник Воронежского государственного университета. Серия: Системный анализ и информационные технологии. 2025. № 4. С. 155–182.
Подробнее

2024

Ryumin D., Axyonov A., Ryumina E., Ivanko D., Kashevnik A., Karpov A. Audio–visual speech recognition based on regulated transformer and spatio–temporal fusion strategy for driver assistive systems // Expert Systems with Applications. 2024. vol. 252. ID 124159.