Публикации
2025
Zaburdaev Alexander, Ivanko Denis, Ryumin Dmitry. CrossMP-SENet: Transformer-Based Cross-Attention for Joint Magnitude-Phase Speech Enhancement // Lecture Notes in Computer Science / Proc. SPECOM 2025, Szeged, Hungary. 2026. vol. 16188. pp. 174–188.
Подробнее
Ryumin Dmitry, Egorova Angelina. MoDeG-Prompt: Depth-Enhanced Multimodal Gesture Recognition with Dynamic Cross-Modal Prompting for Few-Shot Learning // Communications in Computer and Information Science / Proc. 28th International Conference “Internet and Modern Society” IMS 2025. St. Petersburg, 2026. vol. 2672. pp. 347–360.
Подробнее
Axyonov Alexandr, Dolgushin Mikhail, Ryumin Dmitry. NeRF-LipSync: A Diffusion Model for Speech-Driven and View-Consistent Lip Synchronization in Digital Avatars // The International Archives of the Photogrammetry, Remote Sensing and Spatial Information Sciences / Proc. 6th International Workshop PSBB 2025. Moscow, 2025. vol. XLVIII-2/W9-2025. pp. 25–31.
Подробнее
Ivanko Denis, Ryumin Dmitry. Intelligent System for Automatic Bidirectional Sign Language Translation Based on Recognition and Synthesis of Audiovisual and Sign Speech // The International Archives of the Photogrammetry, Remote Sensing and Spatial Information Sciences / Proc. PSBB 2025. Moscow, 2025. vol. XLVIII-2/W9-2025. pp. 131–136.
Подробнее
Ryumina Elena, Ryumin Dmitry, Ivanko Denis. G-MAE: Gesture-aware Masked Autoencoder for Human-Machine Interaction // The International Archives of the Photogrammetry, Remote Sensing and Spatial Information Sciences / Proc. PSBB 2025. Moscow, 2025. vol. XLVIII-2/W9-2025. pp. 241–248.
Подробнее
Ryumina Elena, Markitantov Maxim, Axyonov Alexandr, Ryumin Dmitry, Dolgushin Mikhail, Karpov Alexey. Zero-Shot Multimodal Compound Expression Recognition Approach using Off-the-Shelf Large Visual-Language Models // Proc. IEEE/CVF International Conference on Computer Vision (ICCV 2025) Workshops, 9th ABAW Workshop, USA, 2025. pp. 71–79.
Подробнее
Двойникова А.А., Величко А.Н., Карпов А.А. Многомодальный корпус данных взаимодействия участников виртуальной коммуникации ENERGI // Известия высших учебных заведений. Приборостроение. 2025. Т. 68, № 12. С. 1011–1019.
Подробнее
Аксёнов А.А. Многомодальная генерация речи, мимики и жестов в цифровых аватарах: современные методы и перспективы // Вестник Воронежского государственного университета. Серия: Системный анализ и информационные технологии. 2025. № 4. С. 155–182.
Подробнее
Смолянинова А.В., Павлова Т.А., Доровских И.В., Карпов А.А., Долгушин М.Д., Краснослободцева Л.А., Сейку Ю.В., Болдаков Д.Ю. Распознавание речи искусственным интеллектом у пациентов, страдающих легким когнитивным расстройством и деменцией // Психиатрия и психофармакотерапия. 2025. № 4. С. 50–54.
Подробнее
Киселева К.О., Кипяткова И.С. Переключение кода с карельского на русский: морфонологические аспекты внутрисловного копирования русских единиц в речи носителей карельского языка // Труды 11-го междисциплинарного семинара «Анализ разговорной русской речи» АР3-2025, Санкт-Петербург. 2025. С. 43–47.
Подробнее
Долгушин М.Д., Гусева Д.Д., Карпов А.А. Исследование методов автоматизированной диагностики когнитивных нарушений на материале видеоинтервью // Труды 11-го междисциплинарного семинара «Анализ разговорной русской речи» АР3-2025, Санкт-Петербург. 2025. С. 25–30.
Подробнее
2024
Dresvyanskiy D., Markitantov M., Yu J., Kaya H., Karpov A. Multi-modal Arousal and Valence Estimation under Noisy Conditions // IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW). 2024. pp. 4773-4783.
Ryumina E., Markitantov M., Ryumin D., Kaya H., Karpov A. Zero-Shot Audio-Visual Compound Expression Recognition Method based on Emotion Probability Fusion // IEEE/CVF Conference on Computer Vision and Pattern Recognition Workshops (CVPRW). 2024. pp. 4752-4760.
Dresvyanskiy D., Karpov A., Minker W. A Cross-Multi-modal Fusion Approach for Enhanced Engagement Recognition // Lecture Notes in Computer Science, SPECOM-2024. 2024. vol. 15300. pp. 3-17.
Mamontov D., Zepf S., Karpov A., Minker W. Cross-Cultural Automatic Depression Detection Based on Audio Signals // Lecture Notes in Computer Science, SPECOM-2024. 2024. vol. 15299. pp. 309-323.