D2 姜の論文が,音声処理分野における主要国際会議 The 27th Interspeech Conference (INTERSPEECH 2026) に採択されました.Full-duplex 音声対話モデル Moshi を拡張することで,ユーザの音声と表情を同時に処理しながら,システムの音声と顔の動きを並行して生成する Multimodal Full-duplex 対話モデルの研究です.
Integrating Facial Generation into Full-Duplex Spoken Dialogue Systems Proceedings Article Forthcoming
In: The 27th Interspeech Conference (INTERSPEECH 2026), Forthcoming.
この研究は,2026年9月27日〜10月1日にシドニー(オーストラリア)で発表予定です.
