Close

音声合成や歌声合成などの音声情報処理技術

誰もが円滑に情報を獲得し、他者とコミュニケーションできる社会を目指し、深層学習などの機械学習に基づく音声合成に関する研究を行っています。単純な読み上げ音声だけでなく、感情や強調などの表現を含む表情豊かな音声の生成を可能とする技術を探究しています。また、テキストで声質や話し方を指示できる自然言語声質制御音声合成や、顔画像から声を再現するクロスモーダル音声合成など、合成音声の声質をどのように指定するのかといった研究も行っています。さらに、人間の多様な音声表現を実現するために、話し言葉だけでなく歌声合成の研究も行っています。よりきれいな歌声を生成するための技術や、歌唱者の特徴や癖を再現するための技術を探求しています。この他にも、音声による個人認証技術として、音声が本人のものか別人のものかを判別する話者認識技術などの研究も行っています。

情報工学類|准教授

橋本 佳(ハシモト ケイ)

HASHIMOTO Kei

4 質の高い教育をみんなに
9 産業と技術革新の基盤をつくろう
10 人や国の不平等をなくそう

キーワード

音声情報処理
音声合成
歌声合成
声質変換
話者認識

担当分野・プログラム

研究区分

人間情報学

研究テーマ

  • 音声合成・歌声合成の研究
  • 声質変換の研究
  • 話者認識の研究

メッセージ

音声合成技術の研究は、誰もが円滑に情報を獲得し、他者とコミュニケーションできる社会の実現につながると考えています。例えば、音声合成技術によってテキストを読み上げることで、視覚障がい者の情報獲得の支援を行うことができたり、発話障がい者に対する音声コミュニケーションの支援を行うことができたりします。また、歌声合成技術の研究は、誰もが創作に参加できる社会の実現につながると考えています。専門的な歌唱技術や環境がなくても楽曲制作が可能であり、音楽表現の可能性を広げることが期待されます。この他にも、話者認識技術による個人認証・セキュリティなどの研究を行っています。これらの音声情報処理技術の研究によって、より豊かな社会の実現に貢献していきます。