声、表情、脳波から、人を理解する。

音声情報処理・顔画像処理・深層学習・機械学習技術

人間が持つ多様な情報を深層学習やマルチモーダル情報処理で解析し、人と機械がより自然に関わり合える技術の研究に取り組んでいます。

人物の横顔と音声波形のイメージ
緑の葉で構成された人の頭部のイメージ

About 研究室について

音声・画像・言語を
多角的にとらえる。

当研究室では音声や音楽、画像、自然言語といったメディアの処理を中心に、人工知能や認知科学、脳科学に関する研究に取り組んでいます。特に調音運動(人間の発話時の口唇や舌の運動)に基づいた音声合成や音声認識、機械読唇の研究に力を入れています。

研究内容

Our Research

Speech Processing

音声情報処理グループ

調音運動(発話時の唇・舌の動き)に着目し、音声合成・声質変換・音声認識など幅広い研究に取り組んでいます。発話困難な方への支援システム開発も視野に入れています。

Facial Image Processing

顔画像処理グループ

唇の動きから発話内容を認識する「機械読唇」を中心に、マルチモーダル音声認識や読唇音声合成など、深層学習を活用した研究に取り組んでいます。

AI & Machine Learning

人工知能・機械学習グループ

現在の人工知能ではまだ実現できていない技術の開発を目指し、ゲームエージェント・対話システム・自然言語処理・脳波解析など幅広い研究に取り組んでいます。

About

更新情報