研究
私の研究は、音声合成、音声信号処理、統計的機械学習を中心としており、特に、統計的音声合成、HMM音声合成、ニューラル音声合成、歌声合成、声質変換に関する研究を行ってきました。
概要
研究全体を通じた中心的なテーマは、音声や歌声を柔軟に、制御可能な形で生成・変換するための方法論を構築することです。統計的モデリングと音声信号処理の両面から、音声合成システムの基礎技術、音声パラメータ生成、ボコーダ、話者適応、表現制御などに取り組んできました。
主な研究分野
統計的音声合成
統計的音声合成、特にHMMに基づく音声合成に関して、音響モデリング、パラメータ生成、話者適応、スタイル制御などの研究を行ってきました。この研究は、学習可能で柔軟な音声合成システムの発展に寄与しました。
音声信号処理とボコーダ
音声分析、音声合成フィルタ、ボコーダ、音声パラメータ表現など、音声合成を支える信号処理技術についても研究を行ってきました。これらは、統計的音声合成およびニューラル音声合成の基盤技術として重要な役割を果たしています。
ニューラル音声合成
近年は、ニューラル音声合成、ニューラルボコーダ、系列モデリング、拡散モデル・フローベース生成モデル、制御可能な音声生成などにも関心を持っています。
歌声合成と声質変換
歌声合成および声質変換に関して、話者・歌手性、音高、タイミング、表現の変化をモデル化する手法について研究してきました。
音声技術基盤
統計的音声合成や日本語音声合成に関連するシステム・ソフトウェア・研究資源の開発と公開にも関わってきました。
現在の関心
現在は、制御可能な音声・歌声生成、ニューラル音声合成、言語モデルに基づく音声生成、信号処理と深層学習の融合、解釈性・適応性・実用性を備えた音声技術に関心を持っています。