文献
J-GLOBAL ID:202302245210652240   整理番号:23A2866714

歌声合成のためのポアソンフローモデルの予備的検討

A Preliminary Investigation of Poisson Flow Model for Singing Voice Synthesis
著者 (3件):
資料名:
巻: 2023  号: 秋季  ページ: ROMBUNNO.2-Q-41  発行年: 2023年09月12日 
JST資料番号: G0381C  ISSN: 1880-7658  資料種別: 会議録 (C)
記事区分: 短報  発行国: 日本 (JPN)  言語: 英語 (EN)
抄録/ポイント:
抄録/ポイント
文献の概要を数百字程度の日本語でまとめたものです。
部分表示の続きは、JDreamⅢ(有料)でご覧頂けます。
J-GLOBALでは書誌(タイトル、著者名等)登載から半年以上経過後に表示されますが、医療系文献の場合はMyJ-GLOBALでのログインが必要です。
・歌声合成(SVS)は,音声およびオーディオ処理の研究が盛んに行われている分野であり,音楽業界,エンターテイメント,教育などさまざまで応用。
・しかしながら,人間の歌声はピッチ,テンポ,ビブラート,アーティキュレーションの幅広いバリエーションを示す複雑な性質を持っているため,SVSが困難。
・人間の深層学習ベースのモデルがSVSタスクで成功しており,本稿では,最先端の拡散ベースのSVS音響モデルよりSVS合成速度が速く,モデルスケール範囲に優れた,ポアソン流ベースのモデルを提案。
シソーラス用語:
シソーラス用語/準シソーラス用語
文献のテーマを表すキーワードです。
部分表示の続きはJDreamⅢ(有料)でご覧いただけます。
J-GLOBALでは書誌(タイトル、著者名等)登載から半年以上経過後に表示されますが、医療系文献の場合はMyJ-GLOBALでのログインが必要です。

準シソーラス用語:
シソーラス用語/準シソーラス用語
文献のテーマを表すキーワードです。
部分表示の続きはJDreamⅢ(有料)でご覧いただけます。
J-GLOBALでは書誌(タイトル、著者名等)登載から半年以上経過後に表示されますが、医療系文献の場合はMyJ-GLOBALでのログインが必要です。

分類 (2件):
分類
JSTが定めた文献の分類名称とコードです
音声処理  ,  人工知能 
引用文献 (10件):
  • Liu et al., AAAI, 11020-11028, 2022.
  • Oord et al., SSW, 125, 2016.
  • Vaswani et al., NIPS, 5998-6008, 2017.
  • Xu et al., NIPS, 16782-16795, 2022.
  • Xu et al., CoRR, abs/2302.04265, 2023.
もっと見る
タイトルに関連する用語 (1件):
タイトルに関連する用語
J-GLOBALで独自に切り出した文献タイトルの用語をもとにしたキーワードです

前のページに戻る