文献
J-GLOBAL ID:202602224317298136   整理番号:26A0531332

距離学習を用いた話者識別に基づく話者ダイアライゼーションの検討

Towards Speaker Diarization based on Speaker Identification using Metric Learning
著者 (4件):
資料名:
巻: 44  号:ページ: 98-101(J-STAGE)  発行年: 2026年 
JST資料番号: Y0482A  ISSN: 0289-1824  資料種別: 逐次刊行物 (A)
記事区分: 短報  発行国: 日本 (JPN)  言語: 日本語 (JA)
抄録/ポイント:
抄録/ポイント
文献の概要を数百字程度の日本語でまとめたものです。
部分表示の続きは、JDreamⅢ(有料)でご覧頂けます。
J-GLOBALでは書誌(タイトル、著者名等)登載から半年以上経過後に表示されますが、医療系文献の場合はMyJ-GLOBALでのログインが必要です。
本稿では,深層学習に基づく話者ダイアライゼーションを取り上げ...
シソーラス用語:
シソーラス用語/準シソーラス用語
文献のテーマを表すキーワードです。
部分表示の続きはJDreamⅢ(有料)でご覧いただけます。
J-GLOBALでは書誌(タイトル、著者名等)登載から半年以上経過後に表示されますが、医療系文献の場合はMyJ-GLOBALでのログインが必要です。
,...
準シソーラス用語:
シソーラス用語/準シソーラス用語
文献のテーマを表すキーワードです。
部分表示の続きはJDreamⅢ(有料)でご覧いただけます。
J-GLOBALでは書誌(タイトル、著者名等)登載から半年以上経過後に表示されますが、医療系文献の場合はMyJ-GLOBALでのログインが必要です。
,...
   このテーマを更に深掘りする(JDreamⅢへ)  {{ this.onShowAbsJLink("http://jdream3.com/lp/jglobal/index.html?docNo=26A0531332&from=J-GLOBAL&jstjournalNo=Y0482A") }}
分類 (2件):
分類
JSTが定めた文献の分類名称とコードです
音声処理  ,  人工知能 
引用文献 (13件):
  • 1) Y. Fujita, et al.: “End-to-end neural speaker diarization with self-attention,” IEEE ASRU 2019, pp.296-303, 2019.
  • 2) N. Yamashita, et al.: “Improving the naturalness of simulated conversations for end-to-end neural diarization,” The Speaker and Language Recognition Workshop (Odyssey 2022), pp.133-140, 2022.
  • 3) R. Bommasani, et al: “On the opportunities and risks of foundation models,” arXiv:2108.07258 [cs.LG], 2021.
  • 4) N. Makishima, et al.: “Joint autoregressive modeling of end-to-end multi-talker overlapped speech recognition and utterance-level timestamp prediction,” Proc. INTERSPEECH 2023, pp.2913-2917, 2023.
  • 5) A. Baevski, et al.: “wav2vec 2.0: A framework for self-supervised learning of speech representations,” Advances in neural information processing systems, vol.33, pp.12449-12460, 2020.
もっと見る
タイトルに関連する用語 (4件):
タイトルに関連する用語
J-GLOBALで独自に切り出した文献タイトルの用語をもとにしたキーワードです

前のページに戻る