文献
J-GLOBAL ID:202302257866087742   整理番号:23A0950106

視覚的質問応答における視線情報を利用した曖昧性解消に向けて

著者 (9件):
資料名:
巻: 29th  ページ: ROMBUNNO.Q8-6 (WEB ONLY)  発行年: 2023年03月 
JST資料番号: U0384A  ISSN: 2188-4420  資料種別: 会議録 (C)
記事区分: 短報  発行国: 日本 (JPN)  言語: 日本語 (JA)
抄録/ポイント:
抄録/ポイント
文献の概要を数百字程度の日本語でまとめたものです。
部分表示の続きは、JDreamⅢ(有料)でご覧頂けます。
J-GLOBALでは書誌(タイトル、著者名等)登載から半年以上経過後に表示されますが、医療系文献の場合はMyJ-GLOBALでのログインが必要です。
視覚的質問応答(VQA:Visual Question Answering)は,画像に関する質問が与えられた時に回答を導くタスクであり,質問と画像中の情報から回答が一意に決定する状況を仮定する.しかし,VQAを人間と実世界対話を行うロボットに応用する場合,主語の省略や指示語が,視線などのマルチモーダルな補完情報(文脈情報)と共に利用される場合がある.本研究では画像中の人物が見ている対象の情報を利用したVQAデータセットを構築し,視線の先の物体名をVQAの曖昧性解消に利用した結果を報告する.(著者抄録)
シソーラス用語:
シソーラス用語/準シソーラス用語
文献のテーマを表すキーワードです。
部分表示の続きはJDreamⅢ(有料)でご覧いただけます。
J-GLOBALでは書誌(タイトル、著者名等)登載から半年以上経過後に表示されますが、医療系文献の場合はMyJ-GLOBALでのログインが必要です。

準シソーラス用語:
シソーラス用語/準シソーラス用語
文献のテーマを表すキーワードです。
部分表示の続きはJDreamⅢ(有料)でご覧いただけます。
J-GLOBALでは書誌(タイトル、著者名等)登載から半年以上経過後に表示されますが、医療系文献の場合はMyJ-GLOBALでのログインが必要です。

分類 (2件):
分類
JSTが定めた文献の分類名称とコードです
自然語処理  ,  人工知能 
タイトルに関連する用語 (4件):
タイトルに関連する用語
J-GLOBALで独自に切り出した文献タイトルの用語をもとにしたキーワードです

前のページに戻る