抄録/ポイント:
抄録/ポイント
文献の概要を数百字程度の日本語でまとめたものです。
部分表示の続きは、JDreamⅢ(有料)でご覧頂けます。
J-GLOBALでは書誌(タイトル、著者名等)登載から半年以上経過後に表示されますが、医療系文献の場合はMyJ-GLOBALでのログインが必要です。
自然言語処理の応用システムでは,大規模文書を対象に単語やパラグラフの意味を数100次元のベクトルに埋め込む分散的意味表現学習により精度向上が図られている。これらの応用システムの課題は,品質保証・改善に必要な分散表現の中身を解釈する手段が無いことである。本研究では,分散表現の可読性を向上させることを目的に人手により構築された単語意味ベクトル辞書Ver.2を提案する。単語意味ベクトル辞書とは,約2万語の基本単語に対して,関係のある特徴単語を列挙した辞書である。Ver.2では特徴単語を264種類とし,日本語の単語意味ベクトル辞書を元にクラウドソーシングを利用して英語版を作成した。ツイートベクトルの可読性を高めるために,基本単語に付与された特徴単語を再帰的に展開することにより生成した多値ベクトルを分散的意味表現学習のシードベクトルとして用いる。この評価のため,日本語Twitterを対象に製品,サービス,組織の全8カテゴリ,38,576ツイートから構成される極性分析ベンチマークをクラウドソーシングを利用して作成した。本稿では,モニター公開を予定している日英単語意味ベクトル辞書ver.2および評判分析のための大規模かつ多様性のある日本語Twitter極性分析ベンチマークについて,ケーススタディと共に報告する。(著者抄録)