抄録/ポイント:
抄録/ポイント
文献の概要を数百字程度の日本語でまとめたものです。
部分表示の続きは、JDreamⅢ(有料)でご覧頂けます。
J-GLOBALでは書誌(タイトル、著者名等)登載から半年以上経過後に表示されますが、医療系文献の場合はMyJ-GLOBALでのログインが必要です。
日本語のテキストを学習することの意義,そして日本語に強い大規模言語モデル(LLM)の特徴は何であろうか.本研究では,35種類の日本語・英語のLLMを日英19件のタスクで統一的に評価することで,言語とタスク性能の関連性を定量的に分析した.その結果,次の三つの知見を得た.まず,タスク性能の相関行列を分析し,一般教養やコード生成,算術推論は英語と日本語の性能がほぼ比例することを見出した(4.2節で詳述する).次に,相関行列の主成分分析により,有意義な主成分を三つ確認した.第1主成分は日英問わず大半のタスクに寄与する基礎能力的な因子,第2主成分は日本語質問応答と英日翻訳に寄与する因子,第3主成分は算術推論とコード生成に寄与する因子である(4.3節で詳述する).最後に,主成分得点と計算予算の対数との関係を分析し,第1主成分は英語向け計算予算,第2主成分は日本語向け計算予算に比例することを見出した(ここで,計算予算=パラメータ数×学習トークン数であり,4.4節で詳述する).以上の分析から,LLMに日本語テキストを学習させることは,主に日本に関する知識の獲得および英日翻訳の向上という効果をもたらすことが示唆された.(著者抄録)