文献
J-GLOBAL ID:202602223787405551   整理番号:26A1039707

対話文脈全体の評価を用いた対話システム学習

Training Dialogue Systems Using Entire Dialogue Context Evaluation
著者 (10件):
資料名:
巻: 41  号:ページ: IDS26-B_1-10(J-STAGE)  発行年: 2026年 
JST資料番号: U0128A  ISSN: 1346-8030  資料種別: 逐次刊行物 (A)
発行国: 日本 (JPN)  言語: 日本語 (JA)
抄録/ポイント:
抄録/ポイント
文献の概要を数百字程度の日本語でまとめたものです。
部分表示の続きは、JDreamⅢ(有料)でご覧頂けます。
J-GLOBALでは書誌(タイトル、著者名等)登載から半年以上経過後に表示されますが、医療系文献の場合はMyJ-GLOBALでのログインが必要です。
システムとの対話におけるユーザ満足度を高めるためには,個人の...
   このテーマを更に深掘りする(JDreamⅢへ)  {{ this.onShowAbsJLink("http://jdream3.com/lp/jglobal/index.html?docNo=26A1039707&from=J-GLOBAL&jstjournalNo=U0128A") }}
引用文献 (27件):
  • [Bai 22a] Bai, Y., Jones, A., Ndousse, K., Askell, A., Chen, A., DasSarma, N., Drain, D., Fort, S., Ganguli, D., Henighan, T., Joseph, N., Kadavath, S., Kernion, J., Conerly, T., El-Showk, S., Elhage, N., Hatfield-Dodds, Z., Hernandez, D., Hume, T., Johnston, S., Kravec, S., Lovitt, L., Nanda, N., Olsson, C., Amodei, D., Brown, T., Clark, J., McCandlish, S., Olah, C., Mann, B., and Kaplan, J.: Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback, arXiv:2204.05862 (2022)
  • [Bai 22b] Bai, Y., Kadavath, S., Kundu, S., Askell, A., Kernion, J., Jones, A., Chen, A., Goldie, A., Mirhoseini, A., McKinnon, C., Chen, C., Olsson, C., Olah, C., Hernandez, D., Drain, D., Ganguli, D., Li, D., Tran-Johnson, E., Perez, E., Kerr, J., Mueller, J., Ladish, J., Ladish, J., Landau, J., Ndousse, K., Lukosuite, K., Lovitt, L., Sellitto, M., Elhage, N., Schiefer, N., Mercado, N., DasSarma, N., Lasenby, R., Larson, R., Ringer, S., Johnston, S., Kravec, S., Showk, S. E., Fort, S., Lanham, T., Telleen-Lawton, T., Conerly, T., Henighan, T., Hume, T., Bowman, S. R., Hatfield-Dodds, Z., Mann, B., Amodei, D., Joseph, N., McCandlish, S., Brown, T., and Kaplan, J.: Constitutional AI: Harmlessness from AI Feedback, arXiv:2212.08073 (2022)
  • [Brown 20] Brown, T. B., Mann, B., Ryder, N., Subbiah, M., Kaplan, J., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., Agarwal, S., Herbert-Voss, A., Krueger, G., Henighan, T., Child, R., Ramesh, A., Ziegler, D. M., Wu, J., Winter, C., Hesse, C., Chen, M., Sigler, E., Litwin, M., Gray, S., Chess, B., Clark, J., Berner, C., McCandlish, S., Radford, A., Sutskever, I., and Amodei, D. : Language Models are Few-Shot Learners, arXiv:2005.14165 (2020)
  • [Christiano 17] Christiano, P. F., Leike, J., Brown, T. B., Martic, M., Legg, S., and Amodei, D. : Deep Reinforcement Learning from Human Preferences, in Proceedings of the 31st International Conference on Neural Information Processing Systems (NIPS’17), pp. 4302-4310 (2017)
  • [Ferron 23] Ferron, A., Shore, A., Mitra, E., and Agrawal, A. : MEEP: Is this Engaging? Prompting Large Language Models for Dialogue Evaluation in Multilingual Settings, in Findings of the Association for Computational Linguistics: EMNLP 2023, pp. 2078-2100 (2023)
もっと見る
タイトルに関連する用語 (5件):
タイトルに関連する用語
J-GLOBALで独自に切り出した文献タイトルの用語をもとにしたキーワードです

前のページに戻る