中文

整合情感与语言模型以实现大型语言模型的伦理合规

计算与语言 2024-05-15 v2 人工智能

摘要

本研究发展了一系列先进的方法,用于改进大型语言模型(LLM)在情感和伦理相关语言行为方面的表现。我们引入了DIKE框架,通过对抗学习来增强LLM的内化和反思全球人类价值观的能力,使其能够适应不同的文化背景,以促进用户之间的透明度和信任。该方法涉及对情感的详细建模、对语言行为的分类,以及实施伦理监控。我们的创新方法包括使用自监督学习技术对情感和行为进行映射,通过对抗性评论来细化这些监控,并系统地调整输出以确保伦理合规。该框架为AI系统在伦理完整性和文化敏感性方术能运行奠定了坚实的基础,为更负责任和具有情境意识的AI交互 paving the way。

关键词

引用

@article{arxiv.2405.07076,
  title  = {Integrating Emotional and Linguistic Models for Ethical Compliance in Large Language Models},
  author = {Edward Y. Chang},
  journal= {arXiv preprint arXiv:2405.07076},
  year   = {2024}
}

备注

29 pages, 10 tables, 6 figures