中文

使用 QLoRA 探索大语言模型中的事实记忆与风格模仿:实验研究与质量评估方法

计算与语言 2024-06-14 v1

摘要

有多种方法可以将大语言模型适应到不同领域。最常见的方法包括提示工程、微调和RAG。在本工作中,我们探索了使用一种PEFT方法——QLoRA来适应模型的可能性。实验旨在模拟基于其访谈而生成的人类响应。通过比较风格质量和生成事实的质量来评估仿真质量。

关键词

引用

@article{arxiv.2406.08582,
  title  = {Exploring Fact Memorization and Style Imitation in LLMs Using QLoRA: An Experimental Study and Quality Assessment Methods},
  author = {Eugene Vyborov and Oleksiy Osypenko and Serge Sotnyk},
  journal= {arXiv preprint arXiv:2406.08582},
  year   = {2024}
}

备注

16 pages, 5 tables