中文

PLLaMa:面向植物科学的开源大语言模型

计算与语言 2024-01-04 v1 人工智能 计算工程、金融与科学 机器学习

摘要

大语言模型(Large Language Models, LLMs)在理解和交互各领域的自然语言方面展现出卓越能力。然而,在植物科学等需要高精度的专业领域,由于缺乏特定专业知识,其有效性受到限制。本文介绍了 PLLaMa,一个从 LLaMa-2 演进而来的开源语言模型。它通过一个包含超过 150 万篇植物科学学术论文的综合数据库得到增强。这一开发显著丰富了 PLLaMa 在植物与农业科学方面的广泛知识和熟练程度。我们使用与植物和农业相关的特定数据集进行的初步测试表明,PLLaMa 大幅提升了其对植物科学相关主题的理解。此外,我们组建了一个由植物科学家、农业工程师和植物育种家组成的国际专业小组。该团队在验证 PLLaMa 对各种学术查询回答的准确性方面发挥着关键作用,确保其在该领域的有效和可靠应用。为了支持进一步的研究与开发,我们已向科学界开放了该模型的检查点和源代码。这些资源可在 \url{https://github.com/Xianjun-Yang/PLLaMa} 下载。

关键词

引用

@article{arxiv.2401.01600,
  title  = {PLLaMa: An Open-source Large Language Model for Plant Science},
  author = {Xianjun Yang and Junfeng Gao and Wenxin Xue and Erik Alexandersson},
  journal= {arXiv preprint arXiv:2401.01600},
  year   = {2024}
}

备注

Work in progress