中文

Lithuanian 语言的开源 Llama2 模型

计算与语言 2025-05-01 v1 人工智能 机器学习

摘要

本文提出并描述了首个开源 Llama2 大型语言模型(LLM)及其对应的问答(Q/A)数据集,以及对流行 LLM 基准测试的翻译版本。我们提供了开源区域性 LLM 的简要回顾,并详细介绍了所提模型及其训练过程。我们还进行了经验评估,将所提模型的困惑度与其他现代开源 LLM 进行了比较。此外,对所提模型进行基准测试显示,高质量的预训练数据集可能是实现在此类基准测试中高效运行模型的关键。所述 LLM 的完整实现均可在随附的开源存储库中获取:\url{https://huggingface.co/neurotechnology}。

关键词

引用

@article{arxiv.2408.12963,
  title  = {Open Llama2 Model for the Lithuanian Language},
  author = {Artūras Nakvosas and Povilas Daniušis and Vytas Mulevičius},
  journal= {arXiv preprint arXiv:2408.12963},
  year   = {2025}
}

备注

12 pages, 8 figures, 5 tables