中文

低资源语言的最新大型语言模型性能评估

计算与语言 2024-08-01 v1

摘要

大型语言模型(LLM)在过去一年中取得了显著进展。除了新的GPT和Llama版本外,还近期涌现出许多其他LLM。其中一些是可下载和修改的开放模型。虽然多语言大型语言模型已有一段时间可供使用,但它们在诸如 Sinhala 等低资源语言上的性能仍较差。我们在 Sinhala 语言中直接评估了四个最新的LLM,并通过英语到该语言及其反之的翻译进行评估。我们还评估了在少量微调数据下的微调能力。Claude 和 GPT-4o 在开箱即用的情况下表现良好,显著优于以前的版本。Llama 和 Mistral 表现较差,但在微调方面显示出一些改进的前景。

关键词

引用

@article{arxiv.2407.21330,
  title  = {Performance of Recent Large Language Models for a Low-Resourced Language},
  author = {Ravindu Jayakody and Gihan Dias},
  journal= {arXiv preprint arXiv:2407.21330},
  year   = {2024}
}