中文

TigerLLM - 孟加拉语大型语言模型家族

计算与语言 2025-07-01 v3

摘要

大型语言模型(LLM)的发展仍然严重偏向英语和其他少数高资源语言。这种语言差异在孟加拉语——全球使用人数第五多的语言——中尤为明显。少数倡议曾试图创建开源的孟加拉语 LLM,但其性能仍落后于高资源语言,且可复现性有限。为了弥补这一差距,我们推出了 TigerLLM——一个孟加拉语 LLM 家族。我们的结果表明,这些模型超越了所有开源替代方案,并在标准基准测试中优于 GPT3.5 等更大的专有模型,从而确立了 TigerLLM 作为未来孟加拉语语言建模的新基准。

关键词

引用

@article{arxiv.2503.10995,
  title  = {TigerLLM - A Family of Bangla Large Language Models},
  author = {Nishat Raihan and Marcos Zampieri},
  journal= {arXiv preprint arXiv:2503.10995},
  year   = {2025}
}