中文

AceGPT:将大语言模型本地化于阿拉伯语

计算与语言 2024-04-03 v5

摘要

本文致力于开发专用于阿拉伯语的本地化大语言模型(LLM),该语言具有当前主流模型未能充分应对的独特文化特征。在文化敏感性与本地价值观方面出现了显著关切。为此,本文提出综合解决方案:使用阿拉伯语文本进一步预训练、利用原生阿拉伯语指令与阿拉伯语GPT-4回复进行监督微调(SFT),并采用契合本地文化与价值观的奖励模型进行人工智能反馈强化学习(RLAIF)。目标是培育具备文化认知与价值对齐的阿拉伯语LLM,以满足阿拉伯语社群多样且特定的应用需求。全面评估显示,所得模型AceGPT在各基准上树立了开放阿拉伯语LLM的SOTA标准。代码、数据与模型见https://github.com/FreedomIntelligence/AceGPT。

关键词

引用

@article{arxiv.2309.12053,
  title  = {AceGPT, Localizing Large Language Models in Arabic},
  author = {Huang Huang and Fei Yu and Jianqing Zhu and Xuening Sun and Hao Cheng and Dingjie Song and Zhihong Chen and Abdulmohsen Alharthi and Bang An and Juncai He and Ziche Liu and Zhiyi Zhang and Junying Chen and Jianquan Li and Benyou Wang and Lian Zhang and Ruoyu Sun and Xiang Wan and Haizhou Li and Jinchao Xu},
  journal= {arXiv preprint arXiv:2309.12053},
  year   = {2024}
}

备注

Accepted to NAACL main conference. https://github.com/FreedomIntelligence/AceGPT