通用大型语言模型能否泛化到英泰机器翻译?
计算与语言
2024-10-23 v1 人工智能
机器学习
摘要
大型语言模型 (LLM) 在常见任务上表现良好,但在低资源和低计算设置下在泛化方面存在挑战。我们通过测试 various LLMs 和 specialized translation models on English-Thai 机器翻译和 code-switching 数据集来考察这一局限性。我们的发现表明,在更严格的计算约束下(例如 4 位量化),LLM 无法有效翻译。相比之下,specialized 模型在 comparable 或更低的计算要求下始终优于 LLM。这凸显了在资源受限情况下保持性能的重要性。
关键词
引用
@article{arxiv.2410.17145,
title = {Can General-Purpose Large Language Models Generalize to English-Thai Machine Translation ?},
author = {Jirat Chiaranaipanich and Naiyarat Hanmatheekuna and Jitkapat Sawatphol and Krittamate Tiankanon and Jiramet Kinchagawat and Amrest Chinkamol and Parinthapat Pengpun and Piyalitt Ittichaiwong and Peerat Limkonchotiwat},
journal= {arXiv preprint arXiv:2410.17145},
year = {2024}
}
备注
Accepted in GenBench EMNLP 2024