SiamGPT:面向稳定泰语文本生成的质量优先精调策略
计算与语言
2026-01-09 v3
摘要
尽管表现出强大的英语性能,开源大语言模型在复杂指令下仍难以为泰语提供稳定的生成。为缓解这些限制,我们提出SiamGPT-32B,这是一个基于 Qwen3-32B 的开源模型,采用质量优先策略进行精调,强调精心挑选的监督数据而非数据规模。精调管道将高复杂度英语指令数据与泰语适配的 AutoIF 框架相结合,用于指令和语言约束。仅使用监督式精调(不进行持续预训练或语料扩张),SiamGPT-32B 在指令遵循性、多轮鲁棒性和语言稳定性方面均取得改进。在 SEA-HELM 榜单上评估显示,SiamGPT-32B 在相似规模的开源泰语模型中实现了最强的整体性能,在指令跟随、多轮对话和自然语言理解方面均取得持续性提升。
引用
@article{arxiv.2512.19455,
title = {SiamGPT: Quality-First Fine-Tuning for Stable Thai Text Generation},
author = {Thittipat Pairatsuppawat and Abhibhu Tachaapornchai and Paweekorn Kusolsomboon and Chutikan Chaiwong and Thodsaporn Chay-intr and Kobkrit Viriyayudhakorn and Nongnuch Ketui and Aslan B. Wong},
journal= {arXiv preprint arXiv:2512.19455},
year = {2026}
}