Sabi\'a-4 技术报告
计算与语言
2026-03-12 v1
摘要
本技术报告介绍了 Sabi\'a-4 和 Sabiazinho-4,以及一代新的葡萄牙语语言模型,旨在关注巴西葡萄牙语。我们通过四阶段训练管道开发了这些模型:对葡萄牙语和巴西葡萄牙语法律语料进行持续预训练,将上下文扩展至 128K token,对覆盖聊天、代码、法律任务和函数调用的指令数据进行监督式微调,并进行偏好对齐。我们在六个基准类别上评估了这些模型:巴西葡萄牙语对话能力、巴西立法知识、长文本理解、指令遵循、标准化考试以及包括工具使用和网页导航在内的代理能力。结果表明,Sabi\'a-4 和 Sabiazinho-4 在其他模型的成本-性能权衡方面表现优异,位于定价-准确性图表的左上角。这些模型在法律文件起草、多轮对话质量和代理任务完成方面均优于前一代。
引用
@article{arxiv.2603.10213,
title = {Sabi\'a-4 Technical Report},
author = {Thiago Laitz and Thales Sales Almeida and Hugo Abonizio and Roseval Malaquias Junior and Giovana Kerche Bonás and Marcos Piau and Celio Larcher and Ramon Pires and Rodrigo Nogueira},
journal= {arXiv preprint arXiv:2603.10213},
year = {2026}
}