English

Aligning LLMs for Multilingual Consistency in Enterprise Applications

Computation and Language 2025-10-28 v2 Artificial Intelligence

Abstract

Large language models (LLMs) remain unreliable for global enterprise applications due to substantial performance gaps between high-resource and mid/low-resource languages, driven by English-centric pretraining and internal reasoning biases. This inconsistency undermines customer experience and operational reliability in multilingual settings such as customer support, content moderation, and information retrieval. Even with advanced Retrieval-Augmented Generation (RAG) systems, we observe up to an 29% accuracy drop in non-English languages compared to English. We propose a practical, batch-wise alignment strategy for fine-tuning LLMs, leveraging semantically equivalent multilingual data in each training batch to directly align model outputs across languages. This approach improves non-English accuracy by up to 23.9% without compromising English performance, model reasoning, or retrieval quality. Our method is simple to implement, scalable, and integrates seamlessly with existing LLM training & deployment pipelines, enabling more robust and equitable multilingual AI solutions in industry.

Keywords

Cite

@article{arxiv.2509.23659,
  title  = {Aligning LLMs for Multilingual Consistency in Enterprise Applications},
  author = {Amit Agarwal and Hansa Meghwani and Hitesh Laxmichand Patel and Tao Sheng and Sujith Ravi and Dan Roth},
  journal= {arXiv preprint arXiv:2509.23659},
  year   = {2025}
}

Comments

Accepted at EMNLP 2025

R2 v1 2026-07-01T06:02:01.830Z