Mi:dm K 2.5 Pro
计算与语言
2026-03-25 v2 人工智能
摘要
不断演变的LLM领域需要超越简单文本生成的能力,强调多步推理、长文本理解和智能体工作流程。这一转变挑战着现有模型在企业环境中的表现,尤其是在韩语和特定领域场景中由于规模不足。我们引入Mi:dm K 2.5 Pro,这是一个320亿参数的旗舰LLM,通过以推理为导向的优化,旨在解决企业级复杂问题。我们的 метод构建了一个以质量为中心的精选管道,通过抽象语法树(AST)分析代码、gap-filling合成数学,并利用基于LLM的质量评估器。通过基于层预测器的深度扩展(DuS)和支持128K token上下文窗口的渐进策略进行预训练。后训练引入一个专业的多阶段管道,包括推理SFT、模型合并和异步强化学习(RL),以发展复杂问题解决技能。随后,“Fusion Training”将这些能力与对话流畅性、一致的响应样式和可靠的工具使用重新平衡。评估结果表明,Mi:dm K 2.5 Pro在对抗领先的全球和国内模型方面实现了竞争性能。此外,它在韩语特定基准测试中取得了最先进的结果,展现了深厚的语言和文化理解。最后,负责任的AI评估验证了模型在抵抗攻击方面的安全性,确保了在无害性和响应性之间取得平衡,适用于部署。
引用
@article{arxiv.2603.18788,
title = {Mi:dm K 2.5 Pro},
author = {KT Tech innovation Group},
journal= {arXiv preprint arXiv:2603.18788},
year = {2026}
}