智能体技能框架:关于小型语言模型在工业环境中的潜力
人工智能
2026-02-23 v2
摘要
智能体技能框架(Agent Skill framework)已被 GitHub Copilot、LangChain 和 OpenAI 等主要厂商广泛且官方支持,尤其擅长通过改进上下文工程、减少幻觉并提升任务准确性来提升专有模型的性能。基于这些观察,本文探讨了智能体技能范式是否为小型语言模型(Small Language Models, SLMs)提供类似收益。这一问题在工业场景中尤为重要,因为数据安全和预算约束要求使持续依赖公共 API 不切实际,而且 SLMs 在高度定制化的场景中常表现出有限的泛化能力。本文提出小型语言模型的智能体技能过程的形式数学定义,随后对不同规模的语言模型进行系统评估。评估包括两个开源任务和一个真实的保险索赔数据集。结果表明,极小模型在可靠技能选择方面困难重重,而中等规模的 SLMs(约 12B - 30B 参数)从智能体技能方法中获益显著。此外,约 80B 参数的面向代码优化的变体在提高 GPU 效率的同时,实现了与闭源基线相当的性能。总体而言,这些发现对小型语言模型环境中智能体技能的有效部署提供了全面且细致的能力与约束特征描述。
引用
@article{arxiv.2602.16653,
title = {Agent Skill Framework: Perspectives on the Potential of Small Language Models in Industrial Environments},
author = {Yangjie Xu and Lujun Li and Lama Sleem and Niccolo Gentile and Yewei Song and Yiqun Wang and Siming Ji and Wenbo Wu and Radu State},
journal= {arXiv preprint arXiv:2602.16653},
year = {2026}
}