中文

大语言模型 (LLM) 在电信领域应用综述:原理、关键技术与机遇

系统与控制 2024-09-17 v2 机器学习 系统与控制

摘要

大语言模型 (LLM) 因其卓越的理解与推理能力而备受关注,推动了诸多领域的快速进展。LLM 技术的发展也为自动化电信领域的许多任务提供了前景。经过预训练和微调后,LLM 可基于人类指令执行多样的下游任务,为实现人工通用智能 (AGI) 使能的 6G 铺平了道路。鉴于 LLM 技术的巨大潜力,本文旨在提供 LLM 使能电信网络的全面概览。具体而言,我们首先介绍 LLM 的基本原理,包括模型架构、预训练、微调、推理与应用、模型评估以及电信部署。随后,我们介绍 LLM 使能的关键技术和电信应用,涵盖生成、分类、优化和预测问题。具体到生成应用,包括电信领域知识、代码和网络配置生成。随后,LLM 基于的分类应用涉及网络安全、文本、图像和流量分类问题。此外,介绍了多项 LLM 使能的优化技术,如强化学习的自动奖励函数设计和口语强化学习。就 LLM 辅助预测问题,本文讨论了电信领域的时间序列预测模型和多模态预测问题。最后,我们指出 LLM 使能电信网络的挑战,并阐明未来发展方向。

关键词

引用

@article{arxiv.2405.10825,
  title  = {Large Language Model (LLM) for Telecommunications: A Comprehensive Survey on Principles, Key Techniques, and Opportunities},
  author = {Hao Zhou and Chengming Hu and Ye Yuan and Yufei Cui and Yili Jin and Can Chen and Haolun Wu and Dun Yuan and Li Jiang and Di Wu and Xue Liu and Charlie Zhang and Xianbin Wang and Jiangchuan Liu},
  journal= {arXiv preprint arXiv:2405.10825},
  year   = {2024}
}