ModelGPT:释放大型语言模型能力以生成定制模型
机器学习
2024-02-21 v1 人工智能
计算与语言
摘要
大型语言模型(LLMs)的快速进步通过自动化常规任务彻底改变了各个行业,标志着向实现通用人工智能(AGI)迈出了一步。然而,它们在满足用户多样化和特定需求以及简化普通用户对 AI 模型的利用方面仍面临挑战。为此,我们提出了 ModelGPT,这是一种新颖的框架,旨在利用 LLMs 的能力,根据用户提供的数据或任务描述来确定并生成专门定制的 AI 模型。给定用户需求,ModelGPT 能够以比先前范式(例如全参数微调或 LoRA 微调)快最多 270 倍的速度提供定制模型。在 NLP、CV 和表格数据集上的综合实验证实了我们的框架在使 AI 模型更易于访问和用户友好方面的有效性。我们的代码可在 https://github.com/IshiKura-a/ModelGPT 获取。
引用
@article{arxiv.2402.12408,
title = {ModelGPT: Unleashing LLM's Capabilities for Tailored Model Generation},
author = {Zihao Tang and Zheqi Lv and Shengyu Zhang and Fei Wu and Kun Kuang},
journal= {arXiv preprint arXiv:2402.12408},
year = {2024}
}