EasyEdit2:用于编辑大型语言模型的易用引导框架
计算与语言
2025-09-16 v3 人工智能
计算机视觉与模式识别
人机交互
机器学习
摘要
本文介绍 EasyEdit2,一个旨在实现大型语言模型 (Large Language Model, LLM) 行为可插拔调节的框架。EasyEdit2 支持广泛的测试时干预,包括安全性、情感、人格、推理模式、事实性和语言特征。与其前身不同,EasyEdit2 采用新型架构专为无缝模型引导设计,包含驾驶向量生成器和驾驶向量应用器等关键模块,使可自动生成和应用驾驶向量以影响模型行为,而无需修改其参数。EasyEdit2 的一个主要优势是使用便捷性——用户无需具备 extensive 技术知识。只需一个示例,即可有效引导和调整模型的响应,实现精确控制兼具可访问性和效率。我们在不同 LLMs 上报告了模型引导性能,证明了这些技术的有效性。我们已在 GitHub 上发布源码,链接为 https://github.com/zjunlp/EasyEdit,附带演示笔记本。此外,我们还提供了一个演示视频链接 https://www.youtube.com/watch?v=AkfoiPfp5rQ 进行快速介绍。
引用
@article{arxiv.2504.15133,
title = {EasyEdit2: An Easy-to-use Steering Framework for Editing Large Language Models},
author = {Ziwen Xu and Shuxun Wang and Kewei Xu and Haoming Xu and Mengru Wang and Xinle Deng and Yunzhi Yao and Guozhou Zheng and Huajun Chen and Ningyu Zhang},
journal= {arXiv preprint arXiv:2504.15133},
year = {2025}
}
备注
EMNLP 2025 System Demonstrations. Demo: https://www.youtube.com/watch?v=AkfoiPfp5rQ; code: https://github.com/zjunlp/EasyEdit