中文
相关论文

相关论文: Kimi-Dev: Agentless Training as Skill Prior for SW…

200 篇论文

Tool use has turned large language models (LLMs) into powerful agents that can perform complex multi-step tasks by dynamically utilising external software components. However, these tools must be implemented in advance by human developers,…

计算与语言 · 计算机科学 2025-06-02 Georg Wölflein , Dyke Ferber , Daniel Truhn , Ognjen Arandjelović , Jakob Nikolas Kather

This paper investigates the integration of cognitive agents powered by Large Language Models (LLMs) within the Scaled Agile Framework (SAFe) to reinforce software project management. By deploying virtual agents in simulated software…

软件工程 · 计算机科学 2025-08-26 Konrad Cinkusz , Jarosław A. Chudziak , Ewa Niewiadomska-Szynkiewicz

Recent advances in Large Language Models (LLMs) have shown promise in function-level code generation, yet repository-level software engineering tasks remain challenging. Current solutions predominantly rely on proprietary LLM agents, which…

We demonstrate that large language model (LLM) agents can autonomously perform tensor network simulations of quantum many-body systems, achieving approximately 90% success rate across representative benchmark tasks. Tensor network methods…

量子物理 · 物理学 2026-01-16 Weitang Li , Jiajun Ren , Lixue Cheng , Cunxi Gong

Despite the proliferation of powerful agentic models, the lack of critical post-training details hinders the development of strong counterparts in the open-source community. In this study, we present a comprehensive and fully open-source…

We present SWE-Lego, a supervised fine-tuning (SFT) recipe designed to achieve state-ofthe-art performance in software engineering (SWE) issue resolving. In contrast to prevalent methods that rely on complex training paradigms (e.g.,…

Large Language Models (LLMs) have shown surprising proficiency in generating code snippets, promising to automate large parts of software engineering via artificial intelligence (AI). We argue that successfully deploying AI software…

软件工程 · 计算机科学 2025-09-24 Abhik Roychoudhury , Corina Pasareanu , Michael Pradel , Baishakhi Ray

Large language models (LLMs) and LLM-based Agents have been applied to fix bugs automatically, demonstrating the capability in addressing software defects by engaging in development environment interaction, iterative validation and code…

软件工程 · 计算机科学 2025-10-21 Xiangxin Meng , Zexiong Ma , Pengfei Gao , Chao Peng

Large Language Model (LLM) based agents are powerful yet fundamentally static after deployment, lacking the ability to autonomously expand capabilities, generate new tools, or evolve their reasoning. This work introduces a hierarchical…

计算与语言 · 计算机科学 2026-01-21 Indrajit Kar , Sammy Zonunpuia , Zonunfeli Ralte

The advancement of large language models (LLMs) and code agents has demonstrated significant potential to assist software engineering (SWE) tasks, such as autonomous issue resolution and feature addition. Existing AI for software…

Large language models (LLM) are perceived to offer promising potentials for automating security tasks, such as those found in security operation centers (SOCs). As a first step towards evaluating this perceived potential, we investigate the…

We introduce Kimi K2.5, an open-source multimodal agentic model designed to advance general agentic intelligence. K2.5 emphasizes the joint optimization of text and vision so that two modalities enhance each other. This includes a series of…

计算与语言 · 计算机科学 2026-02-04 Kimi Team , Tongtong Bai , Yifan Bai , Yiping Bao , S. H. Cai , Yuan Cao , Y. Charles , H. S. Che , Cheng Chen , Guanduo Chen , Huarong Chen , Jia Chen , Jiahao Chen , Jianlong Chen , Jun Chen , Kefan Chen , Liang Chen , Ruijue Chen , Xinhao Chen , Yanru Chen , Yanxu Chen , Yicun Chen , Yimin Chen , Yingjiang Chen , Yuankun Chen , Yujie Chen , Yutian Chen , Zhirong Chen , Ziwei Chen , Dazhi Cheng , Minghan Chu , Jialei Cui , Jiaqi Deng , Muxi Diao , Hao Ding , Mengfan Dong , Mengnan Dong , Yuxin Dong , Yuhao Dong , Angang Du , Chenzhuang Du , Dikang Du , Lingxiao Du , Yulun Du , Yu Fan , Shengjun Fang , Qiulin Feng , Yichen Feng , Garimugai Fu , Kelin Fu , Hongcheng Gao , Tong Gao , Yuyao Ge , Shangyi Geng , Chengyang Gong , Xiaochen Gong , Zhuoma Gongque , Qizheng Gu , Xinran Gu , Yicheng Gu , Longyu Guan , Yuanying Guo , Xiaoru Hao , Weiran He , Wenyang He , Yunjia He , Chao Hong , Hao Hu , Jiaxi Hu , Yangyang Hu , Zhenxing Hu , Ke Huang , Ruiyuan Huang , Weixiao Huang , Zhiqi Huang , Tao Jiang , Zhejun Jiang , Xinyi Jin , Yu Jing , Guokun Lai , Aidi Li , C. Li , Cheng Li , Fang Li , Guanghe Li , Guanyu Li , Haitao Li , Haoyang Li , Jia Li , Jingwei Li , Junxiong Li , Lincan Li , Mo Li , Weihong Li , Wentao Li , Xinhang Li , Xinhao Li , Yang Li , Yanhao Li , Yiwei Li , Yuxiao Li , Zhaowei Li , Zheming Li , Weilong Liao , Jiawei Lin , Xiaohan Lin , Zhishan Lin , Zichao Lin , Cheng Liu , Chenyu Liu , Hongzhang Liu , Liang Liu , Shaowei Liu , Shudong Liu , Shuran Liu , Tianwei Liu , Tianyu Liu , Weizhou Liu , Xiangyan Liu , Yangyang Liu , Yanming Liu , Yibo Liu , Yuanxin Liu , Yue Liu , Zhengying Liu , Zhongnuo Liu , Enzhe Lu , Haoyu Lu , Zhiyuan Lu , Junyu Luo , Tongxu Luo , Yashuo Luo , Long Ma , Yingwei Ma , Shaoguang Mao , Yuan Mei , Xin Men , Fanqing Meng , Zhiyong Meng , Yibo Miao , Minqing Ni , Kun Ouyang , Siyuan Pan , Bo Pang , Yuchao Qian , Ruoyu Qin , Zeyu Qin , Jiezhong Qiu , Bowen Qu , Zeyu Shang , Youbo Shao , Tianxiao Shen , Zhennan Shen , Juanfeng Shi , Lidong Shi , Shengyuan Shi , Feifan Song , Pengwei Song , Tianhui Song , Xiaoxi Song , Hongjin Su , Jianlin Su , Zhaochen Su , Lin Sui , Jinsong Sun , Junyao Sun , Tongyu Sun , Flood Sung , Yunpeng Tai , Chuning Tang , Heyi Tang , Xiaojuan Tang , Zhengyang Tang , Jiawen Tao , Shiyuan Teng , Chaoran Tian , Pengfei Tian , Ao Wang , Bowen Wang , Chensi Wang , Chuang Wang , Congcong Wang , Dingkun Wang , Dinglu Wang , Dongliang Wang , Feng Wang , Hailong Wang , Haiming Wang , Hengzhi Wang , Huaqing Wang , Hui Wang , Jiahao Wang , Jinhong Wang , Jiuzheng Wang , Kaixin Wang , Linian Wang , Qibin Wang , Shengjie Wang , Shuyi Wang , Si Wang , Wei Wang , Xiaochen Wang , Xinyuan Wang , Yao Wang , Yejie Wang , Yipu Wang , Yiqin Wang , Yucheng Wang , Yuzhi Wang , Zhaoji Wang , Zhaowei Wang , Zhengtao Wang , Zhexu Wang , Zihan Wang , Zizhe Wang , Chu Wei , Ming Wei , Chuan Wen , Zichen Wen , Chengjie Wu , Haoning Wu , Junyan Wu , Rucong Wu , Wenhao Wu , Yuefeng Wu , Yuhao Wu , Yuxin Wu , Zijian Wu , Chenjun Xiao , Jin Xie , Xiaotong Xie , Yuchong Xie , Yifei Xin , Bowei Xing , Boyu Xu , Jianfan Xu , Jing Xu , Jinjing Xu , L. H. Xu , Lin Xu , Suting Xu , Weixin Xu , Xinbo Xu , Xinran Xu , Yangchuan Xu , Yichang Xu , Yuemeng Xu , Zelai Xu , Ziyao Xu , Junjie Yan , Yuzi Yan , Guangyao Yang , Hao Yang , Junwei Yang , Kai Yang , Ningyuan Yang , Ruihan Yang , Xiaofei Yang , Xinlong Yang , Ying Yang , Yi Yang , Yi Yang , Zhen Yang , Zhilin Yang , Zonghan Yang , Haotian Yao , Dan Ye , Wenjie Ye , Zhuorui Ye , Bohong Yin , Chengzhen Yu , Longhui Yu , Tao Yu , Tianxiang Yu , Enming Yuan , Mengjie Yuan , Xiaokun Yuan , Yang Yue , Weihao Zeng , Dunyuan Zha , Haobing Zhan , Dehao Zhang , Hao Zhang , Jin Zhang , Puqi Zhang , Qiao Zhang , Rui Zhang , Xiaobin Zhang , Y. Zhang , Yadong Zhang , Yangkun Zhang , Yichi Zhang , Yizhi Zhang , Yongting Zhang , Yu Zhang , Yushun Zhang , Yutao Zhang , Yutong Zhang , Zheng Zhang , Chenguang Zhao , Feifan Zhao , Jinxiang Zhao , Shuai Zhao , Xiangyu Zhao , Yikai Zhao , Zijia Zhao , Huabin Zheng , Ruihan Zheng , Shaojie Zheng , Tengyang Zheng , Junfeng Zhong , Longguang Zhong , Weiming Zhong , M. Zhou , Runjie Zhou , Xinyu Zhou , Zaida Zhou , Jinguo Zhu , Liya Zhu , Xinhao Zhu , Yuxuan Zhu , Zhen Zhu , Jingze Zhuang , Weiyu Zhuang , Ying Zou , Xinxing Zu

Large language model (LLM)-based agents that reason, plan, and act through tools, memory, and structured interaction are emerging as a promising paradigm for automating complex workflows. Recent systems such as OpenClaw and Claude Code…

信息检索 · 计算机科学 2026-05-27 Yingli Zhou , Wang Shu , Yaodong Su , Wenchuan Du , Yixiang Fang , Xuemin Lin

As Language Models (LMs) increasingly operate as autonomous agents, accurately forecasting their capabilities becomes crucial for societal preparedness. We evaluate six forecasting methods that predict downstream capabilities of LM agents.…

计算与语言 · 计算机科学 2025-03-04 Govind Pimpale , Axel Højmark , Jérémy Scheurer , Marius Hobbhahn

Large Language Model (LLM)-based agents are increasingly employed to automate complex software engineering tasks, such as program repair and issue resolution. These agents operate by autonomously generating natural language thoughts,…

软件工程 · 计算机科学 2025-10-09 Islem Bouzenia , Michael Pradel

We study whether self-learning can scale LLM-based agents without relying on human-curated datasets or predefined rule-based rewards. Through controlled experiments in a search-agent setting, we identify two key determinants of scalable…

人工智能 · 计算机科学 2025-10-22 Wangtao Sun , Xiang Cheng , Jialin Fan , Yao Xu , Xing Yu , Shizhu He , Jun Zhao , Kang Liu

Large Language Model (LLM) code agents increasingly resolve repository-level issues by iteratively editing code, invoking tools, and validating candidate patches. In these workflows, agents often write tests on the fly, but the value of…

软件工程 · 计算机科学 2026-04-10 Zhi Chen , Zhensu Sun , Yuling Shi , Chao Peng , Xiaodong Gu , David Lo , Lingxiao Jiang

The development of LLM-based autonomous agents for end-to-end software development represents a significant paradigm shift in software engineering. However, the scientific evaluation of these systems is hampered by significant challenges,…

软件工程 · 计算机科学 2025-11-07 Zhengran Zeng , Yixin Li , Rui Xie , Wei Ye , Shikun Zhang

Automated issue solving seeks to autonomously identify and repair defective code snippets across an entire codebase. SWE-Bench has emerged as the most widely adopted benchmark for evaluating progress in this area. While LLM-based agentic…

软件工程 · 计算机科学 2025-09-18 Simiao Liu , Fang Liu , Liehao Li , Xin Tan , Yinghao Zhu , Xiaoli Lian , Li Zhang

Prior works on training software engineering agents have explored utilizing existing resources such as issues on GitHub repositories to construct software engineering tasks and corresponding test suites. These approaches face two key…

软件工程 · 计算机科学 2026-01-13 Yiqi Zhu , Apurva Gandhi , Graham Neubig