English
Related papers

Related papers: DeepSeek-Coder-V2: Breaking the Barrier of Closed-…

200 papers

Modern software relies on a multitude of automated testing and quality assurance tools to prevent errors, bugs and potential vulnerabilities. This study sets out to provide a head-to-head, quantitative and qualitative evaluation of six…

Software Engineering · Computer Science 2025-08-07 Damian Gnieciak , Tomasz Szandala

The rapid development of open-source large language models (LLMs) has been truly remarkable. However, the scaling law described in previous literature presents varying conclusions, which casts a dark cloud over scaling LLMs. We delve into…

Code completion is a key feature of Integrated Development Environments (IDEs), aimed at predicting the next tokens a developer is likely to write, helping them write code faster and with less effort. Modern code completion approaches are…

Software Engineering · Computer Science 2024-03-25 Matteo Ciniselli , Alberto Martin-Lopez , Gabriele Bavota

Determining the most effective Large Language Model for code smell detection presents a complex challenge. This study introduces a structured methodology and evaluation matrix to tackle this issue, leveraging a curated dataset of code…

Software Engineering · Computer Science 2025-04-23 Ahmed R. Sadik , Siddhata Govind

Large Language Models have shown impressive capabilities in coding tasks like code generation and code completion, as they have been trained on a large amount of code data. Also, since one of the core pretraining objectives is Next Token…

Software Engineering · Computer Science 2025-07-16 Jayant Havare , Saurav Chaudhary , Ganesh Ramakrishnan , Kaushik Maharajan , Srikanth Tamilselvam

Mixture-of-Experts (MoE) effectively scales large language models (LLMs) and vision-language models (VLMs) by increasing capacity through sparse activation. However, preloading all experts into memory and activating multiple experts per…

Machine Learning · Computer Science 2025-10-14 Wei Huang , Yue Liao , Yukang Chen , Jianhui Liu , Haoru Tan , Si Liu , Shiming Zhang , Shuicheng Yan , Xiaojuan Qi

This study presents a comprehensive empirical evaluation of six state-of-the-art large language models (LLMs) for code generation, including both general-purpose and code-specialized models. Using a dataset of 944 real-world LeetCode…

Software Engineering · Computer Science 2025-12-23 Le Zhang , Suresh Kothari

We introduce DeepSeek-Prover-V1.5, an open-source language model designed for theorem proving in Lean 4, which enhances DeepSeek-Prover-V1 by optimizing both training and inference processes. Pre-trained on DeepSeekMath-Base with…

We present Seed1.5-VL, a vision-language foundation model designed to advance general-purpose multimodal understanding and reasoning. Seed1.5-VL is composed with a 532M-parameter vision encoder and a Mixture-of-Experts (MoE) LLM of 20B…

Computer Vision and Pattern Recognition · Computer Science 2025-05-13 Dong Guo , Faming Wu , Feida Zhu , Fuxing Leng , Guang Shi , Haobin Chen , Haoqi Fan , Jian Wang , Jianyu Jiang , Jiawei Wang , Jingji Chen , Jingjia Huang , Kang Lei , Liping Yuan , Lishu Luo , Pengfei Liu , Qinghao Ye , Rui Qian , Shen Yan , Shixiong Zhao , Shuai Peng , Shuangye Li , Sihang Yuan , Sijin Wu , Tianheng Cheng , Weiwei Liu , Wenqian Wang , Xianhan Zeng , Xiao Liu , Xiaobo Qin , Xiaohan Ding , Xiaojun Xiao , Xiaoying Zhang , Xuanwei Zhang , Xuehan Xiong , Yanghua Peng , Yangrui Chen , Yanwei Li , Yanxu Hu , Yi Lin , Yiyuan Hu , Yiyuan Zhang , Youbin Wu , Yu Li , Yudong Liu , Yue Ling , Yujia Qin , Zanbo Wang , Zhiwu He , Aoxue Zhang , Bairen Yi , Bencheng Liao , Can Huang , Can Zhang , Chaorui Deng , Chaoyi Deng , Cheng Lin , Cheng Yuan , Chenggang Li , Chenhui Gou , Chenwei Lou , Chengzhi Wei , Chundian Liu , Chunyuan Li , Deyao Zhu , Donghong Zhong , Feng Li , Feng Zhang , Gang Wu , Guodong Li , Guohong Xiao , Haibin Lin , Haihua Yang , Haoming Wang , Heng Ji , Hongxiang Hao , Hui Shen , Huixia Li , Jiahao Li , Jialong Wu , Jianhua Zhu , Jianpeng Jiao , Jiashi Feng , Jiaze Chen , Jianhui Duan , Jihao Liu , Jin Zeng , Jingqun Tang , Jingyu Sun , Joya Chen , Jun Long , Junda Feng , Junfeng Zhan , Junjie Fang , Junting Lu , Kai Hua , Kai Liu , Kai Shen , Kaiyuan Zhang , Ke Shen , Ke Wang , Keyu Pan , Kun Zhang , Kunchang Li , Lanxin Li , Lei Li , Lei Shi , Li Han , Liang Xiang , Liangqiang Chen , Lin Chen , Lin Li , Lin Yan , Liying Chi , Longxiang Liu , Mengfei Du , Mingxuan Wang , Ningxin Pan , Peibin Chen , Pengfei Chen , Pengfei Wu , Qingqing Yuan , Qingyao Shuai , Qiuyan Tao , Renjie Zheng , Renrui Zhang , Ru Zhang , Rui Wang , Rui Yang , Rui Zhao , Shaoqiang Xu , Shihao Liang , Shipeng Yan , Shu Zhong , Shuaishuai Cao , Shuangzhi Wu , Shufan Liu , Shuhan Chang , Songhua Cai , Tenglong Ao , Tianhao Yang , Tingting Zhang , Wanjun Zhong , Wei Jia , Wei Weng , Weihao Yu , Wenhao Huang , Wenjia Zhu , Wenli Yang , Wenzhi Wang , Xiang Long , XiangRui Yin , Xiao Li , Xiaolei Zhu , Xiaoying Jia , Xijin Zhang , Xin Liu , Xinchen Zhang , Xinyu Yang , Xiongcai Luo , Xiuli Chen , Xuantong Zhong , Xuefeng Xiao , Xujing Li , Yan Wu , Yawei Wen , Yifan Du , Yihao Zhang , Yining Ye , Yonghui Wu , Yu Liu , Yu Yue , Yufeng Zhou , Yufeng Yuan , Yuhang Xu , Yuhong Yang , Yun Zhang , Yunhao Fang , Yuntao Li , Yurui Ren , Yuwen Xiong , Zehua Hong , Zehua Wang , Zewei Sun , Zeyu Wang , Zhao Cai , Zhaoyue Zha , Zhecheng An , Zhehui Zhao , Zhengzhuo Xu , Zhipeng Chen , Zhiyong Wu , Zhuofan Zheng , Zihao Wang , Zilong Huang , Ziyu Zhu , Zuquan Song

We introduce Seed1.5-Thinking, capable of reasoning through thinking before responding, resulting in improved performance on a wide range of benchmarks. Seed1.5-Thinking achieves 86.7 on AIME 2024, 55.0 on Codeforces and 77.3 on GPQA,…

Computation and Language · Computer Science 2025-04-30 ByteDance Seed , : , Jiaze Chen , Tiantian Fan , Xin Liu , Lingjun Liu , Zhiqi Lin , Mingxuan Wang , Chengyi Wang , Xiangpeng Wei , Wenyuan Xu , Yufeng Yuan , Yu Yue , Lin Yan , Qiying Yu , Xiaochen Zuo , Chi Zhang , Ruofei Zhu , Zhecheng An , Zhihao Bai , Yu Bao , Xingyan Bin , Jiangjie Chen , Feng Chen , Hongmin Chen , Riwei Chen , Liangqiang Chen , Zixin Chen , Jinsong Chen , Siyan Chen , Kaiyuan Chen , Zhi Chen , Jin Chen , Jiecao Chen , Jinxin Chi , Weinan Dai , Ning Dai , Jiahui Dai , Shihan Dou , Yantao Du , Zhengyin Du , Jianhui Duan , Chen Dun , Ting-Han Fan , Jiazhan Feng , Junda Feng , Ziyuan Feng , Yuwei Fu , Wenqi Fu , Hanjie Fu , Hao Ge , Hongyi Guo , Mingji Han , Li Han , Wenhao Hao , Xintong Hao , Qianyu He , Jerry He , Feng He , Wen Heng , Zehua Hong , Qi Hou , Liang Hu , Shengding Hu , Nan Hu , Kai Hua , Qi Huang , Ziyue Huang , Hongzhi Huang , Zihao Huang , Ting Huang , Wenhao Huang , Wei Jia , Bin Jia , Xiaoying Jia , Yuhua Jiang , Haobin Jiang , Ziheng Jiang , Kaihua Jiang , Chengquan Jiang , Jianpeng Jiao , Xiaoran Jin , Xing Jin , Xunhao Lai , Zheng Li , Xiang Li , Liyi Li , Hongkai Li , Zheng Li , Shengxian Wan , Ya Wang , Yunshui Li , Chenggang Li , Niuniu Li , Siyu Li , Xi Li , Xiao Li , Aoyan Li , Yuntao Li , Nianning Liang , Xinnian Liang , Haibin Lin , Weijian Lin , Ye Lin , Zhicheng Liu , Guanlin Liu , Guanlin Liu , Chenxiao Liu , Yan Liu , Gaohong Liu , Juncai Liu , Chundian Liu , Deyi Liu , Kaibo Liu , Siyao Liu , Qi Liu , Yongfei Liu , Kang Liu , Gan Liu , Boyi Liu , Rui Long , Weiqiang Lou , Chenwei Lou , Xiang Luo , Yao Luo , Caiping Lv , Heyang Lv , Bole Ma , Qianli Ma , Hongzhi Ma , Yiyuan Ma , Jin Ma , Wenchang Ma , Tingting Ma , Chen Mao , Qiyang Min , Zhe Nan , Guanghan Ning , Jinxiang Ou , Haojie Pan , Renming Pang , Yanghua Peng , Tao Peng , Lihua Qian , Lihua Qian , Mu Qiao , Meng Qu , Cheng Ren , Hongbin Ren , Yong Shan , Wei Shen , Ke Shen , Kai Shen , Guangming Sheng , Jinlong Shi , Wenlei Shi , Guang Shi , Shuai Shuai Cao , Yuxin Song , Zuquan Song , Jing Su , Yifan Sun , Tao Sun , Zewei Sun , Borui Wan , Zihan Wang , Xiaohui Wang , Xi Wang , Shuguang Wang , Jun Wang , Qinlong Wang , Chenyuan Wang , Shuai Wang , Zihan Wang , Changbao Wang , Jiaqiang Wang , Shihang Wang , Xuwu Wang , Zaiyuan Wang , Yuxuan Wang , Wenqi Wang , Taiqing Wang , Chengzhi Wei , Houmin Wei , Ziyun Wei , Shufa Wei , Zheng Wu , Yonghui Wu , Yangjun Wu , Bohong Wu , Shuang Wu , Jingqiao Wu , Ning Wu , Shuangzhi Wu , Jianmin Wu , Chenguang Xi , Fan Xia , Yuqiao Xian , Liang Xiang , Boren Xiang , Bowen Xiao , Zhen Xiao , Xia Xiao , Yongsheng Xiao , Chao Xin , Shulin Xin , Yuwen Xiong , Jingjing Xu , Ziwen Xu , Chenyin Xu , Jiayi Xu , Yifan Xu , Wei Xu , Yufei Xu , Shikun Xu , Shipeng Yan , Shen Yan , Qingping Yang , Xi Yang , Tianhao Yang , Yuehang Yang , Yuan Yang , Ximing Yang , Zeyu Yang , Guang Yang , Yifan Yang , Xuesong Yao , Bairen Yi , Fan Yin , Jianian Yin , Ziqiang Ying , Xiangyu Yu , Hongli Yu , Song Yu , Menghan Yu , Huan Yu , Siyu Yuan , Jun Yuan , Yutao Zeng , Tianyang Zhan , Zheng Zhang , Yun Zhang , Mofan Zhang , Wang Zhang , Ru Zhang , Zhi Zhang , Tianqi Zhang , Xinyi Zhang , Zhexi Zhang , Sijun Zhang , Wenqiang Zhang , Xiangxiang Zhang , Yongtao Zhang , Yuyu Zhang , Ge Zhang , He Zhang , Yue Zhang , Renjie Zheng , Ningxin Zheng , Zhuolin Zheng , Yaowei Zheng , Chen Zheng , Xiaoyun Zhi , Wanjun Zhong , Cheng Zhong , Zheng Zhong , Baoquan Zhong , Xun Zhou , Na Zhou , Huan Zhou , Hang Zhu , Defa Zhu , Wenjia Zhu , Lei Zuo

Recently, Mixture-of-Experts (short as MoE) architecture has achieved remarkable success in increasing the model capacity of large-scale language models. However, MoE requires incorporating significantly more parameters than the base model…

Computation and Language · Computer Science 2022-10-14 Ze-Feng Gao , Peiyu Liu , Wayne Xin Zhao , Zhong-Yi Lu , Ji-Rong Wen

Scaling Mixture-of-Experts (MoE) training introduces systems challenges absent in dense models. Because each token activates only a subset of experts, this sparsity allows total parameters to grow much faster than per-token computation,…

The application of Artificial Intelligence has become a powerful approach to detecting software vulnerabilities. However, effective vulnerability detection relies on accurately capturing the semantic structure of code and its contextual…

Software Engineering · Computer Science 2025-05-12 José Gonçalves , Miguel Silva , Eva Maia , Isabel Praça

Code intelligence leverages machine learning techniques to extract knowledge from extensive code corpora, with the aim of developing intelligent tools to improve the quality and productivity of computer programming. Currently, there is…

Software Engineering · Computer Science 2024-01-02 Yao Wan , Yang He , Zhangqian Bi , Jianguo Zhang , Hongyu Zhang , Yulei Sui , Guandong Xu , Hai Jin , Philip S. Yu

Nowadays, DeepSeek, ChatGPT, and Google Gemini are the most trending and exciting Large Language Model (LLM) technologies for reasoning, multimodal capabilities, and general linguistic performance worldwide. DeepSeek employs a…

Code large language models mark a pivotal breakthrough in artificial intelligence. They are specifically crafted to understand and generate programming languages, significantly boosting the efficiency of coding development workflows. In…

Software Engineering · Computer Science 2024-03-26 Rui Xie , Zhengran Zeng , Zhuohao Yu , Chang Gao , Shikun Zhang , Wei Ye

We present MiMo-V2-Flash, a Mixture-of-Experts (MoE) model with 309B total parameters and 15B active parameters, designed for fast, strong reasoning and agentic capabilities. MiMo-V2-Flash adopts a hybrid attention architecture that…

Computation and Language · Computer Science 2026-01-09 Core Team , Bangjun Xiao , Bingquan Xia , Bo Yang , Bofei Gao , Bowen Shen , Chen Zhang , Chenhong He , Chiheng Lou , Fuli Luo , Gang Wang , Gang Xie , Hailin Zhang , Hanglong Lv , Hanyu Li , Heyu Chen , Hongshen Xu , Houbin Zhang , Huaqiu Liu , Jiangshan Duo , Jianyu Wei , Jiebao Xiao , Jinhao Dong , Jun Shi , Junhao Hu , Kainan Bao , Kang Zhou , Lei Li , Liang Zhao , Linghao Zhang , Peidian Li , Qianli Chen , Shaohui Liu , Shihua Yu , Shijie Cao , Shimao Chen , Shouqiu Yu , Shuo Liu , Tianling Zhou , Weijiang Su , Weikun Wang , Wenhan Ma , Xiangwei Deng , Bohan Mao , Bowen Ye , Can Cai , Chenghua Wang , Chengxuan Zhu , Chong Ma , Chun Chen , Chunan Li , Dawei Zhu , Deshan Xiao , Dong Zhang , Duo Zhang , Fangyue Liu , Feiyu Yang , Fengyuan Shi , Guoan Wang , Hao Tian , Hao Wu , Heng Qu , Hongfei Yi , Hongxu An , Hongyi Guan , Xing Zhang , Yifan Song , Yihan Yan , Yihao Zhao , Yingchun Lai , Yizhao Gao , Yu Cheng , Yuanyuan Tian , Yudong Wang , Zhen Tang , Zhengju Tang , Zhengtao Wen , Zhichao Song , Zhixian Zheng , Zihan Jiang , Jian Wen , Jiarui Sun , Jiawei Li , Jinlong Xue , Jun Xia , Kai Fang , Menghang Zhu , Nuo Chen , Qian Tu , Qihao Zhang , Qiying Wang , Rang Li , Rui Ma , Shaolei Zhang , Shengfan Wang , Shicheng Li , Shuhao Gu , Shuhuai Ren , Sirui Deng , Tao Guo , Tianyang Lu , Weiji Zhuang , Weikang Zhang , Weimin Xiong , Wenshan Huang , Wenyu Yang , Xin Zhang , Xing Yong , Xu Wang , Xueyang Xie , Yilin Jiang , Yixin Yang , Yongzhe He , Yu Tu , Yuanliang Dong , Yuchen Liu , Yue Ma , Yue Yu , Yuxing Xiang , Zhaojun Huang , Zhenru Lin , Zhipeng Xu , Zhiyang Chen , Zhonghua Deng , Zihan Zhang , Zihao Yue

Recent work demonstrates that, after instruction tuning, Code Large Language Models (Code LLMs) can obtain impressive capabilities to address a wide range of code-related tasks. However, current instruction tuning methods for Code LLMs…

Computation and Language · Computer Science 2024-06-10 Zhaojian Yu , Xin Zhang , Ning Shang , Yangyu Huang , Can Xu , Yishujie Zhao , Wenxiang Hu , Qiufeng Yin

As the quality of code generated by Large Language Models (LLMs) improves, their adoption in the software industry for automated code generation continues to grow. Researchers primarily focus on enhancing the functional correctness of the…

Contemporary vision-language models (VLMs) perform well on existing multimodal reasoning benchmarks (78-85\% accuracy on MMMU, MathVista). Yet, these results fail to sufficiently distinguish true scientific reasoning articulation…

Computation and Language · Computer Science 2025-11-13 Arka Mukherjee , Shreya Ghosh