English
Related papers

Related papers: Qwen2 Technical Report

200 papers

As language models (LMs) become capable of handling a wide range of tasks, their evaluation is becoming as challenging as their development. Most generation benchmarks currently assess LMs using abstract evaluation criteria like helpfulness…

Recent advances in large language models (LLMs) and medical LLMs (Med-LLMs) have demonstrated strong performance on general medical benchmarks. However, their capabilities in specialized medical fields, such as dentistry which require…

Computation and Language · Computer Science 2025-08-29 Hengchuan Zhu , Yihuan Xu , Yichen Li , Zijie Meng , Zuozhu Liu

Today's strongest video-language models (VLMs) remain proprietary. The strongest open-weight models either rely on synthetic data from proprietary VLMs, effectively distilling from them, or do not disclose their training data or recipe. As…

We introduce the Yi model family, a series of language and multimodal models that demonstrate strong multi-dimensional capabilities. The Yi model family is based on 6B and 34B pretrained language models, then we extend them to chat models,…

Pre-training state-of-the-art large language models (LLMs) requires vast amounts of clean and diverse text data. While the open development of large high-quality English pre-training datasets has seen substantial recent progress, training…

Large language models (LLMs) exhibit cultural bias from overrepresented viewpoints in training data, yet cultural alignment remains a challenge due to limited cultural knowledge and a lack of exploration into effective learning approaches.…

Computation and Language · Computer Science 2025-12-16 Chunhua Liu , Kabir Manandhar Shrestha , Sukai Huang

We present Laguna M.1 and Laguna XS.2, two Mixture-of-Experts foundation models built for long-horizon, agentic coding: M.1 has $225.8$B total parameters ($23.4$B activated per token) and XS.2 has $33.4$B total ($3$B activated). Both models…

Artificial Intelligence · Computer Science 2026-05-28 Julien Abadji , Marah Abdin , Connor Adams , Eric Alcaide , Mustafa Altun , Michele Artoni , Junze Bao , Uday Barar , Vassilis Bekiaris , Arkadii Bessonov , Benjamin Bütikofer , Jonathan Chang , Yen-Chun Chen , Dmitry Chernenkov , Yang Chi , Filippos Christianos , Fenia Christopoulou , Razvan-Andrei Ciocoiu , Tzachi Cohen , Yohann Coppel , Dmitrii Emelianenko , Brandon Fergerson , Brian Fitzgerald , Matthias Gallé , Alex Golonzovskyi , George Grigorev , Yiyang Hao , Christian Hensel , Jan Huenermann , Ye Ji , Sarthak Joshi , Eiso Kant , Kabir Khandpur , Seonghyeon Kim , Vladimir Kirichenko , Umut Kocasarac , Ilya Kochik , Ivan Komarov , Chaerin Kong , Anurag Koul , François-Joseph Lacroix , Sergei Laktionov , Waren Long , Quentin Malartic , Vadim Markovtsev , Afonso Marques , Robert McHardy , Carlos Mocholí , Dmitry Monakhov , Adam Morris , Martin Muller , Christian Mürtz , Robin Nabel , Thien Nguyen , Rok Novosel , Szymon Ozog , Aalhad Patankar , Aleksei Petrov , Alexandre Piché , Arthur Pignet , Teodor Poncu , Phil Potter , Alexander Rakowski , Pierre-Yves Ritschard , Jay Roberts , Joe Rowell , Piotr Sarna , Pierre-André Savalle , Uladzislau Sazanovich , Nikita Shapovalov , Arsenii Shevchenko , Mikhail Shilkov , Andrei Sokol , Mohamed Soliman , Jack Stephenson , Victor Storchan , Dragos-Constantin Tantaru , Artem Tyurin , Adrian Wälchli , Pengming Wang , Jianxiao Yang , Renat Zayashnikov , Alexander Zelenka Martin , Nikolay Zinov , Caroline Bercier , José Caldeira , Margarida Garcia , Tom George , Kabeer Gharzai , Glenn Hitchcock , Carson Klingenberg , Ivo Pinto , Varun Randery , Noah Smith , Arina Sugako , Jason Warner

We introduce two multilingual, multimodal foundation language models that power Apple Intelligence features across Apple devices and services: i a 3B-parameter on-device model optimized for Apple silicon through architectural innovations…

Machine Learning · Computer Science 2025-08-28 Ethan Li , Anders Boesen Lindbo Larsen , Chen Zhang , Xiyou Zhou , Jun Qin , Dian Ang Yap , Narendran Raghavan , Xuankai Chang , Margit Bowler , Eray Yildiz , John Peebles , Hannah Gillis Coleman , Matteo Ronchi , Peter Gray , Keen You , Anthony Spalvieri-Kruse , Ruoming Pang , Reed Li , Yuli Yang , Emad Soroush , Zhiyun Lu , Crystal Xiao , Rong Situ , Jordan Huffaker , David Griffiths , Zaid Ahmed , Peng Zhang , Daniel Parilla , Asaf Liberman , Jennifer Mallalieu , Parsa Mazaheri , Qibin Chen , Manjot Bilkhu , Aonan Zhang , Eric Wang , Dave Nelson , Michael FitzMaurice , Thomas Voice , Jeremy Liu , Josh Shaffer , Shiwen Zhao , Prasanth Yadla , Farzin Rasteh , Pengsheng Guo , Arsalan Farooq , Jeremy Snow , Stephen Murphy , Tao Lei , Minsik Cho , George Horrell , Sam Dodge , Lindsay Hislop , Sumeet Singh , Alex Dombrowski , Aiswarya Raghavan , Sasha Sirovica , Mandana Saebi , Faye Lao , Max Lam , TJ Lu , Zhaoyang Xu , Karanjeet Singh , Marc Kirchner , David Mizrahi , Rajat Arora , Haotian Zhang , Henry Mason , Lawrence Zhou , Yi Hua , Ankur Jain , Felix Bai , Joseph Astrauskas , Floris Weers , Josh Gardner , Mira Chiang , Yi Zhang , Pulkit Agrawal , Tony Sun , Quentin Keunebroek , Matthew Hopkins , Bugu Wu , Tao Jia , Chen Chen , Xingyu Zhou , Nanzhu Wang , Peng Liu , Ruixuan Hou , Rene Rauch , Yuan Gao , Afshin Dehghan , Jonathan Janke , Zirui Wang , Cha Chen , Xiaoyi Ren , Feng Nan , Josh Elman , Dong Yin , Yusuf Goren , Jeff Lai , Yiran Fei , Syd Evans , Muyang Yu , Guoli Yin , Yi Qin , Erin Feldman , Isha Garg , Aparna Rajamani , Karla Vega , Walker Cheng , TJ Collins , Hans Han , Raul Rea Menacho , Simon Yeung , Sophy Lee , Phani Mutyala , Ying-Chang Cheng , Zhe Gan , Sprite Chu , Justin Lazarow , Alessandro Pappalardo , Federico Scozzafava , Jing Lu , Erik Daxberger , Laurent Duchesne , Jen Liu , David Güera , Stefano Ligas , Mary Beth Kery , Brent Ramerth , Ciro Sannino , Marcin Eichner , Haoshuo Huang , Rui Qian , Moritz Schwarzer-Becker , David Riazati , Mingfei Gao , Bailin Wang , Jack Cackler , Yang Lu , Ransen Niu , John Dennison , Guillaume Klein , Jeffrey Bigham , Deepak Gopinath , Navid Shiee , Darren Botten , Guillaume Tartavel , Alex Guillen Garcia , Sam Xu , Victoria MönchJuan Haladjian , Zi-Yi Dou , Matthias Paulik , Adolfo Lopez Mendez , Zhen Li , Hong-You Chen , Chao Jia , Dhaval Doshi , Zhengdong Zhang , Raunak Manjani , Aaron Franklin , Zhile Ren , David Chen , Artsiom Peshko , Nandhitha Raghuram , Hans Hao , Jiulong Shan , Kavya Nerella , Ramsey Tantawi , Vivek Kumar , Saiwen Wang , Brycen Wershing , Bhuwan Dhingra , Dhruti Shah , Ob Adaranijo , Xin Zheng , Tait Madsen , Hadas Kotek , Chang Liu , Yin Xia , Hanli Li , Suma Jayaram , Yanchao Sun , Ahmed Fakhry , Vasileios Saveris , Dustin Withers , Yanghao Li , Alp Aygar , Andres Romero Mier Y Teran , Kaiwei Huang , Mark Lee , Xiujun Li , Yuhong Li , Tyler Johnson , Jay Tang , Joseph Yitan Cheng , Futang Peng , Andrew Walkingshaw , Lucas Guibert , Abhishek Sharma , Cheng Shen , Piotr Maj , Yasutaka Tanaka , You-Cyuan Jhang , Vivian Ma , Tommi Vehvilainen , Kelvin Zou , Jeff Nichols , Matthew Lei , David Qiu , Yihao Qian , Gokul Santhanam , Wentao Wu , Yena Han , Dominik Moritz , Haijing Fu , Mingze Xu , Vivek Rathod , Jian Liu , Louis D'hauwe , Qin Ba , Haitian Sun , Haoran Yan , Philipp Dufter , Anh Nguyen , Yihao Feng , Emma Wang , Keyu He , Rahul Nair , Sanskruti Shah , Jiarui Lu , Patrick Sonnenberg , Jeremy Warner , Yuanzhi Li , Bowen Pan , Ziyi Zhong , Joe Zhou , Sam Davarnia , Olli Saarikivi , Irina Belousova , Rachel Burger , Shang-Chen Wu , Di Feng , Bas Straathof , James Chou , Yuanyang Zhang , Marco Zuliani , Eduardo Jimenez , Abhishek Sundararajan , Xianzhi Du , Chang Lan , Nilesh Shahdadpuri , Peter Grasch , Sergiu Sima , Josh Newnham , Varsha Paidi , Jianyu Wang , Kaelen Haag , Alex Braunstein , Daniele Molinari , Richard Wei , Brenda Yang , Nicholas Lusskin , Joanna Arreaza-Taylor , Meng Cao , Nicholas Seidl , Simon Wang , Jiaming Hu , Yiping Ma , Mengyu Li , Kieran Liu , Hang Su , Sachin Ravi , Chong Wang , Xin Wang , Kevin Smith , Haoxuan You , Binazir Karimzadeh , Rui Li , Jinhao Lei , Wei Fang , Alec Doane , Sam Wiseman , Ismael Fernandez , Jane Li , Andrew Hansen , Javier Movellan , Christopher Neubauer , Hanzhi Zhou , Chris Chaney , Nazir Kamaldin , Valentin Wolf , Fernando Bermúdez-Medina , Joris Pelemans , Peter Fu , Howard Xing , Xiang Kong , Wayne Shan , Gabriel Jacoby-Cooper , Dongcai Shen , Tom Gunter , Guillaume Seguin , Fangping Shi , Shiyu Li , Yang Xu , Areeba Kamal , Dan Masi , Saptarshi Guha , Qi Zhu , Jenna Thibodeau , Changyuan Zhang , Rebecca Callahan , Charles Maalouf , Wilson Tsao , Boyue Li , Qingqing Cao , Naomy Sabo , Cheng Leong , Yi Wang , Anupama Mann Anupama , Colorado Reed , Kenneth Jung , Zhifeng Chen , Mohana Prasad Sathya Moorthy , Yifei He , Erik Hornberger , Devi Krishna , Senyu Tong , Michael , Lee , David Haldimann , Yang Zhao , Bowen Zhang , Chang Gao , Chris Bartels , Sushma Rao , Nathalie Tran , Simon Lehnerer , Co Giang , Patrick Dong , Junting Pan , Biyao Wang , Dongxu Li , Mehrdad Farajtabar , Dongseong Hwang , Grace Duanmu , Eshan Verma , Sujeeth Reddy , Qi Shan , Hongbin Gao , Nan Du , Pragnya Sridhar , Forrest Huang , Yingbo Wang , Nikhil Bhendawade , Diane Zhu , Sai Aitharaju , Fred Hohman , Lauren Gardiner , Chung-Cheng Chiu , Yinfei Yang , Alper Kokmen , Frank Chu , Ke Ye , Kaan Elgin , Oron Levy , John Park , Donald Zhang , Eldon Schoop , Nina Wenzel , Michael Booker , Hyunjik Kim , Chinguun Erdenebileg , Nan Dun , Eric Liang Yang , Priyal Chhatrapati , Vishaal Mahtani , Haiming Gang , Kohen Chia , Deepa Seshadri , Donghan Yu , Yan Meng , Kelsey Peterson , Zhen Yang , Yongqiang Wang , Carina Peng , Doug Kang , Anuva Agarwal , Albert Antony , Juan Lao Tebar , Albin Madappally Jose , Regan Poston , Andy De Wang , Gerard Casamayor , Elmira Amirloo , Violet Yao , Wojciech Kryscinski , Kun Duan , Lezhi L

We present DeepSeek-V2, a strong Mixture-of-Experts (MoE) language model characterized by economical training and efficient inference. It comprises 236B total parameters, of which 21B are activated for each token, and supports a context…

Computation and Language · Computer Science 2024-06-21 DeepSeek-AI , Aixin Liu , Bei Feng , Bin Wang , Bingxuan Wang , Bo Liu , Chenggang Zhao , Chengqi Dengr , Chong Ruan , Damai Dai , Daya Guo , Dejian Yang , Deli Chen , Dongjie Ji , Erhang Li , Fangyun Lin , Fuli Luo , Guangbo Hao , Guanting Chen , Guowei Li , H. Zhang , Hanwei Xu , Hao Yang , Haowei Zhang , Honghui Ding , Huajian Xin , Huazuo Gao , Hui Li , Hui Qu , J. L. Cai , Jian Liang , Jianzhong Guo , Jiaqi Ni , Jiashi Li , Jin Chen , Jingyang Yuan , Junjie Qiu , Junxiao Song , Kai Dong , Kaige Gao , Kang Guan , Lean Wang , Lecong Zhang , Lei Xu , Leyi Xia , Liang Zhao , Liyue Zhang , Meng Li , Miaojun Wang , Mingchuan Zhang , Minghua Zhang , Minghui Tang , Mingming Li , Ning Tian , Panpan Huang , Peiyi Wang , Peng Zhang , Qihao Zhu , Qinyu Chen , Qiushi Du , R. J. Chen , R. L. Jin , Ruiqi Ge , Ruizhe Pan , Runxin Xu , Ruyi Chen , S. S. Li , Shanghao Lu , Shangyan Zhou , Shanhuang Chen , Shaoqing Wu , Shengfeng Ye , Shirong Ma , Shiyu Wang , Shuang Zhou , Shuiping Yu , Shunfeng Zhou , Size Zheng , T. Wang , Tian Pei , Tian Yuan , Tianyu Sun , W. L. Xiao , Wangding Zeng , Wei An , Wen Liu , Wenfeng Liang , Wenjun Gao , Wentao Zhang , X. Q. Li , Xiangyue Jin , Xianzu Wang , Xiao Bi , Xiaodong Liu , Xiaohan Wang , Xiaojin Shen , Xiaokang Chen , Xiaosha Chen , Xiaotao Nie , Xiaowen Sun , Xiaoxiang Wang , Xin Liu , Xin Xie , Xingkai Yu , Xinnan Song , Xinyi Zhou , Xinyu Yang , Xuan Lu , Xuecheng Su , Y. Wu , Y. K. Li , Y. X. Wei , Y. X. Zhu , Yanhong Xu , Yanping Huang , Yao Li , Yao Zhao , Yaofeng Sun , Yaohui Li , Yaohui Wang , Yi Zheng , Yichao Zhang , Yiliang Xiong , Yilong Zhao , Ying He , Ying Tang , Yishi Piao , Yixin Dong , Yixuan Tan , Yiyuan Liu , Yongji Wang , Yongqiang Guo , Yuchen Zhu , Yuduan Wang , Yuheng Zou , Yukun Zha , Yunxian Ma , Yuting Yan , Yuxiang You , Yuxuan Liu , Z. Z. Ren , Zehui Ren , Zhangli Sha , Zhe Fu , Zhen Huang , Zhen Zhang , Zhenda Xie , Zhewen Hao , Zhihong Shao , Zhiniu Wen , Zhipeng Xu , Zhongyu Zhang , Zhuoshu Li , Zihan Wang , Zihui Gu , Zilin Li , Ziwei Xie

Llama-Breeze2 (hereinafter referred to as Breeze2) is a suite of advanced multi-modal language models, available in 3B and 8B parameter configurations, specifically designed to enhance Traditional Chinese language representation. Building…

Computation and Language · Computer Science 2025-02-12 MediaTek Research , : , Chan-Jan Hsu , Chia-Sheng Liu , Meng-Hsi Chen , Muxi Chen , Po-Chun Hsu , Yi-Chang Chen , Da-Shan Shiu

As large language models (LLMs) become more capable and widely used, ensuring the safety of their outputs is increasingly critical. Existing guardrail models, though useful in static evaluation settings, face two major limitations in…

As large language models (LLM) become more and more capable in languages other than English, it is important to collect benchmark datasets in order to evaluate their multilingual performance, including on tasks like machine translation…

We present Sapiens2, a model family of high-resolution transformers for human-centric vision focused on generalization, versatility, and high-fidelity outputs. Our model sizes range from 0.4 to 5 billion parameters, with native 1K…

Computer Vision and Pattern Recognition · Computer Science 2026-04-24 Rawal Khirodkar , He Wen , Julieta Martinez , Yuan Dong , Su Zhaoen , Shunsuke Saito

Various large language models (LLMs) have been proposed in recent years, including closed- and open-source ones, continually setting new records on multiple benchmarks. However, the development of LLMs still faces several issues, such as…

Computation and Language · Computer Science 2024-04-05 Ruyi Gan , Ziwei Wu , Renliang Sun , Junyu Lu , Xiaojun Wu , Dixiang Zhang , Kunhao Pan , Junqing He , Yuanhe Tian , Ping Yang , Qi Yang , Hao Wang , Jiaxing Zhang , Yan Song

In 2022, with the release of ChatGPT, large-scale language models gained widespread attention. ChatGPT not only surpassed previous models in terms of parameters and the scale of its pretraining corpus but also achieved revolutionary…

Artificial Intelligence · Computer Science 2024-11-13 Yiming Ju , Huanhuan Ma

Multimodal reasoning has become a cornerstone of modern AI research. Standardized exam questions offer a uniquely rigorous testbed for such reasoning, providing structured visual contexts and verifiable answers. While recent progress has…

Computer Vision and Pattern Recognition · Computer Science 2025-12-02 Egemen Sert , Şeyda Ertekin

We introduce MobileVLM V2, a family of significantly improved vision language models upon MobileVLM, which proves that a delicate orchestration of novel architectural design, an improved training scheme tailored for mobile VLMs, and rich…

Computer Vision and Pattern Recognition · Computer Science 2024-02-07 Xiangxiang Chu , Limeng Qiao , Xinyu Zhang , Shuang Xu , Fei Wei , Yang Yang , Xiaofei Sun , Yiming Hu , Xinyang Lin , Bo Zhang , Chunhua Shen

We present BlueLM-2.5-3B, a compact and unified dense Multimodal Large Language Model (MLLM) designed for efficient edge-device deployment, offering strong general-purpose and reasoning capabilities. To the best of our knowledge, this is…

Recently, large language models (LLMs) have achieved remarkable breakthroughs in general domains such as programming and writing, and have demonstrated strong potential in various scientific research scenarios. However, the capabilities of…

Machine Learning · Computer Science 2025-09-16 Yonghao Weng , Liqiang Gao , Linwu Zhu , Jian Huang

Despite the transformative impact of Large Language Models (LLMs) across critical domains such as healthcare, customer service, and business marketing, their integration into Open Radio Access Networks (O-RAN) remains limited. This gap is…

Computation and Language · Computer Science 2025-07-24 Pranshav Gajjar , Vijay K. Shah