English
Related papers

Related papers: Apriel-1.5-15b-Thinker

200 papers

We present MM1.5, a new family of multimodal large language models (MLLMs) designed to enhance capabilities in text-rich image understanding, visual referring and grounding, and multi-image reasoning. Building upon the MM1 architecture,…

Recent advances in reinforcement learning for large language models have converged on increasing complexity: multi-stage training pipelines, dynamic hyperparameter schedules, and curriculum learning strategies. This raises a fundamental…

Computation and Language · Computer Science 2025-12-19 Bingxiang He , Zekai Qu , Zeyuan Liu , Yinghao Chen , Yuxin Zuo , Cheng Qian , Kaiyan Zhang , Weize Chen , Chaojun Xiao , Ganqu Cui , Ning Ding , Zhiyuan Liu

Reasoning-augmented machine learning systems have shown improved performance in various domains, including image generation. However, existing reasoning-based methods for image generation either restrict reasoning to a single modality…

Computer Vision and Pattern Recognition · Computer Science 2026-02-11 Yapeng Mi , Yanpeng Zhao , Hengli Li , Chenxi Li , Huimin Wu , Xiaojian Ma , Song-Chun Zhu , Ying Nian Wu , Qing Li

We introduce OpenVLThinker, one of the first open-source large vision-language models (LVLMs) to exhibit sophisticated chain-of-thought reasoning, achieving notable performance gains on challenging visual reasoning tasks. While text-based…

Computer Vision and Pattern Recognition · Computer Science 2025-11-12 Yihe Deng , Hritik Bansal , Fan Yin , Nanyun Peng , Wei Wang , Kai-Wei Chang

We introduce QwenLong-L1.5, a model that achieves superior long-context reasoning capabilities through systematic post-training innovations. The key technical breakthroughs of QwenLong-L1.5 are as follows: (1) Long-Context Data Synthesis…

We introduce Pixtral-12B, a 12--billion-parameter multimodal language model. Pixtral-12B is trained to understand both natural images and documents, achieving leading performance on various multimodal benchmarks, surpassing a number of…

This paper presents a practical investigation into fine-tuning model parameters for mathematical reasoning tasks through experimenting with various configurations including randomness control, reasoning depth, and sampling strategies,…

Machine Learning · Computer Science 2025-09-10 Pranav Pawar , Dhwaj Jain , Varun Gupta , Kaustav Dedhia , Dashrath Kale , Sudhir Dhekane

Large Language Models (LLMs) have demonstrated strong reasoning capabilities in solving complex problems. However, current approaches primarily enhance reasoning through the elaboration of thoughts while neglecting the diversity of…

Computation and Language · Computer Science 2025-04-25 Danqing Wang , Jianxin Ma , Fei Fang , Lei Li

Current unified multimodal models for image generation and editing typically rely on massive parameter scales (e.g., >10B), entailing prohibitive training costs and deployment footprints. In this work, we present DeepGen 1.0, a lightweight…

Large Language Models exhibit impressive reasoning capabilities across diverse tasks, motivating efforts to distill these capabilities into smaller models through generated reasoning data. However, direct training on such synthesized…

Computation and Language · Computer Science 2025-02-05 Shengmin Piao , Sanghyun Park

Evaluating language models fairly is increasingly difficult as static benchmarks risk contamination by training data, obscuring whether models truly reason or recall. We introduce BeyondBench, an evaluation framework using algorithmic…

Computation and Language · Computer Science 2026-03-06 Gaurav Srivastava , Aafiya Hussain , Zhenyu Bi , Swastik Roy , Priya Pitre , Meng Lu , Morteza Ziyadi , Xuan Wang

Large Multimodal Models (LMMs) have recently demonstrated remarkable visual understanding performance on both vision-language and vision-centric tasks. However, they often fall short in integrating advanced, task-specific capabilities for…

Computer Vision and Pattern Recognition · Computer Science 2025-05-28 Yufei Zhan , Hongyin Zhao , Yousong Zhu , Shurong Zheng , Fan Yang , Ming Tang , Jinqiao Wang

Training multimodal process reward models (PRMs) is hard due to (i) distribution shift between training set and test set and (ii) quality imbalance across training data samples. While domain-level reweighting (e.g., DreamPRM) aligns…

Machine Learning · Computer Science 2025-10-22 Qi Cao , Pengtao Xie

We present Seed1.5-VL, a vision-language foundation model designed to advance general-purpose multimodal understanding and reasoning. Seed1.5-VL is composed with a 532M-parameter vision encoder and a Mixture-of-Experts (MoE) LLM of 20B…

Computer Vision and Pattern Recognition · Computer Science 2025-05-13 Dong Guo , Faming Wu , Feida Zhu , Fuxing Leng , Guang Shi , Haobin Chen , Haoqi Fan , Jian Wang , Jianyu Jiang , Jiawei Wang , Jingji Chen , Jingjia Huang , Kang Lei , Liping Yuan , Lishu Luo , Pengfei Liu , Qinghao Ye , Rui Qian , Shen Yan , Shixiong Zhao , Shuai Peng , Shuangye Li , Sihang Yuan , Sijin Wu , Tianheng Cheng , Weiwei Liu , Wenqian Wang , Xianhan Zeng , Xiao Liu , Xiaobo Qin , Xiaohan Ding , Xiaojun Xiao , Xiaoying Zhang , Xuanwei Zhang , Xuehan Xiong , Yanghua Peng , Yangrui Chen , Yanwei Li , Yanxu Hu , Yi Lin , Yiyuan Hu , Yiyuan Zhang , Youbin Wu , Yu Li , Yudong Liu , Yue Ling , Yujia Qin , Zanbo Wang , Zhiwu He , Aoxue Zhang , Bairen Yi , Bencheng Liao , Can Huang , Can Zhang , Chaorui Deng , Chaoyi Deng , Cheng Lin , Cheng Yuan , Chenggang Li , Chenhui Gou , Chenwei Lou , Chengzhi Wei , Chundian Liu , Chunyuan Li , Deyao Zhu , Donghong Zhong , Feng Li , Feng Zhang , Gang Wu , Guodong Li , Guohong Xiao , Haibin Lin , Haihua Yang , Haoming Wang , Heng Ji , Hongxiang Hao , Hui Shen , Huixia Li , Jiahao Li , Jialong Wu , Jianhua Zhu , Jianpeng Jiao , Jiashi Feng , Jiaze Chen , Jianhui Duan , Jihao Liu , Jin Zeng , Jingqun Tang , Jingyu Sun , Joya Chen , Jun Long , Junda Feng , Junfeng Zhan , Junjie Fang , Junting Lu , Kai Hua , Kai Liu , Kai Shen , Kaiyuan Zhang , Ke Shen , Ke Wang , Keyu Pan , Kun Zhang , Kunchang Li , Lanxin Li , Lei Li , Lei Shi , Li Han , Liang Xiang , Liangqiang Chen , Lin Chen , Lin Li , Lin Yan , Liying Chi , Longxiang Liu , Mengfei Du , Mingxuan Wang , Ningxin Pan , Peibin Chen , Pengfei Chen , Pengfei Wu , Qingqing Yuan , Qingyao Shuai , Qiuyan Tao , Renjie Zheng , Renrui Zhang , Ru Zhang , Rui Wang , Rui Yang , Rui Zhao , Shaoqiang Xu , Shihao Liang , Shipeng Yan , Shu Zhong , Shuaishuai Cao , Shuangzhi Wu , Shufan Liu , Shuhan Chang , Songhua Cai , Tenglong Ao , Tianhao Yang , Tingting Zhang , Wanjun Zhong , Wei Jia , Wei Weng , Weihao Yu , Wenhao Huang , Wenjia Zhu , Wenli Yang , Wenzhi Wang , Xiang Long , XiangRui Yin , Xiao Li , Xiaolei Zhu , Xiaoying Jia , Xijin Zhang , Xin Liu , Xinchen Zhang , Xinyu Yang , Xiongcai Luo , Xiuli Chen , Xuantong Zhong , Xuefeng Xiao , Xujing Li , Yan Wu , Yawei Wen , Yifan Du , Yihao Zhang , Yining Ye , Yonghui Wu , Yu Liu , Yu Yue , Yufeng Zhou , Yufeng Yuan , Yuhang Xu , Yuhong Yang , Yun Zhang , Yunhao Fang , Yuntao Li , Yurui Ren , Yuwen Xiong , Zehua Hong , Zehua Wang , Zewei Sun , Zeyu Wang , Zhao Cai , Zhaoyue Zha , Zhecheng An , Zhehui Zhao , Zhengzhuo Xu , Zhipeng Chen , Zhiyong Wu , Zhuofan Zheng , Zihao Wang , Zilong Huang , Ziyu Zhu , Zuquan Song

We introduce Motif-2-12.7B-Reasoning, a 12.7B parameter language model designed to bridge the gap between open-weight systems and proprietary frontier models in complex reasoning and long-context understanding. Addressing the common…

We present a novel 4.5B parameter small language model that can handle multiple input and output modalities, including text, images, videos, and audio. Despite its small size, the model achieves near state-of-the-art performance on a…

Machine Learning · Computer Science 2024-11-12 Ben Koska , Mojmír Horváth

Recent R1-Zero-like research further demonstrates that reasoning extension has given large language models (LLMs) unprecedented reasoning capabilities, and Reinforcement Learning is the core technology to elicit its complex reasoning.…

Artificial Intelligence · Computer Science 2025-08-15 Anxiang Zeng , Haibo Zhang , Kaixiang Mo , Long Zhang , Shuman Liu , Yanhui Huang , Yawen Liu , Yuepeng Sheng , Yuwei Huang

We present Ring-1T, the first open-source, state-of-the-art thinking model with a trillion-scale parameter. It features 1 trillion total parameters and activates approximately 50 billion per token. Training such models at a…

Reward models are critical for aligning vision-language systems with human preferences, yet current approaches suffer from hallucination, weak visual grounding, and an inability to use tools for verification, limiting their reliability on…

Computer Vision and Pattern Recognition · Computer Science 2025-12-05 Shengyuan Ding , Xinyu Fang , Ziyu Liu , Yuhang Zang , Yuhang Cao , Xiangyu Zhao , Haodong Duan , Xiaoyi Dong , Jianze Liang , Bin Wang , Conghui He , Dahua Lin , Jiaqi Wang

Reasoning is a key component of language understanding in Large Language Models. While Chain-of-Thought prompting enhances performance via explicit intermediate steps, it suffers from sufficient token overhead and a fixed reasoning…

Computation and Language · Computer Science 2025-11-18 Xinyuan Wang , Dongjie Wang , Wangyang Ying , Haoyue Bai , Nanxu Gong , Sixun Dong , Kunpeng Liu , Yanjie Fu