Computation and Language · Computer Science
Inner Thinking Transformer: Leveraging Dynamic Depth Scaling to Foster Adaptive Internal Thinking
Yilong Chen, Junyuan Shang, Zhenyu Zhang, Yanxi Xie +6
2025-02-25
Computation and Language · Computer Science
Parallel Loop Transformer for Efficient Test-Time Computation Scaling
Bohong Wu, Mengzhao Chen, Xiang Luo, Shen Yan +8
2025-10-30
Computation and Language · Computer Science
Trainable Transformer in Transformer
Abhishek Panigrahi, Sadhika Malladi, Mengzhou Xia, Sanjeev Arora
2024-02-09
Machine Learning · Computer Science
Encode, Think, Decode: Scaling test-time reasoning with recursive latent thoughts
Yeskendir Koishekenov, Aldo Lipani, Nicola Cancedda
2025-10-10
Computation and Language · Computer Science
ReflectMT: Internalizing Reflection for Efficient and High-Quality Machine Translation
Kunquan Li, Yingxue Zhang, Fandong Meng, Jinsong Su
2026-04-22
Computation and Language · Computer Science
Byte Latent Transformer: Patches Scale Better Than Tokens
Artidoro Pagnoni, Ram Pasunuru, Pedro Rodriguez, John Nguyen +10
2024-12-16
Computation and Language · Computer Science
Think Thrice Before You Act: Progressive Thought Refinement in Large Language Models
Chengyu Du, Jinyi Han, Yizhou Ying, Aili Chen +8
2024-10-18
Computation and Language · Computer Science
Zero Token-Driven Deep Thinking in LLMs: Unlocking the Full Potential of Existing Parameters via Cyclic Refinement
Guanghao Li, Wenhao Jiang, Li Shen, Ming Tang +1
2025-02-19
Machine Learning · Computer Science
CLT-Forge: A Scalable Library for Cross-Layer Transcoders and Attribution Graphs
Florent Draye, Abir Harrasse, Vedant Palit, Tung-Yu Wu +6
2026-03-24
Information Retrieval · Computer Science
LLM-KT: A Versatile Framework for Knowledge Transfer from Large Language Models to Collaborative Filtering
Nikita Severin, Aleksei Ziablitsev, Yulia Savelyeva, Valeriy Tashchilin +7
2024-11-04
Computation and Language · Computer Science
ITERTL: An Iterative Framework for Fine-tuning LLMs for RTL Code Generation
Peiyang Wu, Nan Guo, Xiao Xiao, Wenming Li +2
2025-04-24
Computation and Language · Computer Science
Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models
Victor Conchello Vendrell, Arnau Padres Masdemont, Niccolò Grillo, Jordi Ros-Giralt +2
2026-05-20
Machine Learning · Computer Science
Taming the Long-Tail: Efficient Reasoning RL Training with Adaptive Drafter
Qinghao Hu, Shang Yang, Junxian Guo, Xiaozhe Yao +6
2026-03-23
Distributed, Parallel, and Cluster Computing · Computer Science
SplitLLM: Collaborative Inference of LLMs for Model Placement and Throughput Optimization
Akrit Mudvari, Yuang Jiang, Leandros Tassiulas
2024-10-17
Machine Learning · Computer Science
LIFT: Latent Implicit Functions for Task- and Data-Agnostic Encoding
Amirhossein Kazerouni, Soroush Mehraban, Michael Brudno, Babak Taati
2025-03-20
Computation and Language · Computer Science
Enhanced Transformer Architecture for Natural Language Processing
Woohyeon Moon, Taeyoung Kim, Bumgeun Park, Dongsoo Har
2023-10-18
Computation and Language · Computer Science
Fast-FNet: Accelerating Transformer Encoder Models via Efficient Fourier Layers
Nurullah Sevim, Ege Ozan Özyedek, Furkan Şahinuç, Aykut Koç
2023-05-17
Computation and Language · Computer Science
MERIT: Memory-Enhanced Retrieval for Interpretable Knowledge Tracing
Runze Li, Kedi Chen, Guwei Feng, Mo Yu +2
2026-03-25
Computation and Language · Computer Science
HMT: Hierarchical Memory Transformer for Efficient Long Context Language Processing
Zifan He, Yingqi Cao, Zongyue Qin, Neha Prakriya +2
2025-02-07
Machine Learning · Computer Science
Next-Latent Prediction Transformers Learn Compact World Models
Jayden Teoh, Manan Tomar, Kwangjun Ahn, Edward S. Hu +6
2026-05-26
Computation and Language · Computer Science
LIFT: A Novel Framework for Enhancing Long-Context Understanding of LLMs via Long Input Fine-Tuning
Yansheng Mao, Yufei Xu, Jiaqi Li, Fanxu Meng +4
2026-04-14
Machine Learning · Computer Science
Fractional Reasoning via Latent Steering Vectors Improves Inference Time Compute
Sheng Liu, Tianlang Chen, Pan Lu, Haotian Ye +3
2025-09-26