Computation and Language · Computer Science
A Survey on Transformer Context Extension: Approaches and Evaluation
Yijun Liu, Jinzheng Yu, Yang Xu, Zhongyang Li +1
2025-07-09
Computation and Language · Computer Science
Language Models Struggle to Use Representations Learned In-Context
Michael A. Lepori, Tal Linzen, Ann Yuan, Katja Filippova
2026-05-04
Computation and Language · Computer Science
Advancing Transformer Architecture in Long-Context Large Language Models: A Comprehensive Survey
Yunpeng Huang, Jingwei Xu, Junyu Lai, Zixu Jiang +8
2024-02-27
Computation and Language · Computer Science
Towards Uncovering How Large Language Model Works: An Explainability Perspective
Haiyan Zhao, Fan Yang, Bo Shen, Himabindu Lakkaraju +1
2024-04-17
Computation and Language · Computer Science
Lost in the Middle: How Language Models Use Long Contexts
Nelson F. Liu, Kevin Lin, John Hewitt, Ashwin Paranjape +3
2023-11-22
Computation and Language · Computer Science
How Large Language Models Encode Context Knowledge? A Layer-Wise Probing Study
Tianjie Ju, Weiwei Sun, Wei Du, Xinwei Yuan +2
2024-03-05
Machine Learning · Computer Science
Why Larger Language Models Do In-context Learning Differently?
Zhenmei Shi, Junyi Wei, Zhuoyan Xu, Yingyu Liang
2024-05-31
Computation and Language · Computer Science
Beyond Continuity: Challenges of Context Switching in Multi-Turn Dialogue with LLMs
Aditya Sinha, Harald Steck, Vito Ostuni, Matteo Rinaldi
2026-05-12
Computation and Language · Computer Science
LLMs Explain't: A Post-Mortem on Semantic Interpretability in Transformer Models
Alhassan Abdelhalim, Janick Edinger, Sören Laue, Michaela Regneri
2026-02-02
Computation and Language · Computer Science
Lost in Multilinguality: Dissecting Cross-lingual Factual Inconsistency in Transformer Language Models
Mingyang Wang, Heike Adel, Lukas Lange, Yihong Liu +3
2025-04-08
Computation and Language · Computer Science
LLMs Know More Than They Show: On the Intrinsic Representation of LLM Hallucinations
Hadas Orgad, Michael Toker, Zorik Gekhman, Roi Reichart +3
2025-05-20
Computation and Language · Computer Science
Positional Biases Shift as Inputs Approach Context Window Limits
Blerta Veseli, Julian Chibane, Mariya Toneva, Alexander Koller
2025-08-12
Computation and Language · Computer Science
Do Large Language Models Understand Logic or Just Mimick Context?
Junbing Yan, Chengyu Wang, Jun Huang, Wei Zhang
2024-02-20
Artificial Intelligence · Computer Science
Is More Context Always Better? Examining LLM Reasoning Capability for Time Interval Prediction
Yanan Cao, Farnaz Fallahi, Murali Mohana Krishna Dandu, Lalitesh Morishetti +8
2026-01-27
Computation and Language · Computer Science
Do Large Language Models know who did what to whom?
Joseph M. Denning, Xiaohan Hannah Guo, Bryor Snefjella, Idan A. Blank
2025-04-29
Computation and Language · Computer Science
Are Large Language Models Temporally Grounded?
Yifu Qiu, Zheng Zhao, Yftah Ziser, Anna Korhonen +2
2023-11-17
Computation and Language · Computer Science
Found in the Middle: Calibrating Positional Attention Bias Improves Long Context Utilization
Cheng-Yu Hsieh, Yung-Sung Chuang, Chun-Liang Li, Zifeng Wang +7
2024-07-04
Computation and Language · Computer Science
Do LLMs dream of elephants (when told not to)? Latent concept association and associative memory in transformers
Yibo Jiang, Goutham Rajendran, Pradeep Ravikumar, Bryon Aragam
2024-12-02
Computation and Language · Computer Science
Large Language Models as Misleading Assistants in Conversation
Betty Li Hou, Kejian Shi, Jason Phang, James Aung +2
2024-07-17
Machine Learning · Computer Science
Theoretical Understanding of In-Context Learning in Shallow Transformers with Unstructured Data
Yue Xing, Xiaofeng Lin, Chenheng Xu, Namjoon Suh +2
2024-06-19