Artificial Intelligence · Computer Science
Do Large Language Models Reason Causally Like Us? Even Better?
Hanna M. Dettki, Brenden M. Lake, Charley M. Wu, Bob Rehder
2025-06-09
Computation and Language · Computer Science
Evaluating the Limits of Large Language Models in Multilingual Legal Reasoning
Antreas Ioannou, Andreas Shiamishis, Nora Hollenstein, Nezihe Merve Gürel
2025-09-29
Computation and Language · Computer Science
CORDIAL: Can Multimodal Large Language Models Effectively Understand Coherence Relationships?
Aashish Anantha Ramakrishnan, Aadarsh Anantha Ramakrishnan, Dongwon Lee
2025-06-10
Computation and Language · Computer Science
Evaluating the Effectiveness of Retrieval-Augmented Large Language Models in Scientific Document Reasoning
Sai Munikoti, Anurag Acharya, Sridevi Wagle, Sameera Horawalavithana
2023-11-09
Applications · Statistics
Collective Reasoning Among LLMs: A Framework for Answer Validation Without Ground Truth
Seyed Pouyan Mousavi Davoudi, Amin Gholami Davodi, Alireza Amiri-Margavi, Alireza Shafiee Fard +1
2025-08-12
Computation and Language · Computer Science
Towards Understanding the Robustness of LLM-based Evaluations under Perturbations
Manav Chaudhary, Harshit Gupta, Savita Bhat, Vasudeva Varma
2024-12-13
Computation and Language · Computer Science
Evaluating Multilingual Long-Context Models for Retrieval and Reasoning
Ameeta Agrawal, Andy Dang, Sina Bagheri Nezhad, Rhitabrat Pokharel +1
2024-10-15
Computation and Language · Computer Science
Gemma: Open Models Based on Gemini Research and Technology
Gemma Team, Thomas Mesnard, Cassidy Hardin, Robert Dadashi +104
2024-04-17
Artificial Intelligence · Computer Science
Exploring the psychology of LLMs' Moral and Legal Reasoning
Guilherme F. C. F. Almeida, José Luiz Nunes, Neele Engelmann, Alex Wiegmann +1
2024-05-24
Computation and Language · Computer Science
Accelerating Scientific Research with Gemini: Case Studies and Common Techniques
David P. Woodruff, Vincent Cohen-Addad, Lalit Jain, Jieming Mao +32
2026-03-09
Computation and Language · Computer Science
Characterizing Large Language Models as Rationalizers of Knowledge-intensive Tasks
Aditi Mishra, Sajjadur Rahman, Hannah Kim, Kushan Mitra +1
2024-02-02