If I Could Turn Back Time: Temporal Reframing as a Historical Reasoning Task for LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bungum, Lars, Huang, Charles Yijia, Kashar, Abeer |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Could Thinking Multilingually Empower LLM Reasoning?
par: Gao, Changjiang, et autres
Publié: (2025)
par: Gao, Changjiang, et autres
Publié: (2025)
Not Minds, but Signs: Reframing LLMs through Semiotics
par: Picca, Davide
Publié: (2025)
par: Picca, Davide
Publié: (2025)
Test of Time: A Benchmark for Evaluating LLMs on Temporal Reasoning
par: Fatemi, Bahare, et autres
Publié: (2024)
par: Fatemi, Bahare, et autres
Publié: (2024)
Multi-Turn Puzzles: Evaluating Interactive Reasoning and Strategic Dialogue in LLMs
par: Badola, Kartikeya, et autres
Publié: (2025)
par: Badola, Kartikeya, et autres
Publié: (2025)
Reframing Tax Law Entailment as Analogical Reasoning
par: Zou, Xinrui, et autres
Publié: (2024)
par: Zou, Xinrui, et autres
Publié: (2024)
LLMs Could Autonomously Learn Without External Supervision
par: Ji, Ke, et autres
Publié: (2024)
par: Ji, Ke, et autres
Publié: (2024)
Slot Filling as a Reasoning Task for SpeechLLMs
par: Hacioglu, Kadri, et autres
Publié: (2025)
par: Hacioglu, Kadri, et autres
Publié: (2025)
Test-Time Policy Adaptation for Enhanced Multi-Turn Interactions with LLMs
par: Wei, Chenxing, et autres
Publié: (2025)
par: Wei, Chenxing, et autres
Publié: (2025)
Reasoning Is Not All You Need: Examining LLMs for Multi-Turn Mental Health Conversations
par: Chandra, Mohit, et autres
Publié: (2025)
par: Chandra, Mohit, et autres
Publié: (2025)
Time-R1: Towards Comprehensive Temporal Reasoning in LLMs
par: Liu, Zijia, et autres
Publié: (2025)
par: Liu, Zijia, et autres
Publié: (2025)
Advancing AI-Scientist Understanding: Multi-Agent LLMs with Interpretable Physics Reasoning
par: Xu, Yinggan, et autres
Publié: (2025)
par: Xu, Yinggan, et autres
Publié: (2025)
LLM-Driven Multi-Turn Task-Oriented Dialogue Synthesis for Realistic Reasoning
par: Zhu, Yu, et autres
Publié: (2026)
par: Zhu, Yu, et autres
Publié: (2026)
Unveiling Over-Memorization in Finetuning LLMs for Reasoning Tasks
par: Ruan, Zhiwen, et autres
Publié: (2025)
par: Ruan, Zhiwen, et autres
Publié: (2025)
STReasoner: Empowering LLMs for Spatio-Temporal Reasoning in Time Series via Spatial-Aware Reinforcement Learning
par: Ni, Juntong, et autres
Publié: (2026)
par: Ni, Juntong, et autres
Publié: (2026)
CHE-TKG: Collaborative Historical Evidence and Evolutionary Dynamics Learning for Temporal Knowledge Graph Reasoning
par: Lei, Shuai-long, et autres
Publié: (2026)
par: Lei, Shuai-long, et autres
Publié: (2026)
Be Careful When Fine-tuning On Open-Source LLMs: Your Fine-tuning Data Could Be Secretly Stolen!
par: Zhang, Zhexin, et autres
Publié: (2025)
par: Zhang, Zhexin, et autres
Publié: (2025)
Multimodal Cognitive Reframing Therapy via Multi-hop Psychotherapeutic Reasoning
par: Kim, Subin, et autres
Publié: (2025)
par: Kim, Subin, et autres
Publié: (2025)
LatentRAG: Latent Reasoning and Retrieval for Efficient Agentic RAG
par: Zheng, Yijia, et autres
Publié: (2026)
par: Zheng, Yijia, et autres
Publié: (2026)
RICE-PO: Turning Retrieval Interactions into Credit Signals for Reasoning Agents
par: Li, Mingchen, et autres
Publié: (2026)
par: Li, Mingchen, et autres
Publié: (2026)
I Could've Asked That: Reformulating Unanswerable Questions
par: Zhao, Wenting, et autres
Publié: (2024)
par: Zhao, Wenting, et autres
Publié: (2024)
Evaluating Temporal Consistency in Multi-Turn Language Models
par: Atri, Yash Kumar, et autres
Publié: (2026)
par: Atri, Yash Kumar, et autres
Publié: (2026)
Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning
par: Lin, Jiacheng, et autres
Publié: (2025)
par: Lin, Jiacheng, et autres
Publié: (2025)
TimeSage-MT: A Multi-Turn Benchmark for Evaluating Agentic Time Series Reasoning
par: Kong, Yaxuan, et autres
Publié: (2026)
par: Kong, Yaxuan, et autres
Publié: (2026)
Autonomous Evaluation of LLMs for Truth Maintenance and Reasoning Tasks
par: Karia, Rushang, et autres
Publié: (2024)
par: Karia, Rushang, et autres
Publié: (2024)
LLMs Get Lost In Multi-Turn Conversation
par: Laban, Philippe, et autres
Publié: (2025)
par: Laban, Philippe, et autres
Publié: (2025)
When Smiley Turns Hostile: Interpreting How Emojis Trigger LLMs' Toxicity
par: Cui, Shiyao, et autres
Publié: (2025)
par: Cui, Shiyao, et autres
Publié: (2025)
CID-TKG: Collaborative Historical Invariance and Evolutionary Dynamics Learning for Temporal Knowledge Graph Reasoning
par: Lei, Shuai-Long, et autres
Publié: (2026)
par: Lei, Shuai-Long, et autres
Publié: (2026)
Promoting Constructive Deliberation: Reframing for Receptiveness
par: Kambhatla, Gauri, et autres
Publié: (2024)
par: Kambhatla, Gauri, et autres
Publié: (2024)
Approaches to Analysing Historical Newspapers Using LLMs
par: Dobranić, Filip, et autres
Publié: (2026)
par: Dobranić, Filip, et autres
Publié: (2026)
From Harm to Help: Turning Reasoning In-Context Demos into Assets for Reasoning LMs
par: Wang, Haonan, et autres
Publié: (2025)
par: Wang, Haonan, et autres
Publié: (2025)
MathGenie: Generating Synthetic Data with Question Back-translation for Enhancing Mathematical Reasoning of LLMs
par: Lu, Zimu, et autres
Publié: (2024)
par: Lu, Zimu, et autres
Publié: (2024)
RMTBench: Benchmarking LLMs Through Multi-Turn User-Centric Role-Playing
par: Xiang, Hao, et autres
Publié: (2025)
par: Xiang, Hao, et autres
Publié: (2025)
Does "Reasoning" with Large Language Models Improve Recognizing, Generating, and Reframing Unhelpful Thoughts?
par: Qi, Yilin, et autres
Publié: (2025)
par: Qi, Yilin, et autres
Publié: (2025)
Could We Have Had Better Multilingual LLMs If English Was Not the Central Language?
par: Diandaru, Ryandito, et autres
Publié: (2024)
par: Diandaru, Ryandito, et autres
Publié: (2024)
A Comment On "The Illusion of Thinking": Reframing the Reasoning Cliff as an Agentic Gap
par: Khan, Sheraz, et autres
Publié: (2025)
par: Khan, Sheraz, et autres
Publié: (2025)
Measuring Iterative Temporal Reasoning with Time Puzzles
par: Wang, Zhengxiang, et autres
Publié: (2026)
par: Wang, Zhengxiang, et autres
Publié: (2026)
Reframing Spatial Reasoning Evaluation in Language Models: A Real-World Simulation Benchmark for Qualitative Reasoning
par: Li, Fangjun, et autres
Publié: (2024)
par: Li, Fangjun, et autres
Publié: (2024)
Reasoning Topology Matters: Network-of-Thought for Complex Reasoning Tasks
par: Huang, Fan
Publié: (2026)
par: Huang, Fan
Publié: (2026)
Multi-IF: Benchmarking LLMs on Multi-Turn and Multilingual Instructions Following
par: He, Yun, et autres
Publié: (2024)
par: He, Yun, et autres
Publié: (2024)
TurnBench-MS: A Benchmark for Evaluating Multi-Turn, Multi-Step Reasoning in Large Language Models
par: Zhang, Yiran, et autres
Publié: (2025)
par: Zhang, Yiran, et autres
Publié: (2025)
Documents similaires
-
Could Thinking Multilingually Empower LLM Reasoning?
par: Gao, Changjiang, et autres
Publié: (2025) -
Not Minds, but Signs: Reframing LLMs through Semiotics
par: Picca, Davide
Publié: (2025) -
Test of Time: A Benchmark for Evaluating LLMs on Temporal Reasoning
par: Fatemi, Bahare, et autres
Publié: (2024) -
Multi-Turn Puzzles: Evaluating Interactive Reasoning and Strategic Dialogue in LLMs
par: Badola, Kartikeya, et autres
Publié: (2025) -
Reframing Tax Law Entailment as Analogical Reasoning
par: Zou, Xinrui, et autres
Publié: (2024)