If I Could Turn Back Time: Temporal Reframing as a Historical Reasoning Task for LLMs
Fuente:
arXiv
Guardado en:
| Autores principales: | Bungum, Lars, Huang, Charles Yijia, Kashar, Abeer |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Could Thinking Multilingually Empower LLM Reasoning?
por: Gao, Changjiang, et al.
Publicado: (2025)
por: Gao, Changjiang, et al.
Publicado: (2025)
Not Minds, but Signs: Reframing LLMs through Semiotics
por: Picca, Davide
Publicado: (2025)
por: Picca, Davide
Publicado: (2025)
Test of Time: A Benchmark for Evaluating LLMs on Temporal Reasoning
por: Fatemi, Bahare, et al.
Publicado: (2024)
por: Fatemi, Bahare, et al.
Publicado: (2024)
Multi-Turn Puzzles: Evaluating Interactive Reasoning and Strategic Dialogue in LLMs
por: Badola, Kartikeya, et al.
Publicado: (2025)
por: Badola, Kartikeya, et al.
Publicado: (2025)
Reframing Tax Law Entailment as Analogical Reasoning
por: Zou, Xinrui, et al.
Publicado: (2024)
por: Zou, Xinrui, et al.
Publicado: (2024)
LLMs Could Autonomously Learn Without External Supervision
por: Ji, Ke, et al.
Publicado: (2024)
por: Ji, Ke, et al.
Publicado: (2024)
Slot Filling as a Reasoning Task for SpeechLLMs
por: Hacioglu, Kadri, et al.
Publicado: (2025)
por: Hacioglu, Kadri, et al.
Publicado: (2025)
Test-Time Policy Adaptation for Enhanced Multi-Turn Interactions with LLMs
por: Wei, Chenxing, et al.
Publicado: (2025)
por: Wei, Chenxing, et al.
Publicado: (2025)
Reasoning Is Not All You Need: Examining LLMs for Multi-Turn Mental Health Conversations
por: Chandra, Mohit, et al.
Publicado: (2025)
por: Chandra, Mohit, et al.
Publicado: (2025)
Time-R1: Towards Comprehensive Temporal Reasoning in LLMs
por: Liu, Zijia, et al.
Publicado: (2025)
por: Liu, Zijia, et al.
Publicado: (2025)
Advancing AI-Scientist Understanding: Multi-Agent LLMs with Interpretable Physics Reasoning
por: Xu, Yinggan, et al.
Publicado: (2025)
por: Xu, Yinggan, et al.
Publicado: (2025)
LLM-Driven Multi-Turn Task-Oriented Dialogue Synthesis for Realistic Reasoning
por: Zhu, Yu, et al.
Publicado: (2026)
por: Zhu, Yu, et al.
Publicado: (2026)
Unveiling Over-Memorization in Finetuning LLMs for Reasoning Tasks
por: Ruan, Zhiwen, et al.
Publicado: (2025)
por: Ruan, Zhiwen, et al.
Publicado: (2025)
STReasoner: Empowering LLMs for Spatio-Temporal Reasoning in Time Series via Spatial-Aware Reinforcement Learning
por: Ni, Juntong, et al.
Publicado: (2026)
por: Ni, Juntong, et al.
Publicado: (2026)
CHE-TKG: Collaborative Historical Evidence and Evolutionary Dynamics Learning for Temporal Knowledge Graph Reasoning
por: Lei, Shuai-long, et al.
Publicado: (2026)
por: Lei, Shuai-long, et al.
Publicado: (2026)
Be Careful When Fine-tuning On Open-Source LLMs: Your Fine-tuning Data Could Be Secretly Stolen!
por: Zhang, Zhexin, et al.
Publicado: (2025)
por: Zhang, Zhexin, et al.
Publicado: (2025)
Multimodal Cognitive Reframing Therapy via Multi-hop Psychotherapeutic Reasoning
por: Kim, Subin, et al.
Publicado: (2025)
por: Kim, Subin, et al.
Publicado: (2025)
LatentRAG: Latent Reasoning and Retrieval for Efficient Agentic RAG
por: Zheng, Yijia, et al.
Publicado: (2026)
por: Zheng, Yijia, et al.
Publicado: (2026)
RICE-PO: Turning Retrieval Interactions into Credit Signals for Reasoning Agents
por: Li, Mingchen, et al.
Publicado: (2026)
por: Li, Mingchen, et al.
Publicado: (2026)
I Could've Asked That: Reformulating Unanswerable Questions
por: Zhao, Wenting, et al.
Publicado: (2024)
por: Zhao, Wenting, et al.
Publicado: (2024)
Evaluating Temporal Consistency in Multi-Turn Language Models
por: Atri, Yash Kumar, et al.
Publicado: (2026)
por: Atri, Yash Kumar, et al.
Publicado: (2026)
Training LLMs for EHR-Based Reasoning Tasks via Reinforcement Learning
por: Lin, Jiacheng, et al.
Publicado: (2025)
por: Lin, Jiacheng, et al.
Publicado: (2025)
TimeSage-MT: A Multi-Turn Benchmark for Evaluating Agentic Time Series Reasoning
por: Kong, Yaxuan, et al.
Publicado: (2026)
por: Kong, Yaxuan, et al.
Publicado: (2026)
Autonomous Evaluation of LLMs for Truth Maintenance and Reasoning Tasks
por: Karia, Rushang, et al.
Publicado: (2024)
por: Karia, Rushang, et al.
Publicado: (2024)
LLMs Get Lost In Multi-Turn Conversation
por: Laban, Philippe, et al.
Publicado: (2025)
por: Laban, Philippe, et al.
Publicado: (2025)
When Smiley Turns Hostile: Interpreting How Emojis Trigger LLMs' Toxicity
por: Cui, Shiyao, et al.
Publicado: (2025)
por: Cui, Shiyao, et al.
Publicado: (2025)
CID-TKG: Collaborative Historical Invariance and Evolutionary Dynamics Learning for Temporal Knowledge Graph Reasoning
por: Lei, Shuai-Long, et al.
Publicado: (2026)
por: Lei, Shuai-Long, et al.
Publicado: (2026)
Promoting Constructive Deliberation: Reframing for Receptiveness
por: Kambhatla, Gauri, et al.
Publicado: (2024)
por: Kambhatla, Gauri, et al.
Publicado: (2024)
Approaches to Analysing Historical Newspapers Using LLMs
por: Dobranić, Filip, et al.
Publicado: (2026)
por: Dobranić, Filip, et al.
Publicado: (2026)
From Harm to Help: Turning Reasoning In-Context Demos into Assets for Reasoning LMs
por: Wang, Haonan, et al.
Publicado: (2025)
por: Wang, Haonan, et al.
Publicado: (2025)
MathGenie: Generating Synthetic Data with Question Back-translation for Enhancing Mathematical Reasoning of LLMs
por: Lu, Zimu, et al.
Publicado: (2024)
por: Lu, Zimu, et al.
Publicado: (2024)
RMTBench: Benchmarking LLMs Through Multi-Turn User-Centric Role-Playing
por: Xiang, Hao, et al.
Publicado: (2025)
por: Xiang, Hao, et al.
Publicado: (2025)
Does "Reasoning" with Large Language Models Improve Recognizing, Generating, and Reframing Unhelpful Thoughts?
por: Qi, Yilin, et al.
Publicado: (2025)
por: Qi, Yilin, et al.
Publicado: (2025)
Could We Have Had Better Multilingual LLMs If English Was Not the Central Language?
por: Diandaru, Ryandito, et al.
Publicado: (2024)
por: Diandaru, Ryandito, et al.
Publicado: (2024)
A Comment On "The Illusion of Thinking": Reframing the Reasoning Cliff as an Agentic Gap
por: Khan, Sheraz, et al.
Publicado: (2025)
por: Khan, Sheraz, et al.
Publicado: (2025)
Measuring Iterative Temporal Reasoning with Time Puzzles
por: Wang, Zhengxiang, et al.
Publicado: (2026)
por: Wang, Zhengxiang, et al.
Publicado: (2026)
Reframing Spatial Reasoning Evaluation in Language Models: A Real-World Simulation Benchmark for Qualitative Reasoning
por: Li, Fangjun, et al.
Publicado: (2024)
por: Li, Fangjun, et al.
Publicado: (2024)
Reasoning Topology Matters: Network-of-Thought for Complex Reasoning Tasks
por: Huang, Fan
Publicado: (2026)
por: Huang, Fan
Publicado: (2026)
Multi-IF: Benchmarking LLMs on Multi-Turn and Multilingual Instructions Following
por: He, Yun, et al.
Publicado: (2024)
por: He, Yun, et al.
Publicado: (2024)
TurnBench-MS: A Benchmark for Evaluating Multi-Turn, Multi-Step Reasoning in Large Language Models
por: Zhang, Yiran, et al.
Publicado: (2025)
por: Zhang, Yiran, et al.
Publicado: (2025)
Ejemplares similares
-
Could Thinking Multilingually Empower LLM Reasoning?
por: Gao, Changjiang, et al.
Publicado: (2025) -
Not Minds, but Signs: Reframing LLMs through Semiotics
por: Picca, Davide
Publicado: (2025) -
Test of Time: A Benchmark for Evaluating LLMs on Temporal Reasoning
por: Fatemi, Bahare, et al.
Publicado: (2024) -
Multi-Turn Puzzles: Evaluating Interactive Reasoning and Strategic Dialogue in LLMs
por: Badola, Kartikeya, et al.
Publicado: (2025) -
Reframing Tax Law Entailment as Analogical Reasoning
por: Zou, Xinrui, et al.
Publicado: (2024)