What Really Controls Temporal Reasoning in Large Language Models: Tokenisation or Representation of Time?
Fuente:
arXiv
Guardado en:
| Autores principales: | Bhatia, Gagan, Isa, Ahmad Muhammad, Peyrard, Maxime, Zhao, Wei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Date Fragments: A Hidden Bottleneck of Tokenization for Temporal Reasoning
por: Bhatia, Gagan, et al.
Publicado: (2025)
por: Bhatia, Gagan, et al.
Publicado: (2025)
Dallah: A Dialect-Aware Multimodal Large Language Model for Arabic
por: Alwajih, Fakhraddin, et al.
Publicado: (2024)
por: Alwajih, Fakhraddin, et al.
Publicado: (2024)
DateLogicQA: Benchmarking Temporal Biases in Large Language Models
por: Bhatia, Gagan, et al.
Publicado: (2024)
por: Bhatia, Gagan, et al.
Publicado: (2024)
FinTral: A Family of GPT-4 Level Multimodal Financial Large Language Models
por: Bhatia, Gagan, et al.
Publicado: (2024)
por: Bhatia, Gagan, et al.
Publicado: (2024)
Peacock: A Family of Arabic Multimodal Large Language Models and Benchmarks
por: Alwajih, Fakhraddin, et al.
Publicado: (2024)
por: Alwajih, Fakhraddin, et al.
Publicado: (2024)
Mechanistic Interpretability as Statistical Estimation: A Variance Analysis
por: Méloux, Maxime, et al.
Publicado: (2025)
por: Méloux, Maxime, et al.
Publicado: (2025)
AdapTime: Enabling Adaptive Temporal Reasoning in Large Language Models
por: Deng, Yimin, et al.
Publicado: (2026)
por: Deng, Yimin, et al.
Publicado: (2026)
Are Large Language Models Really Good Logical Reasoners? A Comprehensive Evaluation and Beyond
por: Xu, Fangzhi, et al.
Publicado: (2023)
por: Xu, Fangzhi, et al.
Publicado: (2023)
Distributional Semantics Tracing: A Framework for Explaining Hallucinations in Large Language Models
por: Bhatia, Gagan, et al.
Publicado: (2025)
por: Bhatia, Gagan, et al.
Publicado: (2025)
Everything, Everywhere, All at Once: Is Mechanistic Interpretability Identifiable?
por: Méloux, Maxime, et al.
Publicado: (2025)
por: Méloux, Maxime, et al.
Publicado: (2025)
Causal Estimation of Tokenisation Bias
por: Lesci, Pietro, et al.
Publicado: (2025)
por: Lesci, Pietro, et al.
Publicado: (2025)
What Really Improves Mathematical Reasoning: Structured Reasoning Signals Beyond Pure Code
por: Zhao, Yuze, et al.
Publicado: (2026)
por: Zhao, Yuze, et al.
Publicado: (2026)
Agentic AI: The Era of Semantic Decoding
por: Peyrard, Maxime, et al.
Publicado: (2024)
por: Peyrard, Maxime, et al.
Publicado: (2024)
TimeBench: A Comprehensive Evaluation of Temporal Reasoning Abilities in Large Language Models
por: Chu, Zheng, et al.
Publicado: (2023)
por: Chu, Zheng, et al.
Publicado: (2023)
Grammar-Constrained Decoding for Structured NLP Tasks without Finetuning
por: Geng, Saibo, et al.
Publicado: (2023)
por: Geng, Saibo, et al.
Publicado: (2023)
R-Horizon: How Far Can Your Large Reasoning Model Really Go in Breadth and Depth?
por: Lu, Yi, et al.
Publicado: (2025)
por: Lu, Yi, et al.
Publicado: (2025)
Large Language Models-guided Dynamic Adaptation for Temporal Knowledge Graph Reasoning
por: Wang, Jiapu, et al.
Publicado: (2024)
por: Wang, Jiapu, et al.
Publicado: (2024)
What Really is Commonsense Knowledge?
por: Do, Quyet V., et al.
Publicado: (2024)
por: Do, Quyet V., et al.
Publicado: (2024)
Evaluating Language Model Agency through Negotiations
por: Davidson, Tim R., et al.
Publicado: (2024)
por: Davidson, Tim R., et al.
Publicado: (2024)
LTLBench: Towards Benchmarks for Evaluating Temporal Reasoning in Large Language Models
por: Tang, Weizhi, et al.
Publicado: (2024)
por: Tang, Weizhi, et al.
Publicado: (2024)
Persuasion Games using Large Language Models
por: Ramani, Ganesh Prasath, et al.
Publicado: (2024)
por: Ramani, Ganesh Prasath, et al.
Publicado: (2024)
OpenAI's GPT-OSS-20B Model and Safety Alignment Issues in a Low-Resource Language
por: Inuwa-Dutse, Isa
Publicado: (2025)
por: Inuwa-Dutse, Isa
Publicado: (2025)
What is an "Abstract Reasoner"? Revisiting Experiments and Arguments about Large Language Models
por: Yun, Tian, et al.
Publicado: (2025)
por: Yun, Tian, et al.
Publicado: (2025)
Thinking in Many Modes: How Composite Reasoning Elevates Large Language Model Performance with Limited Data
por: Ahmad, Zishan, et al.
Publicado: (2025)
por: Ahmad, Zishan, et al.
Publicado: (2025)
Qalam : A Multimodal LLM for Arabic Optical Character and Handwriting Recognition
por: Bhatia, Gagan, et al.
Publicado: (2024)
por: Bhatia, Gagan, et al.
Publicado: (2024)
Dataset Creation and Baseline Models for Sexism Detection in Hausa
por: Muhammad, Fatima Adam, et al.
Publicado: (2025)
por: Muhammad, Fatima Adam, et al.
Publicado: (2025)
Is the System Message Really Important to Jailbreaks in Large Language Models?
por: Zou, Xiaotian, et al.
Publicado: (2024)
por: Zou, Xiaotian, et al.
Publicado: (2024)
A Glitch in the Matrix? Locating and Detecting Language Model Grounding with Fakepedia
por: Monea, Giovanni, et al.
Publicado: (2023)
por: Monea, Giovanni, et al.
Publicado: (2023)
NeSTR: A Neuro-Symbolic Abductive Framework for Temporal Reasoning in Large Language Models
por: Liang, Feng, et al.
Publicado: (2025)
por: Liang, Feng, et al.
Publicado: (2025)
Compliance versus Sensibility: On the Reasoning Controllability in Large Language Models
por: Tan, Xingwei, et al.
Publicado: (2026)
por: Tan, Xingwei, et al.
Publicado: (2026)
Narrative-of-Thought: Improving Temporal Reasoning of Large Language Models via Recounted Narratives
por: Zhang, Xinliang Frederick, et al.
Publicado: (2024)
por: Zhang, Xinliang Frederick, et al.
Publicado: (2024)
Large Language Model Cascades with Mixture of Thoughts Representations for Cost-efficient Reasoning
por: Yue, Murong, et al.
Publicado: (2023)
por: Yue, Murong, et al.
Publicado: (2023)
NaijaNLP: A Survey of Nigerian Low-Resource Languages
por: Inuwa-Dutse, Isa
Publicado: (2025)
por: Inuwa-Dutse, Isa
Publicado: (2025)
Agentic Reasoning for Large Language Models
por: Wei, Tianxin, et al.
Publicado: (2026)
por: Wei, Tianxin, et al.
Publicado: (2026)
State Design Matters: How Representations Shape Dynamic Reasoning in Large Language Models
por: Wong, Annie, et al.
Publicado: (2026)
por: Wong, Annie, et al.
Publicado: (2026)
Are Large Language Models Really Bias-Free? Jailbreak Prompts for Assessing Adversarial Robustness to Bias Elicitation
por: Cantini, Riccardo, et al.
Publicado: (2024)
por: Cantini, Riccardo, et al.
Publicado: (2024)
Towards Explainable Temporal Reasoning in Large Language Models: A Structure-Aware Generative Framework
por: Jiang, Zihao, et al.
Publicado: (2025)
por: Jiang, Zihao, et al.
Publicado: (2025)
Dissecting Failure Dynamics in Large Language Model Reasoning
por: Zhu, Wei, et al.
Publicado: (2026)
por: Zhu, Wei, et al.
Publicado: (2026)
LongReasonArena: A Long Reasoning Benchmark for Large Language Models
por: Ding, Jiayu, et al.
Publicado: (2025)
por: Ding, Jiayu, et al.
Publicado: (2025)
Timo: Towards Better Temporal Reasoning for Language Models
por: Su, Zhaochen, et al.
Publicado: (2024)
por: Su, Zhaochen, et al.
Publicado: (2024)
Ejemplares similares
-
Date Fragments: A Hidden Bottleneck of Tokenization for Temporal Reasoning
por: Bhatia, Gagan, et al.
Publicado: (2025) -
Dallah: A Dialect-Aware Multimodal Large Language Model for Arabic
por: Alwajih, Fakhraddin, et al.
Publicado: (2024) -
DateLogicQA: Benchmarking Temporal Biases in Large Language Models
por: Bhatia, Gagan, et al.
Publicado: (2024) -
FinTral: A Family of GPT-4 Level Multimodal Financial Large Language Models
por: Bhatia, Gagan, et al.
Publicado: (2024) -
Peacock: A Family of Arabic Multimodal Large Language Models and Benchmarks
por: Alwajih, Fakhraddin, et al.
Publicado: (2024)