HEARTS: Benchmarking LLM Reasoning on Health Time Series
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Sirui, Xiao, Shuhan, Joshi, Mihir, Metwally, Ahmed, McDuff, Daniel, Wang, Wei, Yang, Yuzhe |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Health-LLM: Large Language Models for Health Prediction via Wearable Sensor Data
par: Kim, Yubin, et autres
Publié: (2024)
par: Kim, Yubin, et autres
Publié: (2024)
Reasoning-Aware Training for Time Series Forecasting
par: Ahamed, Md Atik, et autres
Publié: (2026)
par: Ahamed, Md Atik, et autres
Publié: (2026)
When LLM Meets Time Series: Can LLMs Perform Multi-Step Time Series Reasoning and Inference
par: Ye, Wen, et autres
Publié: (2025)
par: Ye, Wen, et autres
Publié: (2025)
Feature Fitted Online Conformal Prediction for Deep Time Series Forecasting Model
par: Huang, Xiannan, et autres
Publié: (2025)
par: Huang, Xiannan, et autres
Publié: (2025)
TemporalBench: A Benchmark for Evaluating LLM-Based Agents on Contextual and Event-Informed Time Series Tasks
par: Weng, Muyan, et autres
Publié: (2026)
par: Weng, Muyan, et autres
Publié: (2026)
Time-RA: Towards Time Series Reasoning for Anomaly Diagnosis with LLM Feedback
par: Yang, Yiyuan, et autres
Publié: (2025)
par: Yang, Yiyuan, et autres
Publié: (2025)
A Multi-Scale Decomposition MLP-Mixer for Time Series Analysis
par: Zhong, Shuhan, et autres
Publié: (2023)
par: Zhong, Shuhan, et autres
Publié: (2023)
From Private to Public: Benchmarking GANs in the Context of Private Time Series Classification
par: Mercier, Dominique, et autres
Publié: (2023)
par: Mercier, Dominique, et autres
Publié: (2023)
TS-Reasoner: Domain-Oriented Time Series Inference Agents for Reasoning and Automated Analysis
par: Ye, Wen, et autres
Publié: (2024)
par: Ye, Wen, et autres
Publié: (2024)
Inference-Time Computations for LLM Reasoning and Planning: A Benchmark and Insights
par: Parashar, Shubham, et autres
Publié: (2025)
par: Parashar, Shubham, et autres
Publié: (2025)
Dynamic TMoE: A Drift-Aware Dynamic Mixture of Experts Framework for Non-Stationary Time Series Forecasting
par: Zhu, Jiawen, et autres
Publié: (2026)
par: Zhu, Jiawen, et autres
Publié: (2026)
SensorLM: Learning the Language of Wearable Sensors
par: Zhang, Yuwei, et autres
Publié: (2025)
par: Zhang, Yuwei, et autres
Publié: (2025)
How Well Do Multimodal Models Reason on ECG Signals?
par: Xu, Maxwell A., et autres
Publié: (2026)
par: Xu, Maxwell A., et autres
Publié: (2026)
DLGAN : Time Series Synthesis Based on Dual-Layer Generative Adversarial Networks
par: Hou, Xuan, et autres
Publié: (2025)
par: Hou, Xuan, et autres
Publié: (2025)
LTSM-Bundle: A Toolbox and Benchmark on Large Language Models for Time Series Forecasting
par: Chuang, Yu-Neng, et autres
Publié: (2024)
par: Chuang, Yu-Neng, et autres
Publié: (2024)
An Electrocardiogram Multi-task Benchmark with Comprehensive Evaluations and Insightful Findings
par: Xu, Yuhao, et autres
Publié: (2025)
par: Xu, Yuhao, et autres
Publié: (2025)
TSI-Bench: Benchmarking Time Series Imputation
par: Du, Wenjie, et autres
Publié: (2024)
par: Du, Wenjie, et autres
Publié: (2024)
Stage-Diff: Stage-wise Long-Term Time Series Generation Based on Diffusion Models
par: Hou, Xuan, et autres
Publié: (2025)
par: Hou, Xuan, et autres
Publié: (2025)
TSRBench: A Comprehensive Multi-task Multi-modal Time Series Reasoning Benchmark for Generalist Models
par: Yu, Fangxu, et autres
Publié: (2026)
par: Yu, Fangxu, et autres
Publié: (2026)
Cross-Representation Benchmarking in Time-Series Electronic Health Records for Clinical Outcome Prediction
par: Chen, Tianyi, et autres
Publié: (2025)
par: Chen, Tianyi, et autres
Publié: (2025)
TimeSeriesGym: A Scalable Benchmark for (Time Series) Machine Learning Engineering Agents
par: Cai, Yifu, et autres
Publié: (2025)
par: Cai, Yifu, et autres
Publié: (2025)
TempoGPT: Enhancing Time Series Reasoning via Quantizing Embedding
par: Zhang, Haochuan, et autres
Publié: (2025)
par: Zhang, Haochuan, et autres
Publié: (2025)
Exploring Progress in Multivariate Time Series Forecasting: Comprehensive Benchmarking and Heterogeneity Analysis
par: Shao, Zezhi, et autres
Publié: (2023)
par: Shao, Zezhi, et autres
Publié: (2023)
CGM-JEPA: Learning Consistent Continuous Glucose Monitor Representations via Predictive Self-Supervised Pretraining
par: Muhammad, Hada Melino, et autres
Publié: (2026)
par: Muhammad, Hada Melino, et autres
Publié: (2026)
Empowering Time Series Forecasting with LLM-Agents
par: Yeh, Chin-Chia Michael, et autres
Publié: (2025)
par: Yeh, Chin-Chia Michael, et autres
Publié: (2025)
Class-incremental Learning for Time Series: Benchmark and Evaluation
par: Qiao, Zhongzheng, et autres
Publié: (2024)
par: Qiao, Zhongzheng, et autres
Publié: (2024)
Evaluating System 1 vs. 2 Reasoning Approaches for Zero-Shot Time Series Forecasting: A Benchmark and Insights
par: Liu, Haoxin, et autres
Publié: (2025)
par: Liu, Haoxin, et autres
Publié: (2025)
TimeOmni-1: Incentivizing Complex Reasoning with Time Series in Large Language Models
par: Guan, Tong, et autres
Publié: (2025)
par: Guan, Tong, et autres
Publié: (2025)
Tri-Level Navigator: LLM-Empowered Tri-Level Learning for Time Series OOD Generalization
par: Jian, Chengtao, et autres
Publié: (2024)
par: Jian, Chengtao, et autres
Publié: (2024)
FinSTaR: Towards Financial Reasoning with Time Series Reasoning Models
par: Lee, Seunghan, et autres
Publié: (2026)
par: Lee, Seunghan, et autres
Publié: (2026)
From Time Series Analysis to Question Answering: A Survey in the LLM Era
par: Li, Wei, et autres
Publié: (2025)
par: Li, Wei, et autres
Publié: (2025)
ReasonBENCH: Benchmarking the (In)Stability of LLM Reasoning
par: Potamitis, Nearchos, et autres
Publié: (2025)
par: Potamitis, Nearchos, et autres
Publié: (2025)
Marginals Before Conditionals
par: Sahasrabudhe, Mihir
Publié: (2026)
par: Sahasrabudhe, Mihir
Publié: (2026)
Time-LLM: Time Series Forecasting by Reprogramming Large Language Models
par: Jin, Ming, et autres
Publié: (2023)
par: Jin, Ming, et autres
Publié: (2023)
TimeSRL: Generalizable Time-Series Behavioral Modeling via Semantic RL-Tuned LLMs -- A Case Study in Mental Health
par: Fan, Yuang, et autres
Publié: (2026)
par: Fan, Yuang, et autres
Publié: (2026)
TimeMKG: Knowledge-Infused Causal Reasoning for Multivariate Time Series Modeling
par: Sun, Yifei, et autres
Publié: (2025)
par: Sun, Yifei, et autres
Publié: (2025)
Finding the DeepDream for Time Series: Activation Maximization for Univariate Time Series
par: Schlegel, Udo, et autres
Publié: (2024)
par: Schlegel, Udo, et autres
Publié: (2024)
CATS: Mitigating Correlation Shift for Multivariate Time Series Classification
par: Lin, Xiao, et autres
Publié: (2025)
par: Lin, Xiao, et autres
Publié: (2025)
TimeMaster: Training Time-Series Multimodal LLMs to Reason via Reinforcement Learning
par: Zhang, Junru, et autres
Publié: (2025)
par: Zhang, Junru, et autres
Publié: (2025)
MDAgents: An Adaptive Collaboration of LLMs for Medical Decision-Making
par: Kim, Yubin, et autres
Publié: (2024)
par: Kim, Yubin, et autres
Publié: (2024)
Documents similaires
-
Health-LLM: Large Language Models for Health Prediction via Wearable Sensor Data
par: Kim, Yubin, et autres
Publié: (2024) -
Reasoning-Aware Training for Time Series Forecasting
par: Ahamed, Md Atik, et autres
Publié: (2026) -
When LLM Meets Time Series: Can LLMs Perform Multi-Step Time Series Reasoning and Inference
par: Ye, Wen, et autres
Publié: (2025) -
Feature Fitted Online Conformal Prediction for Deep Time Series Forecasting Model
par: Huang, Xiannan, et autres
Publié: (2025) -
TemporalBench: A Benchmark for Evaluating LLM-Based Agents on Contextual and Event-Informed Time Series Tasks
par: Weng, Muyan, et autres
Publié: (2026)