What If TSF: A Benchmark for Reframing Forecasting as Scenario-Guided Multimodal Forecasting
Fuente:
arXiv
Guardado en:
| Autores principales: | Jang, Jinkwan, Jin, Hyunbin, Park, Hyungjin, Chae, Kyubyung, Kim, Taesup |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
From Threat to Tool: Leveraging Refusal-Aware Injection Attacks for Safety Alignment
por: Chae, Kyubyung, et al.
Publicado: (2025)
por: Chae, Kyubyung, et al.
Publicado: (2025)
Towards Robust Real-World Multivariate Time Series Forecasting: A Unified Framework for Dependency, Asynchrony, and Missingness
por: Jang, Jinkwan, et al.
Publicado: (2025)
por: Jang, Jinkwan, et al.
Publicado: (2025)
Beyond Case Law: Evaluating Structure-Aware Retrieval and Safety in Statute-Centric Legal QA
por: Chae, Kyubyung, et al.
Publicado: (2026)
por: Chae, Kyubyung, et al.
Publicado: (2026)
Mitigating Hallucination in Abstractive Summarization with Domain-Conditional Mutual Information
por: Chae, Kyubyung, et al.
Publicado: (2024)
por: Chae, Kyubyung, et al.
Publicado: (2024)
Model-based Preference Optimization in Abstractive Summarization without Human Feedback
por: Choi, Jaepill, et al.
Publicado: (2024)
por: Choi, Jaepill, et al.
Publicado: (2024)
What Models Know, How Well They Know It: Knowledge-Weighted Fine-Tuning for Learning When to Say "I Don't Know"
por: Lee, Joosung, et al.
Publicado: (2026)
por: Lee, Joosung, et al.
Publicado: (2026)
When Vision Models Meet Parameter Efficient Look-Aside Adapters Without Large-Scale Audio Pretraining
por: Yeo, Juan, et al.
Publicado: (2024)
por: Yeo, Juan, et al.
Publicado: (2024)
X-PEFT: eXtremely Parameter-Efficient Fine-Tuning for Extreme Multi-Profile Scenarios
por: Kwak, Namju, et al.
Publicado: (2024)
por: Kwak, Namju, et al.
Publicado: (2024)
Multimodal Cognitive Reframing Therapy via Multi-hop Psychotherapeutic Reasoning
por: Kim, Subin, et al.
Publicado: (2025)
por: Kim, Subin, et al.
Publicado: (2025)
PRISP: Privacy-Safe Few-Shot Personalization via Lightweight Adaptation
por: Park, Junho, et al.
Publicado: (2026)
por: Park, Junho, et al.
Publicado: (2026)
ForecastBench: A Dynamic Benchmark of AI Forecasting Capabilities
por: Karger, Ezra, et al.
Publicado: (2024)
por: Karger, Ezra, et al.
Publicado: (2024)
Assessing Socio-Cultural Alignment and Technical Safety of Sovereign LLMs
por: Chae, Kyubyung, et al.
Publicado: (2025)
por: Chae, Kyubyung, et al.
Publicado: (2025)
PreScience: A Benchmark for Forecasting Scientific Contributions
por: Ajith, Anirudh, et al.
Publicado: (2026)
por: Ajith, Anirudh, et al.
Publicado: (2026)
KoSimpleQA: A Korean Factuality Benchmark with an Analysis of Reasoning LLMs
por: Ko, Donghyeon, et al.
Publicado: (2025)
por: Ko, Donghyeon, et al.
Publicado: (2025)
CLLMate: A Multimodal Benchmark for Weather and Climate Events Forecasting
por: Li, Haobo, et al.
Publicado: (2024)
por: Li, Haobo, et al.
Publicado: (2024)
Forecasting Future International Events: A Reliable Dataset for Text-Based Event Modeling
por: Gwak, Daehoon, et al.
Publicado: (2024)
por: Gwak, Daehoon, et al.
Publicado: (2024)
Multimodal Forecasting of Sparse Intraoperative Hypotension Events Powered by Language Model
por: Zhang, Jintao, et al.
Publicado: (2025)
por: Zhang, Jintao, et al.
Publicado: (2025)
RuleArena: A Benchmark for Rule-Guided Reasoning with LLMs in Real-World Scenarios
por: Zhou, Ruiwen, et al.
Publicado: (2024)
por: Zhou, Ruiwen, et al.
Publicado: (2024)
Bench to the Future: A Pastcasting Benchmark for Forecasting Agents
por: FutureSearch, et al.
Publicado: (2025)
por: FutureSearch, et al.
Publicado: (2025)
"Well, Keep Thinking": Enhancing LLM Reasoning with Adaptive Injection Decoding
por: Jin, Hyunbin, et al.
Publicado: (2025)
por: Jin, Hyunbin, et al.
Publicado: (2025)
Assessing Modality Bias in Video Question Answering Benchmarks with Multimodal Large Language Models
por: Park, Jean, et al.
Publicado: (2024)
por: Park, Jean, et al.
Publicado: (2024)
CXR-LLAVA: a multimodal large language model for interpreting chest X-ray images
por: Lee, Seowoo, et al.
Publicado: (2023)
por: Lee, Seowoo, et al.
Publicado: (2023)
When Does Multimodality Lead to Better Time Series Forecasting?
por: Zhang, Xiyuan, et al.
Publicado: (2025)
por: Zhang, Xiyuan, et al.
Publicado: (2025)
Does "Reasoning" with Large Language Models Improve Recognizing, Generating, and Reframing Unhelpful Thoughts?
por: Qi, Yilin, et al.
Publicado: (2025)
por: Qi, Yilin, et al.
Publicado: (2025)
AI PB: A Grounded Generative Agent for Personalized Investment Insights
por: Park, Daewoo, et al.
Publicado: (2025)
por: Park, Daewoo, et al.
Publicado: (2025)
EventTSF: Event-Aware Non-Stationary Time Series Forecasting
por: Ge, Yunfeng, et al.
Publicado: (2025)
por: Ge, Yunfeng, et al.
Publicado: (2025)
UniSAFE: A Comprehensive Benchmark for Safety Evaluation of Unified Multimodal Models
por: Lee, Segyu, et al.
Publicado: (2026)
por: Lee, Segyu, et al.
Publicado: (2026)
Wait! There's a Way Out: A Decision Mechanism for Forecasting Conversational Derailment
por: Kim, Laerdon, et al.
Publicado: (2026)
por: Kim, Laerdon, et al.
Publicado: (2026)
Reframing Spatial Reasoning Evaluation in Language Models: A Real-World Simulation Benchmark for Qualitative Reasoning
por: Li, Fangjun, et al.
Publicado: (2024)
por: Li, Fangjun, et al.
Publicado: (2024)
Benchmark Profiling: Mechanistic Diagnosis of LLM Benchmarks
por: Kim, Dongjun, et al.
Publicado: (2025)
por: Kim, Dongjun, et al.
Publicado: (2025)
KITE: A Benchmark for Evaluating Korean Instruction-Following Abilities in Large Language Models
por: Kim, Dongjun, et al.
Publicado: (2025)
por: Kim, Dongjun, et al.
Publicado: (2025)
FinReport: Explainable Stock Earnings Forecasting via News Factor Analyzing Model
por: Li, Xiangyu, et al.
Publicado: (2024)
por: Li, Xiangyu, et al.
Publicado: (2024)
CondTSF: One-line Plugin of Dataset Condensation for Time Series Forecasting
por: Ding, Jianrong, et al.
Publicado: (2024)
por: Ding, Jianrong, et al.
Publicado: (2024)
Evaluating LLMs on Real-World Forecasting Against Expert Forecasters
por: Lu, Janna
Publicado: (2025)
por: Lu, Janna
Publicado: (2025)
DoMIX: An Efficient Framework for Exploiting Domain Knowledge in Fine-Tuning
por: Kim, Dohoon, et al.
Publicado: (2025)
por: Kim, Dohoon, et al.
Publicado: (2025)
Reframing Tax Law Entailment as Analogical Reasoning
por: Zou, Xinrui, et al.
Publicado: (2024)
por: Zou, Xinrui, et al.
Publicado: (2024)
Draw Your Mind: Personalized Generation via Condition-Level Modeling in Text-to-Image Diffusion Models
por: Kim, Hyungjin, et al.
Publicado: (2025)
por: Kim, Hyungjin, et al.
Publicado: (2025)
MIRAI: Evaluating LLM Agents for Event Forecasting
por: Ye, Chenchen, et al.
Publicado: (2024)
por: Ye, Chenchen, et al.
Publicado: (2024)
Forecasting Frontier Language Model Agent Capabilities
por: Pimpale, Govind, et al.
Publicado: (2025)
por: Pimpale, Govind, et al.
Publicado: (2025)
STELLA: Guiding Large Language Models for Time Series Forecasting with Semantic Abstractions
por: Fan, Junjie, et al.
Publicado: (2025)
por: Fan, Junjie, et al.
Publicado: (2025)
Ejemplares similares
-
From Threat to Tool: Leveraging Refusal-Aware Injection Attacks for Safety Alignment
por: Chae, Kyubyung, et al.
Publicado: (2025) -
Towards Robust Real-World Multivariate Time Series Forecasting: A Unified Framework for Dependency, Asynchrony, and Missingness
por: Jang, Jinkwan, et al.
Publicado: (2025) -
Beyond Case Law: Evaluating Structure-Aware Retrieval and Safety in Statute-Centric Legal QA
por: Chae, Kyubyung, et al.
Publicado: (2026) -
Mitigating Hallucination in Abstractive Summarization with Domain-Conditional Mutual Information
por: Chae, Kyubyung, et al.
Publicado: (2024) -
Model-based Preference Optimization in Abstractive Summarization without Human Feedback
por: Choi, Jaepill, et al.
Publicado: (2024)