Beyond Accuracy: Evaluating Forecasting Models by Multi-Echelon Inventory Cost
Fuente:
arXiv
Saved in:
| Main Authors: | Marik, Swata, Saha, Swayamjit, Chatterjee, Garga |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Comprehensive Forecasting-Based Analysis of Hybrid and Stacked Stateful/ Stateless Models
by: Saha, Swayamjit
Published: (2024)
by: Saha, Swayamjit
Published: (2024)
Knowledge-Aware Self-Correction in Language Models via Structured Memory Graphs
by: Saha, Swayamjit
Published: (2025)
by: Saha, Swayamjit
Published: (2025)
Exploring and Visualizing COVID-19 Trends in India: Vulnerabilities and Mitigation Strategies
by: Saha, Swayamjit, et al.
Published: (2024)
by: Saha, Swayamjit, et al.
Published: (2024)
Can Transformer Memory Be Corrupted? Investigating Cache-Side Vulnerabilities in Large Language Models
by: Hossain, Elias, et al.
Published: (2025)
by: Hossain, Elias, et al.
Published: (2025)
A Deep Q-Network Based on Radial Basis Functions for Multi-Echelon Inventory Management
by: Cheng, Liqiang, et al.
Published: (2024)
by: Cheng, Liqiang, et al.
Published: (2024)
Hybrid LLM-based Intelligent Framework for Robot Task Scheduling
by: Saha, Swayamjit, et al.
Published: (2026)
by: Saha, Swayamjit, et al.
Published: (2026)
Reinforcement Learning for Multi-Objective Multi-Echelon Supply Chain Optimisation
by: Rachman, Rifny, et al.
Published: (2025)
by: Rachman, Rifny, et al.
Published: (2025)
Bridging Forecast Accuracy and Inventory KPIs: A Simulation-Based Software Framework
by: Fukuhara, So, et al.
Published: (2026)
by: Fukuhara, So, et al.
Published: (2026)
Contract2Plan: Verified Contract-Grounded Retrieval-Augmented Optimization for BOM-Aware Procurement and Multi-Echelon Inventory Planning
by: Agarwal, Sahil
Published: (2026)
by: Agarwal, Sahil
Published: (2026)
EMO-BOOST: Emotion-Augmented Audio-Visual Features for Improved Generalization in Deepfake Detection
by: Marik, Aritra, et al.
Published: (2026)
by: Marik, Aritra, et al.
Published: (2026)
What Single-Prompt Accuracy Misses: A Multi-Variant Reliability Audit of Language Models
by: Karmakar, Ranit, et al.
Published: (2026)
by: Karmakar, Ranit, et al.
Published: (2026)
Beyond Accuracy: A Multi-Dimensional Framework for Evaluating Enterprise Agentic AI Systems
by: Mehta, Sushant
Published: (2025)
by: Mehta, Sushant
Published: (2025)
Balancing Forecast Accuracy and Switching Costs in Online Optimization of Energy Management Systems
by: Genov, Evgenii, et al.
Published: (2024)
by: Genov, Evgenii, et al.
Published: (2024)
Beyond Accuracy: A Geometric Stability Analysis of Large Language Models in Chess Evaluation
by: Song, Xidan, et al.
Published: (2025)
by: Song, Xidan, et al.
Published: (2025)
Security Considerations in AI-Robotics: A Survey of Current Methods, Challenges, and Opportunities
by: Neupane, Subash, et al.
Published: (2023)
by: Neupane, Subash, et al.
Published: (2023)
Luna: An Evaluation Foundation Model to Catch Language Model Hallucinations with High Accuracy and Low Cost
by: Belyi, Masha, et al.
Published: (2024)
by: Belyi, Masha, et al.
Published: (2024)
Beyond Accuracy: Evaluating the Reasoning Behavior of Large Language Models -- A Survey
by: Mondorf, Philipp, et al.
Published: (2024)
by: Mondorf, Philipp, et al.
Published: (2024)
Beyond Accuracy: Evaluating Strategy Diversity in LLM Mathematical Reasoning
by: Yang, Xia, et al.
Published: (2026)
by: Yang, Xia, et al.
Published: (2026)
Beyond Accuracy: Risk-Sensitive Evaluation of Hallucinated Medical Advice
by: Doshi, Savan
Published: (2026)
by: Doshi, Savan
Published: (2026)
Beyond Model Ranking: Predictability-Aligned Evaluation for Time Series Forecasting
by: Feng, Wanjin, et al.
Published: (2025)
by: Feng, Wanjin, et al.
Published: (2025)
Looking Beyond Accuracy: A Holistic Benchmark of ECG Foundation Models
by: Filice, Francesca, et al.
Published: (2026)
by: Filice, Francesca, et al.
Published: (2026)
User Behavior Prediction as a Generic, Robust, Scalable, and Low-Cost Evaluation Strategy for Estimating Generalization in LLMs
by: Saha, Sougata, et al.
Published: (2025)
by: Saha, Sougata, et al.
Published: (2025)
LLM-as-a-Judge for Scalable Test Coverage Evaluation: Accuracy, Operational Reliability, and Cost
by: Huang, Donghao, et al.
Published: (2025)
by: Huang, Donghao, et al.
Published: (2025)
Beyond Inefficiency: Systemic Costs of Incivility in Multi-Agent Monte Carlo Simulations
by: Moldovan-Mauer, Alison, et al.
Published: (2026)
by: Moldovan-Mauer, Alison, et al.
Published: (2026)
Automatic Transmission for LLM Tiers: Optimizing Cost and Accuracy in Large Language Models
by: Na, Injae, et al.
Published: (2025)
by: Na, Injae, et al.
Published: (2025)
Cut Costs, Not Accuracy: LLM-Powered Data Processing with Guarantees
by: Zeighami, Sepanta, et al.
Published: (2025)
by: Zeighami, Sepanta, et al.
Published: (2025)
Beyond Generation: Multi-Hop Reasoning for Factual Accuracy in Vision-Language Models
by: Hossain, Shamima
Published: (2025)
by: Hossain, Shamima
Published: (2025)
Beyond Accuracy: Characterizing Code Comprehension Capabilities in (Large) Language Models
by: Mächtle, Felix, et al.
Published: (2026)
by: Mächtle, Felix, et al.
Published: (2026)
Beyond Accuracy: The Role of Calibration in Self-Improving Large Language Models
by: Huang, Liangjie, et al.
Published: (2025)
by: Huang, Liangjie, et al.
Published: (2025)
Beyond Multiple-Choice Accuracy: Real-World Challenges of Implementing Large Language Models in Healthcare
by: Yang, Yifan, et al.
Published: (2024)
by: Yang, Yifan, et al.
Published: (2024)
Trading-off Accuracy and Communication Cost in Federated Learning
by: Villani, Mattia Jacopo, et al.
Published: (2025)
by: Villani, Mattia Jacopo, et al.
Published: (2025)
Beyond Accuracy: Are Time Series Foundation Models Well-Calibrated?
by: Adler, Coen, et al.
Published: (2025)
by: Adler, Coen, et al.
Published: (2025)
PivotRL: High Accuracy Agentic Post-Training at Low Compute Cost
by: Yi, Junkeun, et al.
Published: (2026)
by: Yi, Junkeun, et al.
Published: (2026)
Beyond Accuracy: Dissecting Mathematical Reasoning for LLMs Under Reinforcement Learning
by: Wang, Jiayu, et al.
Published: (2025)
by: Wang, Jiayu, et al.
Published: (2025)
Hardware Aware Ensemble Selection for Balancing Predictive Accuracy and Cost
by: Maier, Jannis, et al.
Published: (2024)
by: Maier, Jannis, et al.
Published: (2024)
The Hidden Costs of Translation Accuracy: Distillation, Quantization, and Environmental Impact
by: Vijay, Dhaathri, et al.
Published: (2025)
by: Vijay, Dhaathri, et al.
Published: (2025)
Quantifying the Accuracy and Cost Impact of Design Decisions in Budget-Constrained Agentic LLM Search
by: McCleary, Kyle, et al.
Published: (2026)
by: McCleary, Kyle, et al.
Published: (2026)
AI for Regulatory Affairs: Balancing Accuracy, Interpretability, and Computational Cost in Medical Device Classification
by: Han, Yu, et al.
Published: (2025)
by: Han, Yu, et al.
Published: (2025)
AIM-Bench: Evaluating Decision-making Biases of Agentic LLM as Inventory Manager
by: Zhao, Xuhua, et al.
Published: (2025)
by: Zhao, Xuhua, et al.
Published: (2025)
The ORCA Benchmark: Evaluating Real-World Calculation Accuracy in Large Language Models
by: Herambourg, Claudia, et al.
Published: (2025)
by: Herambourg, Claudia, et al.
Published: (2025)
Similar Items
-
Comprehensive Forecasting-Based Analysis of Hybrid and Stacked Stateful/ Stateless Models
by: Saha, Swayamjit
Published: (2024) -
Knowledge-Aware Self-Correction in Language Models via Structured Memory Graphs
by: Saha, Swayamjit
Published: (2025) -
Exploring and Visualizing COVID-19 Trends in India: Vulnerabilities and Mitigation Strategies
by: Saha, Swayamjit, et al.
Published: (2024) -
Can Transformer Memory Be Corrupted? Investigating Cache-Side Vulnerabilities in Large Language Models
by: Hossain, Elias, et al.
Published: (2025) -
A Deep Q-Network Based on Radial Basis Functions for Multi-Echelon Inventory Management
by: Cheng, Liqiang, et al.
Published: (2024)