SupChain-Bench: Benchmarking Large Language Models for Real-World Supply Chain Management
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guan, Shengyue, Liu, Yihao, Cao, Lang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Large Language Models for Supply Chain Decisions
par: Simchi-Levi, David, et autres
Publié: (2025)
par: Simchi-Levi, David, et autres
Publié: (2025)
MonitorBench: A Comprehensive Benchmark for Chain-of-Thought Monitorability in Large Language Models
par: Wang, Han, et autres
Publié: (2026)
par: Wang, Han, et autres
Publié: (2026)
Integrating Large Language Models with Network Optimization for Interactive and Explainable Supply Chain Planning: A Real-World Case Study
par: Venkatachalam, Saravanan
Publié: (2025)
par: Venkatachalam, Saravanan
Publié: (2025)
VisualDeltas: Learning Preferences from Visual Quality Perturbations
par: Huang, Hailiang, et autres
Publié: (2026)
par: Huang, Hailiang, et autres
Publié: (2026)
LLMs for Supply Chain Management
par: Wang, Haojie, et autres
Publié: (2025)
par: Wang, Haojie, et autres
Publié: (2025)
RealFactBench: A Benchmark for Evaluating Large Language Models in Real-World Fact-Checking
par: Yang, Shuo, et autres
Publié: (2025)
par: Yang, Shuo, et autres
Publié: (2025)
From Topology to Trajectory: LLM-Driven World Models For Supply Chain Resilience
par: Luo, Jia
Publié: (2026)
par: Luo, Jia
Publié: (2026)
Enhancing Supply Chain Visibility with Knowledge Graphs and Large Language Models
par: AlMahri, Sara, et autres
Publié: (2024)
par: AlMahri, Sara, et autres
Publié: (2024)
QuarkMedBench: A Real-World Scenario Driven Benchmark for Evaluating Large Language Models
par: Wu, Yao, et autres
Publié: (2026)
par: Wu, Yao, et autres
Publié: (2026)
Large Language Model Supply Chain: Open Problems From the Security Perspective
par: Hu, Qiang, et autres
Publié: (2024)
par: Hu, Qiang, et autres
Publié: (2024)
Supply Chain Management by Means of Simulation
par: Borja Ponte
Publié: (2013)
par: Borja Ponte
Publié: (2013)
Stochastic Optimization of Inventory at Large-scale Supply Chains
par: Jin, Zhaoyang Larry, et autres
Publié: (2025)
par: Jin, Zhaoyang Larry, et autres
Publié: (2025)
Towards an Ontology of Traceable Impact Management in the Food Supply Chain
par: Gajderowicz, Bart, et autres
Publié: (2025)
par: Gajderowicz, Bart, et autres
Publié: (2025)
ElecBench: a Power Dispatch Evaluation Benchmark for Large Language Models
par: Zhou, Xiyuan, et autres
Publié: (2024)
par: Zhou, Xiyuan, et autres
Publié: (2024)
EgoPlan-Bench2: A Benchmark for Multimodal Large Language Model Planning in Real-World Scenarios
par: Qiu, Lu, et autres
Publié: (2024)
par: Qiu, Lu, et autres
Publié: (2024)
MCP-SafetyBench: A Benchmark for Safety Evaluation of Large Language Models with Real-World MCP Servers
par: Zong, Xuanjun, et autres
Publié: (2025)
par: Zong, Xuanjun, et autres
Publié: (2025)
Flowr -- Scaling Up Retail Supply Chain Operations Through Agentic AI in Large Scale Supermarket Chains
par: Bandara, Eranga, et autres
Publié: (2026)
par: Bandara, Eranga, et autres
Publié: (2026)
RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models
par: Jin, Zhuoran, et autres
Publié: (2024)
par: Jin, Zhuoran, et autres
Publié: (2024)
GraphChain: Large Language Models for Large-scale Graph Analysis via Tool Chaining
par: Wei, Chunyu, et autres
Publié: (2025)
par: Wei, Chunyu, et autres
Publié: (2025)
FaithCoT-Bench: Benchmarking Instance-Level Faithfulness of Chain-of-Thought Reasoning
par: Shen, Xu, et autres
Publié: (2025)
par: Shen, Xu, et autres
Publié: (2025)
PCA-Bench: Evaluating Multimodal Large Language Models in Perception-Cognition-Action Chain
par: Chen, Liang, et autres
Publié: (2024)
par: Chen, Liang, et autres
Publié: (2024)
Validating Generative Agent-Based Models for Logistics and Supply Chain Management Research
par: Castillo, Vincent E.
Publié: (2025)
par: Castillo, Vincent E.
Publié: (2025)
Crisis-Bench: Benchmarking Strategic Ambiguity and Reputation Management in Large Language Models
par: Lin, Cooper, et autres
Publié: (2026)
par: Lin, Cooper, et autres
Publié: (2026)
Large Language Models Play StarCraft II: Benchmarks and A Chain of Summarization Approach
par: Ma, Weiyu, et autres
Publié: (2023)
par: Ma, Weiyu, et autres
Publié: (2023)
Benchmarking Multi-Step Legal Reasoning and Analyzing Chain-of-Thought Effects in Large Language Models
par: Yu, Wenhan, et autres
Publié: (2025)
par: Yu, Wenhan, et autres
Publié: (2025)
BiSup: Bidirectional Quantization Error Suppression for Large Language Models
par: Zou, Minghui, et autres
Publié: (2024)
par: Zou, Minghui, et autres
Publié: (2024)
The ORCA Benchmark: Evaluating Real-World Calculation Accuracy in Large Language Models
par: Herambourg, Claudia, et autres
Publié: (2025)
par: Herambourg, Claudia, et autres
Publié: (2025)
PPU-Bench:Real World Benchmark for Personalized Partial Unlearning in Vision Language Models
par: Guang, Jiahui, et autres
Publié: (2026)
par: Guang, Jiahui, et autres
Publié: (2026)
PROPEL: Supervised and Reinforcement Learning for Large-Scale Supply Chain Planning
par: Akhlaghi, Vahid Eghbal, et autres
Publié: (2025)
par: Akhlaghi, Vahid Eghbal, et autres
Publié: (2025)
GraphReason: Enhancing Reasoning Capabilities of Large Language Models through A Graph-Based Verification Approach
par: Cao, Lang
Publié: (2023)
par: Cao, Lang
Publié: (2023)
Rethinking Supply Chain Planning: A Generative Paradigm
par: Yin, Jiaheng, et autres
Publié: (2025)
par: Yin, Jiaheng, et autres
Publié: (2025)
Identifying the Supply Chain of AI for Trustworthiness and Risk Management in Critical Applications
par: Sheh, Raymond K., et autres
Publié: (2025)
par: Sheh, Raymond K., et autres
Publié: (2025)
Reliability and Effectiveness of Autonomous AI Agents in Supply Chain Management
par: Long, Carol Xuan, et autres
Publié: (2026)
par: Long, Carol Xuan, et autres
Publié: (2026)
Hidden You Malicious Goal Into Benign Narratives: Jailbreak Large Language Models through Logic Chain Injection
par: Wang, Zhilong, et autres
Publié: (2024)
par: Wang, Zhilong, et autres
Publié: (2024)
Large Language Models as Markov Chains
par: Zekri, Oussama, et autres
Publié: (2024)
par: Zekri, Oussama, et autres
Publié: (2024)
TRIP-Bench: A Benchmark for Long-Horizon Interactive Agents in Real-World Scenarios
par: Shen, Yuanzhe, et autres
Publié: (2026)
par: Shen, Yuanzhe, et autres
Publié: (2026)
Chain-of-Thought in Large Language Models: Decoding, Projection, and Activation
par: Yang, Hao, et autres
Publié: (2024)
par: Yang, Hao, et autres
Publié: (2024)
Applying Large Language Models and Chain-of-Thought for Automatic Scoring
par: Lee, Gyeong-Geon, et autres
Publié: (2023)
par: Lee, Gyeong-Geon, et autres
Publié: (2023)
GNN-based Probabilistic Supply and Inventory Predictions in Supply Chain Networks
par: Ahn, Hyung-il, et autres
Publié: (2024)
par: Ahn, Hyung-il, et autres
Publié: (2024)
Optimizing Supply Chain Management using Gravitational Search Algorithm and Multi Agent System
par: Ojha, Muneendra
Publié: (2012)
par: Ojha, Muneendra
Publié: (2012)
Documents similaires
-
Large Language Models for Supply Chain Decisions
par: Simchi-Levi, David, et autres
Publié: (2025) -
MonitorBench: A Comprehensive Benchmark for Chain-of-Thought Monitorability in Large Language Models
par: Wang, Han, et autres
Publié: (2026) -
Integrating Large Language Models with Network Optimization for Interactive and Explainable Supply Chain Planning: A Real-World Case Study
par: Venkatachalam, Saravanan
Publié: (2025) -
VisualDeltas: Learning Preferences from Visual Quality Perturbations
par: Huang, Hailiang, et autres
Publié: (2026) -
LLMs for Supply Chain Management
par: Wang, Haojie, et autres
Publié: (2025)