Exploitation Strategies in Conditional Markov Chain Search: A case study on the three-index assignment problem
Fuente:
arXiv
Salvato in:
| Autori principali: | Patel, Sahil, Karapetyan, Daniel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Controlling Exploration-Exploitation in GFlowNets via Markov Chain Perspectives
di: Chen, Lin, et al.
Pubblicazione: (2026)
di: Chen, Lin, et al.
Pubblicazione: (2026)
Look It Up: Analysing Internal Web Search Capabilities of Modern LLMs
di: Kale, Sahil
Pubblicazione: (2025)
di: Kale, Sahil
Pubblicazione: (2025)
Strategy-Augmented Planning for Large Language Models via Opponent Exploitation
di: Xu, Shuai, et al.
Pubblicazione: (2025)
di: Xu, Shuai, et al.
Pubblicazione: (2025)
Value Iteration with Guessing for Markov Chains and Markov Decision Processes
di: Chatterjee, Krishnendu, et al.
Pubblicazione: (2025)
di: Chatterjee, Krishnendu, et al.
Pubblicazione: (2025)
Chained Prompting for Better Systematic Review Search Strategies
di: Nasser, Fatima, et al.
Pubblicazione: (2025)
di: Nasser, Fatima, et al.
Pubblicazione: (2025)
UniST-Pred: A Robust Unified Framework for Spatio-Temporal Traffic Forecasting in Transportation Networks Under Disruptions
di: Wang, Yue, et al.
Pubblicazione: (2026)
di: Wang, Yue, et al.
Pubblicazione: (2026)
Query Decomposition for RAG: Balancing Exploration-Exploitation
di: Petcu, Roxana, et al.
Pubblicazione: (2025)
di: Petcu, Roxana, et al.
Pubblicazione: (2025)
AI-Based Demand Forecasting and Load Balancing for Optimising Energy use in Healthcare Systems: A real case study
di: Rahimi, Iman, et al.
Pubblicazione: (2025)
di: Rahimi, Iman, et al.
Pubblicazione: (2025)
LLM-assisted sentiment analysis for integrated computational and qualitative mixed methods education research: A case study of students' written reflection assignments
di: Gonzalez, Xiomara, et al.
Pubblicazione: (2026)
di: Gonzalez, Xiomara, et al.
Pubblicazione: (2026)
Bi-objective Optimization in Role Mining
di: Crampton, Jason, et al.
Pubblicazione: (2024)
di: Crampton, Jason, et al.
Pubblicazione: (2024)
Markov Chain of Thought for Efficient Mathematical Reasoning
di: Yang, Wen, et al.
Pubblicazione: (2024)
di: Yang, Wen, et al.
Pubblicazione: (2024)
Large Language Models as Markov Chains
di: Zekri, Oussama, et al.
Pubblicazione: (2024)
di: Zekri, Oussama, et al.
Pubblicazione: (2024)
From Markov to Laplace: How Mamba In-Context Learns Markov Chains
di: Bondaschi, Marco, et al.
Pubblicazione: (2025)
di: Bondaschi, Marco, et al.
Pubblicazione: (2025)
A Combinatorial Theory of Dropout: Subnetworks, Graph Geometry, and Generalization
di: Dhayalkar, Sahil Rajesh
Pubblicazione: (2025)
di: Dhayalkar, Sahil Rajesh
Pubblicazione: (2025)
Attention as Binding: A Vector-Symbolic Perspective on Transformer Reasoning
di: Dhayalkar, Sahil Rajesh
Pubblicazione: (2025)
di: Dhayalkar, Sahil Rajesh
Pubblicazione: (2025)
Reasoning Stabilization Point: A Training-Time Signal for Stable Evidence and Shortcut Reliance
di: Dhayalkar, Sahil Rajesh
Pubblicazione: (2026)
di: Dhayalkar, Sahil Rajesh
Pubblicazione: (2026)
Analyzing Value Functions of States in Parametric Markov Chains
di: Engelen, Kasper, et al.
Pubblicazione: (2025)
di: Engelen, Kasper, et al.
Pubblicazione: (2025)
Counterfactual Strategies for Markov Decision Processes
di: Kobialka, Paul, et al.
Pubblicazione: (2025)
di: Kobialka, Paul, et al.
Pubblicazione: (2025)
Parameter Expanded Stochastic Gradient Markov Chain Monte Carlo
di: Kim, Hyunsu, et al.
Pubblicazione: (2025)
di: Kim, Hyunsu, et al.
Pubblicazione: (2025)
Learning Hidden Markov Models Using Conditional Samples
di: Kakade, Sham M., et al.
Pubblicazione: (2023)
di: Kakade, Sham M., et al.
Pubblicazione: (2023)
In-context Exploration-Exploitation for Reinforcement Learning
di: Dai, Zhenwen, et al.
Pubblicazione: (2024)
di: Dai, Zhenwen, et al.
Pubblicazione: (2024)
Exploitation Is All You Need... for Exploration
di: Rentschler, Micah, et al.
Pubblicazione: (2025)
di: Rentschler, Micah, et al.
Pubblicazione: (2025)
Scale-Adaptive Balancing of Exploration and Exploitation in Classical Planning
di: Wissow, Stephen, et al.
Pubblicazione: (2023)
di: Wissow, Stephen, et al.
Pubblicazione: (2023)
Exploration and Exploitation Errors Are Measurable for Language Model Agents
di: Park, Jaden, et al.
Pubblicazione: (2026)
di: Park, Jaden, et al.
Pubblicazione: (2026)
Action Conditioned Tactile Prediction: case study on slip prediction
di: Mandil, Willow, et al.
Pubblicazione: (2022)
di: Mandil, Willow, et al.
Pubblicazione: (2022)
The application of GPT-4 in grading design university students' assignment and providing feedback: An exploratory study
di: Huang, Qian, et al.
Pubblicazione: (2024)
di: Huang, Qian, et al.
Pubblicazione: (2024)
Deep Vision-Based Framework for Coastal Flood Prediction Under Climate Change Impacts and Shoreline Adaptations
di: Karapetyan, Areg, et al.
Pubblicazione: (2024)
di: Karapetyan, Areg, et al.
Pubblicazione: (2024)
MC-Search: Evaluating and Enhancing Multimodal Agentic Search with Structured Long Reasoning Chains
di: Ning, Xuying, et al.
Pubblicazione: (2026)
di: Ning, Xuying, et al.
Pubblicazione: (2026)
Building Expressive and Tractable Probabilistic Generative Models: A Review
di: Sidheekh, Sahil, et al.
Pubblicazione: (2024)
di: Sidheekh, Sahil, et al.
Pubblicazione: (2024)
Dopamine-driven synaptic credit assignment in neural networks
di: Nambusubramaniyan, Saranraj, et al.
Pubblicazione: (2025)
di: Nambusubramaniyan, Saranraj, et al.
Pubblicazione: (2025)
Dynamic Context Adaptation and Information Flow Control in Transformers: Introducing the Evaluator Adjuster Unit and Gated Residual Connections
di: Dhayalkar, Sahil Rajesh
Pubblicazione: (2024)
di: Dhayalkar, Sahil Rajesh
Pubblicazione: (2024)
TeXpert: A Multi-Level Benchmark for Evaluating LaTeX Code Generation by LLMs
di: Kale, Sahil, et al.
Pubblicazione: (2025)
di: Kale, Sahil, et al.
Pubblicazione: (2025)
Climate Adaptation-Aware Flood Prediction for Coastal Cities Using Deep Learning
di: Hassan, Bilal, et al.
Pubblicazione: (2025)
di: Hassan, Bilal, et al.
Pubblicazione: (2025)
MEDMKG: Benchmarking Medical Knowledge Exploitation with Multimodal Knowledge Graph
di: Wang, Xiaochen, et al.
Pubblicazione: (2025)
di: Wang, Xiaochen, et al.
Pubblicazione: (2025)
Plan-MCTS: Plan Exploration for Action Exploitation in Web Navigation
di: Zhang, Weiming, et al.
Pubblicazione: (2026)
di: Zhang, Weiming, et al.
Pubblicazione: (2026)
Chain-in-Tree: Back to Sequential Reasoning in LLM Tree Search
di: Li, Xinzhe
Pubblicazione: (2025)
di: Li, Xinzhe
Pubblicazione: (2025)
Adaptive Data Exploitation in Deep Reinforcement Learning
di: Yuan, Mingqi, et al.
Pubblicazione: (2025)
di: Yuan, Mingqi, et al.
Pubblicazione: (2025)
Markov Chain Decoders Overcome the Heavy-Tail Limitations of Lipschitz Generative Models
di: Ziani, Abdelhakim, et al.
Pubblicazione: (2026)
di: Ziani, Abdelhakim, et al.
Pubblicazione: (2026)
Entailment vs. Verification for Partial-assignment Satisfiability and Enumeration
di: Sebastiani, Roberto
Pubblicazione: (2025)
di: Sebastiani, Roberto
Pubblicazione: (2025)
Analysis of approximate linear programming solution to Markov decision problem with log barrier function
di: Lee, Donghwan, et al.
Pubblicazione: (2025)
di: Lee, Donghwan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Controlling Exploration-Exploitation in GFlowNets via Markov Chain Perspectives
di: Chen, Lin, et al.
Pubblicazione: (2026) -
Look It Up: Analysing Internal Web Search Capabilities of Modern LLMs
di: Kale, Sahil
Pubblicazione: (2025) -
Strategy-Augmented Planning for Large Language Models via Opponent Exploitation
di: Xu, Shuai, et al.
Pubblicazione: (2025) -
Value Iteration with Guessing for Markov Chains and Markov Decision Processes
di: Chatterjee, Krishnendu, et al.
Pubblicazione: (2025) -
Chained Prompting for Better Systematic Review Search Strategies
di: Nasser, Fatima, et al.
Pubblicazione: (2025)