Context Attribution with Multi-Armed Bandit Optimization
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Pan, Deng, Murugesan, Keerthiram, Hua, Ting, Moniz, Nuno, Chawla, Nitesh |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Fast Explanations via Policy Gradient-Optimized Explainer
von: Pan, Deng, et al.
Veröffentlicht: (2024)
von: Pan, Deng, et al.
Veröffentlicht: (2024)
Combinatorial Multi-armed Bandits: Arm Selection via Group Testing
von: Mukherjee, Arpan, et al.
Veröffentlicht: (2024)
von: Mukherjee, Arpan, et al.
Veröffentlicht: (2024)
NGQA: A Nutritional Graph Question Answering Benchmark for Personalized Health-aware Nutritional Reasoning
von: Zhang, Zheyuan, et al.
Veröffentlicht: (2024)
von: Zhang, Zheyuan, et al.
Veröffentlicht: (2024)
Multi-Armed Bandits-Based Optimization of Decision Trees
von: Shanto, Hasibul Karim, et al.
Veröffentlicht: (2025)
von: Shanto, Hasibul Karim, et al.
Veröffentlicht: (2025)
Flickering Multi-Armed Bandits
von: Chakraborty, Sourav, et al.
Veröffentlicht: (2026)
von: Chakraborty, Sourav, et al.
Veröffentlicht: (2026)
Chunks as Arms: Multi-Armed Bandit-Guided Sampling for Long-Context LLM Preference Optimization
von: Duan, Shaohua, et al.
Veröffentlicht: (2025)
von: Duan, Shaohua, et al.
Veröffentlicht: (2025)
CrochetBench: Can Vision-Language Models Move from Describing to Doing in Crochet Domain?
von: Li, Peiyu, et al.
Veröffentlicht: (2025)
von: Li, Peiyu, et al.
Veröffentlicht: (2025)
STARLING: Self-supervised Training of Text-based Reinforcement Learning Agent with Large Language Models
von: Basavatia, Shreyas, et al.
Veröffentlicht: (2024)
von: Basavatia, Shreyas, et al.
Veröffentlicht: (2024)
AgentDrug: Utilizing Large Language Models in An Agentic Workflow for Zero-Shot Molecular Editing
von: Le, Khiem, et al.
Veröffentlicht: (2024)
von: Le, Khiem, et al.
Veröffentlicht: (2024)
Introduction to Multi-Armed Bandits
von: Slivkins, Aleksandrs
Veröffentlicht: (2019)
von: Slivkins, Aleksandrs
Veröffentlicht: (2019)
FLAME: Towards Federated Fine-Tuning Large Language Models Through Adaptive SMoE
von: Le, Khiem, et al.
Veröffentlicht: (2025)
von: Le, Khiem, et al.
Veröffentlicht: (2025)
Multi-Armed Bandits With Best-Action Queries
von: Bacchiocchi, Francesco, et al.
Veröffentlicht: (2026)
von: Bacchiocchi, Francesco, et al.
Veröffentlicht: (2026)
From Verification Burden to Trusted Collaboration: Design Goals for LLM-Assisted Literature Reviews
von: Nogueira, Brenda, et al.
Veröffentlicht: (2025)
von: Nogueira, Brenda, et al.
Veröffentlicht: (2025)
Survey: Multi-Armed Bandits Meet Large Language Models
von: Bouneffouf, Djallel, et al.
Veröffentlicht: (2025)
von: Bouneffouf, Djallel, et al.
Veröffentlicht: (2025)
Fair Algorithms with Probing for Multi-Agent Multi-Armed Bandits
von: Xu, Tianyi, et al.
Veröffentlicht: (2025)
von: Xu, Tianyi, et al.
Veröffentlicht: (2025)
Large Language Model-Enhanced Multi-Armed Bandits
von: Sun, Jiahang, et al.
Veröffentlicht: (2025)
von: Sun, Jiahang, et al.
Veröffentlicht: (2025)
Global Rewards in Restless Multi-Armed Bandits
von: Raman, Naveen, et al.
Veröffentlicht: (2024)
von: Raman, Naveen, et al.
Veröffentlicht: (2024)
Conformalized Selective Regression
von: Sokol, Anna, et al.
Veröffentlicht: (2024)
von: Sokol, Anna, et al.
Veröffentlicht: (2024)
TeachingCoach: A Fine-Tuned Scaffolding Chatbot for Instructional Guidance to Instructors
von: Molnar, Isabel, et al.
Veröffentlicht: (2026)
von: Molnar, Isabel, et al.
Veröffentlicht: (2026)
CAREForMe: Contextual Multi-Armed Bandit Recommendation Framework for Mental Health
von: Yu, Sheng, et al.
Veröffentlicht: (2024)
von: Yu, Sheng, et al.
Veröffentlicht: (2024)
Contextual Restless Multi-Armed Bandits with Application to Demand Response Decision-Making
von: Chen, Xin, et al.
Veröffentlicht: (2024)
von: Chen, Xin, et al.
Veröffentlicht: (2024)
Federated Combinatorial Multi-Agent Multi-Armed Bandits
von: Fourati, Fares, et al.
Veröffentlicht: (2024)
von: Fourati, Fares, et al.
Veröffentlicht: (2024)
The Unlearning Mirage: A Dynamic Framework for Evaluating LLM Unlearning
von: Shah, Raj Sanjay, et al.
Veröffentlicht: (2026)
von: Shah, Raj Sanjay, et al.
Veröffentlicht: (2026)
Facilitating Human-LLM Collaboration through Factuality Scores and Source Attributions
von: Do, Hyo Jin, et al.
Veröffentlicht: (2024)
von: Do, Hyo Jin, et al.
Veröffentlicht: (2024)
Towards Aligning Language Models with Textual Feedback
von: Lloret, Saüc Abadal, et al.
Veröffentlicht: (2024)
von: Lloret, Saüc Abadal, et al.
Veröffentlicht: (2024)
KernelBand: Steering LLM-based Kernel Optimization via Hardware-Aware Multi-Armed Bandits
von: Ran, Dezhi, et al.
Veröffentlicht: (2025)
von: Ran, Dezhi, et al.
Veröffentlicht: (2025)
IRL for Restless Multi-Armed Bandits with Applications in Maternal and Child Health
von: Jain, Gauri, et al.
Veröffentlicht: (2024)
von: Jain, Gauri, et al.
Veröffentlicht: (2024)
Thresholding Data Shapley for Data Cleansing Using Multi-Armed Bandits
von: Namba, Hiroyuki, et al.
Veröffentlicht: (2024)
von: Namba, Hiroyuki, et al.
Veröffentlicht: (2024)
Provably Efficient Reinforcement Learning for Adversarial Restless Multi-Armed Bandits with Unknown Transitions and Bandit Feedback
von: Xiong, Guojun, et al.
Veröffentlicht: (2024)
von: Xiong, Guojun, et al.
Veröffentlicht: (2024)
Near-Optimal Regret for KL-Regularized Multi-Armed Bandits
von: Ji, Kaixuan, et al.
Veröffentlicht: (2026)
von: Ji, Kaixuan, et al.
Veröffentlicht: (2026)
On the Benefits of Free Exploration for Regret Minimization in Multi-Armed Bandits
von: Hou, Yunlong, et al.
Veröffentlicht: (2026)
von: Hou, Yunlong, et al.
Veröffentlicht: (2026)
Restless Multi-Process Multi-Armed Bandits with Applications to Self-Driving Microscopies
von: Peris, Jaume Anguera, et al.
Veröffentlicht: (2025)
von: Peris, Jaume Anguera, et al.
Veröffentlicht: (2025)
Coordinated Multi-Armed Bandits for Improved Spatial Reuse in Wi-Fi
von: Wilhelmi, Francesc, et al.
Veröffentlicht: (2024)
von: Wilhelmi, Francesc, et al.
Veröffentlicht: (2024)
OjaKV: Context-Aware Online Low-Rank KV Cache Compression
von: Zhu, Yuxuan, et al.
Veröffentlicht: (2025)
von: Zhu, Yuxuan, et al.
Veröffentlicht: (2025)
Intersectional Divergence: Measuring Fairness in Regression
von: Germino, Joe, et al.
Veröffentlicht: (2025)
von: Germino, Joe, et al.
Veröffentlicht: (2025)
AnyLoss: Transforming Classification Metrics into Loss Functions
von: Han, Doheon, et al.
Veröffentlicht: (2024)
von: Han, Doheon, et al.
Veröffentlicht: (2024)
Class-Aware Contrastive Optimization for Imbalanced Text Classification
von: Khvatskii, Grigorii, et al.
Veröffentlicht: (2024)
von: Khvatskii, Grigorii, et al.
Veröffentlicht: (2024)
On the Optimal Sample Complexity of Offline Multi-Armed Bandits with KL Regularization
von: Ji, Kaixuan, et al.
Veröffentlicht: (2026)
von: Ji, Kaixuan, et al.
Veröffentlicht: (2026)
Annealed Softmax Greedy in Many-Armed Bayesian Bandits
von: Overman, William, et al.
Veröffentlicht: (2026)
von: Overman, William, et al.
Veröffentlicht: (2026)
ParBalans: Parallel Multi-Armed Bandits-based Adaptive Large Neighborhood Search
von: Yilmaz, Alican, et al.
Veröffentlicht: (2025)
von: Yilmaz, Alican, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Fast Explanations via Policy Gradient-Optimized Explainer
von: Pan, Deng, et al.
Veröffentlicht: (2024) -
Combinatorial Multi-armed Bandits: Arm Selection via Group Testing
von: Mukherjee, Arpan, et al.
Veröffentlicht: (2024) -
NGQA: A Nutritional Graph Question Answering Benchmark for Personalized Health-aware Nutritional Reasoning
von: Zhang, Zheyuan, et al.
Veröffentlicht: (2024) -
Multi-Armed Bandits-Based Optimization of Decision Trees
von: Shanto, Hasibul Karim, et al.
Veröffentlicht: (2025) -
Flickering Multi-Armed Bandits
von: Chakraborty, Sourav, et al.
Veröffentlicht: (2026)