Contextual Causal Bayesian Optimisation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Arsenyan, Vahan, Grosnit, Antoine, Bou-Ammar, Haitham, Dalalyan, Arnak |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Assessing the Quality of Denoising Diffusion Models in Wasserstein Distance: Noisy Score and Optimal Bounds
par: Arsenyan, Vahan, et autres
Publié: (2025)
par: Arsenyan, Vahan, et autres
Publié: (2025)
Many of Your DPOs are Secretly One: Attempting Unification Through Mutual Information
par: Tutnov, Rasul, et autres
Publié: (2025)
par: Tutnov, Rasul, et autres
Publié: (2025)
Improved Guarantees for Langevin Monte Carlo with Average Smoothness
par: Dalalyan, Arnak S., et autres
Publié: (2026)
par: Dalalyan, Arnak S., et autres
Publié: (2026)
Parallelized Midpoint Randomization for Langevin Monte Carlo
par: Yu, Lu, et autres
Publié: (2024)
par: Yu, Lu, et autres
Publié: (2024)
User-friendly guarantees for the Langevin Monte Carlo with inaccurate gradient
par: Dalalyan, Arnak S., et autres
Publié: (2017)
par: Dalalyan, Arnak S., et autres
Publié: (2017)
ShortCircuit: AlphaZero-Driven Circuit Design
par: Tsaras, Dimitrios, et autres
Publié: (2024)
par: Tsaras, Dimitrios, et autres
Publié: (2024)
Decoding as Optimisation on the Probability Simplex: From Top-K to Top-P (Nucleus) to Best-of-K Samplers
par: Ji, Xiaotong, et autres
Publié: (2026)
par: Ji, Xiaotong, et autres
Publié: (2026)
Statistically Optimal Generative Modeling with Maximum Deviation from the Empirical Distribution
par: Vardanyan, Elen, et autres
Publié: (2023)
par: Vardanyan, Elen, et autres
Publié: (2023)
Al-Khwarizmi: Discovering Physical Laws with Foundation Models
par: Mower, Christopher E., et autres
Publié: (2025)
par: Mower, Christopher E., et autres
Publié: (2025)
Large Language Models for Biomedical Knowledge Graph Construction: Information extraction from EMR notes
par: Arsenyan, Vahan, et autres
Publié: (2023)
par: Arsenyan, Vahan, et autres
Publié: (2023)
Why Can Large Language Models Generate Correct Chain-of-Thoughts?
par: Tutunov, Rasul, et autres
Publié: (2023)
par: Tutunov, Rasul, et autres
Publié: (2023)
Safe Reinforcement Learning on the Constraint Manifold: Theory and Applications
par: Liu, Puze, et autres
Publié: (2024)
par: Liu, Puze, et autres
Publié: (2024)
Bayesian Reward Models for LLM Alignment
par: Yang, Adam X., et autres
Publié: (2024)
par: Yang, Adam X., et autres
Publié: (2024)
Scalable Power Sampling: Unlocking Efficient, Training-Free Reasoning for LLMs via Distribution Sharpening
par: Ji, Xiaotong, et autres
Publié: (2026)
par: Ji, Xiaotong, et autres
Publié: (2026)
Rethinking Large Language Model Distillation: A Constrained Markov Decision Process Perspective
par: Zimmer, Matthieu, et autres
Publié: (2025)
par: Zimmer, Matthieu, et autres
Publié: (2025)
Bottlenecked Transformers: Periodic KV Cache Consolidation for Generalised Reasoning
par: Oomerjee, Adnan, et autres
Publié: (2025)
par: Oomerjee, Adnan, et autres
Publié: (2025)
Graph Agnostic Causal Bayesian Optimisation
par: Mukherjee, Sumantrak, et autres
Publié: (2024)
par: Mukherjee, Sumantrak, et autres
Publié: (2024)
The Model Knows, the Decoder Finds: Future Value Guided Particle Power Sampling
par: Nguyen, Tu, et autres
Publié: (2026)
par: Nguyen, Tu, et autres
Publié: (2026)
The $\mathbf{Y}$-Combinator for LLMs: Solving Long-Context Rot with $λ$-Calculus
par: Roy, Amartya, et autres
Publié: (2026)
par: Roy, Amartya, et autres
Publié: (2026)
Model-Based and Sample-Efficient AI-Assisted Math Discovery in Sphere Packing
par: Tutunov, Rasul, et autres
Publié: (2025)
par: Tutunov, Rasul, et autres
Publié: (2025)
SparsePO: Controlling Preference Alignment of LLMs via Sparse Token Masks
par: Christopoulou, Fenia, et autres
Publié: (2024)
par: Christopoulou, Fenia, et autres
Publié: (2024)
Why the Brain Consolidates: Predictive Forgetting for Optimal Generalisation
par: Fountas, Zafeirios, et autres
Publié: (2026)
par: Fountas, Zafeirios, et autres
Publié: (2026)
Mixture of Attentions For Speculative Decoding
par: Zimmer, Matthieu, et autres
Publié: (2024)
par: Zimmer, Matthieu, et autres
Publié: (2024)
Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving
par: Zimmer, Matthieu, et autres
Publié: (2025)
par: Zimmer, Matthieu, et autres
Publié: (2025)
Subjective Depth and Timescale Transformers: Learning Where and When to Compute
par: Wieser, Frederico, et autres
Publié: (2025)
par: Wieser, Frederico, et autres
Publié: (2025)
Efficient Reinforcement Learning with Large Language Model Priors
par: Yan, Xue, et autres
Publié: (2024)
par: Yan, Xue, et autres
Publié: (2024)
On Almost Surely Safe Alignment of Large Language Models at Inference-Time
par: Ji, Xiaotong, et autres
Publié: (2025)
par: Ji, Xiaotong, et autres
Publié: (2025)
Untangling Component Imbalance in Hybrid Linear Attention Conversion Methods
par: Benfeghoul, Martin, et autres
Publié: (2025)
par: Benfeghoul, Martin, et autres
Publié: (2025)
Trust Region Inverse Reinforcement Learning: Explicit Dual Ascent using Local Policy Updates
par: Diwan, Anish, et autres
Publié: (2026)
par: Diwan, Anish, et autres
Publié: (2026)
SuRe: Surprise-Driven Prioritised Replay for Continual LLM Learning
par: Hazard, Hugo, et autres
Publié: (2025)
par: Hazard, Hugo, et autres
Publié: (2025)
Kolb-Based Experiential Learning for Generalist Agents with Human-Level Kaggle Data Science Performance
par: Grosnit, Antoine, et autres
Publié: (2024)
par: Grosnit, Antoine, et autres
Publié: (2024)
Group Robust Preference Optimization in Reward-free RLHF
par: Ramesh, Shyam Sundhar, et autres
Publié: (2024)
par: Ramesh, Shyam Sundhar, et autres
Publié: (2024)
Efficient and Principled Scientific Discovery through Bayesian Optimization: A Tutorial
par: Yu, Zhongwei, et autres
Publié: (2026)
par: Yu, Zhongwei, et autres
Publié: (2026)
Robust Bayesian Optimisation with Unbounded Corruptions
par: Ezzerg, Abdelhamid, et autres
Publié: (2025)
par: Ezzerg, Abdelhamid, et autres
Publié: (2025)
Human-inspired Episodic Memory for Infinite Context LLMs
par: Fountas, Zafeirios, et autres
Publié: (2024)
par: Fountas, Zafeirios, et autres
Publié: (2024)
Mean-Field Bayesian Optimisation
par: Steinberg, Petar, et autres
Publié: (2025)
par: Steinberg, Petar, et autres
Publié: (2025)
Multi-Task GRPO: Reliable LLM Reasoning Across Tasks
par: Ramesh, Shyam Sundhar, et autres
Publié: (2026)
par: Ramesh, Shyam Sundhar, et autres
Publié: (2026)
Data-driven Prior Learning for Bayesian Optimisation
par: Hellan, Sigrid Passano, et autres
Publié: (2023)
par: Hellan, Sigrid Passano, et autres
Publié: (2023)
Distributionally Robust Optimisation with Bayesian Ambiguity Sets
par: Dellaporta, Charita, et autres
Publié: (2024)
par: Dellaporta, Charita, et autres
Publié: (2024)
Bayesian Optimistic Optimisation with Exponentially Decaying Regret
par: Tran-The, Hung, et autres
Publié: (2021)
par: Tran-The, Hung, et autres
Publié: (2021)
Documents similaires
-
Assessing the Quality of Denoising Diffusion Models in Wasserstein Distance: Noisy Score and Optimal Bounds
par: Arsenyan, Vahan, et autres
Publié: (2025) -
Many of Your DPOs are Secretly One: Attempting Unification Through Mutual Information
par: Tutnov, Rasul, et autres
Publié: (2025) -
Improved Guarantees for Langevin Monte Carlo with Average Smoothness
par: Dalalyan, Arnak S., et autres
Publié: (2026) -
Parallelized Midpoint Randomization for Langevin Monte Carlo
par: Yu, Lu, et autres
Publié: (2024) -
User-friendly guarantees for the Langevin Monte Carlo with inaccurate gradient
par: Dalalyan, Arnak S., et autres
Publié: (2017)