Entropy-MCMC: Sampling from Flat Basins with Ease
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Bolian, Zhang, Ruqi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Making Reliable and Flexible Decisions in Long-tailed Classification
di: Li, Bolian, et al.
Pubblicazione: (2025)
di: Li, Bolian, et al.
Pubblicazione: (2025)
Entropy-Guided Sampling of Flat Modes in Discrete Spaces
di: Mohanty, Pinaki, et al.
Pubblicazione: (2025)
di: Mohanty, Pinaki, et al.
Pubblicazione: (2025)
Uniform-Correct Policy Optimization: Breaking RLVR's Indifference to Diversity
di: Lochab, Anamika, et al.
Pubblicazione: (2026)
di: Lochab, Anamika, et al.
Pubblicazione: (2026)
Cascade Reward Sampling for Efficient Decoding-Time Alignment
di: Li, Bolian, et al.
Pubblicazione: (2024)
di: Li, Bolian, et al.
Pubblicazione: (2024)
Bayesian Computation in Deep Learning
di: Chen, Wenlong, et al.
Pubblicazione: (2025)
di: Chen, Wenlong, et al.
Pubblicazione: (2025)
ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time
di: Ding, Yi, et al.
Pubblicazione: (2024)
di: Ding, Yi, et al.
Pubblicazione: (2024)
Addressing Performance Saturation for LLM RL via Precise Entropy Curve Control
di: Li, Bolian, et al.
Pubblicazione: (2026)
di: Li, Bolian, et al.
Pubblicazione: (2026)
Learning Self-Correction in Vision-Language Models via Rollout Augmentation
di: Ding, Yi, et al.
Pubblicazione: (2026)
di: Ding, Yi, et al.
Pubblicazione: (2026)
Stacey: Promoting Stochastic Steepest Descent via Accelerated $\ell_p$-Smooth Nonconvex Optimization
di: Luo, Xinyu, et al.
Pubblicazione: (2025)
di: Luo, Xinyu, et al.
Pubblicazione: (2025)
Reheated Gradient-based Discrete Sampling for Combinatorial Optimization
di: Li, Muheng, et al.
Pubblicazione: (2025)
di: Li, Muheng, et al.
Pubblicazione: (2025)
On Cyclical MCMC Sampling
di: Wang, Liwei, et al.
Pubblicazione: (2024)
di: Wang, Liwei, et al.
Pubblicazione: (2024)
Gradient-based Discrete Sampling with Automatic Cyclical Scheduling
di: Pynadath, Patrick, et al.
Pubblicazione: (2024)
di: Pynadath, Patrick, et al.
Pubblicazione: (2024)
Efficient MCMC Sampling with Expensive-to-Compute and Irregular Likelihoods
di: Rosato, Conor, et al.
Pubblicazione: (2025)
di: Rosato, Conor, et al.
Pubblicazione: (2025)
Enhancing Low-Precision Sampling via Stochastic Gradient Hamiltonian Monte Carlo
di: Wang, Ziyi, et al.
Pubblicazione: (2023)
di: Wang, Ziyi, et al.
Pubblicazione: (2023)
PolytopeWalk: Sparse MCMC Sampling over Polytopes
di: Sun, Benny, et al.
Pubblicazione: (2024)
di: Sun, Benny, et al.
Pubblicazione: (2024)
Efficient Sampling on Riemannian Manifolds via Langevin MCMC
di: Cheng, Xiang, et al.
Pubblicazione: (2024)
di: Cheng, Xiang, et al.
Pubblicazione: (2024)
Reward-Shifted Speculative Sampling Is An Efficient Test-Time Weak-to-Strong Aligner
di: Li, Bolian, et al.
Pubblicazione: (2025)
di: Li, Bolian, et al.
Pubblicazione: (2025)
Slithering Through Gaps: Capturing Discrete Isolated Modes via Logistic Bridging
di: Mohanty, Pinaki, et al.
Pubblicazione: (2026)
di: Mohanty, Pinaki, et al.
Pubblicazione: (2026)
NLP Sampling: Combining MCMC and NLP Methods for Diverse Constrained Sampling
di: Toussaint, Marc, et al.
Pubblicazione: (2024)
di: Toussaint, Marc, et al.
Pubblicazione: (2024)
CoT-UQ: Improving Response-wise Uncertainty Quantification in LLMs with Chain-of-Thought
di: Zhang, Boxuan, et al.
Pubblicazione: (2025)
di: Zhang, Boxuan, et al.
Pubblicazione: (2025)
Transition Path Sampling with Boltzmann Generator-based MCMC Moves
di: Plainer, Michael, et al.
Pubblicazione: (2023)
di: Plainer, Michael, et al.
Pubblicazione: (2023)
DRiffusion: Draft-and-Refine Process Parallelizes Diffusion Models with Ease
di: Bai, Runsheng, et al.
Pubblicazione: (2026)
di: Bai, Runsheng, et al.
Pubblicazione: (2026)
Why Any-Order Autoregressive Models Need Two-Stream Attention: A Structural-Semantic Tradeoff
di: Pynadath, Patrick, et al.
Pubblicazione: (2026)
di: Pynadath, Patrick, et al.
Pubblicazione: (2026)
Controlled LLM Decoding via Discrete Auto-regressive Biasing
di: Pynadath, Patrick, et al.
Pubblicazione: (2025)
di: Pynadath, Patrick, et al.
Pubblicazione: (2025)
Energy-Based Reward Models for Robust Language Model Alignment
di: Lochab, Anamika, et al.
Pubblicazione: (2025)
di: Lochab, Anamika, et al.
Pubblicazione: (2025)
Refining Adaptive Zeroth-Order Optimization at Ease
di: Shu, Yao, et al.
Pubblicazione: (2025)
di: Shu, Yao, et al.
Pubblicazione: (2025)
CANDI: Hybrid Discrete-Continuous Diffusion Models
di: Pynadath, Patrick, et al.
Pubblicazione: (2025)
di: Pynadath, Patrick, et al.
Pubblicazione: (2025)
Constrained Sampling for Language Models Should Be Easy: An MCMC Perspective
di: Gonzalez, Emmanuel Anaya, et al.
Pubblicazione: (2025)
di: Gonzalez, Emmanuel Anaya, et al.
Pubblicazione: (2025)
Training Bayesian Neural Networks with Sparse Subspace Variational Inference
di: Li, Junbo, et al.
Pubblicazione: (2024)
di: Li, Junbo, et al.
Pubblicazione: (2024)
Easing Optimization Paths: a Circuit Perspective
di: Odonnat, Ambroise, et al.
Pubblicazione: (2025)
di: Odonnat, Ambroise, et al.
Pubblicazione: (2025)
Reinforcement Learning for Adaptive MCMC
di: Wang, Congye, et al.
Pubblicazione: (2024)
di: Wang, Congye, et al.
Pubblicazione: (2024)
Learning with Local Search MCMC Layers
di: Vivier-Ardisson, Germain, et al.
Pubblicazione: (2025)
di: Vivier-Ardisson, Germain, et al.
Pubblicazione: (2025)
Single-Step Consistent Diffusion Samplers
di: Jutras-Dubé, Pascal, et al.
Pubblicazione: (2025)
di: Jutras-Dubé, Pascal, et al.
Pubblicazione: (2025)
MCMC-driven learning
di: Bouchard-Côté, Alexandre, et al.
Pubblicazione: (2024)
di: Bouchard-Côté, Alexandre, et al.
Pubblicazione: (2024)
Generative Frontiers: Why Evaluation Matters for Diffusion Language Models
di: Pynadath, Patrick, et al.
Pubblicazione: (2026)
di: Pynadath, Patrick, et al.
Pubblicazione: (2026)
Sherlock: Self-Correcting Reasoning in Vision-Language Models
di: Ding, Yi, et al.
Pubblicazione: (2025)
di: Ding, Yi, et al.
Pubblicazione: (2025)
Adaptive Independent Sticky MCMC algorithms
di: Martino, L., et al.
Pubblicazione: (2013)
di: Martino, L., et al.
Pubblicazione: (2013)
Adaptive Planning with Generative Models under Uncertainty
di: Jutras-Dubé, Pascal, et al.
Pubblicazione: (2024)
di: Jutras-Dubé, Pascal, et al.
Pubblicazione: (2024)
Optimal Stochastic Trace Estimation in Generative Modeling
di: Liu, Xinyang, et al.
Pubblicazione: (2025)
di: Liu, Xinyang, et al.
Pubblicazione: (2025)
Exploring Non-Convex Discrete Energy Landscapes: An Efficient Langevin-Like Sampler with Replica Exchange
di: Zheng, Haoyang, et al.
Pubblicazione: (2025)
di: Zheng, Haoyang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Making Reliable and Flexible Decisions in Long-tailed Classification
di: Li, Bolian, et al.
Pubblicazione: (2025) -
Entropy-Guided Sampling of Flat Modes in Discrete Spaces
di: Mohanty, Pinaki, et al.
Pubblicazione: (2025) -
Uniform-Correct Policy Optimization: Breaking RLVR's Indifference to Diversity
di: Lochab, Anamika, et al.
Pubblicazione: (2026) -
Cascade Reward Sampling for Efficient Decoding-Time Alignment
di: Li, Bolian, et al.
Pubblicazione: (2024) -
Bayesian Computation in Deep Learning
di: Chen, Wenlong, et al.
Pubblicazione: (2025)