Constrained Exploration via Reflected Replica Exchange Stochastic Gradient Langevin Dynamics
Fuente:
arXiv
Salvato in:
| Autori principali: | Zheng, Haoyang, Du, Hengrong, Feng, Qi, Deng, Wei, Lin, Guang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Exploring Non-Convex Discrete Energy Landscapes: An Efficient Langevin-Like Sampler with Replica Exchange
di: Zheng, Haoyang, et al.
Pubblicazione: (2025)
di: Zheng, Haoyang, et al.
Pubblicazione: (2025)
Rethinking Langevin Thompson Sampling from A Stochastic Approximation Perspective
di: Wang, Weixin, et al.
Pubblicazione: (2025)
di: Wang, Weixin, et al.
Pubblicazione: (2025)
Accelerating Approximate Thompson Sampling with Underdamped Langevin Monte Carlo
di: Zheng, Haoyang, et al.
Pubblicazione: (2024)
di: Zheng, Haoyang, et al.
Pubblicazione: (2024)
BLADE: Bayesian Langevin Active Discovery with Replica Exchange for Identification of Complex Systems
di: Kong, Cindy Xiangrui, et al.
Pubblicazione: (2025)
di: Kong, Cindy Xiangrui, et al.
Pubblicazione: (2025)
Non-Reversible Langevin Algorithms for Constrained Sampling
di: Du, Hengrong, et al.
Pubblicazione: (2025)
di: Du, Hengrong, et al.
Pubblicazione: (2025)
Reflected Schrödinger Bridge for Constrained Generative Modeling
di: Deng, Wei, et al.
Pubblicazione: (2024)
di: Deng, Wei, et al.
Pubblicazione: (2024)
Direct Soft-Policy Sampling via Langevin Dynamics
di: Ki, Donghyeon, et al.
Pubblicazione: (2026)
di: Ki, Donghyeon, et al.
Pubblicazione: (2026)
Ultra-Fast Language Generation via Discrete Diffusion Divergence Instruct
di: Zheng, Haoyang, et al.
Pubblicazione: (2025)
di: Zheng, Haoyang, et al.
Pubblicazione: (2025)
Cascaded two-stage feature clustering and selection via separability and consistency in fuzzy decision systems
di: Chen, Yuepeng, et al.
Pubblicazione: (2024)
di: Chen, Yuepeng, et al.
Pubblicazione: (2024)
Stochastic Collapse: How Gradient Noise Attracts SGD Dynamics Towards Simpler Subnetworks
di: Chen, Feng, et al.
Pubblicazione: (2023)
di: Chen, Feng, et al.
Pubblicazione: (2023)
Margin-aware Fuzzy Rough Feature Selection: Bridging Uncertainty Characterization and Pattern Classification
di: Xu, Suping, et al.
Pubblicazione: (2025)
di: Xu, Suping, et al.
Pubblicazione: (2025)
Optimal Stochastic Trace Estimation in Generative Modeling
di: Liu, Xinyang, et al.
Pubblicazione: (2025)
di: Liu, Xinyang, et al.
Pubblicazione: (2025)
Emergence of Exploration in Policy Gradient Reinforcement Learning via Retrying
di: Nishimori, Soichiro, et al.
Pubblicazione: (2026)
di: Nishimori, Soichiro, et al.
Pubblicazione: (2026)
HomPINNs: homotopy physics-informed neural networks for solving the inverse problems of nonlinear differential equations with multiple solutions
di: Zheng, Haoyang, et al.
Pubblicazione: (2023)
di: Zheng, Haoyang, et al.
Pubblicazione: (2023)
Ensuring Safety in an Uncertain Environment: Constrained MDPs via Stochastic Thresholds
di: Zuo, Qian, et al.
Pubblicazione: (2025)
di: Zuo, Qian, et al.
Pubblicazione: (2025)
Stochastic Re-weighted Gradient Descent via Distributionally Robust Optimization
di: Kumar, Ramnath, et al.
Pubblicazione: (2023)
di: Kumar, Ramnath, et al.
Pubblicazione: (2023)
Incentivized Exploration of Non-Stationary Stochastic Bandits
di: Chakraborty, Sourav, et al.
Pubblicazione: (2024)
di: Chakraborty, Sourav, et al.
Pubblicazione: (2024)
Almost Bayesian: The Fractal Dynamics of Stochastic Gradient Descent
di: Hennick, Max, et al.
Pubblicazione: (2025)
di: Hennick, Max, et al.
Pubblicazione: (2025)
Provably Efficient Exploration in Inverse Constrained Reinforcement Learning
di: Yue, Bo, et al.
Pubblicazione: (2024)
di: Yue, Bo, et al.
Pubblicazione: (2024)
Optimistic Exploration for Risk-Averse Constrained Reinforcement Learning
di: McCarthy, James, et al.
Pubblicazione: (2025)
di: McCarthy, James, et al.
Pubblicazione: (2025)
Fast Explanations via Policy Gradient-Optimized Explainer
di: Pan, Deng, et al.
Pubblicazione: (2024)
di: Pan, Deng, et al.
Pubblicazione: (2024)
Scaling up Dynamic Edge Partition Models via Stochastic Gradient MCMC
di: Yang, Sikun, et al.
Pubblicazione: (2024)
di: Yang, Sikun, et al.
Pubblicazione: (2024)
Unlocking Reasoning Capabilities in LLMs via Reinforcement Learning Exploration
di: Deng, Wenhao, et al.
Pubblicazione: (2025)
di: Deng, Wenhao, et al.
Pubblicazione: (2025)
Variational Learning of Gaussian Process Latent Variable Models through Stochastic Gradient Annealed Importance Sampling
di: Xu, Jian, et al.
Pubblicazione: (2024)
di: Xu, Jian, et al.
Pubblicazione: (2024)
Adaptive Heavy-Tailed Stochastic Gradient Descent
di: Gong, Bodu, et al.
Pubblicazione: (2025)
di: Gong, Bodu, et al.
Pubblicazione: (2025)
Stochastic Gradient Descent with Momentum is Algorithmically Stable
di: Lei, Yunwen, et al.
Pubblicazione: (2026)
di: Lei, Yunwen, et al.
Pubblicazione: (2026)
Stochastic Penalty-Barrier Methods for Constrained Machine Learning
di: Bosák, Adam, et al.
Pubblicazione: (2026)
di: Bosák, Adam, et al.
Pubblicazione: (2026)
Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL
di: Wu, Junyi, et al.
Pubblicazione: (2026)
di: Wu, Junyi, et al.
Pubblicazione: (2026)
ASTRO: Adaptive Stitching via Dynamics-Guided Trajectory Rollouts
di: Yu, Hang, et al.
Pubblicazione: (2025)
di: Yu, Hang, et al.
Pubblicazione: (2025)
QF: Quick Feedforward AI Model Training without Gradient Back Propagation
di: Qi, Feng
Pubblicazione: (2025)
di: Qi, Feng
Pubblicazione: (2025)
An Effective Dynamic Gradient Calibration Method for Continual Learning
di: Lin, Weichen, et al.
Pubblicazione: (2024)
di: Lin, Weichen, et al.
Pubblicazione: (2024)
Sequential Controlled Langevin Diffusions
di: Chen, Junhua, et al.
Pubblicazione: (2024)
di: Chen, Junhua, et al.
Pubblicazione: (2024)
Tilted Quantile Gradient Updates for Quantile-Constrained Reinforcement Learning
di: Li, Chenglin, et al.
Pubblicazione: (2024)
di: Li, Chenglin, et al.
Pubblicazione: (2024)
Can LLMs predict the convergence of Stochastic Gradient Descent?
di: Zekri, Oussama, et al.
Pubblicazione: (2024)
di: Zekri, Oussama, et al.
Pubblicazione: (2024)
Noise Balance and Stationary Distribution of Stochastic Gradient Descent
di: Ziyin, Liu, et al.
Pubblicazione: (2023)
di: Ziyin, Liu, et al.
Pubblicazione: (2023)
Beyond Markovian: Reflective Exploration via Bayes-Adaptive RL for LLM Reasoning
di: Zhang, Shenao, et al.
Pubblicazione: (2025)
di: Zhang, Shenao, et al.
Pubblicazione: (2025)
Enhancing Stochastic Gradient Descent: A Unified Framework and Novel Acceleration Methods for Faster Convergence
di: Deng, Yichuan, et al.
Pubblicazione: (2024)
di: Deng, Yichuan, et al.
Pubblicazione: (2024)
Gradient Flow Drifting: Generative Modeling via Wasserstein Gradient Flows of KDE-Approximated Divergences
di: Cao, Jiarui, et al.
Pubblicazione: (2026)
di: Cao, Jiarui, et al.
Pubblicazione: (2026)
Geometric Neural Operators via Lie Group-Constrained Latent Dynamics
di: Zhang, Jiaquan, et al.
Pubblicazione: (2026)
di: Zhang, Jiaquan, et al.
Pubblicazione: (2026)
Generalized Discrete Diffusion with Self-Correction
di: Wang, Linxuan, et al.
Pubblicazione: (2026)
di: Wang, Linxuan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Exploring Non-Convex Discrete Energy Landscapes: An Efficient Langevin-Like Sampler with Replica Exchange
di: Zheng, Haoyang, et al.
Pubblicazione: (2025) -
Rethinking Langevin Thompson Sampling from A Stochastic Approximation Perspective
di: Wang, Weixin, et al.
Pubblicazione: (2025) -
Accelerating Approximate Thompson Sampling with Underdamped Langevin Monte Carlo
di: Zheng, Haoyang, et al.
Pubblicazione: (2024) -
BLADE: Bayesian Langevin Active Discovery with Replica Exchange for Identification of Complex Systems
di: Kong, Cindy Xiangrui, et al.
Pubblicazione: (2025) -
Non-Reversible Langevin Algorithms for Constrained Sampling
di: Du, Hengrong, et al.
Pubblicazione: (2025)