Beyond the Proxy: Trajectory-Distilled Guidance for Offline GFlowNet Training
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Ruishuo, Wang, Xun, Hu, Rui, Li, Zhuoran, Huang, Longbo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GFlowNet Foundations
par: Bengio, Yoshua, et autres
Publié: (2021)
par: Bengio, Yoshua, et autres
Publié: (2021)
Rooted Absorbed Prefix Trajectory Balance with Submodular Replay for GFlowNet Training
par: Wang, Xi, et autres
Publié: (2026)
par: Wang, Xi, et autres
Publié: (2026)
Order-Preserving GFlowNets
par: Chen, Yihang, et autres
Publié: (2023)
par: Chen, Yihang, et autres
Publié: (2023)
PowerFlow: Unlocking the Dual Nature of LLMs via Principled Distribution Matching
par: Chen, Ruishuo, et autres
Publié: (2026)
par: Chen, Ruishuo, et autres
Publié: (2026)
Beyond Shallow Behavior: Task-Efficient Value-Based Multi-Task Offline MARL via Skill Discovery
par: Wang, Xun, et autres
Publié: (2025)
par: Wang, Xun, et autres
Publié: (2025)
Beyond Squared Error: Exploring Loss Design for Enhanced Training of Generative Flow Networks
par: Hu, Rui, et autres
Publié: (2024)
par: Hu, Rui, et autres
Publié: (2024)
Distributional GFlowNets with Quantile Flows
par: Zhang, Dinghuai, et autres
Publié: (2023)
par: Zhang, Dinghuai, et autres
Publié: (2023)
GFlowNet Pretraining with Inexpensive Rewards
par: Pandey, Mohit, et autres
Publié: (2024)
par: Pandey, Mohit, et autres
Publié: (2024)
Global-Order GFlowNets
par: Pastor-Pérez, Lluís, et autres
Publié: (2025)
par: Pastor-Pérez, Lluís, et autres
Publié: (2025)
Offline Critic-Guided Diffusion Policy for Multi-User Delay-Constrained Scheduling
par: Li, Zhuoran, et autres
Publié: (2025)
par: Li, Zhuoran, et autres
Publié: (2025)
Improving GFlowNets with Monte Carlo Tree Search
par: Morozov, Nikita, et autres
Publié: (2024)
par: Morozov, Nikita, et autres
Publié: (2024)
OM2P: Offline Multi-Agent Mean-Flow Policy
par: Li, Zhuoran, et autres
Publié: (2025)
par: Li, Zhuoran, et autres
Publié: (2025)
Controlling Exploration-Exploitation in GFlowNets via Markov Chain Perspectives
par: Chen, Lin, et autres
Publié: (2026)
par: Chen, Lin, et autres
Publié: (2026)
On Divergence Measures for Training GFlowNets
par: da Silva, Tiago, et autres
Publié: (2024)
par: da Silva, Tiago, et autres
Publié: (2024)
Reparameterization Proximal Policy Optimization
par: Zhong, Hai, et autres
Publié: (2025)
par: Zhong, Hai, et autres
Publié: (2025)
Reparameterization Flow Policy Optimization
par: Zhong, Hai, et autres
Publié: (2026)
par: Zhong, Hai, et autres
Publié: (2026)
Improving GFlowNets for Text-to-Image Diffusion Alignment
par: Zhang, Dinghuai, et autres
Publié: (2024)
par: Zhang, Dinghuai, et autres
Publié: (2024)
$f$-Trajectory Balance: A Loss Family for Tuning GFlowNets, Generative Models, and LLMs with Off- and On-Policy Data
par: Fawkes, Jake, et autres
Publié: (2026)
par: Fawkes, Jake, et autres
Publié: (2026)
Interpreting GFlowNets for Drug Discovery: Extracting Actionable Insights for Medicinal Chemistry
par: S, Amirtha Varshini A, et autres
Publié: (2025)
par: S, Amirtha Varshini A, et autres
Publié: (2025)
AbFlowNet: Optimizing Antibody-Antigen Binding Energy via Diffusion-GFlowNet Fusion
par: Abir, Abrar Rahman, et autres
Publié: (2025)
par: Abir, Abrar Rahman, et autres
Publié: (2025)
EMERGENT: Efficient and Manipulation-resistant Matching using GFlowNets
par: Tasnim, Mayesha, et autres
Publié: (2025)
par: Tasnim, Mayesha, et autres
Publié: (2025)
Why Pool When You Can Flow? Active Learning with GFlowNets
par: Zhang, Renfei, et autres
Publié: (2025)
par: Zhang, Renfei, et autres
Publié: (2025)
GFlowNet Training by Policy Gradients
par: Niu, Puhua, et autres
Publié: (2024)
par: Niu, Puhua, et autres
Publié: (2024)
Offline-to-Online Multi-Agent Reinforcement Learning with Offline Value Function Memory and Sequential Exploration
par: Zhong, Hai, et autres
Publié: (2024)
par: Zhong, Hai, et autres
Publié: (2024)
Finite-time Convergence Analysis of Actor-Critic with Evolving Reward
par: Hu, Rui, et autres
Publié: (2025)
par: Hu, Rui, et autres
Publié: (2025)
Symmetry-Aware GFlowNets
par: Kim, Hohyun, et autres
Publié: (2025)
par: Kim, Hohyun, et autres
Publié: (2025)
Streaming Bayes GFlowNets
par: da Silva, Tiago, et autres
Publié: (2024)
par: da Silva, Tiago, et autres
Publié: (2024)
Embarrassingly Parallel GFlowNets
par: da Silva, Tiago, et autres
Publié: (2024)
par: da Silva, Tiago, et autres
Publié: (2024)
Baking Symmetry into GFlowNets
par: Ma, George, et autres
Publié: (2024)
par: Ma, George, et autres
Publié: (2024)
Local Search GFlowNets
par: Kim, Minsu, et autres
Publié: (2023)
par: Kim, Minsu, et autres
Publié: (2023)
Pessimistic Backward Policy for GFlowNets
par: Jang, Hyosoon, et autres
Publié: (2024)
par: Jang, Hyosoon, et autres
Publié: (2024)
Stable GFlowNets with Probabilistic Guarantees
par: Lei, Zengxiang, et autres
Publié: (2026)
par: Lei, Zengxiang, et autres
Publié: (2026)
Avoid What You Know: Divergent Trajectory Balance for GFlowNets
par: Dall'Antonia, Pedro, et autres
Publié: (2026)
par: Dall'Antonia, Pedro, et autres
Publié: (2026)
Optimizing Backward Policies in GFlowNets via Trajectory Likelihood Maximization
par: Gritsaev, Timofei, et autres
Publié: (2024)
par: Gritsaev, Timofei, et autres
Publié: (2024)
GTA: Generative Trajectory Augmentation with Guidance for Offline Reinforcement Learning
par: Lee, Jaewoo, et autres
Publié: (2024)
par: Lee, Jaewoo, et autres
Publié: (2024)
Multi-Fidelity Active Learning with GFlowNets
par: Hernandez-Garcia, Alex, et autres
Publié: (2023)
par: Hernandez-Garcia, Alex, et autres
Publié: (2023)
Revisiting Non-Acyclic GFlowNets in Discrete Environments
par: Morozov, Nikita, et autres
Publié: (2025)
par: Morozov, Nikita, et autres
Publié: (2025)
torchgfn: A PyTorch GFlowNet library
par: Viviano, Joseph D., et autres
Publié: (2023)
par: Viviano, Joseph D., et autres
Publié: (2023)
Maximum entropy GFlowNets with soft Q-learning
par: Mohammadpour, Sobhan, et autres
Publié: (2023)
par: Mohammadpour, Sobhan, et autres
Publié: (2023)
Learning to Scale Logits for Temperature-Conditional GFlowNets
par: Kim, Minsu, et autres
Publié: (2023)
par: Kim, Minsu, et autres
Publié: (2023)
Documents similaires
-
GFlowNet Foundations
par: Bengio, Yoshua, et autres
Publié: (2021) -
Rooted Absorbed Prefix Trajectory Balance with Submodular Replay for GFlowNet Training
par: Wang, Xi, et autres
Publié: (2026) -
Order-Preserving GFlowNets
par: Chen, Yihang, et autres
Publié: (2023) -
PowerFlow: Unlocking the Dual Nature of LLMs via Principled Distribution Matching
par: Chen, Ruishuo, et autres
Publié: (2026) -
Beyond Shallow Behavior: Task-Efficient Value-Based Multi-Task Offline MARL via Skill Discovery
par: Wang, Xun, et autres
Publié: (2025)