Gradient Preconditioning for Efficient and Reliable Reward-Guided Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hwang, Jisung, Sung, Minhyuk |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Occupancy-Based Dual Contouring
par: Hwang, Jisung, et autres
Publié: (2024)
par: Hwang, Jisung, et autres
Publié: (2024)
Moment- and Power-Spectrum-Based Gaussianity Regularization for Text-to-Image Models
par: Hwang, Jisung, et autres
Publié: (2025)
par: Hwang, Jisung, et autres
Publié: (2025)
Inference-Time Scaling for Flow Models via Stochastic Generation and Rollover Budget Forcing
par: Kim, Jaihoon, et autres
Publié: (2025)
par: Kim, Jaihoon, et autres
Publié: (2025)
PairFlow: Closed-Form Source-Target Coupling for Few-Step Generation in Discrete Flow Models
par: Park, Mingue, et autres
Publié: (2025)
par: Park, Mingue, et autres
Publié: (2025)
Neural Green's Functions
par: Yoo, Seungwoo, et autres
Publié: (2025)
par: Yoo, Seungwoo, et autres
Publié: (2025)
Reward-Guided Discrete Diffusion via Clean-Sample Markov Chain for Molecule and Biological Sequence Design
par: Phunyaphibarn, Prin, et autres
Publié: (2026)
par: Phunyaphibarn, Prin, et autres
Publié: (2026)
Drifting Field Policy: A One-Step Generative Policy via Wasserstein Gradient Flow
par: Koo, Juil, et autres
Publié: (2026)
par: Koo, Juil, et autres
Publié: (2026)
BézierFlow: Learning Bézier Stochastic Interpolant Schedulers for Few-Step Generation
par: Min, Yunhong, et autres
Publié: (2025)
par: Min, Yunhong, et autres
Publié: (2025)
Psi-Sampler: Initial Particle Sampling for SMC-Based Inference-Time Reward Alignment in Score Models
par: Yoon, Taehoon, et autres
Publié: (2025)
par: Yoon, Taehoon, et autres
Publié: (2025)
MAC: An Efficient Gradient Preconditioning using Mean Activation Approximated Curvature
par: Seung, Hyunseok, et autres
Publié: (2025)
par: Seung, Hyunseok, et autres
Publié: (2025)
Instruction-Guided Autoregressive Neural Network Parameter Generation
par: Bedionita, Soro, et autres
Publié: (2025)
par: Bedionita, Soro, et autres
Publié: (2025)
Stochastic Gradient Methods with Preconditioned Updates
par: Sadiev, Abdurakhmon, et autres
Publié: (2022)
par: Sadiev, Abdurakhmon, et autres
Publié: (2022)
Dual Space Preconditioning for Gradient Descent in the Overparameterized Regime
par: Ghane, Reza, et autres
Publié: (2026)
par: Ghane, Reza, et autres
Publié: (2026)
Mirror and Preconditioned Gradient Descent in Wasserstein Space
par: Bonet, Clément, et autres
Publié: (2024)
par: Bonet, Clément, et autres
Publié: (2024)
Preconditioning for Accelerated Gradient Descent Optimization and Regularization
par: Ye, Qiang
Publié: (2024)
par: Ye, Qiang
Publié: (2024)
Efficient Low-Tubal-Rank Tensor Estimation via Alternating Preconditioned Gradient Descent
par: Liu, Zhiyu, et autres
Publié: (2025)
par: Liu, Zhiyu, et autres
Publié: (2025)
Adaptive Step Sizes for Preconditioned Stochastic Gradient Descent
par: Köhne, Frederik, et autres
Publié: (2023)
par: Köhne, Frederik, et autres
Publié: (2023)
DiffusionRollout: Uncertainty-Aware Rollout Planning in Long-Horizon PDE Solving
par: Yoo, Seungwoo, et autres
Publié: (2026)
par: Yoo, Seungwoo, et autres
Publié: (2026)
Generative Modeling on Manifolds Through Mixture of Riemannian Diffusion Processes
par: Jo, Jaehyeong, et autres
Publié: (2023)
par: Jo, Jaehyeong, et autres
Publié: (2023)
Efficient Over-parameterized Matrix Sensing from Noisy Measurements via Alternating Preconditioned Gradient Descent
par: Liu, Zhiyu, et autres
Publié: (2025)
par: Liu, Zhiyu, et autres
Publié: (2025)
ORIGEN: Zero-Shot 3D Orientation Grounding in Text-to-Image Generation
par: Min, Yunhong, et autres
Publié: (2025)
par: Min, Yunhong, et autres
Publié: (2025)
NysAct: A Scalable Preconditioned Gradient Descent using Nystrom Approximation
par: Seung, Hyunseok, et autres
Publié: (2025)
par: Seung, Hyunseok, et autres
Publié: (2025)
Preconditioned Gradient Descent for Over-Parameterized Nonconvex Matrix Factorization
par: Zhang, Gavin, et autres
Publié: (2025)
par: Zhang, Gavin, et autres
Publié: (2025)
Efficient Real-time Refinement of Language Model Text Generation
par: Ko, Joonho, et autres
Publié: (2025)
par: Ko, Joonho, et autres
Publié: (2025)
Deep Learning-Enhanced Preconditioning for Efficient Conjugate Gradient Solvers in Large-Scale PDE Systems
par: Li, Rui, et autres
Publié: (2024)
par: Li, Rui, et autres
Publié: (2024)
How Does Preconditioning Guide Feature Learning in Deep Neural Networks?
par: Yoshida, Kotaro, et autres
Publié: (2025)
par: Yoshida, Kotaro, et autres
Publié: (2025)
Euphonium: Steering Video Flow Matching via Process Reward Gradient Guided Stochastic Dynamics
par: Zhong, Ruizhe, et autres
Publié: (2026)
par: Zhong, Ruizhe, et autres
Publié: (2026)
Graph Generation with Diffusion Mixture
par: Jo, Jaehyeong, et autres
Publié: (2023)
par: Jo, Jaehyeong, et autres
Publié: (2023)
Gradient-Guided Annealing for Domain Generalization
par: Ballas, Aristotelis, et autres
Publié: (2025)
par: Ballas, Aristotelis, et autres
Publié: (2025)
Retrieval-Augmented Generation with Estimation of Source Reliability
par: Hwang, Jeongyeon, et autres
Publié: (2024)
par: Hwang, Jeongyeon, et autres
Publié: (2024)
Contrastive Distribution Matching for Amortized Sequential Monte Carlo in Discrete Diffusion
par: Kim, Jaihoon, et autres
Publié: (2026)
par: Kim, Jaihoon, et autres
Publié: (2026)
CDRRM: Contrast-Driven Rubric Generation for Reliable and Interpretable Reward Modeling
par: Liu, Dengcan, et autres
Publié: (2026)
par: Liu, Dengcan, et autres
Publié: (2026)
SAGE: Shaping Anchors for Guided Exploration in RLVR of LLMs
par: Lee, Chanuk, et autres
Publié: (2026)
par: Lee, Chanuk, et autres
Publié: (2026)
Universal Sequence Preconditioning
par: Marsden, Annie, et autres
Publié: (2025)
par: Marsden, Annie, et autres
Publié: (2025)
Reliability Sensitivity with Response Gradient
par: Au, Siu-Kui, et autres
Publié: (2025)
par: Au, Siu-Kui, et autres
Publié: (2025)
Reward Dimension Reduction for Scalable Multi-Objective Reinforcement Learning
par: Park, Giseung, et autres
Publié: (2025)
par: Park, Giseung, et autres
Publié: (2025)
Preconditioned Gradient Descent for Overparameterized Nonconvex Burer--Monteiro Factorization with Global Optimality Certification
par: Zhang, Gavin, et autres
Publié: (2022)
par: Zhang, Gavin, et autres
Publié: (2022)
EVEREST: Efficient Masked Video Autoencoder by Removing Redundant Spatiotemporal Tokens
par: Hwang, Sunil, et autres
Publié: (2022)
par: Hwang, Sunil, et autres
Publié: (2022)
Process Rewards with Learned Reliability
par: Li, Jinyuan, et autres
Publié: (2026)
par: Li, Jinyuan, et autres
Publié: (2026)
Planning with Language and Generative Models: Toward General Reward-Guided Wireless Network Design
par: Yuan, Chenyang, et autres
Publié: (2026)
par: Yuan, Chenyang, et autres
Publié: (2026)
Documents similaires
-
Occupancy-Based Dual Contouring
par: Hwang, Jisung, et autres
Publié: (2024) -
Moment- and Power-Spectrum-Based Gaussianity Regularization for Text-to-Image Models
par: Hwang, Jisung, et autres
Publié: (2025) -
Inference-Time Scaling for Flow Models via Stochastic Generation and Rollover Budget Forcing
par: Kim, Jaihoon, et autres
Publié: (2025) -
PairFlow: Closed-Form Source-Target Coupling for Few-Step Generation in Discrete Flow Models
par: Park, Mingue, et autres
Publié: (2025) -
Neural Green's Functions
par: Yoo, Seungwoo, et autres
Publié: (2025)