Salvato in:
| Autori principali: | Yang, Qianlan, Wang, Yu-Xiong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2406.04323 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Proposer-Agent-Evaluator(PAE): Autonomous Skill Discovery For Foundation Model Internet Agents
di: Zhou, Yifei, et al.
Pubblicazione: (2024)
di: Zhou, Yifei, et al.
Pubblicazione: (2024)
DiffusionNFT: Online Diffusion Reinforcement with Forward Process
di: Zheng, Kaiwen, et al.
Pubblicazione: (2025)
di: Zheng, Kaiwen, et al.
Pubblicazione: (2025)
IVR-R1: Refining Trajectories through Iterative Visual-Grounded Reasoning in Reinforcement Learning
di: Li, Chenghao, et al.
Pubblicazione: (2026)
di: Li, Chenghao, et al.
Pubblicazione: (2026)
FedDiff: Diffusion Model Driven Federated Learning for Multi-Modal and Multi-Clients
di: Li, DaiXun, et al.
Pubblicazione: (2023)
di: Li, DaiXun, et al.
Pubblicazione: (2023)
RefDiffNet: Learning to Expose Subtle PCB Defects Before Detection
di: Edula, Vinay, et al.
Pubblicazione: (2026)
di: Edula, Vinay, et al.
Pubblicazione: (2026)
Consistency Trajectory Models: Learning Probability Flow ODE Trajectory of Diffusion
di: Kim, Dongjun, et al.
Pubblicazione: (2023)
di: Kim, Dongjun, et al.
Pubblicazione: (2023)
DiffEM: Learning from Corrupted Data with Diffusion Models via Expectation Maximization
di: Hosseintabar, Danial, et al.
Pubblicazione: (2025)
di: Hosseintabar, Danial, et al.
Pubblicazione: (2025)
DiffCLIP: Differential Attention Meets CLIP
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2025)
di: Hammoud, Hasan Abed Al Kader, et al.
Pubblicazione: (2025)
OpenWebRL: Demystifying Online Multi-turn Reinforcement Learning for Visual Web Agents
di: Yang, Rui, et al.
Pubblicazione: (2026)
di: Yang, Rui, et al.
Pubblicazione: (2026)
DisCo-Diff: Enhancing Continuous Diffusion Models with Discrete Latents
di: Xu, Yilun, et al.
Pubblicazione: (2024)
di: Xu, Yilun, et al.
Pubblicazione: (2024)
DiffBlender: Composable and Versatile Multimodal Text-to-Image Diffusion Models
di: Kim, Sungnyun, et al.
Pubblicazione: (2023)
di: Kim, Sungnyun, et al.
Pubblicazione: (2023)
SafeDreamer: Safe Reinforcement Learning with World Models
di: Huang, Weidong, et al.
Pubblicazione: (2023)
di: Huang, Weidong, et al.
Pubblicazione: (2023)
STeP-Diff: Spatio-Temporal Physics-Informed Diffusion Models for Mobile Fine-Grained Pollution Forecasting
di: Zhou, Nan, et al.
Pubblicazione: (2025)
di: Zhou, Nan, et al.
Pubblicazione: (2025)
TrajPRed: Trajectory Prediction with Region-based Relation Learning
di: Zhou, Chen, et al.
Pubblicazione: (2024)
di: Zhou, Chen, et al.
Pubblicazione: (2024)
Learning Equi-angular Representations for Online Continual Learning
di: Seo, Minhyuk, et al.
Pubblicazione: (2024)
di: Seo, Minhyuk, et al.
Pubblicazione: (2024)
Reinforcement Learning with Generalizable Gaussian Splatting
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
di: Wang, Jiaxu, et al.
Pubblicazione: (2024)
Measure Twice, Click Once: Co-evolving Proposer and Visual Critic via Reinforcement Learning for GUI Grounding
di: Wang, Wenkai, et al.
Pubblicazione: (2026)
di: Wang, Wenkai, et al.
Pubblicazione: (2026)
GNNRL-Smoothing: A Prior-Free Reinforcement Learning Model for Mesh Smoothing
di: Wang, Zhichao, et al.
Pubblicazione: (2024)
di: Wang, Zhichao, et al.
Pubblicazione: (2024)
Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL
di: Wu, Junyi, et al.
Pubblicazione: (2026)
di: Wu, Junyi, et al.
Pubblicazione: (2026)
Diffusion Reinforcement Learning via Centered Reward Distillation
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2026)
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2026)
MVR: Multi-view Video Reward Shaping for Reinforcement Learning
di: Luo, Lirui, et al.
Pubblicazione: (2026)
di: Luo, Lirui, et al.
Pubblicazione: (2026)
Rays as Pixels: Learning A Joint Distribution of Videos and Camera Trajectories
di: Jang, Wonbong, et al.
Pubblicazione: (2026)
di: Jang, Wonbong, et al.
Pubblicazione: (2026)
Distilling Out-of-Distribution Robustness from Vision-Language Foundation Models
di: Zhou, Andy, et al.
Pubblicazione: (2023)
di: Zhou, Andy, et al.
Pubblicazione: (2023)
Natural Gradient Descent for Online Continual Learning
di: Khawand, Joe, et al.
Pubblicazione: (2026)
di: Khawand, Joe, et al.
Pubblicazione: (2026)
Is Pre-training Truly Better Than Meta-Learning?
di: Miranda, Brando, et al.
Pubblicazione: (2023)
di: Miranda, Brando, et al.
Pubblicazione: (2023)
BridgeDrive: Diffusion Bridge Policy for Closed-Loop Trajectory Planning in Autonomous Driving
di: Liu, Shu, et al.
Pubblicazione: (2025)
di: Liu, Shu, et al.
Pubblicazione: (2025)
DiffFinger: Advancing Synthetic Fingerprint Generation through Denoising Diffusion Probabilistic Models
di: Grabovski, Freddie, et al.
Pubblicazione: (2024)
di: Grabovski, Freddie, et al.
Pubblicazione: (2024)
Delta-Based Neural Architecture Search: LLM Fine-Tuning via Code Diffs
di: Adhikari, Santosh Premi, et al.
Pubblicazione: (2026)
di: Adhikari, Santosh Premi, et al.
Pubblicazione: (2026)
Towards Physics-informed Diffusion for Anomaly Detection in Trajectories
di: Sharma, Arun, et al.
Pubblicazione: (2025)
di: Sharma, Arun, et al.
Pubblicazione: (2025)
Accelerating Heterogeneous Federated Learning with Closed-form Classifiers
di: Fanì, Eros, et al.
Pubblicazione: (2024)
di: Fanì, Eros, et al.
Pubblicazione: (2024)
HERO: Human-Feedback Efficient Reinforcement Learning for Online Diffusion Model Finetuning
di: Hiranaka, Ayano, et al.
Pubblicazione: (2024)
di: Hiranaka, Ayano, et al.
Pubblicazione: (2024)
X-VORTEX: Spatio-Temporal Contrastive Learning for Wake Vortex Trajectory Forecasting
di: Qu, Zhan, et al.
Pubblicazione: (2026)
di: Qu, Zhan, et al.
Pubblicazione: (2026)
Theoretical Guarantees for High Order Trajectory Refinement in Generative Flows
di: Gong, Chengyue, et al.
Pubblicazione: (2025)
di: Gong, Chengyue, et al.
Pubblicazione: (2025)
Instruct 4D-to-4D: Editing 4D Scenes as Pseudo-3D Scenes Using 2D Diffusion
di: Mou, Linzhan, et al.
Pubblicazione: (2024)
di: Mou, Linzhan, et al.
Pubblicazione: (2024)
Emergent Visual Grounding in Large Multimodal Models Without Grounding Supervision
di: Cao, Shengcao, et al.
Pubblicazione: (2024)
di: Cao, Shengcao, et al.
Pubblicazione: (2024)
Diff-Instruct++: Training One-step Text-to-image Generator Model to Align with Human Preferences
di: Luo, Weijian
Pubblicazione: (2024)
di: Luo, Weijian
Pubblicazione: (2024)
DiffRaman: A Conditional Latent Denoising Diffusion Probabilistic Model for Bacterial Raman Spectroscopy Identification Under Limited Data Conditions
di: Yao, Haiming, et al.
Pubblicazione: (2024)
di: Yao, Haiming, et al.
Pubblicazione: (2024)
Enhancing Online Continual Learning with Plug-and-Play State Space Model and Class-Conditional Mixture of Discretization
di: Liu, Sihao, et al.
Pubblicazione: (2024)
di: Liu, Sihao, et al.
Pubblicazione: (2024)
Training Diffusion Models with Reinforcement Learning
di: Black, Kevin, et al.
Pubblicazione: (2023)
di: Black, Kevin, et al.
Pubblicazione: (2023)
VisionThink: Smart and Efficient Vision Language Model via Reinforcement Learning
di: Yang, Senqiao, et al.
Pubblicazione: (2025)
di: Yang, Senqiao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Proposer-Agent-Evaluator(PAE): Autonomous Skill Discovery For Foundation Model Internet Agents
di: Zhou, Yifei, et al.
Pubblicazione: (2024) -
DiffusionNFT: Online Diffusion Reinforcement with Forward Process
di: Zheng, Kaiwen, et al.
Pubblicazione: (2025) -
IVR-R1: Refining Trajectories through Iterative Visual-Grounded Reasoning in Reinforcement Learning
di: Li, Chenghao, et al.
Pubblicazione: (2026) -
FedDiff: Diffusion Model Driven Federated Learning for Multi-Modal and Multi-Clients
di: Li, DaiXun, et al.
Pubblicazione: (2023) -
RefDiffNet: Learning to Expose Subtle PCB Defects Before Detection
di: Edula, Vinay, et al.
Pubblicazione: (2026)