A Unified and Fast-Sampling Diffusion Bridge Framework via Stochastic Optimal Control
Fuente:
arXiv
Guardado en:
| Autores principales: | Pan, Mokai, Zhu, Kaizhen, Ma, Yuexin, Fu, Yanwei, Yu, Jingyi, Wang, Jingya, Shi, Ye |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
UniDB: A Unified Diffusion Bridge Framework via Stochastic Optimal Control
por: Zhu, Kaizhen, et al.
Publicado: (2025)
por: Zhu, Kaizhen, et al.
Publicado: (2025)
Diffusion Bridge or Flow Matching? A Unifying Framework and Comparative Analysis
por: Zhu, Kaizhen, et al.
Publicado: (2025)
por: Zhu, Kaizhen, et al.
Publicado: (2025)
Sample from What You See: Visuomotor Policy Learning via Diffusion Bridge with Observation-Embedded Stochastic Differential Equation
por: Liu, Zhaoyang, et al.
Publicado: (2025)
por: Liu, Zhaoyang, et al.
Publicado: (2025)
A Unified Diffusion Framework for Scene-aware Human Motion Estimation from Sparse Signals
por: Tang, Jiangnan, et al.
Publicado: (2024)
por: Tang, Jiangnan, et al.
Publicado: (2024)
StackFLOW: Monocular Human-Object Reconstruction by Stacked Normalizing Flow with Offset
por: Huo, Chaofan, et al.
Publicado: (2024)
por: Huo, Chaofan, et al.
Publicado: (2024)
HybridGait: A Benchmark for Spatial-Temporal Cloth-Changing Gait Recognition with Hybrid Explorations
por: Dong, Yilan, et al.
Publicado: (2023)
por: Dong, Yilan, et al.
Publicado: (2023)
Towards Immersive Human-X Interaction: A Real-Time Framework for Physically Plausible Motion Synthesis
por: Ji, Kaiyang, et al.
Publicado: (2025)
por: Ji, Kaiyang, et al.
Publicado: (2025)
THOR: Text to Human-Object Interaction Diffusion via Relation Intervention
por: Wu, Qianyang, et al.
Publicado: (2024)
por: Wu, Qianyang, et al.
Publicado: (2024)
DiscoForcing: A Unified Framework for Real-Time Audio-Driven Character Control with Diffusion Forcing
por: Ji, Kaiyang, et al.
Publicado: (2026)
por: Ji, Kaiyang, et al.
Publicado: (2026)
Distributional Reinforcement Learning with Diffusion Bridge Critics
por: Ding, Shutong, et al.
Publicado: (2026)
por: Ding, Shutong, et al.
Publicado: (2026)
Unsupervised Cross-Domain Image Retrieval via Prototypical Optimal Transport
por: Li, Bin, et al.
Publicado: (2024)
por: Li, Bin, et al.
Publicado: (2024)
Gaze-guided Hand-Object Interaction Synthesis: Dataset and Method
por: Tian, Jie, et al.
Publicado: (2024)
por: Tian, Jie, et al.
Publicado: (2024)
HandDiffuse: Generative Controllers for Two-Hand Interactions via Diffusion Models
por: Lin, Pei, et al.
Publicado: (2023)
por: Lin, Pei, et al.
Publicado: (2023)
LiveHPS: LiDAR-based Scene-level Human Pose and Shape Estimation in Free Environment
por: Ren, Yiming, et al.
Publicado: (2024)
por: Ren, Yiming, et al.
Publicado: (2024)
A Unified Framework for Human-centric Point Cloud Video Understanding
por: Xu, Yiteng, et al.
Publicado: (2024)
por: Xu, Yiteng, et al.
Publicado: (2024)
SafeCtrl: Region-Based Safety Control for Text-to-Image Diffusion via Detect-Then-Suppress
por: Zhang, Lingyun, et al.
Publicado: (2025)
por: Zhang, Lingyun, et al.
Publicado: (2025)
FastGrasp: Efficient Grasp Synthesis with Diffusion
por: Wu, Xiaofei, et al.
Publicado: (2024)
por: Wu, Xiaofei, et al.
Publicado: (2024)
Does Visual Token Pruning Improve Calibration? An Empirical Study on Confidence in MLLMs
por: Tan, Kaizhen
Publicado: (2026)
por: Tan, Kaizhen
Publicado: (2026)
EvolvingGrasp: Evolutionary Grasp Generation via Efficient Preference Alignment
por: Zhu, Yufei, et al.
Publicado: (2025)
por: Zhu, Yufei, et al.
Publicado: (2025)
UniHM: Unified Dexterous Hand Manipulation with Vision Language Model
por: Zhang, Zhenhao, et al.
Publicado: (2026)
por: Zhang, Zhenhao, et al.
Publicado: (2026)
Contextually Affinitive Neighborhood Refinery for Deep Clustering
por: Yu, Chunlin, et al.
Publicado: (2023)
por: Yu, Chunlin, et al.
Publicado: (2023)
SeqAfford: Sequential 3D Affordance Reasoning via Multimodal Large Language Model
por: Yu, Chunlin, et al.
Publicado: (2024)
por: Yu, Chunlin, et al.
Publicado: (2024)
Concept Replacer: Replacing Sensitive Concepts in Diffusion Models via Precision Localization
por: Zhang, Lingyun, et al.
Publicado: (2024)
por: Zhang, Lingyun, et al.
Publicado: (2024)
DualFast: Dual-Speedup Framework for Fast Sampling of Diffusion Models
por: Yu, Hu, et al.
Publicado: (2025)
por: Yu, Hu, et al.
Publicado: (2025)
Gait Recognition in Large-scale Free Environment via Single LiDAR
por: Han, Xiao, et al.
Publicado: (2022)
por: Han, Xiao, et al.
Publicado: (2022)
DexGrasp Anything: Towards Universal Robotic Dexterous Grasping with Physics Awareness
por: Zhong, Yiming, et al.
Publicado: (2025)
por: Zhong, Yiming, et al.
Publicado: (2025)
UrbanVGGT: Scalable Sidewalk Width Estimation from Street View Images
por: Tan, Kaizhen, et al.
Publicado: (2026)
por: Tan, Kaizhen, et al.
Publicado: (2026)
AnyRefill: A Unified, Data-Efficient Framework for Left-Prompt-Guided Vision Tasks
por: Xie, Ming, et al.
Publicado: (2025)
por: Xie, Ming, et al.
Publicado: (2025)
Adaptive Stochastic Coefficients for Accelerating Diffusion Sampling
por: Wang, Ruoyu, et al.
Publicado: (2025)
por: Wang, Ruoyu, et al.
Publicado: (2025)
DiffCast: A Unified Framework via Residual Diffusion for Precipitation Nowcasting
por: Yu, Demin, et al.
Publicado: (2023)
por: Yu, Demin, et al.
Publicado: (2023)
InterAgent: Physics-based Multi-agent Command Execution via Diffusion on Interaction Graphs
por: Li, Bin, et al.
Publicado: (2025)
por: Li, Bin, et al.
Publicado: (2025)
Empowering Bridge Digital Twins by Bridging the Data Gap with a Unified Synthesis Framework
por: Wang, Wang, et al.
Publicado: (2025)
por: Wang, Wang, et al.
Publicado: (2025)
Monocular Human-Object Reconstruction in the Wild
por: Huo, Chaofan, et al.
Publicado: (2024)
por: Huo, Chaofan, et al.
Publicado: (2024)
Controllable Video Object Insertion via Multiview Priors
por: Qi, Xia, et al.
Publicado: (2026)
por: Qi, Xia, et al.
Publicado: (2026)
Robust Depth Super-Resolution via Adaptive Diffusion Sampling
por: Wang, Kun, et al.
Publicado: (2026)
por: Wang, Kun, et al.
Publicado: (2026)
HOI-M3:Capture Multiple Humans and Objects Interaction within Contextual Environment
por: Zhang, Juze, et al.
Publicado: (2024)
por: Zhang, Juze, et al.
Publicado: (2024)
MVInpainter: Learning Multi-View Consistent Inpainting to Bridge 2D and 3D Editing
por: Cao, Chenjie, et al.
Publicado: (2024)
por: Cao, Chenjie, et al.
Publicado: (2024)
Multimodal Deep Learning for ATCO Command Lifecycle Modeling and Workload Prediction
por: Tan, Kaizhen
Publicado: (2025)
por: Tan, Kaizhen
Publicado: (2025)
NLPrompt: Noise-Label Prompt Learning for Vision-Language Models
por: Pan, Bikang, et al.
Publicado: (2024)
por: Pan, Bikang, et al.
Publicado: (2024)
Bridging Generative and Discriminative Models for Unified Visual Perception with Diffusion Priors
por: Dong, Shiyin, et al.
Publicado: (2024)
por: Dong, Shiyin, et al.
Publicado: (2024)
Ejemplares similares
-
UniDB: A Unified Diffusion Bridge Framework via Stochastic Optimal Control
por: Zhu, Kaizhen, et al.
Publicado: (2025) -
Diffusion Bridge or Flow Matching? A Unifying Framework and Comparative Analysis
por: Zhu, Kaizhen, et al.
Publicado: (2025) -
Sample from What You See: Visuomotor Policy Learning via Diffusion Bridge with Observation-Embedded Stochastic Differential Equation
por: Liu, Zhaoyang, et al.
Publicado: (2025) -
A Unified Diffusion Framework for Scene-aware Human Motion Estimation from Sparse Signals
por: Tang, Jiangnan, et al.
Publicado: (2024) -
StackFLOW: Monocular Human-Object Reconstruction by Stacked Normalizing Flow with Offset
por: Huo, Chaofan, et al.
Publicado: (2024)