COLLAGE: Collaborative Human-Agent Interaction Generation using Hierarchical Latent Diffusion and Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Daiya, Divyanshu, Conover, Damon, Bera, Aniket |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Sketch2Colab: Sketch-Conditioned Multi-Human Animation via Controllable Flow Distillation
par: Daiya, Divyanshu, et autres
Publié: (2026)
par: Daiya, Divyanshu, et autres
Publié: (2026)
Go-SLAM: Grounded Object Segmentation and Localization with Gaussian Splatting SLAM
par: Pham, Phu, et autres
Publié: (2024)
par: Pham, Phu, et autres
Publié: (2024)
HessianForge: Scalable LiDAR reconstruction with Physics-Informed Neural Representation and Smoothness Energy Constraints
par: Viswanath, Hrishikesh, et autres
Publié: (2025)
par: Viswanath, Hrishikesh, et autres
Publié: (2025)
LEAD: Latent Realignment for Human Motion Diffusion
par: Andreou, Nefeli, et autres
Publié: (2024)
par: Andreou, Nefeli, et autres
Publié: (2024)
SALAD: Skeleton-aware Latent Diffusion for Text-driven Motion Generation and Editing
par: Hong, Seokhyeon, et autres
Publié: (2025)
par: Hong, Seokhyeon, et autres
Publié: (2025)
Auto-Regressive Diffusion for Generating 3D Human-Object Interactions
par: Geng, Zichen, et autres
Publié: (2025)
par: Geng, Zichen, et autres
Publié: (2025)
ArchComplete: Autoregressive 3D Architectural Design Generation with Hierarchical Diffusion-Based Upsampling
par: Rasoulzadeh, S., et autres
Publié: (2024)
par: Rasoulzadeh, S., et autres
Publié: (2024)
To Move or Not to Move: Constraint-based Planning Enables Zero-Shot Generalization for Interactive Navigation
par: Vashisth, Apoorva, et autres
Publié: (2026)
par: Vashisth, Apoorva, et autres
Publié: (2026)
Infinite Leagues Under the Sea: Photorealistic 3D Underwater Terrain Generation by Latent Fractal Diffusion Models
par: Zhang, Tianyi, et autres
Publié: (2025)
par: Zhang, Tianyi, et autres
Publié: (2025)
DiffusionBrowser: Interactive Diffusion Previews via Multi-Branch Decoders
par: Hong, Susung, et autres
Publié: (2025)
par: Hong, Susung, et autres
Publié: (2025)
ComboStoc: Combinatorial Stochasticity for Diffusion Generative Models
par: Xu, Rui, et autres
Publié: (2024)
par: Xu, Rui, et autres
Publié: (2024)
GeneOH Diffusion: Towards Generalizable Hand-Object Interaction Denoising via Denoising Diffusion
par: Liu, Xueyi, et autres
Publié: (2024)
par: Liu, Xueyi, et autres
Publié: (2024)
Improving Video Generation with Human Feedback
par: Liu, Jie, et autres
Publié: (2025)
par: Liu, Jie, et autres
Publié: (2025)
Interactive Character Control with Auto-Regressive Motion Diffusion Models
par: Shi, Yi, et autres
Publié: (2023)
par: Shi, Yi, et autres
Publié: (2023)
GenHMR: Generative Human Mesh Recovery
par: Saleem, Muhammad Usama, et autres
Publié: (2024)
par: Saleem, Muhammad Usama, et autres
Publié: (2024)
UniHM: Universal Human Motion Generation with Object Interactions in Indoor Scenes
par: Geng, Zichen, et autres
Publié: (2025)
par: Geng, Zichen, et autres
Publié: (2025)
BlockFusion: Expandable 3D Scene Generation using Latent Tri-plane Extrapolation
par: Wu, Zhennan, et autres
Publié: (2024)
par: Wu, Zhennan, et autres
Publié: (2024)
DiffH2O: Diffusion-Based Synthesis of Hand-Object Interactions from Textual Descriptions
par: Christen, Sammy, et autres
Publié: (2024)
par: Christen, Sammy, et autres
Publié: (2024)
Diffusion Self-Distillation for Zero-Shot Customized Image Generation
par: Cai, Shengqu, et autres
Publié: (2024)
par: Cai, Shengqu, et autres
Publié: (2024)
ImagenWorld: Stress-Testing Image Generation Models with Explainable Human Evaluation on Open-ended Real-World Tasks
par: Sani, Samin Mahdizadeh, et autres
Publié: (2026)
par: Sani, Samin Mahdizadeh, et autres
Publié: (2026)
FlexMotion: Lightweight, Physics-Aware, and Controllable Human Motion Generation
par: Tashakori, Arvin, et autres
Publié: (2025)
par: Tashakori, Arvin, et autres
Publié: (2025)
End-to-End Training for Unified Tokenization and Latent Denoising
par: Duggal, Shivam, et autres
Publié: (2026)
par: Duggal, Shivam, et autres
Publié: (2026)
Infinite-Resolution Integral Noise Warping for Diffusion Models
par: Deng, Yitong, et autres
Publié: (2024)
par: Deng, Yitong, et autres
Publié: (2024)
Lazy Diffusion Transformer for Interactive Image Editing
par: Nitzan, Yotam, et autres
Publié: (2024)
par: Nitzan, Yotam, et autres
Publié: (2024)
TEXGen: a Generative Diffusion Model for Mesh Textures
par: Yu, Xin, et autres
Publié: (2024)
par: Yu, Xin, et autres
Publié: (2024)
RMD: A Simple Baseline for More General Human Motion Generation via Training-free Retrieval-Augmented Motion Diffuse
par: Liao, Zhouyingcheng, et autres
Publié: (2024)
par: Liao, Zhouyingcheng, et autres
Publié: (2024)
TAUE: Training-free Noise Transplant and Cultivation Diffusion Model
par: Nagai, Daichi, et autres
Publié: (2025)
par: Nagai, Daichi, et autres
Publié: (2025)
Hollowed Net for On-Device Personalization of Text-to-Image Diffusion Models
par: Cho, Wonguk, et autres
Publié: (2024)
par: Cho, Wonguk, et autres
Publié: (2024)
RealmDreamer: Text-Driven 3D Scene Generation with Inpainting and Depth Diffusion
par: Shriram, Jaidev, et autres
Publié: (2024)
par: Shriram, Jaidev, et autres
Publié: (2024)
InfiniteDiffusion: Bridging Learned Fidelity and Procedural Utility for Open-World Terrain Generation
par: Goslin, Alexander
Publié: (2025)
par: Goslin, Alexander
Publié: (2025)
Detection-Driven Object Count Optimization for Text-to-Image Diffusion Models
par: Zafar, Oz, et autres
Publié: (2024)
par: Zafar, Oz, et autres
Publié: (2024)
Add-it: Training-Free Object Insertion in Images With Pretrained Diffusion Models
par: Tewel, Yoad, et autres
Publié: (2024)
par: Tewel, Yoad, et autres
Publié: (2024)
Layout-Corrector: Alleviating Layout Sticking Phenomenon in Discrete Diffusion Model
par: Iwai, Shoma, et autres
Publié: (2024)
par: Iwai, Shoma, et autres
Publié: (2024)
MetricGold: Leveraging Text-To-Image Latent Diffusion Models for Metric Depth Estimation
par: Shah, Ansh, et autres
Publié: (2024)
par: Shah, Ansh, et autres
Publié: (2024)
Revisit Human-Scene Interaction via Space Occupancy
par: Liu, Xinpeng, et autres
Publié: (2023)
par: Liu, Xinpeng, et autres
Publié: (2023)
Zero-Shot Human-Object Interaction Synthesis with Multimodal Priors
par: Lou, Yuke, et autres
Publié: (2025)
par: Lou, Yuke, et autres
Publié: (2025)
ArtiFixer: Enhancing and Extending 3D Reconstruction with Auto-Regressive Diffusion Models
par: de Lutio, Riccardo, et autres
Publié: (2026)
par: de Lutio, Riccardo, et autres
Publié: (2026)
Learning Latent Representations for Image Translation using Frequency Distributed CycleGAN
par: Nigam, Shivangi, et autres
Publié: (2025)
par: Nigam, Shivangi, et autres
Publié: (2025)
Generative Object Insertion in Gaussian Splatting with a Multi-View Diffusion Model
par: Zhong, Hongliang, et autres
Publié: (2024)
par: Zhong, Hongliang, et autres
Publié: (2024)
EMDM: Efficient Motion Diffusion Model for Fast and High-Quality Motion Generation
par: Zhou, Wenyang, et autres
Publié: (2023)
par: Zhou, Wenyang, et autres
Publié: (2023)
Documents similaires
-
Sketch2Colab: Sketch-Conditioned Multi-Human Animation via Controllable Flow Distillation
par: Daiya, Divyanshu, et autres
Publié: (2026) -
Go-SLAM: Grounded Object Segmentation and Localization with Gaussian Splatting SLAM
par: Pham, Phu, et autres
Publié: (2024) -
HessianForge: Scalable LiDAR reconstruction with Physics-Informed Neural Representation and Smoothness Energy Constraints
par: Viswanath, Hrishikesh, et autres
Publié: (2025) -
LEAD: Latent Realignment for Human Motion Diffusion
par: Andreou, Nefeli, et autres
Publié: (2024) -
SALAD: Skeleton-aware Latent Diffusion for Text-driven Motion Generation and Editing
par: Hong, Seokhyeon, et autres
Publié: (2025)