ReactDiff: Fundamental Multiple Appropriate Facial Reaction Diffusion Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Cheng, Luo, Siyang, Song, Siyuan, Yan, Zhen, Yu, Zongyuan, Ge |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ReactFace: Online Multiple Appropriate Facial Reaction Generation in Dyadic Interactions
por: Luo, Cheng, et al.
Publicado: (2023)
por: Luo, Cheng, et al.
Publicado: (2023)
ReactDiff: Latent Diffusion for Facial Reaction Generation
por: Li, Jiaming, et al.
Publicado: (2025)
por: Li, Jiaming, et al.
Publicado: (2025)
ReactMotion: Generating Reactive Listener Motions from Speaker Utterance
por: Luo, Cheng, et al.
Publicado: (2026)
por: Luo, Cheng, et al.
Publicado: (2026)
SVFAP: Self-supervised Video Facial Affect Perceiver
por: Sun, Licai, et al.
Publicado: (2023)
por: Sun, Licai, et al.
Publicado: (2023)
DiffMesh: A Motion-aware Diffusion Framework for Human Mesh Recovery from Videos
por: Zheng, Ce, et al.
Publicado: (2023)
por: Zheng, Ce, et al.
Publicado: (2023)
Co-Speech Gesture Video Generation via Motion-Decoupled Diffusion Model
por: He, Xu, et al.
Publicado: (2024)
por: He, Xu, et al.
Publicado: (2024)
AttentionBender: Manipulating Cross-Attention in Video Diffusion Transformers as a Creative Probe
por: Cole, Adam, et al.
Publicado: (2026)
por: Cole, Adam, et al.
Publicado: (2026)
SentiAvatar: Towards Expressive and Interactive Digital Humans
por: Jin, Chuhao, et al.
Publicado: (2026)
por: Jin, Chuhao, et al.
Publicado: (2026)
MindCross: Fast New Subject Adaptation with Limited Data for Cross-subject Video Reconstruction from Brain Signals
por: Liu, Xuan-Hao, et al.
Publicado: (2025)
por: Liu, Xuan-Hao, et al.
Publicado: (2025)
Plug-and-Play Clarifier: A Zero-Shot Multimodal Framework for Egocentric Intent Disambiguation
por: Yang, Sicheng, et al.
Publicado: (2025)
por: Yang, Sicheng, et al.
Publicado: (2025)
EyeNavGS: A 6-DoF Navigation Dataset and Record-n-Replay Software for Real-World 3DGS Scenes in VR
por: Ding, Zihao, et al.
Publicado: (2025)
por: Ding, Zihao, et al.
Publicado: (2025)
MindCine: Multimodal EEG-to-Video Reconstruction with Large-Scale Pretrained Models
por: Zhou, Tian-Yi, et al.
Publicado: (2026)
por: Zhou, Tian-Yi, et al.
Publicado: (2026)
G3R: Generating Rich and Fine-grained mmWave Radar Data from 2D Videos for Generalized Gesture Recognition
por: Deng, Kaikai, et al.
Publicado: (2024)
por: Deng, Kaikai, et al.
Publicado: (2024)
Videogenic: Identifying Highlight Moments in Videos with Professional Photographs as a Prior
por: Lin, David Chuan-En, et al.
Publicado: (2022)
por: Lin, David Chuan-En, et al.
Publicado: (2022)
Across-Game Engagement Modelling via Few-Shot Learning
por: Pinitas, Kosmas, et al.
Publicado: (2024)
por: Pinitas, Kosmas, et al.
Publicado: (2024)
Seeing, Hearing, and Knowing Together: Multimodal Strategies in Deepfake Videos Detection
por: Chen, Chen, et al.
Publicado: (2026)
por: Chen, Chen, et al.
Publicado: (2026)
VideoMap: Supporting Video Editing Exploration, Brainstorming, and Prototyping in the Latent Space
por: Lin, David Chuan-En, et al.
Publicado: (2022)
por: Lin, David Chuan-En, et al.
Publicado: (2022)
Editing Physiological Signals in Videos Using Latent Representations
por: Zhou, Tianwen, et al.
Publicado: (2025)
por: Zhou, Tianwen, et al.
Publicado: (2025)
Emotion Based Prediction in the Context of Optimized Trajectory Planning for Immersive Learning
por: Sungheetha, Akey, et al.
Publicado: (2023)
por: Sungheetha, Akey, et al.
Publicado: (2023)
MS2Mesh-XR: Multi-modal Sketch-to-Mesh Generation in XR Environments
por: Tong, Yuqi, et al.
Publicado: (2024)
por: Tong, Yuqi, et al.
Publicado: (2024)
BATON: A Multimodal Benchmark for Bidirectional Automation Transition Observation in Naturalistic Driving
por: Wang, Yuhang, et al.
Publicado: (2026)
por: Wang, Yuhang, et al.
Publicado: (2026)
Generative Timelines for Instructed Visual Assembly
por: Pardo, Alejandro, et al.
Publicado: (2024)
por: Pardo, Alejandro, et al.
Publicado: (2024)
Panonut360: A Head and Eye Tracking Dataset for Panoramic Video
por: Xu, Yutong, et al.
Publicado: (2024)
por: Xu, Yutong, et al.
Publicado: (2024)
Shu Dao: A Calligraphy Score Framework Linking Calligraphy, Music, and Performance
por: Huang, Lican
Publicado: (2026)
por: Huang, Lican
Publicado: (2026)
"I Can See Forever!": Evaluating Real-time VideoLLMs for Assisting Individuals with Visual Impairments
por: Zhang, Ziyi, et al.
Publicado: (2025)
por: Zhang, Ziyi, et al.
Publicado: (2025)
WebXR, A-Frame and Networked-Aframe as a Basis for an Open Metaverse: A Conceptual Architecture
por: Macario, Giuseppe
Publicado: (2024)
por: Macario, Giuseppe
Publicado: (2024)
Color When It Counts: Grayscale-Guided Online Triggering for Always-On Streaming Video Sensing
por: Cai, Weitong, et al.
Publicado: (2026)
por: Cai, Weitong, et al.
Publicado: (2026)
Learning High-Quality Navigation and Zooming on Omnidirectional Images in Virtual Reality
por: Cao, Zidong, et al.
Publicado: (2024)
por: Cao, Zidong, et al.
Publicado: (2024)
Inkspire: Supporting Design Exploration with Generative AI through Analogical Sketching
por: Lin, David Chuan-En, et al.
Publicado: (2025)
por: Lin, David Chuan-En, et al.
Publicado: (2025)
FastPerson: Enhancing Video Learning through Effective Video Summarization that Preserves Linguistic and Visual Contexts
por: Kawamura, Kazuki, et al.
Publicado: (2024)
por: Kawamura, Kazuki, et al.
Publicado: (2024)
Text2VR: Automated instruction Generation in Virtual Reality using Large language Models for Assembly Task
por: Peter, Subin Raj
Publicado: (2025)
por: Peter, Subin Raj
Publicado: (2025)
Secure & Personalized Music-to-Video Generation via CHARCHA
por: Agarwal, Mehul, et al.
Publicado: (2025)
por: Agarwal, Mehul, et al.
Publicado: (2025)
An Open, Cross-Platform, Web-Based Metaverse Using WebXR and A-Frame
por: Macario, Giuseppe
Publicado: (2024)
por: Macario, Giuseppe
Publicado: (2024)
SkinGEN: an Explainable Dermatology Diagnosis-to-Generation Framework with Interactive Vision-Language Models
por: Lin, Bo, et al.
Publicado: (2024)
por: Lin, Bo, et al.
Publicado: (2024)
LLaVA-Scissor: Token Compression with Semantic Connected Components for Video LLMs
por: Sun, Boyuan, et al.
Publicado: (2025)
por: Sun, Boyuan, et al.
Publicado: (2025)
SMPLest-X: Ultimate Scaling for Expressive Human Pose and Shape Estimation
por: Yin, Wanqi, et al.
Publicado: (2025)
por: Yin, Wanqi, et al.
Publicado: (2025)
On Semiotic-Grounded Interpretive Evaluation of Generative Art
por: Jiang, Ruixiang, et al.
Publicado: (2026)
por: Jiang, Ruixiang, et al.
Publicado: (2026)
How Good is ChatGPT at Audiovisual Deepfake Detection: A Comparative Study of ChatGPT, AI Models and Human Perception
por: Shahzad, Sahibzada Adil, et al.
Publicado: (2024)
por: Shahzad, Sahibzada Adil, et al.
Publicado: (2024)
Multimodal Infusion Tuning for Large Models
por: Sun, Hao, et al.
Publicado: (2024)
por: Sun, Hao, et al.
Publicado: (2024)
Save It for the "Hot" Day: An LLM-Empowered Visual Analytics System for Heat Risk Management
por: Li, Haobo, et al.
Publicado: (2024)
por: Li, Haobo, et al.
Publicado: (2024)
Ejemplares similares
-
ReactFace: Online Multiple Appropriate Facial Reaction Generation in Dyadic Interactions
por: Luo, Cheng, et al.
Publicado: (2023) -
ReactDiff: Latent Diffusion for Facial Reaction Generation
por: Li, Jiaming, et al.
Publicado: (2025) -
ReactMotion: Generating Reactive Listener Motions from Speaker Utterance
por: Luo, Cheng, et al.
Publicado: (2026) -
SVFAP: Self-supervised Video Facial Affect Perceiver
por: Sun, Licai, et al.
Publicado: (2023) -
DiffMesh: A Motion-aware Diffusion Framework for Human Mesh Recovery from Videos
por: Zheng, Ce, et al.
Publicado: (2023)