ARIG: Autoregressive Interactive Head Generation for Real-time Conversations
Fuente:
arXiv
Salvato in:
| Autori principali: | Guo, Ying, Liu, Xi, Zhen, Cheng, Yan, Pengfei, Wei, Xiaoming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CustomListener: Text-guided Responsive Interaction for User-friendly Listening Head Generation
di: Liu, Xi, et al.
Pubblicazione: (2024)
di: Liu, Xi, et al.
Pubblicazione: (2024)
MIDAS: Multimodal Interactive Digital-humAn Synthesis via Real-time Autoregressive Video Generation
di: Chen, Ming, et al.
Pubblicazione: (2025)
di: Chen, Ming, et al.
Pubblicazione: (2025)
ECHO: Towards Emotionally Appropriate and Contextually Aware Interactive Head Generation
di: Kong, Xiangyu, et al.
Pubblicazione: (2026)
di: Kong, Xiangyu, et al.
Pubblicazione: (2026)
Efficient Autoregressive Video Diffusion with Dummy Head
di: Guo, Hang, et al.
Pubblicazione: (2026)
di: Guo, Hang, et al.
Pubblicazione: (2026)
U-Mind: A Unified Framework for Real-Time Multimodal Interaction with Audiovisual Generation
di: Deng, Xiang, et al.
Pubblicazione: (2026)
di: Deng, Xiang, et al.
Pubblicazione: (2026)
LLIA -- Enabling Low-Latency Interactive Avatars: Real-Time Audio-Driven Portrait Video Generation with Diffusion Models
di: Yu, Haojie, et al.
Pubblicazione: (2025)
di: Yu, Haojie, et al.
Pubblicazione: (2025)
Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation
di: Zhao, Min, et al.
Pubblicazione: (2026)
di: Zhao, Min, et al.
Pubblicazione: (2026)
HINT: Hierarchical Interaction Modeling for Autoregressive Multi-Human Motion Generation
di: Liu, Mengge, et al.
Pubblicazione: (2026)
di: Liu, Mengge, et al.
Pubblicazione: (2026)
Teller: Real-Time Streaming Audio-Driven Portrait Animation with Autoregressive Motion Generation
di: Zhen, Dingcheng, et al.
Pubblicazione: (2025)
di: Zhen, Dingcheng, et al.
Pubblicazione: (2025)
SoulX-FlashHead: Oracle-guided Generation of Infinite Real-time Streaming Talking Heads
di: Yu, Tan, et al.
Pubblicazione: (2026)
di: Yu, Tan, et al.
Pubblicazione: (2026)
Towards Seamless Interaction: Causal Turn-Level Modeling of Interactive 3D Conversational Head Dynamics
di: Chen, Junjie, et al.
Pubblicazione: (2025)
di: Chen, Junjie, et al.
Pubblicazione: (2025)
Rolling Forcing: Autoregressive Long Video Diffusion in Real Time
di: Liu, Kunhao, et al.
Pubblicazione: (2025)
di: Liu, Kunhao, et al.
Pubblicazione: (2025)
INFP: Audio-Driven Interactive Head Generation in Dyadic Conversations
di: Zhu, Yongming, et al.
Pubblicazione: (2024)
di: Zhu, Yongming, et al.
Pubblicazione: (2024)
SSD: Spatial-Semantic Head Decoupling for Efficient Autoregressive Image Generation
di: Jian, Siyong, et al.
Pubblicazione: (2025)
di: Jian, Siyong, et al.
Pubblicazione: (2025)
Head-Aware Key-Value Compression for Efficient Autoregressive Image Generation
di: Liang, Guotao, et al.
Pubblicazione: (2026)
di: Liang, Guotao, et al.
Pubblicazione: (2026)
Perceive, Understand and Restore: Real-World Image Super-Resolution with Autoregressive Multimodal Generative Models
di: Wei, Hongyang, et al.
Pubblicazione: (2025)
di: Wei, Hongyang, et al.
Pubblicazione: (2025)
Knot Forcing: Taming Autoregressive Video Diffusion Models for Real-time Infinite Interactive Portrait Animation
di: Xiao, Steven, et al.
Pubblicazione: (2025)
di: Xiao, Steven, et al.
Pubblicazione: (2025)
From Prediction to Perfection: Introducing Refinement to Autoregressive Image Generation
di: Cheng, Cheng, et al.
Pubblicazione: (2025)
di: Cheng, Cheng, et al.
Pubblicazione: (2025)
Head Forcing: Long Autoregressive Video Generation via Head Heterogeneity
di: Tian, Jiahao, et al.
Pubblicazione: (2026)
di: Tian, Jiahao, et al.
Pubblicazione: (2026)
DyStream: Streaming Dyadic Talking Heads Generation via Flow Matching-based Autoregressive Model
di: Chen, Bohong, et al.
Pubblicazione: (2025)
di: Chen, Bohong, et al.
Pubblicazione: (2025)
Autoregressive Image Generation with Masked Bit Modeling
di: Yu, Qihang, et al.
Pubblicazione: (2026)
di: Yu, Qihang, et al.
Pubblicazione: (2026)
EmbodiedHead: Real-Time Listening and Speaking Avatar for Conversational Agents
di: Zhang, Yu, et al.
Pubblicazione: (2026)
di: Zhang, Yu, et al.
Pubblicazione: (2026)
Head-Aware KV Cache Compression for Efficient Visual Autoregressive Modeling
di: Qin, Ziran, et al.
Pubblicazione: (2025)
di: Qin, Ziran, et al.
Pubblicazione: (2025)
UniMo: Unifying 2D Video and 3D Human Motion with an Autoregressive Framework
di: Pang, Youxin, et al.
Pubblicazione: (2025)
di: Pang, Youxin, et al.
Pubblicazione: (2025)
ANOLE: An Open, Autoregressive, Native Large Multimodal Models for Interleaved Image-Text Generation
di: Chern, Ethan, et al.
Pubblicazione: (2024)
di: Chern, Ethan, et al.
Pubblicazione: (2024)
FACE: A Face-based Autoregressive Representation for High-Fidelity and Efficient Mesh Generation
di: Wang, Hanxiao, et al.
Pubblicazione: (2026)
di: Wang, Hanxiao, et al.
Pubblicazione: (2026)
QuadGPT: Native Quadrilateral Mesh Generation with Autoregressive Models
di: Liu, Jian, et al.
Pubblicazione: (2025)
di: Liu, Jian, et al.
Pubblicazione: (2025)
CausalCine: Real-Time Autoregressive Generation for Multi-Shot Video Narratives
di: Meng, Yihao, et al.
Pubblicazione: (2026)
di: Meng, Yihao, et al.
Pubblicazione: (2026)
Sparse Forcing: Native Trainable Sparse Attention for Real-time Autoregressive Diffusion Video Generation
di: Xu, Boxun, et al.
Pubblicazione: (2026)
di: Xu, Boxun, et al.
Pubblicazione: (2026)
JoyStreamer-Flash: Real-time and Infinite Audio-Driven Avatar Generation with Autoregressive Diffusion
di: Li, Chaochao, et al.
Pubblicazione: (2025)
di: Li, Chaochao, et al.
Pubblicazione: (2025)
LongLive: Real-time Interactive Long Video Generation
di: Yang, Shuai, et al.
Pubblicazione: (2025)
di: Yang, Shuai, et al.
Pubblicazione: (2025)
RSATalker: Realistic Socially-Aware Talking Head Generation for Multi-Turn Conversation
di: Chen, Peng, et al.
Pubblicazione: (2026)
di: Chen, Peng, et al.
Pubblicazione: (2026)
Dense-Face: Personalized Face Generation Model via Dense Annotation Prediction
di: Guo, Xiao, et al.
Pubblicazione: (2024)
di: Guo, Xiao, et al.
Pubblicazione: (2024)
Avatar Forcing: Real-Time Interactive Head Avatar Generation for Natural Conversation
di: Ki, Taekyung, et al.
Pubblicazione: (2026)
di: Ki, Taekyung, et al.
Pubblicazione: (2026)
Parallelized Autoregressive Visual Generation
di: Wang, Yuqing, et al.
Pubblicazione: (2024)
di: Wang, Yuqing, et al.
Pubblicazione: (2024)
Livatar-1: Real-Time Talking Heads Generation with Tailored Flow Matching
di: Liu, Haiyang, et al.
Pubblicazione: (2025)
di: Liu, Haiyang, et al.
Pubblicazione: (2025)
CAR: Controllable Autoregressive Modeling for Visual Generation
di: Yao, Ziyu, et al.
Pubblicazione: (2024)
di: Yao, Ziyu, et al.
Pubblicazione: (2024)
AGORA: Adversarial Generation Of Real-time Animatable 3D Gaussian Head Avatars
di: Fazylov, Ramazan, et al.
Pubblicazione: (2025)
di: Fazylov, Ramazan, et al.
Pubblicazione: (2025)
Orthus: Autoregressive Interleaved Image-Text Generation with Modality-Specific Heads
di: Kou, Siqi, et al.
Pubblicazione: (2024)
di: Kou, Siqi, et al.
Pubblicazione: (2024)
RAVEN: Real-time Autoregressive Video Extrapolation with Consistency-model GRPO
di: Lu, Yanzuo, et al.
Pubblicazione: (2026)
di: Lu, Yanzuo, et al.
Pubblicazione: (2026)
Documenti analoghi
-
CustomListener: Text-guided Responsive Interaction for User-friendly Listening Head Generation
di: Liu, Xi, et al.
Pubblicazione: (2024) -
MIDAS: Multimodal Interactive Digital-humAn Synthesis via Real-time Autoregressive Video Generation
di: Chen, Ming, et al.
Pubblicazione: (2025) -
ECHO: Towards Emotionally Appropriate and Contextually Aware Interactive Head Generation
di: Kong, Xiangyu, et al.
Pubblicazione: (2026) -
Efficient Autoregressive Video Diffusion with Dummy Head
di: Guo, Hang, et al.
Pubblicazione: (2026) -
U-Mind: A Unified Framework for Real-Time Multimodal Interaction with Audiovisual Generation
di: Deng, Xiang, et al.
Pubblicazione: (2026)