JoyStreamer: Unlocking Highly Expressive Avatars via Harmonized Text-Audio Conditioning
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Ruikui, Feng, Jinheng, Tian, Lang, Luo, Huaishao, Li, Chaochao, Zhou, Liangbo, Zhang, Huan, Wu, Youzheng, He, Xiaodong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
JoyStreamer-Flash: Real-time and Infinite Audio-Driven Avatar Generation with Autoregressive Diffusion
di: Li, Chaochao, et al.
Pubblicazione: (2025)
di: Li, Chaochao, et al.
Pubblicazione: (2025)
XHand: Real-time Expressive Hand Avatar
di: Gan, Qijun, et al.
Pubblicazione: (2024)
di: Gan, Qijun, et al.
Pubblicazione: (2024)
Expressive Range Characterization of Open Text-to-Audio Models
di: Morse, Jonathan, et al.
Pubblicazione: (2025)
di: Morse, Jonathan, et al.
Pubblicazione: (2025)
Text2Struct: A Machine Learning Pipeline for Mining Structured Data from Text
di: Zhou, Chaochao, et al.
Pubblicazione: (2022)
di: Zhou, Chaochao, et al.
Pubblicazione: (2022)
D-Rex : Diffusion Rendering for Relightable Expressive Avatars
di: Teufel, Timo, et al.
Pubblicazione: (2026)
di: Teufel, Timo, et al.
Pubblicazione: (2026)
HeadEvolver: Text to Head Avatars via Expressive and Attribute-Preserving Mesh Deformation
di: Wang, Duotun, et al.
Pubblicazione: (2024)
di: Wang, Duotun, et al.
Pubblicazione: (2024)
JoyVoice: Long-Context Conditioning for Anthropomorphic Multi-Speaker Conversational Synthesis
di: Yu, Fan, et al.
Pubblicazione: (2025)
di: Yu, Fan, et al.
Pubblicazione: (2025)
Computational Model for Photoionization in Pure SF6 Streamer at 1-15 atm
di: Feng, Zihao, et al.
Pubblicazione: (2025)
di: Feng, Zihao, et al.
Pubblicazione: (2025)
RenderBox: Expressive Performance Rendering with Text Control
di: Zhang, Huan, et al.
Pubblicazione: (2025)
di: Zhang, Huan, et al.
Pubblicazione: (2025)
StableAvatar: Infinite-Length Audio-Driven Avatar Video Generation
di: Tu, Shuyuan, et al.
Pubblicazione: (2025)
di: Tu, Shuyuan, et al.
Pubblicazione: (2025)
ConditionVideo: Training-Free Condition-Guided Text-to-Video Generation
di: Peng, Bo, et al.
Pubblicazione: (2023)
di: Peng, Bo, et al.
Pubblicazione: (2023)
UME: Upcycling Mixture-of-Experts for Scalable and Efficient Automatic Speech Recognition
di: Fu, Li, et al.
Pubblicazione: (2024)
di: Fu, Li, et al.
Pubblicazione: (2024)
PAC: Pronunciation-Aware Contextualized Large Language Model-based Automatic Speech Recognition
di: Fu, Li, et al.
Pubblicazione: (2025)
di: Fu, Li, et al.
Pubblicazione: (2025)
VinTAGe: Joint Video and Text Conditioning for Holistic Audio Generation
di: Kushwaha, Saksham Singh, et al.
Pubblicazione: (2024)
di: Kushwaha, Saksham Singh, et al.
Pubblicazione: (2024)
Spatial Fluctuation of the Electric Field within SF6 Streamer Channel in Highly Non-Uniform Fields: Phenomenon, Validation, and Mechanism
di: Feng, Zihao, et al.
Pubblicazione: (2024)
di: Feng, Zihao, et al.
Pubblicazione: (2024)
SentiAvatar: Towards Expressive and Interactive Digital Humans
di: Jin, Chuhao, et al.
Pubblicazione: (2026)
di: Jin, Chuhao, et al.
Pubblicazione: (2026)
Expressive Whole-Body 3D Gaussian Avatar
di: Moon, Gyeongsik, et al.
Pubblicazione: (2024)
di: Moon, Gyeongsik, et al.
Pubblicazione: (2024)
HunyuanVideo-Avatar: High-Fidelity Audio-Driven Human Animation for Multiple Characters
di: Chen, Yi, et al.
Pubblicazione: (2025)
di: Chen, Yi, et al.
Pubblicazione: (2025)
EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions
di: Tian, Linrui, et al.
Pubblicazione: (2024)
di: Tian, Linrui, et al.
Pubblicazione: (2024)
Expressive Gaussian Human Avatars from Monocular RGB Video
di: Hu, Hezhen, et al.
Pubblicazione: (2024)
di: Hu, Hezhen, et al.
Pubblicazione: (2024)
$E^{3}$Gen: Efficient, Expressive and Editable Avatars Generation
di: Zhang, Weitian, et al.
Pubblicazione: (2024)
di: Zhang, Weitian, et al.
Pubblicazione: (2024)
EVA: Expressive Virtual Avatars from Multi-view Videos
di: Junkawitsch, Hendrik, et al.
Pubblicazione: (2025)
di: Junkawitsch, Hendrik, et al.
Pubblicazione: (2025)
TopoStreamer: Temporal Lane Segment Topology Reasoning in Autonomous Driving
di: Yang, Yiming, et al.
Pubblicazione: (2025)
di: Yang, Yiming, et al.
Pubblicazione: (2025)
InstructAvatar: Text-Guided Emotion and Motion Control for Avatar Generation
di: Wang, Yuchi, et al.
Pubblicazione: (2024)
di: Wang, Yuchi, et al.
Pubblicazione: (2024)
On Expressivity of Height in Neural Networks
di: Fan, Feng-Lei, et al.
Pubblicazione: (2023)
di: Fan, Feng-Lei, et al.
Pubblicazione: (2023)
Wear Simulations of Involute Harmonic Gear Under Mixed Lubrication Condition
di: Yi Shen, et al.
Pubblicazione: (2024)
di: Yi Shen, et al.
Pubblicazione: (2024)
The Reservoir of the Per-emb-2 Streamer
di: Taniguchi, Kotomi, et al.
Pubblicazione: (2024)
di: Taniguchi, Kotomi, et al.
Pubblicazione: (2024)
Multimodal Integration Challenges in Emotionally Expressive Child Avatars for Training Applications
di: Salehi, Pegah, et al.
Pubblicazione: (2025)
di: Salehi, Pegah, et al.
Pubblicazione: (2025)
Structure-Aware Fine-Grained Gaussian Splatting for Expressive Avatar Reconstruction
di: Su, Yuze, et al.
Pubblicazione: (2026)
di: Su, Yuze, et al.
Pubblicazione: (2026)
Understanding and Supporting Co-viewing Comedy in VR with Embodied Expressive Avatars
di: Ohara, Ryo, et al.
Pubblicazione: (2025)
di: Ohara, Ryo, et al.
Pubblicazione: (2025)
4DSegStreamer: Streaming 4D Panoptic Segmentation via Dual Threads
di: Liu, Ling, et al.
Pubblicazione: (2025)
di: Liu, Ling, et al.
Pubblicazione: (2025)
ExGes: Expressive Human Motion Retrieval and Modulation for Audio-Driven Gesture Synthesis
di: Zhou, Xukun, et al.
Pubblicazione: (2025)
di: Zhou, Xukun, et al.
Pubblicazione: (2025)
High-Fidelity Mobile Avatars with Pruned Local Blendshapes
di: Zhan, Youyi, et al.
Pubblicazione: (2026)
di: Zhan, Youyi, et al.
Pubblicazione: (2026)
Read for Joy!
di: Quigg, Claudia
Pubblicazione: (1993)
di: Quigg, Claudia
Pubblicazione: (1993)
The Joys and Woes
di: Duker, Sam
Pubblicazione: (1970)
di: Duker, Sam
Pubblicazione: (1970)
The Joy of Contracts.
di: Hegarty, Kevin
Pubblicazione: (1979)
di: Hegarty, Kevin
Pubblicazione: (1979)
StoryTTS: A Highly Expressive Text-to-Speech Dataset with Rich Textual Expressiveness Annotations
di: Liu, Sen, et al.
Pubblicazione: (2024)
di: Liu, Sen, et al.
Pubblicazione: (2024)
SceneStreamer: Continuous Scenario Generation as Next Token Group Prediction
di: Peng, Zhenghao, et al.
Pubblicazione: (2025)
di: Peng, Zhenghao, et al.
Pubblicazione: (2025)
EMO2: End-Effector Guided Audio-Driven Avatar Video Generation
di: Tian, Linrui, et al.
Pubblicazione: (2025)
di: Tian, Linrui, et al.
Pubblicazione: (2025)
Pedagogies of Joy;) A Leap to Joy‐Centered Critical Design
di: Déana Scipio, et al.
Pubblicazione: (2025)
di: Déana Scipio, et al.
Pubblicazione: (2025)
Documenti analoghi
-
JoyStreamer-Flash: Real-time and Infinite Audio-Driven Avatar Generation with Autoregressive Diffusion
di: Li, Chaochao, et al.
Pubblicazione: (2025) -
XHand: Real-time Expressive Hand Avatar
di: Gan, Qijun, et al.
Pubblicazione: (2024) -
Expressive Range Characterization of Open Text-to-Audio Models
di: Morse, Jonathan, et al.
Pubblicazione: (2025) -
Text2Struct: A Machine Learning Pipeline for Mining Structured Data from Text
di: Zhou, Chaochao, et al.
Pubblicazione: (2022) -
D-Rex : Diffusion Rendering for Relightable Expressive Avatars
di: Teufel, Timo, et al.
Pubblicazione: (2026)