Attention (as Discrete-Time Markov) Chains
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Erel, Yotam, Dünkel, Olaf, Dabral, Rishabh, Golyanik, Vladislav, Theobalt, Christian, Bermano, Amit H. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PractiLight: Practical Light Control Using Foundational Diffusion Models
par: Erel, Yotam, et autres
Publié: (2025)
par: Erel, Yotam, et autres
Publié: (2025)
Betsu-Betsu: Multi-View Separable 3D Reconstruction of Two Interacting Objects
par: Gopal, Suhas, et autres
Publié: (2025)
par: Gopal, Suhas, et autres
Publié: (2025)
ReMoS: 3D Motion-Conditioned Reaction Synthesis for Two-Person Interactions
par: Ghosh, Anindita, et autres
Publié: (2023)
par: Ghosh, Anindita, et autres
Publié: (2023)
ROAM: Robust and Object-Aware Motion Generation Using Neural Pose Descriptors
par: Zhang, Wanyue, et autres
Publié: (2023)
par: Zhang, Wanyue, et autres
Publié: (2023)
SceMoS: Scene-Aware 3D Human Motion Synthesis by Planning with Geometry-Grounded Tokens
par: Ghosh, Anindita, et autres
Publié: (2026)
par: Ghosh, Anindita, et autres
Publié: (2026)
Quantum Visual Fields with Neural Amplitude Encoding
par: Wang, Shuteng, et autres
Publié: (2025)
par: Wang, Shuteng, et autres
Publié: (2025)
BimArt: A Unified Approach for the Synthesis of 3D Bimanual Interaction with Articulated Objects
par: Zhang, Wanyue, et autres
Publié: (2024)
par: Zhang, Wanyue, et autres
Publié: (2024)
Relightable Holoported Characters: Capturing and Relighting Dynamic Human Performance from Sparse Views
par: Singh, Kunwar Maheep, et autres
Publié: (2025)
par: Singh, Kunwar Maheep, et autres
Publié: (2025)
Bring Your Rear Cameras for Egocentric 3D Human Pose Estimation
par: Akada, Hiroyasu, et autres
Publié: (2025)
par: Akada, Hiroyasu, et autres
Publié: (2025)
3D Human Pose Perception from Egocentric Stereo Videos
par: Akada, Hiroyasu, et autres
Publié: (2023)
par: Akada, Hiroyasu, et autres
Publié: (2023)
DuetGen: Music Driven Two-Person Dance Generation via Hierarchical Masked Modeling
par: Ghosh, Anindita, et autres
Publié: (2025)
par: Ghosh, Anindita, et autres
Publié: (2025)
Follow My Hold: Hand-Object Interaction Reconstruction through Geometric Guidance
par: Aytekin, Ayce Idil, et autres
Publié: (2025)
par: Aytekin, Ayce Idil, et autres
Publié: (2025)
MetaCap: Meta-learning Priors from Multi-View Imagery for Sparse-view Human Performance Capture and Rendering
par: Sun, Guoxing, et autres
Publié: (2024)
par: Sun, Guoxing, et autres
Publié: (2024)
Common3D: Self-Supervised Learning of 3D Morphable Models for Common Objects in Neural Feature Space
par: Sommer, Leonhard, et autres
Publié: (2025)
par: Sommer, Leonhard, et autres
Publié: (2025)
Dynamic EventNeRF: Reconstructing General Dynamic Scenes from Multi-view RGB and Event Streams
par: Rudnev, Viktor, et autres
Publié: (2024)
par: Rudnev, Viktor, et autres
Publié: (2024)
EventNeuS: 3D Mesh Reconstruction from a Single Event Camera
par: Sachan, Shreyas, et autres
Publié: (2026)
par: Sachan, Shreyas, et autres
Publié: (2026)
Relightable Neural Actor with Intrinsic Decomposition and Pose Control
par: Luvizon, Diogo, et autres
Publié: (2023)
par: Luvizon, Diogo, et autres
Publié: (2023)
E-3DPSM: A State Machine for Event-Based Egocentric 3D Human Pose Estimation
par: Deshmukh, Mayur, et autres
Publié: (2026)
par: Deshmukh, Mayur, et autres
Publié: (2026)
MIBURI: Towards Expressive Interactive Gesture Synthesis
par: Mughal, M. Hamza, et autres
Publié: (2026)
par: Mughal, M. Hamza, et autres
Publié: (2026)
VHOI: Controllable Video Generation of Human-Object Interactions from Sparse Trajectories via Motion Densification
par: Zhang, Wanyue, et autres
Publié: (2025)
par: Zhang, Wanyue, et autres
Publié: (2025)
GRMM: Real-Time High-Fidelity Gaussian Morphable Head Model with Learned Residuals
par: Mendiratta, Mohit, et autres
Publié: (2025)
par: Mendiratta, Mohit, et autres
Publié: (2025)
Do It Yourself: Learning Semantic Correspondence from Pseudo-Labels
par: Dünkel, Olaf, et autres
Publié: (2025)
par: Dünkel, Olaf, et autres
Publié: (2025)
Real-time Free-view Human Rendering from Sparse-view RGB Videos using Double Unprojected Textures
par: Sun, Guoxing, et autres
Publié: (2024)
par: Sun, Guoxing, et autres
Publié: (2024)
Masked Extended Attention for Zero-Shot Virtual Try-On In The Wild
par: Orzech, Nadav, et autres
Publié: (2024)
par: Orzech, Nadav, et autres
Publié: (2024)
EventEgo3D: 3D Human Motion Capture from Egocentric Event Streams
par: Millerdurai, Christen, et autres
Publié: (2024)
par: Millerdurai, Christen, et autres
Publié: (2024)
Holoported Characters: Real-time Free-viewpoint Rendering of Humans from Sparse RGB Cameras
par: Shetty, Ashwath, et autres
Publié: (2023)
par: Shetty, Ashwath, et autres
Publié: (2023)
ConvoFusion: Multi-Modal Conversational Diffusion for Co-Speech Gesture Synthesis
par: Mughal, Muhammad Hamza, et autres
Publié: (2024)
par: Mughal, Muhammad Hamza, et autres
Publié: (2024)
CoMoGen: COntrollable MOtion Dynamics and Interactions with Mask-Guided Video GENeration
par: Meric, Adil, et autres
Publié: (2026)
par: Meric, Adil, et autres
Publié: (2026)
Retrieving Semantics from the Deep: an RAG Solution for Gesture Synthesis
par: Mughal, M. Hamza, et autres
Publié: (2024)
par: Mughal, M. Hamza, et autres
Publié: (2024)
Thin-Shell-SfT: Fine-Grained Monocular Non-rigid 3D Surface Tracking with Neural Deformation Fields
par: Kairanda, Navami, et autres
Publié: (2025)
par: Kairanda, Navami, et autres
Publié: (2025)
CNS-Bench: Benchmarking Image Classifier Robustness Under Continuous Nuisance Shifts
par: Dünkel, Olaf, et autres
Publié: (2025)
par: Dünkel, Olaf, et autres
Publié: (2025)
Ego4o: Egocentric Human Motion Capture and Understanding from Multi-Modal Input
par: Wang, Jian, et autres
Publié: (2025)
par: Wang, Jian, et autres
Publié: (2025)
SOCO: Benchmarking Semantic Object Correspondence in Vision Foundation Models
par: Dünkel, Olaf, et autres
Publié: (2026)
par: Dünkel, Olaf, et autres
Publié: (2026)
Physics-based Human Pose Estimation from a Single Moving RGB Camera
par: Aytekin, Ayce Idil, et autres
Publié: (2025)
par: Aytekin, Ayce Idil, et autres
Publié: (2025)
FRAME: Floor-aligned Representation for Avatar Motion from Egocentric Video
par: Camiletto, Andrea Boscolo, et autres
Publié: (2025)
par: Camiletto, Andrea Boscolo, et autres
Publié: (2025)
PocoLoco: A Point Cloud Diffusion Model of Human Shape in Loose Clothing
par: Seth, Siddharth, et autres
Publié: (2024)
par: Seth, Siddharth, et autres
Publié: (2024)
Grasp in Gaussians: Fast Monocular Reconstruction of Dynamic Hand-Object Interactions
par: Aytekin, Ayce Idil, et autres
Publié: (2026)
par: Aytekin, Ayce Idil, et autres
Publié: (2026)
Splat the Net: Radiance Fields with Splattable Neural Primitives
par: Zhou, Xilong, et autres
Publié: (2025)
par: Zhou, Xilong, et autres
Publié: (2025)
EventEgo3D++: 3D Human Motion Capture from a Head-Mounted Event Camera
par: Millerdurai, Christen, et autres
Publié: (2025)
par: Millerdurai, Christen, et autres
Publié: (2025)
HumanOLAT: A Large-Scale Dataset for Full-Body Human Relighting and Novel-View Synthesis
par: Teufel, Timo, et autres
Publié: (2025)
par: Teufel, Timo, et autres
Publié: (2025)
Documents similaires
-
PractiLight: Practical Light Control Using Foundational Diffusion Models
par: Erel, Yotam, et autres
Publié: (2025) -
Betsu-Betsu: Multi-View Separable 3D Reconstruction of Two Interacting Objects
par: Gopal, Suhas, et autres
Publié: (2025) -
ReMoS: 3D Motion-Conditioned Reaction Synthesis for Two-Person Interactions
par: Ghosh, Anindita, et autres
Publié: (2023) -
ROAM: Robust and Object-Aware Motion Generation Using Neural Pose Descriptors
par: Zhang, Wanyue, et autres
Publié: (2023) -
SceMoS: Scene-Aware 3D Human Motion Synthesis by Planning with Geometry-Grounded Tokens
par: Ghosh, Anindita, et autres
Publié: (2026)