FORESCENE: FOREcasting human activity via latent SCENE graphs diffusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Alliegro, Antonio, Pistilli, Francesca, Tommasi, Tatiana, Averta, Giuseppe |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Hier-EgoPack: Hierarchical Egocentric Video Understanding with Diverse Task Perspectives
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2025)
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2025)
Learning reusable concepts across different egocentric video understanding tasks
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2025)
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2025)
A Backpack Full of Skills: Egocentric Video Understanding with Diverse Task Perspectives
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2024)
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2024)
HiERO: understanding the hierarchy of human behavior enhances reasoning on egocentric videos
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2025)
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2025)
HiERO-StepG @ Ego4D Step Grounding Challenge: hierarchical activity understanding enables zero-shot step grounding
di: Zenotto, Andrea, et al.
Pubblicazione: (2026)
di: Zenotto, Andrea, et al.
Pubblicazione: (2026)
PEM: Prototype-based Efficient MaskFormer for Image Segmentation
di: Cavagnero, Niccolò, et al.
Pubblicazione: (2024)
di: Cavagnero, Niccolò, et al.
Pubblicazione: (2024)
Transient Fault Tolerant Semantic Segmentation for Autonomous Driving
di: Iurada, Leonardo, et al.
Pubblicazione: (2024)
di: Iurada, Leonardo, et al.
Pubblicazione: (2024)
A Modern Take on Visual Relationship Reasoning for Grasp Planning
di: Rabino, Paolo, et al.
Pubblicazione: (2024)
di: Rabino, Paolo, et al.
Pubblicazione: (2024)
Cross-Domain Transfer Learning with CoRTe: Consistent and Reliable Transfer from Black-Box to Lightweight Segmentation Model
di: Cuttano, Claudia, et al.
Pubblicazione: (2024)
di: Cuttano, Claudia, et al.
Pubblicazione: (2024)
SANSA: Unleashing the Hidden Semantics in SAM2 for Few-Shot Segmentation
di: Cuttano, Claudia, et al.
Pubblicazione: (2025)
di: Cuttano, Claudia, et al.
Pubblicazione: (2025)
AMEGO: Active Memory from long EGOcentric videos
di: Goletto, Gabriele, et al.
Pubblicazione: (2024)
di: Goletto, Gabriele, et al.
Pubblicazione: (2024)
What does CLIP know about peeling a banana?
di: Cuttano, Claudia, et al.
Pubblicazione: (2024)
di: Cuttano, Claudia, et al.
Pubblicazione: (2024)
Efficient Odd-One-Out Anomaly Detection
di: Chito, Silvio, et al.
Pubblicazione: (2025)
di: Chito, Silvio, et al.
Pubblicazione: (2025)
Finding Lottery Tickets in Vision Models via Data-driven Spectral Foresight Pruning
di: Iurada, Leonardo, et al.
Pubblicazione: (2024)
di: Iurada, Leonardo, et al.
Pubblicazione: (2024)
MaskPlanner: Learning-Based Object-Centric Motion Generation from 3D Point Clouds
di: Tiboni, Gabriele, et al.
Pubblicazione: (2025)
di: Tiboni, Gabriele, et al.
Pubblicazione: (2025)
SAMWISE: Infusing Wisdom in SAM2 for Text-Driven Video Segmentation
di: Cuttano, Claudia, et al.
Pubblicazione: (2024)
di: Cuttano, Claudia, et al.
Pubblicazione: (2024)
The revenge of BiSeNet: Efficient Multi-Task Image Segmentation
di: Rosi, Gabriele, et al.
Pubblicazione: (2024)
di: Rosi, Gabriele, et al.
Pubblicazione: (2024)
A Second-Order Perspective on Pruning at Initialization and Knowledge Transfer
di: Iurada, Leonardo, et al.
Pubblicazione: (2025)
di: Iurada, Leonardo, et al.
Pubblicazione: (2025)
Addressing degeneracies in latent interpolation for diffusion models
di: Landolsi, Erik, et al.
Pubblicazione: (2025)
di: Landolsi, Erik, et al.
Pubblicazione: (2025)
Domain Generalization using Action Sequences for Egocentric Action Recognition
di: Nasirimajd, Amirshayan, et al.
Pubblicazione: (2025)
di: Nasirimajd, Amirshayan, et al.
Pubblicazione: (2025)
Egocentric zone-aware action recognition across environments
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2024)
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2024)
Fixed External Cameras as Common Prior Maps for Active 3D Scene Graph Generation
di: Modi, Giorgia, et al.
Pubblicazione: (2026)
di: Modi, Giorgia, et al.
Pubblicazione: (2026)
RGB-only Active 3D Scene Graph Generation for Indoor Mobile Robots
di: Modi, Giorgia, et al.
Pubblicazione: (2026)
di: Modi, Giorgia, et al.
Pubblicazione: (2026)
Efficient Model Editing with Task-Localized Sparse Fine-tuning
di: Iurada, Leonardo, et al.
Pubblicazione: (2025)
di: Iurada, Leonardo, et al.
Pubblicazione: (2025)
Stroke3D: Lifting 2D strokes into rigged 3D model via latent diffusion models
di: Zhao, Ruisi, et al.
Pubblicazione: (2026)
di: Zhao, Ruisi, et al.
Pubblicazione: (2026)
About latent roles in forecasting players in team sports
di: Scofano, Luca, et al.
Pubblicazione: (2023)
di: Scofano, Luca, et al.
Pubblicazione: (2023)
MultiGraspNet: A Multitask 3D Vision Model for Multi-gripper Robotic Grasping
di: Ortuno-Chanelo, Stephany, et al.
Pubblicazione: (2026)
di: Ortuno-Chanelo, Stephany, et al.
Pubblicazione: (2026)
Your ViT is Secretly an Image Segmentation Model
di: Kerssies, Tommie, et al.
Pubblicazione: (2025)
di: Kerssies, Tommie, et al.
Pubblicazione: (2025)
DEMIST: Decoupled Multi-stream latent diffusion for Quantitative Myelin Map Synthesis
di: Wang, Jiacheng, et al.
Pubblicazione: (2025)
di: Wang, Jiacheng, et al.
Pubblicazione: (2025)
SCENE: Semantic-aware Codec Enhancement with Neural Embeddings
di: Lin, Han-Yu, et al.
Pubblicazione: (2026)
di: Lin, Han-Yu, et al.
Pubblicazione: (2026)
DerMAE: Improving skin lesion classification through conditioned latent diffusion and MAE distillation
di: Filho, Francisco, et al.
Pubblicazione: (2026)
di: Filho, Francisco, et al.
Pubblicazione: (2026)
Bias mitigation in graph diffusion models
di: Yu, Meng, et al.
Pubblicazione: (2026)
di: Yu, Meng, et al.
Pubblicazione: (2026)
Generating floorplans for various building functionalities via latent diffusion model
di: Ibrahim, Mohamed R., et al.
Pubblicazione: (2024)
di: Ibrahim, Mohamed R., et al.
Pubblicazione: (2024)
3D latent diffusion models for parameterizing and history matching multiscenario facies systems
di: Di Federico, Guido, et al.
Pubblicazione: (2025)
di: Di Federico, Guido, et al.
Pubblicazione: (2025)
High-resolution efficient image generation from WiFi CSI using a pretrained latent diffusion model
di: Ramesh, Eshan, et al.
Pubblicazione: (2025)
di: Ramesh, Eshan, et al.
Pubblicazione: (2025)
Multimodal generative semantic communication based on latent diffusion model
di: Fu, Weiqi, et al.
Pubblicazione: (2024)
di: Fu, Weiqi, et al.
Pubblicazione: (2024)
An Outlook into the Future of Egocentric Vision
di: Plizzari, Chiara, et al.
Pubblicazione: (2023)
di: Plizzari, Chiara, et al.
Pubblicazione: (2023)
Flexible graph convolutional network for 3D human pose estimation
di: Shahjahan, Abu Taib Mohammed, et al.
Pubblicazione: (2024)
di: Shahjahan, Abu Taib Mohammed, et al.
Pubblicazione: (2024)
Exploring the latent space of diffusion models directly through singular value decomposition
di: Wang, Li, et al.
Pubblicazione: (2025)
di: Wang, Li, et al.
Pubblicazione: (2025)
Conditional diffusion model with spatial attention and latent embedding for medical image segmentation
di: Hejrati, Behzad, et al.
Pubblicazione: (2025)
di: Hejrati, Behzad, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Hier-EgoPack: Hierarchical Egocentric Video Understanding with Diverse Task Perspectives
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2025) -
Learning reusable concepts across different egocentric video understanding tasks
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2025) -
A Backpack Full of Skills: Egocentric Video Understanding with Diverse Task Perspectives
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2024) -
HiERO: understanding the hierarchy of human behavior enhances reasoning on egocentric videos
di: Peirone, Simone Alberto, et al.
Pubblicazione: (2025) -
HiERO-StepG @ Ego4D Step Grounding Challenge: hierarchical activity understanding enables zero-shot step grounding
di: Zenotto, Andrea, et al.
Pubblicazione: (2026)