Graph Transformer GANs with Graph Masked Modeling for Architectural Layout Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Tang, Hao, Shao, Ling, Sebe, Nicu, Van Gool, Luc |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Spatial-Temporal Graph Mamba for Music-Guided Dance Video Synthesis
di: Tang, Hao, et al.
Pubblicazione: (2025)
di: Tang, Hao, et al.
Pubblicazione: (2025)
Enhanced Multi-Scale Cross-Attention for Person Image Generation
di: Tang, Hao, et al.
Pubblicazione: (2025)
di: Tang, Hao, et al.
Pubblicazione: (2025)
Asymmetric GANs for Image-to-Image Translation
di: Tang, Hao, et al.
Pubblicazione: (2019)
di: Tang, Hao, et al.
Pubblicazione: (2019)
Key-Graph Transformer for Image Restoration
di: Ren, Bin, et al.
Pubblicazione: (2024)
di: Ren, Bin, et al.
Pubblicazione: (2024)
Bringing Masked Autoencoders Explicit Contrastive Properties for Point Cloud Self-Supervised Learning
di: Ren, Bin, et al.
Pubblicazione: (2024)
di: Ren, Bin, et al.
Pubblicazione: (2024)
GraphMLP: A Graph MLP-Like Architecture for 3D Human Pose Estimation
di: Li, Wenhao, et al.
Pubblicazione: (2022)
di: Li, Wenhao, et al.
Pubblicazione: (2022)
Sharing Key Semantics in Transformer Makes Efficient Image Restoration
di: Ren, Bin, et al.
Pubblicazione: (2024)
di: Ren, Bin, et al.
Pubblicazione: (2024)
Towards Online Real-Time Memory-based Video Inpainting Transformers
di: Thiry, Guillaume, et al.
Pubblicazione: (2024)
di: Thiry, Guillaume, et al.
Pubblicazione: (2024)
CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation
di: Ma, Qi, et al.
Pubblicazione: (2025)
di: Ma, Qi, et al.
Pubblicazione: (2025)
Hierarchical Cross-Attention Network for Virtual Try-On
di: Tang, Hao, et al.
Pubblicazione: (2024)
di: Tang, Hao, et al.
Pubblicazione: (2024)
Retrieval Augmented Generation and Understanding in Vision: A Survey and New Outlook
di: Zheng, Xu, et al.
Pubblicazione: (2025)
di: Zheng, Xu, et al.
Pubblicazione: (2025)
ShapeSplat: A Large-scale Dataset of Gaussian Splats and Their Self-Supervised Pretraining
di: Ma, Qi, et al.
Pubblicazione: (2024)
di: Ma, Qi, et al.
Pubblicazione: (2024)
EarthMind: Leveraging Cross-Sensor Data for Advanced Earth Observation Interpretation with a Unified Multimodal LLM
di: Shu, Yan, et al.
Pubblicazione: (2025)
di: Shu, Yan, et al.
Pubblicazione: (2025)
MatIR: A Hybrid Mamba-Transformer Image Restoration Model
di: Wen, Juan, et al.
Pubblicazione: (2025)
di: Wen, Juan, et al.
Pubblicazione: (2025)
Efficient Degradation-agnostic Image Restoration via Channel-Wise Functional Decomposition and Manifold Regularization
di: Ren, Bin, et al.
Pubblicazione: (2025)
di: Ren, Bin, et al.
Pubblicazione: (2025)
Training and Tuning Generative Neural Radiance Fields for Attribute-Conditional 3D-Aware Face Generation
di: Zhang, Jichao, et al.
Pubblicazione: (2022)
di: Zhang, Jichao, et al.
Pubblicazione: (2022)
HandDiff: 3D Hand Pose Estimation with Diffusion on Image-Point Cloud
di: Cheng, Wencan, et al.
Pubblicazione: (2024)
di: Cheng, Wencan, et al.
Pubblicazione: (2024)
CLIP is Strong Enough to Fight Back: Test-time Counterattacks towards Zero-shot Adversarial Robustness of CLIP
di: Xing, Songlong, et al.
Pubblicazione: (2025)
di: Xing, Songlong, et al.
Pubblicazione: (2025)
POCI-Diff: Position Objects Consistently and Interactively with 3D-Layout Guided Diffusion
di: Rigo, Andrea, et al.
Pubblicazione: (2026)
di: Rigo, Andrea, et al.
Pubblicazione: (2026)
TrafficBots V1.5: Traffic Simulation via Conditional VAEs and Transformers with Relative Pose Encoding
di: Zhang, Zhejun, et al.
Pubblicazione: (2024)
di: Zhang, Zhejun, et al.
Pubblicazione: (2024)
A Unified Masked Jigsaw Puzzle Framework for Vision and Language Models
di: Ye, Weixin, et al.
Pubblicazione: (2026)
di: Ye, Weixin, et al.
Pubblicazione: (2026)
Walker: Self-supervised Multiple Object Tracking by Walking on Temporal Appearance Graphs
di: Segu, Mattia, et al.
Pubblicazione: (2024)
di: Segu, Mattia, et al.
Pubblicazione: (2024)
Masked Image Modeling: A Survey
di: Hondru, Vlad, et al.
Pubblicazione: (2024)
di: Hondru, Vlad, et al.
Pubblicazione: (2024)
Masked Clustering Prediction for Unsupervised Point Cloud Pre-training
di: Ren, Bin, et al.
Pubblicazione: (2025)
di: Ren, Bin, et al.
Pubblicazione: (2025)
Any Image Restoration via Efficient Spatial-Frequency Degradation Adaptation
di: Ren, Bin, et al.
Pubblicazione: (2025)
di: Ren, Bin, et al.
Pubblicazione: (2025)
Token Reduction via Local and Global Contexts Optimization for Efficient Video Large Language Models
di: Li, Jinlong, et al.
Pubblicazione: (2026)
di: Li, Jinlong, et al.
Pubblicazione: (2026)
DSGC-Net: A Dual-Stream Graph Convolutional Network for Crowd Counting via Feature Correlation Mining
di: Wu, Yihong, et al.
Pubblicazione: (2025)
di: Wu, Yihong, et al.
Pubblicazione: (2025)
Reverse Personalization
di: Kung, Han-Wei, et al.
Pubblicazione: (2025)
di: Kung, Han-Wei, et al.
Pubblicazione: (2025)
RAGME: Retrieval Augmented Video Generation for Enhanced Motion Realism
di: Peruzzo, Elia, et al.
Pubblicazione: (2025)
di: Peruzzo, Elia, et al.
Pubblicazione: (2025)
Chorus: Multi-Teacher Pretraining for Holistic 3D Gaussian Scene Encoding
di: Li, Yue, et al.
Pubblicazione: (2025)
di: Li, Yue, et al.
Pubblicazione: (2025)
CreatiLayout: Siamese Multimodal Diffusion Transformer for Creative Layout-to-Image Generation
di: Zhang, Hui, et al.
Pubblicazione: (2024)
di: Zhang, Hui, et al.
Pubblicazione: (2024)
Generalized Fine-Grained Category Discovery with Multi-Granularity Conceptual Experts
di: Zheng, Haiyang, et al.
Pubblicazione: (2025)
di: Zheng, Haiyang, et al.
Pubblicazione: (2025)
Anti-Forgetting Adaptation for Unsupervised Person Re-identification
di: Chen, Hao, et al.
Pubblicazione: (2024)
di: Chen, Hao, et al.
Pubblicazione: (2024)
Test-time Training for Hyperspectral Image Super-resolution
di: Li, Ke, et al.
Pubblicazione: (2024)
di: Li, Ke, et al.
Pubblicazione: (2024)
Optimizing against Infeasible Inclusions from Data for Semantic Segmentation through Morphology
di: Basu, Shamik, et al.
Pubblicazione: (2024)
di: Basu, Shamik, et al.
Pubblicazione: (2024)
Bayesian Self-Training for Semi-Supervised 3D Segmentation
di: Unal, Ozan, et al.
Pubblicazione: (2024)
di: Unal, Ozan, et al.
Pubblicazione: (2024)
Textual Knowledge Matters: Cross-Modality Co-Teaching for Generalized Visual Class Discovery
di: Zheng, Haiyang, et al.
Pubblicazione: (2024)
di: Zheng, Haiyang, et al.
Pubblicazione: (2024)
Hallucination Early Detection in Diffusion Models
di: Betti, Federico, et al.
Pubblicazione: (2026)
di: Betti, Federico, et al.
Pubblicazione: (2026)
RankFeat&RankWeight: Rank-1 Feature/Weight Removal for Out-of-distribution Detection
di: Song, Yue, et al.
Pubblicazione: (2023)
di: Song, Yue, et al.
Pubblicazione: (2023)
Investigating the Effectiveness of Cross-Attention to Unlock Zero-Shot Editing of Text-to-Video Diffusion Models
di: Motamed, Saman, et al.
Pubblicazione: (2024)
di: Motamed, Saman, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Spatial-Temporal Graph Mamba for Music-Guided Dance Video Synthesis
di: Tang, Hao, et al.
Pubblicazione: (2025) -
Enhanced Multi-Scale Cross-Attention for Person Image Generation
di: Tang, Hao, et al.
Pubblicazione: (2025) -
Asymmetric GANs for Image-to-Image Translation
di: Tang, Hao, et al.
Pubblicazione: (2019) -
Key-Graph Transformer for Image Restoration
di: Ren, Bin, et al.
Pubblicazione: (2024) -
Bringing Masked Autoencoders Explicit Contrastive Properties for Point Cloud Self-Supervised Learning
di: Ren, Bin, et al.
Pubblicazione: (2024)