Graph Transformer GANs with Graph Masked Modeling for Architectural Layout Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tang, Hao, Shao, Ling, Sebe, Nicu, Van Gool, Luc |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Spatial-Temporal Graph Mamba for Music-Guided Dance Video Synthesis
par: Tang, Hao, et autres
Publié: (2025)
par: Tang, Hao, et autres
Publié: (2025)
Enhanced Multi-Scale Cross-Attention for Person Image Generation
par: Tang, Hao, et autres
Publié: (2025)
par: Tang, Hao, et autres
Publié: (2025)
Asymmetric GANs for Image-to-Image Translation
par: Tang, Hao, et autres
Publié: (2019)
par: Tang, Hao, et autres
Publié: (2019)
Key-Graph Transformer for Image Restoration
par: Ren, Bin, et autres
Publié: (2024)
par: Ren, Bin, et autres
Publié: (2024)
Bringing Masked Autoencoders Explicit Contrastive Properties for Point Cloud Self-Supervised Learning
par: Ren, Bin, et autres
Publié: (2024)
par: Ren, Bin, et autres
Publié: (2024)
GraphMLP: A Graph MLP-Like Architecture for 3D Human Pose Estimation
par: Li, Wenhao, et autres
Publié: (2022)
par: Li, Wenhao, et autres
Publié: (2022)
Sharing Key Semantics in Transformer Makes Efficient Image Restoration
par: Ren, Bin, et autres
Publié: (2024)
par: Ren, Bin, et autres
Publié: (2024)
Towards Online Real-Time Memory-based Video Inpainting Transformers
par: Thiry, Guillaume, et autres
Publié: (2024)
par: Thiry, Guillaume, et autres
Publié: (2024)
CityLoc: 6DoF Pose Distributional Localization for Text Descriptions in Large-Scale Scenes with Gaussian Representation
par: Ma, Qi, et autres
Publié: (2025)
par: Ma, Qi, et autres
Publié: (2025)
Hierarchical Cross-Attention Network for Virtual Try-On
par: Tang, Hao, et autres
Publié: (2024)
par: Tang, Hao, et autres
Publié: (2024)
Retrieval Augmented Generation and Understanding in Vision: A Survey and New Outlook
par: Zheng, Xu, et autres
Publié: (2025)
par: Zheng, Xu, et autres
Publié: (2025)
ShapeSplat: A Large-scale Dataset of Gaussian Splats and Their Self-Supervised Pretraining
par: Ma, Qi, et autres
Publié: (2024)
par: Ma, Qi, et autres
Publié: (2024)
EarthMind: Leveraging Cross-Sensor Data for Advanced Earth Observation Interpretation with a Unified Multimodal LLM
par: Shu, Yan, et autres
Publié: (2025)
par: Shu, Yan, et autres
Publié: (2025)
MatIR: A Hybrid Mamba-Transformer Image Restoration Model
par: Wen, Juan, et autres
Publié: (2025)
par: Wen, Juan, et autres
Publié: (2025)
Efficient Degradation-agnostic Image Restoration via Channel-Wise Functional Decomposition and Manifold Regularization
par: Ren, Bin, et autres
Publié: (2025)
par: Ren, Bin, et autres
Publié: (2025)
Training and Tuning Generative Neural Radiance Fields for Attribute-Conditional 3D-Aware Face Generation
par: Zhang, Jichao, et autres
Publié: (2022)
par: Zhang, Jichao, et autres
Publié: (2022)
HandDiff: 3D Hand Pose Estimation with Diffusion on Image-Point Cloud
par: Cheng, Wencan, et autres
Publié: (2024)
par: Cheng, Wencan, et autres
Publié: (2024)
CLIP is Strong Enough to Fight Back: Test-time Counterattacks towards Zero-shot Adversarial Robustness of CLIP
par: Xing, Songlong, et autres
Publié: (2025)
par: Xing, Songlong, et autres
Publié: (2025)
POCI-Diff: Position Objects Consistently and Interactively with 3D-Layout Guided Diffusion
par: Rigo, Andrea, et autres
Publié: (2026)
par: Rigo, Andrea, et autres
Publié: (2026)
TrafficBots V1.5: Traffic Simulation via Conditional VAEs and Transformers with Relative Pose Encoding
par: Zhang, Zhejun, et autres
Publié: (2024)
par: Zhang, Zhejun, et autres
Publié: (2024)
A Unified Masked Jigsaw Puzzle Framework for Vision and Language Models
par: Ye, Weixin, et autres
Publié: (2026)
par: Ye, Weixin, et autres
Publié: (2026)
Walker: Self-supervised Multiple Object Tracking by Walking on Temporal Appearance Graphs
par: Segu, Mattia, et autres
Publié: (2024)
par: Segu, Mattia, et autres
Publié: (2024)
Masked Image Modeling: A Survey
par: Hondru, Vlad, et autres
Publié: (2024)
par: Hondru, Vlad, et autres
Publié: (2024)
Masked Clustering Prediction for Unsupervised Point Cloud Pre-training
par: Ren, Bin, et autres
Publié: (2025)
par: Ren, Bin, et autres
Publié: (2025)
Any Image Restoration via Efficient Spatial-Frequency Degradation Adaptation
par: Ren, Bin, et autres
Publié: (2025)
par: Ren, Bin, et autres
Publié: (2025)
Token Reduction via Local and Global Contexts Optimization for Efficient Video Large Language Models
par: Li, Jinlong, et autres
Publié: (2026)
par: Li, Jinlong, et autres
Publié: (2026)
DSGC-Net: A Dual-Stream Graph Convolutional Network for Crowd Counting via Feature Correlation Mining
par: Wu, Yihong, et autres
Publié: (2025)
par: Wu, Yihong, et autres
Publié: (2025)
Reverse Personalization
par: Kung, Han-Wei, et autres
Publié: (2025)
par: Kung, Han-Wei, et autres
Publié: (2025)
RAGME: Retrieval Augmented Video Generation for Enhanced Motion Realism
par: Peruzzo, Elia, et autres
Publié: (2025)
par: Peruzzo, Elia, et autres
Publié: (2025)
Chorus: Multi-Teacher Pretraining for Holistic 3D Gaussian Scene Encoding
par: Li, Yue, et autres
Publié: (2025)
par: Li, Yue, et autres
Publié: (2025)
CreatiLayout: Siamese Multimodal Diffusion Transformer for Creative Layout-to-Image Generation
par: Zhang, Hui, et autres
Publié: (2024)
par: Zhang, Hui, et autres
Publié: (2024)
Generalized Fine-Grained Category Discovery with Multi-Granularity Conceptual Experts
par: Zheng, Haiyang, et autres
Publié: (2025)
par: Zheng, Haiyang, et autres
Publié: (2025)
Anti-Forgetting Adaptation for Unsupervised Person Re-identification
par: Chen, Hao, et autres
Publié: (2024)
par: Chen, Hao, et autres
Publié: (2024)
Test-time Training for Hyperspectral Image Super-resolution
par: Li, Ke, et autres
Publié: (2024)
par: Li, Ke, et autres
Publié: (2024)
Optimizing against Infeasible Inclusions from Data for Semantic Segmentation through Morphology
par: Basu, Shamik, et autres
Publié: (2024)
par: Basu, Shamik, et autres
Publié: (2024)
Bayesian Self-Training for Semi-Supervised 3D Segmentation
par: Unal, Ozan, et autres
Publié: (2024)
par: Unal, Ozan, et autres
Publié: (2024)
Textual Knowledge Matters: Cross-Modality Co-Teaching for Generalized Visual Class Discovery
par: Zheng, Haiyang, et autres
Publié: (2024)
par: Zheng, Haiyang, et autres
Publié: (2024)
Hallucination Early Detection in Diffusion Models
par: Betti, Federico, et autres
Publié: (2026)
par: Betti, Federico, et autres
Publié: (2026)
RankFeat&RankWeight: Rank-1 Feature/Weight Removal for Out-of-distribution Detection
par: Song, Yue, et autres
Publié: (2023)
par: Song, Yue, et autres
Publié: (2023)
Investigating the Effectiveness of Cross-Attention to Unlock Zero-Shot Editing of Text-to-Video Diffusion Models
par: Motamed, Saman, et autres
Publié: (2024)
par: Motamed, Saman, et autres
Publié: (2024)
Documents similaires
-
Spatial-Temporal Graph Mamba for Music-Guided Dance Video Synthesis
par: Tang, Hao, et autres
Publié: (2025) -
Enhanced Multi-Scale Cross-Attention for Person Image Generation
par: Tang, Hao, et autres
Publié: (2025) -
Asymmetric GANs for Image-to-Image Translation
par: Tang, Hao, et autres
Publié: (2019) -
Key-Graph Transformer for Image Restoration
par: Ren, Bin, et autres
Publié: (2024) -
Bringing Masked Autoencoders Explicit Contrastive Properties for Point Cloud Self-Supervised Learning
par: Ren, Bin, et autres
Publié: (2024)