Unifying and Enhancing Graph Transformers via a Hierarchical Mask Framework
Fuente:
arXiv
Salvato in:
| Autori principali: | Xing, Yujie, Wang, Xiao, Wu, Bin, Huang, Hai, Shi, Chuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Diffusion Transformer Meets Random Masks: An Advanced PET Reconstruction Framework
di: Huang, Bin, et al.
Pubblicazione: (2025)
di: Huang, Bin, et al.
Pubblicazione: (2025)
A Unified Masked Jigsaw Puzzle Framework for Vision and Language Models
di: Ye, Weixin, et al.
Pubblicazione: (2026)
di: Ye, Weixin, et al.
Pubblicazione: (2026)
MFP-VTON: Enhancing Mask-Free Person-to-Person Virtual Try-On via Diffusion Transformer
di: Shen, Le, et al.
Pubblicazione: (2025)
di: Shen, Le, et al.
Pubblicazione: (2025)
High-Fidelity Mural Restoration via a Unified Hybrid Mask-Aware Transformer
di: Jiang, Jincheng, et al.
Pubblicazione: (2026)
di: Jiang, Jincheng, et al.
Pubblicazione: (2026)
MaskBEV: Towards A Unified Framework for BEV Detection and Map Segmentation
di: Zhao, Xiao, et al.
Pubblicazione: (2024)
di: Zhao, Xiao, et al.
Pubblicazione: (2024)
Pedestrian Attribute Recognition via Hierarchical Cross-Modality HyperGraph Learning
di: Wang, Xiao, et al.
Pubblicazione: (2025)
di: Wang, Xiao, et al.
Pubblicazione: (2025)
OneReward: Unified Mask-Guided Image Generation via Multi-Task Human Preference Learning
di: Gong, Yuan, et al.
Pubblicazione: (2025)
di: Gong, Yuan, et al.
Pubblicazione: (2025)
Mask as Supervision: Leveraging Unified Mask Information for Unsupervised 3D Pose Estimation
di: Yang, Yuchen, et al.
Pubblicazione: (2023)
di: Yang, Yuchen, et al.
Pubblicazione: (2023)
MaskINT: Video Editing via Interpolative Non-autoregressive Masked Transformers
di: Ma, Haoyu, et al.
Pubblicazione: (2023)
di: Ma, Haoyu, et al.
Pubblicazione: (2023)
Hierarchical Graph Interaction Transformer with Dynamic Token Clustering for Camouflaged Object Detection
di: Yao, Siyuan, et al.
Pubblicazione: (2024)
di: Yao, Siyuan, et al.
Pubblicazione: (2024)
InterMask: 3D Human Interaction Generation via Collaborative Masked Modeling
di: Javed, Muhammad Gohar, et al.
Pubblicazione: (2024)
di: Javed, Muhammad Gohar, et al.
Pubblicazione: (2024)
Graph Transformer GANs with Graph Masked Modeling for Architectural Layout Generation
di: Tang, Hao, et al.
Pubblicazione: (2024)
di: Tang, Hao, et al.
Pubblicazione: (2024)
HMSViT: A Hierarchical Masked Self-Supervised Vision Transformer for Corneal Nerve Segmentation and Diabetic Neuropathy Diagnosis
di: Zhang, Xin, et al.
Pubblicazione: (2025)
di: Zhang, Xin, et al.
Pubblicazione: (2025)
Bridging Brain and Semantics: A Hierarchical Framework for Semantically Enhanced fMRI-to-Video Reconstruction
di: Wei, Yujie, et al.
Pubblicazione: (2026)
di: Wei, Yujie, et al.
Pubblicazione: (2026)
Hierarchical GraphCut Phase Unwrapping based on Invariance of Diffeomorphisms Framework
di: Gao, Xiang, et al.
Pubblicazione: (2025)
di: Gao, Xiang, et al.
Pubblicazione: (2025)
Hierarchical Side-Tuning for Vision Transformers
di: Lin, Weifeng, et al.
Pubblicazione: (2023)
di: Lin, Weifeng, et al.
Pubblicazione: (2023)
HOLA: Enhancing Audio-visual Deepfake Detection via Hierarchical Contextual Aggregations and Efficient Pre-training
di: Wu, Xuecheng, et al.
Pubblicazione: (2025)
di: Wu, Xuecheng, et al.
Pubblicazione: (2025)
Temporal-Enhanced Multimodal Transformer for Referring Multi-Object Tracking and Segmentation
di: Xiao, Changcheng, et al.
Pubblicazione: (2024)
di: Xiao, Changcheng, et al.
Pubblicazione: (2024)
MRStyle: A Unified Framework for Color Style Transfer with Multi-Modality Reference
di: Huang, Jiancheng, et al.
Pubblicazione: (2024)
di: Huang, Jiancheng, et al.
Pubblicazione: (2024)
Emotion-Qwen: A Unified Framework for Emotion and Vision Understanding
di: Huang, Dawei, et al.
Pubblicazione: (2025)
di: Huang, Dawei, et al.
Pubblicazione: (2025)
HRGR: Enhancing Image Manipulation Detection via Hierarchical Region-aware Graph Reasoning
di: Wang, Xudong, et al.
Pubblicazione: (2024)
di: Wang, Xudong, et al.
Pubblicazione: (2024)
Asymmetric Masked Distillation for Pre-Training Small Foundation Models
di: Zhao, Zhiyu, et al.
Pubblicazione: (2023)
di: Zhao, Zhiyu, et al.
Pubblicazione: (2023)
Bridging Domain Generalization to Multimodal Domain Generalization via Unified Representations
di: Huang, Hai, et al.
Pubblicazione: (2025)
di: Huang, Hai, et al.
Pubblicazione: (2025)
MotionDreamer: One-to-Many Motion Synthesis with Localized Generative Masked Transformer
di: Wang, Yilin, et al.
Pubblicazione: (2025)
di: Wang, Yilin, et al.
Pubblicazione: (2025)
OneRef: Unified One-tower Expression Grounding and Segmentation with Mask Referring Modeling
di: Xiao, Linhui, et al.
Pubblicazione: (2024)
di: Xiao, Linhui, et al.
Pubblicazione: (2024)
Benchmarking Unified Face Attack Detection via Hierarchical Prompt Tuning
di: Liu, Ajian, et al.
Pubblicazione: (2025)
di: Liu, Ajian, et al.
Pubblicazione: (2025)
HAVEN: Hierarchically Aligned Multimodal Benchmark for Unified Video Understanding
di: Shi, Mengqi, et al.
Pubblicazione: (2026)
di: Shi, Mengqi, et al.
Pubblicazione: (2026)
A Unified Graph-based Framework for Scalable 3D Tree Reconstruction and Non-Destructive Biomass Estimation from Point Clouds
di: Wang, Di, et al.
Pubblicazione: (2025)
di: Wang, Di, et al.
Pubblicazione: (2025)
Polyline Path Masked Attention for Vision Transformer
di: Zhao, Zhongchen, et al.
Pubblicazione: (2025)
di: Zhao, Zhongchen, et al.
Pubblicazione: (2025)
Omni-Diffusion: Unified Multimodal Understanding and Generation with Masked Discrete Diffusion
di: Li, Lijiang, et al.
Pubblicazione: (2026)
di: Li, Lijiang, et al.
Pubblicazione: (2026)
Cross-Slice Knowledge Transfer via Masked Multi-Modal Heterogeneous Graph Contrastive Learning for Spatial Gene Expression Inference
di: Shi, Zhiceng, et al.
Pubblicazione: (2026)
di: Shi, Zhiceng, et al.
Pubblicazione: (2026)
Unifying Graph Contrastive Learning via Graph Message Augmentation
di: Zhang, Ziyan, et al.
Pubblicazione: (2024)
di: Zhang, Ziyan, et al.
Pubblicazione: (2024)
CoMA: Complementary Masking and Hierarchical Dynamic Multi-Window Self-Attention in a Unified Pre-training Framework
di: Li, Jiaxuan, et al.
Pubblicazione: (2025)
di: Li, Jiaxuan, et al.
Pubblicazione: (2025)
Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts
di: Zhang, Chang-Bin, et al.
Pubblicazione: (2024)
di: Zhang, Chang-Bin, et al.
Pubblicazione: (2024)
Enhancing Gradient Inversion Attacks in Federated Learning via Hierarchical Feature Optimization
di: Fang, Hao, et al.
Pubblicazione: (2026)
di: Fang, Hao, et al.
Pubblicazione: (2026)
VasoMIM: Vascular Anatomy-Aware Masked Image Modeling for Vessel Segmentation
di: Huang, De-Xing, et al.
Pubblicazione: (2025)
di: Huang, De-Xing, et al.
Pubblicazione: (2025)
Mask-Adapter: The Devil is in the Masks for Open-Vocabulary Segmentation
di: Li, Yongkang, et al.
Pubblicazione: (2024)
di: Li, Yongkang, et al.
Pubblicazione: (2024)
Hierarchical Vision Transformer Enhanced by Graph Convolutional Network for Image Classification
di: Jiao, Haibin
Pubblicazione: (2026)
di: Jiao, Haibin
Pubblicazione: (2026)
Fine-Grained VLM Fine-tuning via Latent Hierarchical Adapter Learning
di: Zhao, Yumiao, et al.
Pubblicazione: (2025)
di: Zhao, Yumiao, et al.
Pubblicazione: (2025)
HybridMIM: A Hybrid Masked Image Modeling Framework for 3D Medical Image Segmentation
di: Xing, Zhaohu, et al.
Pubblicazione: (2023)
di: Xing, Zhaohu, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Diffusion Transformer Meets Random Masks: An Advanced PET Reconstruction Framework
di: Huang, Bin, et al.
Pubblicazione: (2025) -
A Unified Masked Jigsaw Puzzle Framework for Vision and Language Models
di: Ye, Weixin, et al.
Pubblicazione: (2026) -
MFP-VTON: Enhancing Mask-Free Person-to-Person Virtual Try-On via Diffusion Transformer
di: Shen, Le, et al.
Pubblicazione: (2025) -
High-Fidelity Mural Restoration via a Unified Hybrid Mask-Aware Transformer
di: Jiang, Jincheng, et al.
Pubblicazione: (2026) -
MaskBEV: Towards A Unified Framework for BEV Detection and Map Segmentation
di: Zhao, Xiao, et al.
Pubblicazione: (2024)