HyperDiT: Hyper-Connected Transformers for High-Fidelity Pixel-Space Diffusion
Fuente:
arXiv
Saved in:
| Main Authors: | He, Yu, Ma, Lichen, Guo, Zipeng, Shan, Xinyuan, Fu, Jingling, Chen, Dong, Huang, Junshi, Li, Yan |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
FrequencyBooster: Full-Frequency Modeling for High-Fidelity Pixel Diffusion
by: Ma, Lichen, et al.
Published: (2026)
by: Ma, Lichen, et al.
Published: (2026)
Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition
by: He, Yu, et al.
Published: (2026)
by: He, Yu, et al.
Published: (2026)
LiWi: Layering in the Wild
by: He, Yu, et al.
Published: (2026)
by: He, Yu, et al.
Published: (2026)
Dynamic-TreeRPO: Breaking the Independent Trajectory Bottleneck with Structured Sampling
by: Fu, Xiaolong, et al.
Published: (2025)
by: Fu, Xiaolong, et al.
Published: (2025)
Hyper-Connections
by: Zhu, Defa, et al.
Published: (2024)
by: Zhu, Defa, et al.
Published: (2024)
PixelDiT: Pixel Diffusion Transformers for Image Generation
by: Yu, Yongsheng, et al.
Published: (2025)
by: Yu, Yongsheng, et al.
Published: (2025)
UM-Text: A Unified Multimodal Model for Image Understanding and Visual Text Editing
by: Ma, Lichen, et al.
Published: (2026)
by: Ma, Lichen, et al.
Published: (2026)
Hyper-Transformer for Amodal Completion
by: Gao, Jianxiong, et al.
Published: (2024)
by: Gao, Jianxiong, et al.
Published: (2024)
RePainter: Empowering E-commerce Object Removal via Spatial-matting Reinforcement Learning
by: Guo, Zipeng, et al.
Published: (2025)
by: Guo, Zipeng, et al.
Published: (2025)
HyperAlign: Hypernetwork for Efficient Test-Time Alignment of Diffusion Models
by: Xie, Xin, et al.
Published: (2026)
by: Xie, Xin, et al.
Published: (2026)
HyperSpaceX: Radial and Angular Exploration of HyperSpherical Dimensions
by: Chiranjeev, Chiranjeev, et al.
Published: (2024)
by: Chiranjeev, Chiranjeev, et al.
Published: (2024)
HyperHuman: Hyper-Realistic Human Generation with Latent Structural Diffusion
by: Liu, Xian, et al.
Published: (2023)
by: Liu, Xian, et al.
Published: (2023)
DiP: Taming Diffusion Models in Pixel Space
by: Chen, Zhennan, et al.
Published: (2025)
by: Chen, Zhennan, et al.
Published: (2025)
HyperGaussians: High-Dimensional Gaussian Splatting for High-Fidelity Animatable Face Avatars
by: Serifi, Gent, et al.
Published: (2025)
by: Serifi, Gent, et al.
Published: (2025)
Scalable Diffusion Models with State Space Backbone
by: Fei, Zhengcong, et al.
Published: (2024)
by: Fei, Zhengcong, et al.
Published: (2024)
HyperGCT: A Dynamic Hyper-GNN-Learned Geometric Constraint for 3D Registration
by: Zhang, Xiyu, et al.
Published: (2025)
by: Zhang, Xiyu, et al.
Published: (2025)
HyperDefect-YOLO: Enhance YOLO with HyperGraph Computation for Industrial Defect Detection
by: Zuo, Zuo, et al.
Published: (2024)
by: Zuo, Zuo, et al.
Published: (2024)
Not All Noises Are Created Equally:Diffusion Noise Selection and Optimization
by: Qi, Zipeng, et al.
Published: (2024)
by: Qi, Zipeng, et al.
Published: (2024)
Scaling Diffusion Transformers to 16 Billion Parameters
by: Fei, Zhengcong, et al.
Published: (2024)
by: Fei, Zhengcong, et al.
Published: (2024)
Hyper Diffusion Avatars: Dynamic Human Avatar Generation using Network Weight Space Diffusion
by: Cao, Dongliang, et al.
Published: (2025)
by: Cao, Dongliang, et al.
Published: (2025)
HyperPath: Knowledge-Guided Hyperbolic Semantic Hierarchy Modeling for WSI Analysis
by: Huang, Peixiang, et al.
Published: (2025)
by: Huang, Peixiang, et al.
Published: (2025)
Dimba: Transformer-Mamba Diffusion Models
by: Fei, Zhengcong, et al.
Published: (2024)
by: Fei, Zhengcong, et al.
Published: (2024)
HyperGLM: HyperGraph for Video Scene Graph Generation and Anticipation
by: Nguyen, Trong-Thuan, et al.
Published: (2024)
by: Nguyen, Trong-Thuan, et al.
Published: (2024)
Hyper-Connections for Adaptive Multi-Modal MRI Brain Tumor Segmentation
by: Kumar, Lokendra, et al.
Published: (2026)
by: Kumar, Lokendra, et al.
Published: (2026)
Registers Matter for Pixel-Space Diffusion Transformers
by: Starodubcev, Nikita, et al.
Published: (2026)
by: Starodubcev, Nikita, et al.
Published: (2026)
MMFace-DiT: A Dual-Stream Diffusion Transformer for High-Fidelity Multimodal Face Generation
by: Krishnamurthy, Bharath, et al.
Published: (2026)
by: Krishnamurthy, Bharath, et al.
Published: (2026)
HyperSpace: Hypernetworks for spacing-adaptive image segmentation
by: Joutard, Samuel, et al.
Published: (2024)
by: Joutard, Samuel, et al.
Published: (2024)
HyperMotionX: The Dataset and Benchmark with DiT-Based Pose-Guided Human Image Animation of Complex Motions
by: Xu, Shuolin, et al.
Published: (2025)
by: Xu, Shuolin, et al.
Published: (2025)
HyperDiff: Hypergraph Guided Diffusion Model for 3D Human Pose Estimation
by: Han, Bing, et al.
Published: (2025)
by: Han, Bing, et al.
Published: (2025)
Hyper-Local Deformable Transformers for Text Spotting on Historical Maps
by: Lin, Yijun, et al.
Published: (2025)
by: Lin, Yijun, et al.
Published: (2025)
HGFormer: Topology-Aware Vision Transformer with HyperGraph Learning
by: Wang, Hao, et al.
Published: (2025)
by: Wang, Hao, et al.
Published: (2025)
HyperPointFormer: Multimodal Fusion in 3D Space with Dual-Branch Cross-Attention Transformers
by: Rizaldy, Aldino, et al.
Published: (2025)
by: Rizaldy, Aldino, et al.
Published: (2025)
Hyper-VolTran: Fast and Generalizable One-Shot Image to 3D Object Structure via HyperNetworks
by: Simon, Christian, et al.
Published: (2023)
by: Simon, Christian, et al.
Published: (2023)
HyperSLICE: HyperBand optimized Spiral for Low-latency Interactive Cardiac Examination
by: Jaubert, Olivier, et al.
Published: (2023)
by: Jaubert, Olivier, et al.
Published: (2023)
mHC-HSI: Clustering-Guided Hyper-Connection Mamba for Hyperspectral Image Classification
by: Zhu, Yimin, et al.
Published: (2026)
by: Zhu, Yimin, et al.
Published: (2026)
HyperDreamBooth: HyperNetworks for Fast Personalization of Text-to-Image Models
by: Ruiz, Nataniel, et al.
Published: (2023)
by: Ruiz, Nataniel, et al.
Published: (2023)
Scalable High-Resolution Pixel-Space Image Synthesis with Hourglass Diffusion Transformers
by: Crowson, Katherine, et al.
Published: (2024)
by: Crowson, Katherine, et al.
Published: (2024)
HyperDet: Generalizable Detection of Synthesized Images by Generating and Merging A Mixture of Hyper LoRAs
by: Cao, Huangsen, et al.
Published: (2024)
by: Cao, Huangsen, et al.
Published: (2024)
HyperST: Hierarchical Hyperbolic Learning for Spatial Transcriptomics Prediction
by: Zhang, Chen, et al.
Published: (2025)
by: Zhang, Chen, et al.
Published: (2025)
High-Fidelity and Long-Duration Human Image Animation with Diffusion Transformer
by: Zheng, Shen, et al.
Published: (2025)
by: Zheng, Shen, et al.
Published: (2025)
Similar Items
-
FrequencyBooster: Full-Frequency Modeling for High-Fidelity Pixel Diffusion
by: Ma, Lichen, et al.
Published: (2026) -
Fashion130K: An E-commerce Fashion Dataset for Outfit Generation with Unified Multi-modal Condition
by: He, Yu, et al.
Published: (2026) -
LiWi: Layering in the Wild
by: He, Yu, et al.
Published: (2026) -
Dynamic-TreeRPO: Breaking the Independent Trajectory Bottleneck with Structured Sampling
by: Fu, Xiaolong, et al.
Published: (2025) -
Hyper-Connections
by: Zhu, Defa, et al.
Published: (2024)