High-Fidelity Differential-information Driven Binary Vision Transformer
Fuente:
arXiv
Guardado en:
| Autores principales: | Gao, Tian, Zhang, Zhiyuan, Yin, Kaijie, Zhong, Xu-Cheng, Kong, Hui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Information-Bottleneck Driven Binary Neural Network for Change Detection
por: Yin, Kaijie, et al.
Publicado: (2025)
por: Yin, Kaijie, et al.
Publicado: (2025)
BHViT: Binarized Hybrid Vision Transformer
por: Gao, Tian, et al.
Publicado: (2025)
por: Gao, Tian, et al.
Publicado: (2025)
Pathfinder for Low-altitude Aircraft with Binary Neural Network
por: Yin, Kaijie, et al.
Publicado: (2024)
por: Yin, Kaijie, et al.
Publicado: (2024)
GSB: Group Superposition Binarization for Vision Transformer with Limited Training Samples
por: Gao, Tian, et al.
Publicado: (2023)
por: Gao, Tian, et al.
Publicado: (2023)
Binary Event-Driven Spiking Transformer
por: Cao, Honglin, et al.
Publicado: (2025)
por: Cao, Honglin, et al.
Publicado: (2025)
FaceRefiner: High-Fidelity Facial Texture Refinement with Differentiable Rendering-based Style Transfer
por: Li, Chengyang, et al.
Publicado: (2026)
por: Li, Chengyang, et al.
Publicado: (2026)
FLUX-Makeup: High-Fidelity, Identity-Consistent, and Robust Makeup Transfer via Diffusion Transformer
por: Zhu, Jian, et al.
Publicado: (2025)
por: Zhu, Jian, et al.
Publicado: (2025)
Frequency-Aware Vision Transformers for High-Fidelity Super-Resolution of Earth System Models
por: Zeraatkar, Ehsan, et al.
Publicado: (2025)
por: Zeraatkar, Ehsan, et al.
Publicado: (2025)
Plug-and-Play Fidelity Optimization for Diffusion Transformer Acceleration via Cumulative Error Minimization
por: Shao, Tong, et al.
Publicado: (2025)
por: Shao, Tong, et al.
Publicado: (2025)
BinaryAttention: One-Bit QK-Attention for Vision and Diffusion Transformers
por: Xiao, Chaodong, et al.
Publicado: (2026)
por: Xiao, Chaodong, et al.
Publicado: (2026)
Simba: Towards High-Fidelity and Geometrically-Consistent Point Cloud Completion via Transformation Diffusion
por: Zhang, Lirui, et al.
Publicado: (2025)
por: Zhang, Lirui, et al.
Publicado: (2025)
HDiffTG: A Lightweight Hybrid Diffusion-Transformer-GCN Architecture for 3D Human Pose Estimation
por: Fu, Yajie, et al.
Publicado: (2025)
por: Fu, Yajie, et al.
Publicado: (2025)
Adaptive Visual Navigation Assistant in 3D RPGs
por: Xu, Kaijie, et al.
Publicado: (2025)
por: Xu, Kaijie, et al.
Publicado: (2025)
High-Fidelity and Long-Duration Human Image Animation with Diffusion Transformer
por: Zheng, Shen, et al.
Publicado: (2025)
por: Zheng, Shen, et al.
Publicado: (2025)
Aberration Correcting Vision Transformers for High-Fidelity Metalens Imaging
por: Lee, Byeonghyeon, et al.
Publicado: (2024)
por: Lee, Byeonghyeon, et al.
Publicado: (2024)
Differentiable Stroke Planning with Dual Parameterization for Efficient and High-Fidelity Painting Creation
por: Liu, Jinfan, et al.
Publicado: (2026)
por: Liu, Jinfan, et al.
Publicado: (2026)
MirrorMe: Towards Realtime and High Fidelity Audio-Driven Halfbody Animation
por: Meng, Dechao, et al.
Publicado: (2025)
por: Meng, Dechao, et al.
Publicado: (2025)
GazeGaussian: High-Fidelity Gaze Redirection with 3D Gaussian Splatting
por: Wei, Xiaobao, et al.
Publicado: (2024)
por: Wei, Xiaobao, et al.
Publicado: (2024)
InkDiffuser: High-Fidelity One-shot Chinese Calligraphy via Differentiable Morphological Optimization
por: Shi, Kunchong, et al.
Publicado: (2026)
por: Shi, Kunchong, et al.
Publicado: (2026)
MonoRelief V2: Leveraging Real Data for High-Fidelity Monocular Relief Recovery
por: Zhang, Yu-Wei, et al.
Publicado: (2025)
por: Zhang, Yu-Wei, et al.
Publicado: (2025)
Dynamic Proxy Domain Generalizes the Crowd Localization by Better Binary Segmentation
por: Gao, Junyu, et al.
Publicado: (2024)
por: Gao, Junyu, et al.
Publicado: (2024)
Implicit Discriminative Knowledge Learning for Visible-Infrared Person Re-Identification
por: Ren, Kaijie, et al.
Publicado: (2024)
por: Ren, Kaijie, et al.
Publicado: (2024)
LongWriter-V: Enabling Ultra-Long and High-Fidelity Generation in Vision-Language Models
por: Tu, Shangqing, et al.
Publicado: (2025)
por: Tu, Shangqing, et al.
Publicado: (2025)
Gated Differential Linear Attention: A Linear-Time Decoder for High-Fidelity Medical Segmentation
por: Zheng, Hongbo, et al.
Publicado: (2026)
por: Zheng, Hongbo, et al.
Publicado: (2026)
DreamText: High Fidelity Scene Text Synthesis
por: Wang, Yibin, et al.
Publicado: (2024)
por: Wang, Yibin, et al.
Publicado: (2024)
Exploring the Distinctiveness and Fidelity of the Descriptions Generated by Large Vision-Language Models
por: Huang, Yuhang, et al.
Publicado: (2024)
por: Huang, Yuhang, et al.
Publicado: (2024)
UMAD: University of Macau Anomaly Detection Benchmark Dataset
por: Li, Dong, et al.
Publicado: (2024)
por: Li, Dong, et al.
Publicado: (2024)
High-Fidelity Mural Restoration via a Unified Hybrid Mask-Aware Transformer
por: Jiang, Jincheng, et al.
Publicado: (2026)
por: Jiang, Jincheng, et al.
Publicado: (2026)
High Fidelity Text to Image Generation with Contrastive Alignment and Structural Guidance
por: Gao, Danyi
Publicado: (2025)
por: Gao, Danyi
Publicado: (2025)
Distillation Dynamics: Towards Understanding Feature-Based Distillation in Vision Transformers
por: Tian, Huiyuan, et al.
Publicado: (2025)
por: Tian, Huiyuan, et al.
Publicado: (2025)
Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning
por: Zhong, Hanwen, et al.
Publicado: (2025)
por: Zhong, Hanwen, et al.
Publicado: (2025)
SyncTalk++: High-Fidelity and Efficient Synchronized Talking Heads Synthesis Using Gaussian Splatting
por: Peng, Ziqiao, et al.
Publicado: (2025)
por: Peng, Ziqiao, et al.
Publicado: (2025)
Image Recognition with Online Lightweight Vision Transformer: A Survey
por: Zhang, Zherui, et al.
Publicado: (2025)
por: Zhang, Zherui, et al.
Publicado: (2025)
DreamID-V:Bridging the Image-to-Video Gap for High-Fidelity Face Swapping via Diffusion Transformer
por: Guo, Xu, et al.
Publicado: (2026)
por: Guo, Xu, et al.
Publicado: (2026)
G2Face: High-Fidelity Reversible Face Anonymization via Generative and Geometric Priors
por: Yang, Haoxin, et al.
Publicado: (2024)
por: Yang, Haoxin, et al.
Publicado: (2024)
Sparse-Up: Learnable Sparse Upsampling for 3D Generation with High-Fidelity Textures
por: Xiao, Lu, et al.
Publicado: (2025)
por: Xiao, Lu, et al.
Publicado: (2025)
DART: Differentiable Dynamic Adaptive Region Tokenizer for Vision Foundation Models
por: Yin, Shicheng, et al.
Publicado: (2025)
por: Yin, Shicheng, et al.
Publicado: (2025)
Learning Spatial Decay for Vision Transformers
por: Mao, Yuxin, et al.
Publicado: (2025)
por: Mao, Yuxin, et al.
Publicado: (2025)
Linear Differential Vision Transformer: Learning Visual Contrasts via Pairwise Differentials
por: Pu, Yifan, et al.
Publicado: (2025)
por: Pu, Yifan, et al.
Publicado: (2025)
HyperDiT: Hyper-Connected Transformers for High-Fidelity Pixel-Space Diffusion
por: He, Yu, et al.
Publicado: (2026)
por: He, Yu, et al.
Publicado: (2026)
Ejemplares similares
-
Information-Bottleneck Driven Binary Neural Network for Change Detection
por: Yin, Kaijie, et al.
Publicado: (2025) -
BHViT: Binarized Hybrid Vision Transformer
por: Gao, Tian, et al.
Publicado: (2025) -
Pathfinder for Low-altitude Aircraft with Binary Neural Network
por: Yin, Kaijie, et al.
Publicado: (2024) -
GSB: Group Superposition Binarization for Vision Transformer with Limited Training Samples
por: Gao, Tian, et al.
Publicado: (2023) -
Binary Event-Driven Spiking Transformer
por: Cao, Honglin, et al.
Publicado: (2025)