Learning Where to Edit Vision Transformers
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Yunqiao, Huang, Long-Kai, Chen, Shengzhuang, Ma, Kede, Wei, Ying |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Hiding Images in Diffusion Models by Editing Learned Score Functions
par: Chen, Haoyu, et autres
Publié: (2025)
par: Chen, Haoyu, et autres
Publié: (2025)
Unleashing the Power of Meta-tuning for Few-shot Generalization Through Sparse Interpolated Experts
par: Chen, Shengzhuang, et autres
Publié: (2024)
par: Chen, Shengzhuang, et autres
Publié: (2024)
Enhancing Interpretability for Vision Models via Shapley Value Optimization
par: Fan, Kanglong, et autres
Publié: (2025)
par: Fan, Kanglong, et autres
Publié: (2025)
Task-Specific Normalization for Continual Learning of Blind Image Quality Models
par: Zhang, Weixia, et autres
Publié: (2021)
par: Zhang, Weixia, et autres
Publié: (2021)
X-Edit: Exact, Explicit, and Explainable Null-Space Editing for Medical Vision Transformers
par: Liu, Yuanye, et autres
Publié: (2026)
par: Liu, Yuanye, et autres
Publié: (2026)
Steerable Pyramid Transform Enables Robust Left Ventricle Quantification
par: Zhu, Xiangyang, et autres
Publié: (2022)
par: Zhu, Xiangyang, et autres
Publié: (2022)
Self-Supervised Learning for Detecting AI-Generated Faces as Anomalies
par: Zou, Mian, et autres
Publié: (2025)
par: Zou, Mian, et autres
Publié: (2025)
Scanpath Prediction in Panoramic Videos via Expected Code Length Minimization
par: Li, Mu, et autres
Publié: (2023)
par: Li, Mu, et autres
Publié: (2023)
DiT4Edit: Diffusion Transformer for Image Editing
par: Feng, Kunyu, et autres
Publié: (2024)
par: Feng, Kunyu, et autres
Publié: (2024)
Toward Generalized Image Quality Assessment: Relaxing the Perfect Reference Quality Assumption
par: Chen, Du, et autres
Publié: (2025)
par: Chen, Du, et autres
Publié: (2025)
Edit Where You Mean: Region-Aware Adapter Injection for Mask-Free Local Image Editing
par: Cai, Honghao, et autres
Publié: (2026)
par: Cai, Honghao, et autres
Publié: (2026)
Communication-Efficient Multi-Agent 3D Detection via Hybrid Collaboration
par: Hu, Yue, et autres
Publié: (2025)
par: Hu, Yue, et autres
Publié: (2025)
Edit Transfer: Learning Image Editing via Vision In-Context Relations
par: Chen, Lan, et autres
Publié: (2025)
par: Chen, Lan, et autres
Publié: (2025)
Semantics-Oriented Multitask Learning for DeepFake Detection: A Joint Embedding Approach
par: Zou, Mian, et autres
Publié: (2024)
par: Zou, Mian, et autres
Publié: (2024)
VisualQuality-R1: Reasoning-Induced Image Quality Assessment via Reinforcement Learning to Rank
par: Wu, Tianhe, et autres
Publié: (2025)
par: Wu, Tianhe, et autres
Publié: (2025)
Group Editing: Edit Multiple Images in One Go
par: Ma, Yue, et autres
Publié: (2026)
par: Ma, Yue, et autres
Publié: (2026)
Rethinking Where to Edit: Task-Aware Localization for Instruction-Based Image Editing
par: He, Jingxuan, et autres
Publié: (2026)
par: He, Jingxuan, et autres
Publié: (2026)
When No-Reference Image Quality Models Meet MAP Estimation in Diffusion Latents
par: Zhang, Weixia, et autres
Publié: (2024)
par: Zhang, Weixia, et autres
Publié: (2024)
A Comprehensive Study of Multimodal Large Language Models for Image Quality Assessment
par: Wu, Tianhe, et autres
Publié: (2024)
par: Wu, Tianhe, et autres
Publié: (2024)
Diversity-Preserved Distribution Matching Distillation for Fast Visual Synthesis
par: Wu, Tianhe, et autres
Publié: (2026)
par: Wu, Tianhe, et autres
Publié: (2026)
Image Re-Identification: Where Self-supervision Meets Vision-Language Learning
par: Wang, Bin, et autres
Publié: (2024)
par: Wang, Bin, et autres
Publié: (2024)
Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning
par: Zhong, Hanwen, et autres
Publié: (2025)
par: Zhong, Hanwen, et autres
Publié: (2025)
MT-EditFlow: Reinforcement Learning for Multi-Turn Image Editing with Flow Matching
par: Huang, Jiahui, et autres
Publié: (2026)
par: Huang, Jiahui, et autres
Publié: (2026)
AniClipart: Clipart Animation with Text-to-Video Priors
par: Wu, Ronghuan, et autres
Publié: (2024)
par: Wu, Ronghuan, et autres
Publié: (2024)
Improving Masked Autoencoders by Learning Where to Mask
par: Chen, Haijian, et autres
Publié: (2023)
par: Chen, Haijian, et autres
Publié: (2023)
Bi-Level Optimization for Self-Supervised AI-Generated Face Detection
par: Zou, Mian, et autres
Publié: (2025)
par: Zou, Mian, et autres
Publié: (2025)
What and Where to Adapt: Structure-Semantics Co-Tuning for Machine Vision Compression via Synergistic Adapters
par: Liu, Shaobo, et autres
Publié: (2026)
par: Liu, Shaobo, et autres
Publié: (2026)
Hierarchical Side-Tuning for Vision Transformers
par: Lin, Weifeng, et autres
Publié: (2023)
par: Lin, Weifeng, et autres
Publié: (2023)
In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer
par: Zhang, Zechuan, et autres
Publié: (2025)
par: Zhang, Zechuan, et autres
Publié: (2025)
Concept-Based Explanations in Computer Vision: Where Are We and Where Could We Go?
par: Lee, Jae Hee, et autres
Publié: (2024)
par: Lee, Jae Hee, et autres
Publié: (2024)
Where do Large Vision-Language Models Look at when Answering Questions?
par: Xing, Xiaoying, et autres
Publié: (2025)
par: Xing, Xiaoying, et autres
Publié: (2025)
FreeEdit: Mask-free Reference-based Image Editing with Multi-modal Instruction
par: He, Runze, et autres
Publié: (2024)
par: He, Runze, et autres
Publié: (2024)
Calibration Attention: Learning Reliability-Aware Representations for Vision Transformers
par: Liang, Wenhao, et autres
Publié: (2025)
par: Liang, Wenhao, et autres
Publié: (2025)
MotionEdit: Benchmarking and Learning Motion-Centric Image Editing
par: Wan, Yixin, et autres
Publié: (2025)
par: Wan, Yixin, et autres
Publié: (2025)
PairEdit: Learning Semantic Variations for Exemplar-based Image Editing
par: Lu, Haoguang, et autres
Publié: (2025)
par: Lu, Haoguang, et autres
Publié: (2025)
Beyond Where to Look: Trajectory-Guided Reinforcement Learning for Multimodal RLVR
par: Lu, Jinda, et autres
Publié: (2026)
par: Lu, Jinda, et autres
Publié: (2026)
Edit-Your-Motion: Space-Time Diffusion Decoupling Learning for Video Motion Editing
par: Zuo, Yi, et autres
Publié: (2024)
par: Zuo, Yi, et autres
Publié: (2024)
Perceptual Assessment and Optimization of HDR Image Rendering
par: Cao, Peibei, et autres
Publié: (2023)
par: Cao, Peibei, et autres
Publié: (2023)
Analysis of Video Quality Datasets via Design of Minimalistic Video Quality Models
par: Sun, Wei, et autres
Publié: (2023)
par: Sun, Wei, et autres
Publié: (2023)
UniRef-Image-Edit: Towards Scalable and Consistent Multi-Reference Image Editing
par: Wei, Hongyang, et autres
Publié: (2026)
par: Wei, Hongyang, et autres
Publié: (2026)
Documents similaires
-
Hiding Images in Diffusion Models by Editing Learned Score Functions
par: Chen, Haoyu, et autres
Publié: (2025) -
Unleashing the Power of Meta-tuning for Few-shot Generalization Through Sparse Interpolated Experts
par: Chen, Shengzhuang, et autres
Publié: (2024) -
Enhancing Interpretability for Vision Models via Shapley Value Optimization
par: Fan, Kanglong, et autres
Publié: (2025) -
Task-Specific Normalization for Continual Learning of Blind Image Quality Models
par: Zhang, Weixia, et autres
Publié: (2021) -
X-Edit: Exact, Explicit, and Explainable Null-Space Editing for Medical Vision Transformers
par: Liu, Yuanye, et autres
Publié: (2026)