Charm: The Missing Piece in ViT fine-tuning for Image Aesthetic Assessment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Behrad, Fatemeh, Tuytelaars, Tinne, Wagemans, Johan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
On the Role of Individual Differences in Current Approaches to Computational Image Aesthetics
par: Chen, Li-Wei, et autres
Publié: (2025)
par: Chen, Li-Wei, et autres
Publié: (2025)
From Concepts to Judgments: Interpretable Image Aesthetic Assessment
par: Liu, Xiao-Chang, et autres
Publié: (2026)
par: Liu, Xiao-Chang, et autres
Publié: (2026)
BackFlip: The Impact of Local and Global Data Augmentations on Artistic Image Aesthetic Assessment
par: Strafforello, Ombretta, et autres
Publié: (2024)
par: Strafforello, Ombretta, et autres
Publié: (2024)
PEO: Training-Free Aesthetic Quality Enhancement in Pre-Trained Text-to-Image Diffusion Models with Prompt Embedding Optimization
par: Margaryan, Hovhannes, et autres
Publié: (2025)
par: Margaryan, Hovhannes, et autres
Publié: (2025)
Finding Closure: A Closer Look at the Gestalt Law of Closure in Convolutional Neural Networks
par: Zhang, Yuyan, et autres
Publié: (2024)
par: Zhang, Yuyan, et autres
Publié: (2024)
Investigating the Gestalt Principle of Closure in Deep Convolutional Neural Networks
par: Zhang, Yuyan, et autres
Publié: (2024)
par: Zhang, Yuyan, et autres
Publié: (2024)
Implicit Gaussian Splatting with Efficient Multi-Level Tri-Plane Representation
par: Wu, Minye, et autres
Publié: (2024)
par: Wu, Minye, et autres
Publié: (2024)
Analysis of Spatial augmentation in Self-supervised models in the purview of training and test distributions
par: Jha, Abhishek, et autres
Publié: (2024)
par: Jha, Abhishek, et autres
Publié: (2024)
Visually-Aware Context Modeling for News Image Captioning
par: Qu, Tingyu, et autres
Publié: (2023)
par: Qu, Tingyu, et autres
Publié: (2023)
Remembering by Reconstructing: Domain Incremental Learning With Test-Time Training on Video Streams
par: Swinnen, Jonathan, et autres
Publié: (2026)
par: Swinnen, Jonathan, et autres
Publié: (2026)
Pretrained ViTs Yield Versatile Representations For Medical Images
par: Matsoukas, Christos, et autres
Publié: (2023)
par: Matsoukas, Christos, et autres
Publié: (2023)
DM-Align: Leveraging the Power of Natural Language Instructions to Make Changes to Images
par: Trusca, Maria Mihaela, et autres
Publié: (2024)
par: Trusca, Maria Mihaela, et autres
Publié: (2024)
RGS-DR: Deferred Reflections and Residual Shading in 2D Gaussian Splatting
par: Kouros, Georgios, et autres
Publié: (2025)
par: Kouros, Georgios, et autres
Publié: (2025)
Object-Centric Pretraining via Target Encoder Bootstrapping
par: Đukić, Nikola, et autres
Publié: (2025)
par: Đukić, Nikola, et autres
Publié: (2025)
Animate Your Motion: Turning Still Images into Dynamic Videos
par: Li, Mingxiao, et autres
Publié: (2024)
par: Li, Mingxiao, et autres
Publié: (2024)
Towards More Accurate Personalized Image Generation: Addressing Overfitting and Evaluation Bias
par: Li, Mingxiao, et autres
Publié: (2025)
par: Li, Mingxiao, et autres
Publié: (2025)
Spec-Gloss Surfels and Normal-Diffuse Priors for Relightable Glossy Objects
par: Kouros, Georgios, et autres
Publié: (2025)
par: Kouros, Georgios, et autres
Publié: (2025)
Introducing Routing Functions to Vision-Language Parameter-Efficient Fine-Tuning with Low-Rank Bottlenecks
par: Qu, Tingyu, et autres
Publié: (2024)
par: Qu, Tingyu, et autres
Publié: (2024)
Your ViT is Secretly an Image Segmentation Model
par: Kerssies, Tommie, et autres
Publié: (2025)
par: Kerssies, Tommie, et autres
Publié: (2025)
Same accuracy, twice as fast: continuous training surpasses retraining from scratch
par: Verwimp, Eli, et autres
Publié: (2025)
par: Verwimp, Eli, et autres
Publié: (2025)
Eff-GRot: Efficient and Generalizable Rotation Estimation with Transformers
par: Mathioulakis, Fanis, et autres
Publié: (2025)
par: Mathioulakis, Fanis, et autres
Publié: (2025)
Parameter Efficient Fine-tuning of Self-supervised ViTs without Catastrophic Forgetting
par: Bafghi, Reza Akbarian, et autres
Publié: (2024)
par: Bafghi, Reza Akbarian, et autres
Publié: (2024)
Deeper Inside Deep ViT
par: Hong, Sungrae
Publié: (2025)
par: Hong, Sungrae
Publié: (2025)
Multi-task convolutional neural network for image aesthetic assessment
par: Soydaner, Derya, et autres
Publié: (2023)
par: Soydaner, Derya, et autres
Publié: (2023)
I&S-ViT: An Inclusive & Stable Method for Pushing the Limit of Post-Training ViTs Quantization
par: Zhong, Yunshan, et autres
Publié: (2023)
par: Zhong, Yunshan, et autres
Publié: (2023)
Unsupervised Parameter Efficient Source-free Post-pretraining
par: Jha, Abhishek, et autres
Publié: (2025)
par: Jha, Abhishek, et autres
Publié: (2025)
IML-ViT: Benchmarking Image Manipulation Localization by Vision Transformer
par: Ma, Xiaochen, et autres
Publié: (2023)
par: Ma, Xiaochen, et autres
Publié: (2023)
Let ViT Speak: Generative Language-Image Pre-training
par: Fang, Yan, et autres
Publié: (2026)
par: Fang, Yan, et autres
Publié: (2026)
Forgetting of task-specific knowledge in model merging-based continual learning
par: Hess, Timm, et autres
Publié: (2025)
par: Hess, Timm, et autres
Publié: (2025)
TS-LLaVA: Constructing Visual Tokens through Thumbnail-and-Sampling for Training-Free Video Large Language Models
par: Qu, Tingyu, et autres
Publié: (2024)
par: Qu, Tingyu, et autres
Publié: (2024)
DFQ-ViT: Data-Free Quantization for Vision Transformers without Fine-tuning
par: Tong, Yujia, et autres
Publié: (2025)
par: Tong, Yujia, et autres
Publié: (2025)
RepViT: Revisiting Mobile CNN From ViT Perspective
par: Wang, Ao, et autres
Publié: (2023)
par: Wang, Ao, et autres
Publié: (2023)
ViT-FIQA: Assessing Face Image Quality using Vision Transformers
par: Atzori, Andrea, et autres
Publié: (2025)
par: Atzori, Andrea, et autres
Publié: (2025)
DC-ViT: Modulating Spatial and Channel Interactions for Multi-Channel Images
par: Marikkar, Umar, et autres
Publié: (2026)
par: Marikkar, Umar, et autres
Publié: (2026)
Is this chart lying to me? Automating the detection of misleading visualizations
par: Tonglet, Jonathan, et autres
Publié: (2025)
par: Tonglet, Jonathan, et autres
Publié: (2025)
From Missing Pieces to Masterpieces: Image Completion with Context-Adaptive Diffusion
par: Shamsolmoali, Pourya, et autres
Publié: (2025)
par: Shamsolmoali, Pourya, et autres
Publié: (2025)
OASIS: Online Sample Selection for Continual Visual Instruction Tuning
par: Lee, Minjae, et autres
Publié: (2025)
par: Lee, Minjae, et autres
Publié: (2025)
Unveiling the Ambiguity in Neural Inverse Rendering: A Parameter Compensation Analysis
par: Kouros, Georgios, et autres
Publié: (2024)
par: Kouros, Georgios, et autres
Publié: (2024)
Implicit to Explicit Entropy Regularization: Benchmarking ViT Fine-tuning under Noisy Labels
par: Marrium, Maria, et autres
Publié: (2024)
par: Marrium, Maria, et autres
Publié: (2024)
Rethinking Random Masking in Self-Distillation on ViT
par: Seong, Jihyeon, et autres
Publié: (2025)
par: Seong, Jihyeon, et autres
Publié: (2025)
Documents similaires
-
On the Role of Individual Differences in Current Approaches to Computational Image Aesthetics
par: Chen, Li-Wei, et autres
Publié: (2025) -
From Concepts to Judgments: Interpretable Image Aesthetic Assessment
par: Liu, Xiao-Chang, et autres
Publié: (2026) -
BackFlip: The Impact of Local and Global Data Augmentations on Artistic Image Aesthetic Assessment
par: Strafforello, Ombretta, et autres
Publié: (2024) -
PEO: Training-Free Aesthetic Quality Enhancement in Pre-Trained Text-to-Image Diffusion Models with Prompt Embedding Optimization
par: Margaryan, Hovhannes, et autres
Publié: (2025) -
Finding Closure: A Closer Look at the Gestalt Law of Closure in Convolutional Neural Networks
par: Zhang, Yuyan, et autres
Publié: (2024)