Visual Compositional Tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Xindi, Hwang, Hee Seung, Kirichenko, Polina, Tureci, Esin, Russakovsky, Olga |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Objects: Contextual Synthetic Data Generation for Fine-Grained Classification
par: Yang, William, et autres
Publié: (2025)
par: Yang, William, et autres
Publié: (2025)
The Impact of Coreset Selection on Spurious Correlations and Group Robustness
par: Dharmasiri, Amaya, et autres
Publié: (2025)
par: Dharmasiri, Amaya, et autres
Publié: (2025)
ConceptMix: A Compositional Image Generation Benchmark with Controllable Difficulty
par: Wu, Xindi, et autres
Publié: (2024)
par: Wu, Xindi, et autres
Publié: (2024)
Vision-Language Dataset Distillation
par: Wu, Xindi, et autres
Publié: (2023)
par: Wu, Xindi, et autres
Publié: (2023)
Bias at the End of the Score
par: Magid, Salma Abdel, et autres
Publié: (2026)
par: Magid, Salma Abdel, et autres
Publié: (2026)
Personalized Generative Models for Contextual Debiasing
par: Liang, Xinran, et autres
Publié: (2026)
par: Liang, Xinran, et autres
Publié: (2026)
ICONS: Influence Consensus for Vision-Language Data Selection
par: Wu, Xindi, et autres
Publié: (2024)
par: Wu, Xindi, et autres
Publié: (2024)
D2D: Detector-to-Differentiable Critic for Improved Numeracy in Text-to-Image Generation
par: Yoo, Nobline, et autres
Publié: (2025)
par: Yoo, Nobline, et autres
Publié: (2025)
Video Models Reason Early: Exploiting Plan Commitment for Maze Solving
par: Newman, Kaleb, et autres
Publié: (2026)
par: Newman, Kaleb, et autres
Publié: (2026)
ImageNet-OOD: Deciphering Modern Out-of-Distribution Detection Algorithms
par: Yang, William, et autres
Publié: (2023)
par: Yang, William, et autres
Publié: (2023)
D$^3$: Scaling Up Deepfake Detection by Learning from Discrepancy
par: Yang, Yongqi, et autres
Publié: (2024)
par: Yang, Yongqi, et autres
Publié: (2024)
The Silent Assistant: NoiseQuery as Implicit Guidance for Goal-Driven Image Generation
par: Wang, Ruoyu, et autres
Publié: (2024)
par: Wang, Ruoyu, et autres
Publié: (2024)
Seeing Beyond the Scene: Analyzing and Mitigating Background Bias in Action Recognition
par: Zhou, Ellie, et autres
Publié: (2025)
par: Zhou, Ellie, et autres
Publié: (2025)
Reinforced Fast Weights with Next-Sequence Prediction
par: Hwang, Hee Seung, et autres
Publié: (2026)
par: Hwang, Hee Seung, et autres
Publié: (2026)
What's in Common? Multimodal Models Hallucinate When Reasoning Across Scenes
par: Ross, Candace, et autres
Publié: (2025)
par: Ross, Candace, et autres
Publié: (2025)
Attention IoU: Examining Biases in CelebA using Attention Maps
par: Serianni, Aaron, et autres
Publié: (2025)
par: Serianni, Aaron, et autres
Publié: (2025)
ECLIPSE: Efficient Continual Learning in Panoptic Segmentation with Visual Prompt Tuning
par: Kim, Beomyoung, et autres
Publié: (2024)
par: Kim, Beomyoung, et autres
Publié: (2024)
Unifying Specialized Visual Encoders for Video Language Models
par: Chung, Jihoon, et autres
Publié: (2025)
par: Chung, Jihoon, et autres
Publié: (2025)
A Sampling-Based Domain Generalization Study with Diffusion Generative Models
par: Zhu, Ye, et autres
Publié: (2023)
par: Zhu, Ye, et autres
Publié: (2023)
SOWing Information: Cultivating Contextual Coherence with MLLMs in Image Generation
par: Pei, Yuhan, et autres
Publié: (2024)
par: Pei, Yuhan, et autres
Publié: (2024)
Visual Generation Tuning
par: Guo, Jiahao, et autres
Publié: (2025)
par: Guo, Jiahao, et autres
Publié: (2025)
Explain Before You Answer: A Survey on Compositional Visual Reasoning
par: Ke, Fucai, et autres
Publié: (2025)
par: Ke, Fucai, et autres
Publié: (2025)
Analyzing the Roles of Language and Vision in Learning from Limited Data
par: Chen, Allison, et autres
Publié: (2024)
par: Chen, Allison, et autres
Publié: (2024)
Understanding the Detrimental Class-level Effects of Data Augmentation
par: Kirichenko, Polina, et autres
Publié: (2023)
par: Kirichenko, Polina, et autres
Publié: (2023)
Bayesian Approximation-Based Trajectory Prediction and Tracking with 4D Radar
par: Kim, Dong-In, et autres
Publié: (2025)
par: Kim, Dong-In, et autres
Publié: (2025)
PMC-VQA: Visual Instruction Tuning for Medical Visual Question Answering
par: Zhang, Xiaoman, et autres
Publié: (2023)
par: Zhang, Xiaoman, et autres
Publié: (2023)
Visual Spatial Tuning
par: Yang, Rui, et autres
Publié: (2025)
par: Yang, Rui, et autres
Publié: (2025)
Visual-RFT: Visual Reinforcement Fine-Tuning
par: Liu, Ziyu, et autres
Publié: (2025)
par: Liu, Ziyu, et autres
Publié: (2025)
GeoDE: a Geographically Diverse Evaluation Dataset for Object Recognition
par: Ramaswamy, Vikram V., et autres
Publié: (2023)
par: Ramaswamy, Vikram V., et autres
Publié: (2023)
Minimal Interaction Separated Tuning: A New Paradigm for Visual Adaptation
par: Tang, Ningyuan, et autres
Publié: (2024)
par: Tang, Ningyuan, et autres
Publié: (2024)
Interactivity x Explainability: Toward Understanding How Interactivity Can Improve Computer Vision Explanations
par: Panigrahi, Indu, et autres
Publié: (2025)
par: Panigrahi, Indu, et autres
Publié: (2025)
Personalized Visual Instruction Tuning
par: Pi, Renjie, et autres
Publié: (2024)
par: Pi, Renjie, et autres
Publié: (2024)
Generative Visual Instruction Tuning
par: Hernandez, Jefferson, et autres
Publié: (2024)
par: Hernandez, Jefferson, et autres
Publié: (2024)
Comparison Visual Instruction Tuning
par: Lin, Wei, et autres
Publié: (2024)
par: Lin, Wei, et autres
Publié: (2024)
Visual Fourier Prompt Tuning
par: Zeng, Runjia, et autres
Publié: (2024)
par: Zeng, Runjia, et autres
Publié: (2024)
4DR P2T: 4D Radar Tensor Synthesis with Point Clouds
par: Jung, Woo-Jin, et autres
Publié: (2025)
par: Jung, Woo-Jin, et autres
Publié: (2025)
Enhanced 3D Object Detection via Diverse Feature Representations of 4D Radar Tensor
par: Song, Seung-Hyun, et autres
Publié: (2025)
par: Song, Seung-Hyun, et autres
Publié: (2025)
Attention to the Burstiness in Visual Prompt Tuning!
par: Wang, Yuzhu, et autres
Publié: (2025)
par: Wang, Yuzhu, et autres
Publié: (2025)
Visual Variational Autoencoder Prompt Tuning
par: Xiao, Xi, et autres
Publié: (2025)
par: Xiao, Xi, et autres
Publié: (2025)
FastTracker: Real-Time and Accurate Visual Tracking
par: Hashempoor, Hamidreza, et autres
Publié: (2025)
par: Hashempoor, Hamidreza, et autres
Publié: (2025)
Documents similaires
-
Beyond Objects: Contextual Synthetic Data Generation for Fine-Grained Classification
par: Yang, William, et autres
Publié: (2025) -
The Impact of Coreset Selection on Spurious Correlations and Group Robustness
par: Dharmasiri, Amaya, et autres
Publié: (2025) -
ConceptMix: A Compositional Image Generation Benchmark with Controllable Difficulty
par: Wu, Xindi, et autres
Publié: (2024) -
Vision-Language Dataset Distillation
par: Wu, Xindi, et autres
Publié: (2023) -
Bias at the End of the Score
par: Magid, Salma Abdel, et autres
Publié: (2026)