Variance-Aware Loss Scheduling for Multimodal Alignment in Low-Data Settings
Fuente:
arXiv
Saved in:
| Main Author: | Pillai, Sneh |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MMR1: Enhancing Multimodal Reasoning with Variance-Aware Sampling and Open Resources
by: Leng, Sicong, et al.
Published: (2025)
by: Leng, Sicong, et al.
Published: (2025)
Learning to Fuse: Modality-Aware Adaptive Scheduling for Robust Multimodal Foundation Models
by: Bennett, Liam, et al.
Published: (2025)
by: Bennett, Liam, et al.
Published: (2025)
Prototype-Aware Multimodal Alignment for Open-Vocabulary Visual Grounding
by: Xie, Jiangnan, et al.
Published: (2025)
by: Xie, Jiangnan, et al.
Published: (2025)
Deep Generative Data Assimilation in Multimodal Setting
by: Qu, Yongquan, et al.
Published: (2024)
by: Qu, Yongquan, et al.
Published: (2024)
Taming Sampling Perturbations with Variance Expansion Loss for Latent Diffusion Models
by: Li, Qifan, et al.
Published: (2026)
by: Li, Qifan, et al.
Published: (2026)
Set-CLIP: Exploring Aligned Semantic From Low-Alignment Multimodal Data Through A Distribution View
by: Song, Zijia, et al.
Published: (2024)
by: Song, Zijia, et al.
Published: (2024)
Transformer Based Self-Context Aware Prediction for Few-Shot Anomaly Detection in Videos
by: Pillai, Gargi V., et al.
Published: (2025)
by: Pillai, Gargi V., et al.
Published: (2025)
EAMA : Entity-Aware Multimodal Alignment Based Approach for News Image Captioning
by: Zhang, Junzhe, et al.
Published: (2024)
by: Zhang, Junzhe, et al.
Published: (2024)
VCR: Variance-Driven Channel Recalibration for Robust Low-Light Enhancement
by: Cheng, Zhixin, et al.
Published: (2026)
by: Cheng, Zhixin, et al.
Published: (2026)
Scheduling Weight Transitions for Quantization-Aware Training
by: Lee, Junghyup, et al.
Published: (2024)
by: Lee, Junghyup, et al.
Published: (2024)
Multimodal Alignment and Fusion: A Survey
by: Li, Songtao, et al.
Published: (2024)
by: Li, Songtao, et al.
Published: (2024)
The Indra Representation Hypothesis for Multimodal Alignment
by: Lu, Jianglin, et al.
Published: (2026)
by: Lu, Jianglin, et al.
Published: (2026)
VCD-Texture: Variance Alignment based 3D-2D Co-Denoising for Text-Guided Texturing
by: Liu, Shang, et al.
Published: (2024)
by: Liu, Shang, et al.
Published: (2024)
MSR-Align: Policy-Grounded Multimodal Alignment for Safety-Aware Reasoning in Vision-Language Models
by: Xia, Yinan, et al.
Published: (2025)
by: Xia, Yinan, et al.
Published: (2025)
Variance-Aware Adaptive Weighting for Diffusion Model Training
by: Sun, Nanlong, et al.
Published: (2026)
by: Sun, Nanlong, et al.
Published: (2026)
DyMO: Training-Free Diffusion Model Alignment with Dynamic Multi-Objective Scheduling
by: Xie, Xin, et al.
Published: (2024)
by: Xie, Xin, et al.
Published: (2024)
Perceive What Matters: Relevance-Driven Scheduling for Multimodal Streaming Perception
by: Huang, Dingcheng, et al.
Published: (2026)
by: Huang, Dingcheng, et al.
Published: (2026)
Semantic Alignment for Multimodal Large Language Models
by: Wu, Tao, et al.
Published: (2024)
by: Wu, Tao, et al.
Published: (2024)
Taxonomy-Aware Representation Alignment for Hierarchical Visual Recognition with Large Multimodal Models
by: He, Hulingxiao, et al.
Published: (2026)
by: He, Hulingxiao, et al.
Published: (2026)
Beyond Hallucinations: A Multimodal-Guided Task-Aware Generative Image Compression for Ultra-Low Bitrate
by: Wang, Kaile, et al.
Published: (2025)
by: Wang, Kaile, et al.
Published: (2025)
Unified Directly Denoising for Both Variance Preserving and Variance Exploding Diffusion Models
by: Wang, Jingjing, et al.
Published: (2024)
by: Wang, Jingjing, et al.
Published: (2024)
Enhancing Virtual Try-On with Synthetic Pairs and Error-Aware Noise Scheduling
by: Li, Nannan, et al.
Published: (2025)
by: Li, Nannan, et al.
Published: (2025)
Depth Edge Alignment Loss: DEALing with Depth in Weakly Supervised Semantic Segmentation
by: Schmidt, Patrick, et al.
Published: (2025)
by: Schmidt, Patrick, et al.
Published: (2025)
SGMA: Semantic-Guided Modality-Aware Segmentation for Remote Sensing with Incomplete Multimodal Data
by: Wen, Lekang, et al.
Published: (2026)
by: Wen, Lekang, et al.
Published: (2026)
On the Global Photometric Alignment for Low-Level Vision
by: Li, Mingjia, et al.
Published: (2026)
by: Li, Mingjia, et al.
Published: (2026)
Multi-speaker Attention Alignment for Multimodal Social Interaction
by: Ouyang, Liangyang, et al.
Published: (2025)
by: Ouyang, Liangyang, et al.
Published: (2025)
Visual Representation Alignment for Multimodal Large Language Models
by: Yoon, Heeji, et al.
Published: (2025)
by: Yoon, Heeji, et al.
Published: (2025)
Harnessing Frozen Unimodal Encoders for Flexible Multimodal Alignment
by: Maniparambil, Mayug, et al.
Published: (2024)
by: Maniparambil, Mayug, et al.
Published: (2024)
GuideDog: A Real-World Egocentric Multimodal Dataset for Blind and Low-Vision Accessibility-Aware Guidance
by: Kim, Junhyeok, et al.
Published: (2025)
by: Kim, Junhyeok, et al.
Published: (2025)
Denoised Diffusion for Object-Focused Image Augmentation
by: Pillai, Nisha
Published: (2025)
by: Pillai, Nisha
Published: (2025)
Gradient-Aware Logit Adjustment Loss for Long-tailed Classifier
by: Zhang, Fan, et al.
Published: (2024)
by: Zhang, Fan, et al.
Published: (2024)
Instance Awareness of Multi-class Semantic Segmentation Loss Functions
by: Kundu, Soumya Snigdha, et al.
Published: (2026)
by: Kundu, Soumya Snigdha, et al.
Published: (2026)
Beyond Loss Values: Robust Dynamic Pruning via Loss Trajectory Alignment
by: Qin, Huaiyuan, et al.
Published: (2026)
by: Qin, Huaiyuan, et al.
Published: (2026)
Dynamic Modality Scheduling for Multimodal Large Models via Confidence, Uncertainty, and Semantic Consistency
by: Tanaka, Hiroshi, et al.
Published: (2025)
by: Tanaka, Hiroshi, et al.
Published: (2025)
Instruction-augmented Multimodal Alignment for Image-Text and Element Matching
by: Yue, Xinli, et al.
Published: (2025)
by: Yue, Xinli, et al.
Published: (2025)
Graph-Based Multimodal and Multi-view Alignment for Keystep Recognition
by: Romero, Julia Lee, et al.
Published: (2025)
by: Romero, Julia Lee, et al.
Published: (2025)
Divide and Conquer: Decoupled Representation Alignment for Multimodal World Models
by: Xiao, Junyuan, et al.
Published: (2026)
by: Xiao, Junyuan, et al.
Published: (2026)
LatentUMM: Dual Latent Alignment for Unified Multimodal Models
by: Luo, Yinyi, et al.
Published: (2026)
by: Luo, Yinyi, et al.
Published: (2026)
Assessment of Multimodal Large Language Models in Alignment with Human Values
by: Shi, Zhelun, et al.
Published: (2024)
by: Shi, Zhelun, et al.
Published: (2024)
Latent Denoising Improves Visual Alignment in Large Multimodal Models
by: Parikh, Dhruv, et al.
Published: (2026)
by: Parikh, Dhruv, et al.
Published: (2026)
Similar Items
-
MMR1: Enhancing Multimodal Reasoning with Variance-Aware Sampling and Open Resources
by: Leng, Sicong, et al.
Published: (2025) -
Learning to Fuse: Modality-Aware Adaptive Scheduling for Robust Multimodal Foundation Models
by: Bennett, Liam, et al.
Published: (2025) -
Prototype-Aware Multimodal Alignment for Open-Vocabulary Visual Grounding
by: Xie, Jiangnan, et al.
Published: (2025) -
Deep Generative Data Assimilation in Multimodal Setting
by: Qu, Yongquan, et al.
Published: (2024) -
Taming Sampling Perturbations with Variance Expansion Loss for Latent Diffusion Models
by: Li, Qifan, et al.
Published: (2026)