MoralCLIP: Contrastive Alignment of Vision-and-Language Representations with Moral Foundations Theory
Fuente:
arXiv
Guardado en:
| Autores principales: | Condez, Ana Carolina, Tavares, Diogo, Magalhães, João |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
$β$-CLIP: Text-Conditioned Contrastive Learning for Multi-Granular Vision-Language Alignment
por: Zohra, Fatimah, et al.
Publicado: (2025)
por: Zohra, Fatimah, et al.
Publicado: (2025)
Show and Guide: Instructional-Plan Grounded Vision and Language Model
por: Glória-Silva, Diogo, et al.
Publicado: (2024)
por: Glória-Silva, Diogo, et al.
Publicado: (2024)
ClearCLIP: Decomposing CLIP Representations for Dense Vision-Language Inference
por: Lan, Mengcheng, et al.
Publicado: (2024)
por: Lan, Mengcheng, et al.
Publicado: (2024)
CapCLIP: A Vision-Language Representation Alignment Approach for Wireless Capsule Endoscopy Analysis
por: Wahab, Haroon, et al.
Publicado: (2026)
por: Wahab, Haroon, et al.
Publicado: (2026)
HarmoCLIP: Harmonizing Global and Regional Representations in Contrastive Vision-Language Models
por: Zeng, Haoxi, et al.
Publicado: (2025)
por: Zeng, Haoxi, et al.
Publicado: (2025)
PowerCLIP: Powerset Alignment for Contrastive Pre-Training
por: Kawamura, Masaki, et al.
Publicado: (2025)
por: Kawamura, Masaki, et al.
Publicado: (2025)
RWKV-CLIP: A Robust Vision-Language Representation Learner
por: Gu, Tiancheng, et al.
Publicado: (2024)
por: Gu, Tiancheng, et al.
Publicado: (2024)
DOFA-CLIP: Multimodal Vision-Language Foundation Models for Earth Observation
por: Xiong, Zhitong, et al.
Publicado: (2025)
por: Xiong, Zhitong, et al.
Publicado: (2025)
RemoteCLIP: A Vision Language Foundation Model for Remote Sensing
por: Liu, Fan, et al.
Publicado: (2023)
por: Liu, Fan, et al.
Publicado: (2023)
ProCLIP: Progressive Vision-Language Alignment via LLM-based Embedder
por: Hu, Xiaoxing, et al.
Publicado: (2025)
por: Hu, Xiaoxing, et al.
Publicado: (2025)
MM-MoralBench: A MultiModal Moral Evaluation Benchmark for Large Vision-Language Models
por: Yan, Bei, et al.
Publicado: (2024)
por: Yan, Bei, et al.
Publicado: (2024)
Time Series, Vision, and Language: Exploring the Limits of Alignment in Contrastive Representation Spaces
por: Yashwante, Pratham, et al.
Publicado: (2026)
por: Yashwante, Pratham, et al.
Publicado: (2026)
Cascade-CLIP: Cascaded Vision-Language Embeddings Alignment for Zero-Shot Semantic Segmentation
por: Li, Yunheng, et al.
Publicado: (2024)
por: Li, Yunheng, et al.
Publicado: (2024)
CLIP-GS: Unifying Vision-Language Representation with 3D Gaussian Splatting
por: Jiao, Siyu, et al.
Publicado: (2024)
por: Jiao, Siyu, et al.
Publicado: (2024)
HiMo-CLIP: Modeling Semantic Hierarchy and Monotonicity in Vision-Language Alignment
por: Wu, Ruijia, et al.
Publicado: (2025)
por: Wu, Ruijia, et al.
Publicado: (2025)
PinCLIP: Large-scale Foundational Multimodal Representation at Pinterest
por: Beal, Josh, et al.
Publicado: (2026)
por: Beal, Josh, et al.
Publicado: (2026)
Multilingual Vision-Language Pre-training for the Remote Sensing Domain
por: Silva, João Daniel, et al.
Publicado: (2024)
por: Silva, João Daniel, et al.
Publicado: (2024)
DGTRSD & DGTRS-CLIP: A Dual-Granularity Remote Sensing Image-Text Dataset and Vision Language Foundation Model for Alignment
por: Chen, Weizhi, et al.
Publicado: (2025)
por: Chen, Weizhi, et al.
Publicado: (2025)
An Efficient and Effective Encoder Model for Vision and Language Tasks in the Remote Sensing Domain
por: Silva, João Daniel, et al.
Publicado: (2025)
por: Silva, João Daniel, et al.
Publicado: (2025)
AquaticCLIP: A Vision-Language Foundation Model for Underwater Scene Analysis
por: Alawode, Basit, et al.
Publicado: (2025)
por: Alawode, Basit, et al.
Publicado: (2025)
Enhancing Representation in Radiography-Reports Foundation Model: A Granular Alignment Algorithm Using Masked Contrastive Learning
por: Huang, Weijian, et al.
Publicado: (2023)
por: Huang, Weijian, et al.
Publicado: (2023)
Ultrasound Vision-Language Alignment via Contrastive Learning
por: Lyu, Zhuoyang, et al.
Publicado: (2026)
por: Lyu, Zhuoyang, et al.
Publicado: (2026)
Look Before Acting: Enhancing Vision Foundation Representations for Vision-Language-Action Models
por: Luo, Yulin, et al.
Publicado: (2026)
por: Luo, Yulin, et al.
Publicado: (2026)
Representation Alignment Contrastive Regularization for Multi-Object Tracking
por: Liu, Zhonglin, et al.
Publicado: (2024)
por: Liu, Zhonglin, et al.
Publicado: (2024)
InfoCLIP: Bridging Vision-Language Pretraining and Open-Vocabulary Semantic Segmentation via Information-Theoretic Alignment Transfer
por: Yuan, Muyao, et al.
Publicado: (2025)
por: Yuan, Muyao, et al.
Publicado: (2025)
Joint Vision-Language Social Bias Removal for CLIP
por: Zhang, Haoyu, et al.
Publicado: (2024)
por: Zhang, Haoyu, et al.
Publicado: (2024)
FairCLIP: Harnessing Fairness in Vision-Language Learning
por: Luo, Yan, et al.
Publicado: (2024)
por: Luo, Yan, et al.
Publicado: (2024)
MORALISE: A Structured Benchmark for Moral Alignment in Visual Language Models
por: Lin, Xiao, et al.
Publicado: (2025)
por: Lin, Xiao, et al.
Publicado: (2025)
Do VLMs Have a Moral Backbone? A Study on the Fragile Morality of Vision-Language Models
por: Liu, Zhining, et al.
Publicado: (2026)
por: Liu, Zhining, et al.
Publicado: (2026)
MTA-CLIP: Language-Guided Semantic Segmentation with Mask-Text Alignment
por: Das, Anurag, et al.
Publicado: (2024)
por: Das, Anurag, et al.
Publicado: (2024)
Non-Contrastive Vision-Language Learning with Predictive Embedding Alignment
por: Kuhn, Lukas, et al.
Publicado: (2026)
por: Kuhn, Lukas, et al.
Publicado: (2026)
Collaborative Representation Learning for Alignment of Tactile, Language, and Vision Modalities
por: Zhou, Yiyun, et al.
Publicado: (2025)
por: Zhou, Yiyun, et al.
Publicado: (2025)
SmartCLIP: Modular Vision-language Alignment with Identification Guarantees
por: Xie, Shaoan, et al.
Publicado: (2025)
por: Xie, Shaoan, et al.
Publicado: (2025)
GeoAlignCLIP: Enhancing Fine-Grained Vision-Language Alignment in Remote Sensing via Multi-Granular Consistency Learning
por: Yang, Xiao, et al.
Publicado: (2026)
por: Yang, Xiao, et al.
Publicado: (2026)
Contrast-Aware Calibration for Fine-Tuned CLIP: Leveraging Image-Text Alignment
por: Lv, Song-Lin, et al.
Publicado: (2025)
por: Lv, Song-Lin, et al.
Publicado: (2025)
MaskedCLIP: Bridging the Masked and CLIP Space for Semi-Supervised Medical Vision-Language Pre-training
por: Zhu, Lei, et al.
Publicado: (2025)
por: Zhu, Lei, et al.
Publicado: (2025)
MR-CLIP: Efficient Metadata-Guided Learning of MRI Contrast Representations
por: Avci, Mehmet Yigit, et al.
Publicado: (2025)
por: Avci, Mehmet Yigit, et al.
Publicado: (2025)
TripletCLIP: Improving Compositional Reasoning of CLIP via Synthetic Vision-Language Negatives
por: Patel, Maitreya, et al.
Publicado: (2024)
por: Patel, Maitreya, et al.
Publicado: (2024)
Benchmarking Vision-Language Contrastive Methods for Medical Representation Learning
por: Roy, Shuvendu, et al.
Publicado: (2024)
por: Roy, Shuvendu, et al.
Publicado: (2024)
Fine-Grained Spatiotemporal Motion Alignment for Contrastive Video Representation Learning
por: Zhu, Minghao, et al.
Publicado: (2023)
por: Zhu, Minghao, et al.
Publicado: (2023)
Ejemplares similares
-
$β$-CLIP: Text-Conditioned Contrastive Learning for Multi-Granular Vision-Language Alignment
por: Zohra, Fatimah, et al.
Publicado: (2025) -
Show and Guide: Instructional-Plan Grounded Vision and Language Model
por: Glória-Silva, Diogo, et al.
Publicado: (2024) -
ClearCLIP: Decomposing CLIP Representations for Dense Vision-Language Inference
por: Lan, Mengcheng, et al.
Publicado: (2024) -
CapCLIP: A Vision-Language Representation Alignment Approach for Wireless Capsule Endoscopy Analysis
por: Wahab, Haroon, et al.
Publicado: (2026) -
HarmoCLIP: Harmonizing Global and Regional Representations in Contrastive Vision-Language Models
por: Zeng, Haoxi, et al.
Publicado: (2025)