Learning Hyperspectral Images with Curated Text Prompts for Efficient Multimodal Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chatterjee, Abhiroop, Ghosh, Susmita |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Self-supervised Learning for Hyperspectral Images of Trees
par: Rahman, Moqsadur, et autres
Publié: (2025)
par: Rahman, Moqsadur, et autres
Publié: (2025)
Image Captions are Natural Prompts for Text-to-Image Models
par: Lei, Shiye, et autres
Publié: (2023)
par: Lei, Shiye, et autres
Publié: (2023)
Revisiting Aerial Scene Classification on the AID Benchmark
par: Das, Subhajeet, et autres
Publié: (2026)
par: Das, Subhajeet, et autres
Publié: (2026)
Alignment-Guided Score Matching for Text-to-Image Alignment in Diffusion Models
par: Lee, Jaa-Yeon, et autres
Publié: (2026)
par: Lee, Jaa-Yeon, et autres
Publié: (2026)
Hybrid Deep Learning for Hyperspectral Single Image Super-Resolution
par: Muhammad, Usman, et autres
Publié: (2025)
par: Muhammad, Usman, et autres
Publié: (2025)
Gramian Multimodal Representation Learning and Alignment
par: Cicchetti, Giordano, et autres
Publié: (2024)
par: Cicchetti, Giordano, et autres
Publié: (2024)
Improving GFlowNets for Text-to-Image Diffusion Alignment
par: Zhang, Dinghuai, et autres
Publié: (2024)
par: Zhang, Dinghuai, et autres
Publié: (2024)
Towards Evaluating Robustness of Prompt Adherence in Text to Image Models
par: Vemishetty, Sujith, et autres
Publié: (2025)
par: Vemishetty, Sujith, et autres
Publié: (2025)
An Efficient and Explanatory Image and Text Clustering System with Multimodal Autoencoder Architecture
par: Shi, Tiancheng, et autres
Publié: (2024)
par: Shi, Tiancheng, et autres
Publié: (2024)
AlignGuard: Scalable Safety Alignment for Text-to-Image Generation
par: Liu, Runtao, et autres
Publié: (2024)
par: Liu, Runtao, et autres
Publié: (2024)
Minority-Focused Text-to-Image Generation via Prompt Optimization
par: Um, Soobin, et autres
Publié: (2024)
par: Um, Soobin, et autres
Publié: (2024)
Test-Time Alignment of Text-to-Image Diffusion Models via Null-Text Embedding Optimisation
par: Kim, Taehoon, et autres
Publié: (2025)
par: Kim, Taehoon, et autres
Publié: (2025)
Label Semantics for Robust Hyperspectral Image Classification
par: Hassan, Rafin, et autres
Publié: (2025)
par: Hassan, Rafin, et autres
Publié: (2025)
Optimizing Negative Prompts for Enhanced Aesthetics and Fidelity in Text-To-Image Generation
par: Ogezi, Michael, et autres
Publié: (2024)
par: Ogezi, Michael, et autres
Publié: (2024)
Prompt Optimizer of Text-to-Image Diffusion Models for Abstract Concept Understanding
par: Fan, Zezhong, et autres
Publié: (2024)
par: Fan, Zezhong, et autres
Publié: (2024)
Naïve PAINE: Lightweight Text-to-Image Generation Improvement with Prompt Evaluation
par: Kim, Joong Ho, et autres
Publié: (2026)
par: Kim, Joong Ho, et autres
Publié: (2026)
Distilled Prompt Learning for Incomplete Multimodal Survival Prediction
par: Xu, Yingxue, et autres
Publié: (2025)
par: Xu, Yingxue, et autres
Publié: (2025)
One-Prompt-One-Story: Free-Lunch Consistent Text-to-Image Generation Using a Single Prompt
par: Liu, Tao, et autres
Publié: (2025)
par: Liu, Tao, et autres
Publié: (2025)
Zero-Residual Concept Erasure via Progressive Alignment in Text-to-Image Model
par: Chen, Hongxu, et autres
Publié: (2025)
par: Chen, Hongxu, et autres
Publié: (2025)
Text-to-Image Diffusion Models Cannot Count, and Prompt Refinement Cannot Help
par: Guo, Xuyang, et autres
Publié: (2025)
par: Guo, Xuyang, et autres
Publié: (2025)
Prompt-Based Safety Guidance Is Ineffective for Unlearned Text-to-Image Diffusion Models
par: Shin, Jiwoo, et autres
Publié: (2025)
par: Shin, Jiwoo, et autres
Publié: (2025)
CLEFT: Language-Image Contrastive Learning with Efficient Large Language Model and Prompt Fine-Tuning
par: Du, Yuexi, et autres
Publié: (2024)
par: Du, Yuexi, et autres
Publié: (2024)
Cross-Domain Few-Shot Learning for Hyperspectral Image Classification Based on Mixup Foundation Model
par: Paeedeh, Naeem, et autres
Publié: (2026)
par: Paeedeh, Naeem, et autres
Publié: (2026)
Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs
par: Yang, Ling, et autres
Publié: (2024)
par: Yang, Ling, et autres
Publié: (2024)
DiffBlender: Composable and Versatile Multimodal Text-to-Image Diffusion Models
par: Kim, Sungnyun, et autres
Publié: (2023)
par: Kim, Sungnyun, et autres
Publié: (2023)
Free$^2$Guide: Training-Free Text-to-Video Alignment using Image LVLM
par: Kim, Jaemin, et autres
Publié: (2024)
par: Kim, Jaemin, et autres
Publié: (2024)
Hyperdimensional Cross-Modal Alignment of Frozen Language and Image Models for Efficient Image Captioning
par: Dalvi, Abhishek, et autres
Publié: (2026)
par: Dalvi, Abhishek, et autres
Publié: (2026)
Lightweight Cloud Masking Models for On-Board Inference in Hyperspectral Imaging
par: Ali, Mazen, et autres
Publié: (2025)
par: Ali, Mazen, et autres
Publié: (2025)
Learning Relative Representations for Fine-Grained Multimodal Alignment with Limited Data
par: Kim, Shiwon, et autres
Publié: (2026)
par: Kim, Shiwon, et autres
Publié: (2026)
Secure and Storage-Efficient Deep Learning Models for Edge AI Using Automatic Weight Generation
par: Rahaman, Habibur, et autres
Publié: (2025)
par: Rahaman, Habibur, et autres
Publié: (2025)
Whose View of Safety? A Deep DIVE Dataset for Pluralistic Alignment of Text-to-Image Models
par: Rastogi, Charvi, et autres
Publié: (2025)
par: Rastogi, Charvi, et autres
Publié: (2025)
AutoRubric-T2I: Robust Rule-Based Reward Model for Text-to-Image Alignment
par: Kao, Kuei-Chun, et autres
Publié: (2026)
par: Kao, Kuei-Chun, et autres
Publié: (2026)
TIAM -- A Metric for Evaluating Alignment in Text-to-Image Generation
par: Grimal, Paul, et autres
Publié: (2023)
par: Grimal, Paul, et autres
Publié: (2023)
PromptLoop: Plug-and-Play Prompt Refinement via Latent Feedback for Diffusion Model Alignment
par: Lee, Suhyeon, et autres
Publié: (2025)
par: Lee, Suhyeon, et autres
Publié: (2025)
Skrr: Skip and Re-use Text Encoder Layers for Memory Efficient Text-to-Image Generation
par: Seo, Hoigi, et autres
Publié: (2025)
par: Seo, Hoigi, et autres
Publié: (2025)
Efficient Multi-turn RL for GUI Agents via Decoupled Training and Adaptive Data Curation
par: Li, Pengxiang, et autres
Publié: (2025)
par: Li, Pengxiang, et autres
Publié: (2025)
REP: Resource-Efficient Prompting for Rehearsal-Free Continual Learning
par: Jeon, Sungho, et autres
Publié: (2024)
par: Jeon, Sungho, et autres
Publié: (2024)
SCITUNE: Aligning Large Language Models with Human-Curated Scientific Multimodal Instructions
par: Horawalavithana, Sameera, et autres
Publié: (2023)
par: Horawalavithana, Sameera, et autres
Publié: (2023)
Automatic Data Curation for Self-Supervised Learning: A Clustering-Based Approach
par: Vo, Huy V., et autres
Publié: (2024)
par: Vo, Huy V., et autres
Publié: (2024)
Reconstruction Alignment Improves Unified Multimodal Models
par: Xie, Ji, et autres
Publié: (2025)
par: Xie, Ji, et autres
Publié: (2025)
Documents similaires
-
Self-supervised Learning for Hyperspectral Images of Trees
par: Rahman, Moqsadur, et autres
Publié: (2025) -
Image Captions are Natural Prompts for Text-to-Image Models
par: Lei, Shiye, et autres
Publié: (2023) -
Revisiting Aerial Scene Classification on the AID Benchmark
par: Das, Subhajeet, et autres
Publié: (2026) -
Alignment-Guided Score Matching for Text-to-Image Alignment in Diffusion Models
par: Lee, Jaa-Yeon, et autres
Publié: (2026) -
Hybrid Deep Learning for Hyperspectral Single Image Super-Resolution
par: Muhammad, Usman, et autres
Publié: (2025)