CLIP-PING: Boosting Lightweight Vision-Language Models with Proximus Intrinsic Neighbors Guidance
Fuente:
arXiv
Guardado en:
| Autores principales: | Thwal, Chu Myaet, Tun, Ye Lin, Nguyen, Minh N. H., Huh, Eui-Nam, Hong, Choong Seon |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Attention on Personalized Clinical Decision Support System: Federated Learning Approach
por: Thwal, Chu Myaet, et al.
Publicado: (2024)
por: Thwal, Chu Myaet, et al.
Publicado: (2024)
Resource-efficient Layer-wise Federated Self-supervised Learning
por: Tun, Ye Lin, et al.
Publicado: (2024)
por: Tun, Ye Lin, et al.
Publicado: (2024)
Cross-Domain Federated Semantic Communication with Global Representation Alignment and Domain-Aware Aggregation
por: Nguyen, Loc X., et al.
Publicado: (2025)
por: Nguyen, Loc X., et al.
Publicado: (2025)
Resource-Efficient Federated Multimodal Learning via Layer-wise and Progressive Training
por: Tun, Ye Lin, et al.
Publicado: (2024)
por: Tun, Ye Lin, et al.
Publicado: (2024)
Cross-Modal Prototype based Multimodal Federated Learning under Severely Missing Modality
por: Le, Huy Q., et al.
Publicado: (2024)
por: Le, Huy Q., et al.
Publicado: (2024)
Anchor-Aided Multi-User Semantic Communication with Adaptive Decoders
por: Nguyen, Loc X., et al.
Publicado: (2026)
por: Nguyen, Loc X., et al.
Publicado: (2026)
OnDev-LCT: On-Device Lightweight Convolutional Transformers towards federated learning
por: Thwal, Chu Myaet, et al.
Publicado: (2024)
por: Thwal, Chu Myaet, et al.
Publicado: (2024)
Interest-Aware Joint Caching, Computing, and Communication Optimization for Mobile VR Delivery in MEC Networks
por: Fu, Baojie, et al.
Publicado: (2024)
por: Fu, Baojie, et al.
Publicado: (2024)
Integrated Sensing and Communication for 6G Holographic Digital Twins
por: Zhang, Haijun, et al.
Publicado: (2025)
por: Zhang, Haijun, et al.
Publicado: (2025)
Leveraging Weak Cross-Modal Guidance for Coherence Modelling via Iterative Learning
por: Bin, Yi, et al.
Publicado: (2024)
por: Bin, Yi, et al.
Publicado: (2024)
On the Brittleness of CLIP Text Encoders
por: Tran, Allie, et al.
Publicado: (2025)
por: Tran, Allie, et al.
Publicado: (2025)
Flight Patterns for Swarms of Drones
por: Zhu, Shuqin, et al.
Publicado: (2024)
por: Zhu, Shuqin, et al.
Publicado: (2024)
A Conceptual Model of Intelligent Multimedia Data Rendered using Flying Light Specks
por: Yazdani, Nima, et al.
Publicado: (2024)
por: Yazdani, Nima, et al.
Publicado: (2024)
Don't Lose Yourself: Boosting Multimodal Recommendation via Reducing Node-neighbor Discrepancy in Graph Convolutional Network
por: Chen, Zheyu, et al.
Publicado: (2024)
por: Chen, Zheyu, et al.
Publicado: (2024)
The State-of-the-Art in Lifelog Retrieval: A Review of Progress at the ACM Lifelog Search Challenge Workshop 2022-24
por: Tran, Allie, et al.
Publicado: (2025)
por: Tran, Allie, et al.
Publicado: (2025)
DeepSeek-Inspired Exploration of RL-based LLMs and Synergy with Wireless Networks: A Survey
por: Qiao, Yu, et al.
Publicado: (2025)
por: Qiao, Yu, et al.
Publicado: (2025)
Multimodal Learned Sparse Retrieval for Image Suggestion
por: Nguyen, Thong, et al.
Publicado: (2024)
por: Nguyen, Thong, et al.
Publicado: (2024)
PianoBind: A Multimodal Joint Embedding Model for Pop-piano Music
por: Bang, Hayeon, et al.
Publicado: (2025)
por: Bang, Hayeon, et al.
Publicado: (2025)
RAG-VisualRec: An Open Resource for Vision- and Text-Enhanced Retrieval-Augmented Generation in Recommendation
por: Tourani, Ali, et al.
Publicado: (2025)
por: Tourani, Ali, et al.
Publicado: (2025)
Adaptive Quantum Scaling Model for Histogram Distribution-based Quantum Watermarking
por: Xing, Zheng, et al.
Publicado: (2025)
por: Xing, Zheng, et al.
Publicado: (2025)
Defining Quantum Games
por: Piispanen, Laura, et al.
Publicado: (2022)
por: Piispanen, Laura, et al.
Publicado: (2022)
Conquering High Packet-Loss Erasure: MoE Swin Transformer-Based Video Semantic Communication
por: Teng, Lei, et al.
Publicado: (2025)
por: Teng, Lei, et al.
Publicado: (2025)
Agentic Mixed-Source Multi-Modal Misinformation Detection with Adaptive Test-Time Scaling
por: Jiang, Wei, et al.
Publicado: (2026)
por: Jiang, Wei, et al.
Publicado: (2026)
An Empirical Study of Excitation and Aggregation Design Adaptions in CLIP4Clip for Video-Text Retrieval
por: Jing, Xiaolun, et al.
Publicado: (2024)
por: Jing, Xiaolun, et al.
Publicado: (2024)
OpenLifelogQA: An Open-Ended Multi-Modal Lifelog Question-Answering Dataset
por: Tran, Quang-Linh, et al.
Publicado: (2025)
por: Tran, Quang-Linh, et al.
Publicado: (2025)
Transformers with Attentive Federated Aggregation for Time Series Stock Forecasting
por: Thwal, Chu Myaet, et al.
Publicado: (2024)
por: Thwal, Chu Myaet, et al.
Publicado: (2024)
Technology Mapping with Large Language Models
por: Nguyen, Minh Hieu, et al.
Publicado: (2025)
por: Nguyen, Minh Hieu, et al.
Publicado: (2025)
Thin-Client Interactive Gaussian Adaptive Streaming over HTTP/3
por: Artioli, Emanuele, et al.
Publicado: (2026)
por: Artioli, Emanuele, et al.
Publicado: (2026)
The Immersive Archive: Archival Strategies for the Sensorama & Sutherland HMD
por: Abes, Zeynep, et al.
Publicado: (2025)
por: Abes, Zeynep, et al.
Publicado: (2025)
The Sound of Entanglement
por: Rodríguez, Enar de Dios, et al.
Publicado: (2025)
por: Rodríguez, Enar de Dios, et al.
Publicado: (2025)
Multimodal Misinformation Detection using Large Vision-Language Models
por: Tahmasebi, Sahar, et al.
Publicado: (2024)
por: Tahmasebi, Sahar, et al.
Publicado: (2024)
Semantic Communication Enabled 6G-NTN Framework: A Novel Denoising and Gateway Hop Integration Mechanism
por: Nguyen, Loc X., et al.
Publicado: (2024)
por: Nguyen, Loc X., et al.
Publicado: (2024)
Hierarchical Vision-Language Reasoning for Multimodal Multiple-Choice Question Answering
por: Zhou, Ao, et al.
Publicado: (2025)
por: Zhou, Ao, et al.
Publicado: (2025)
Verifying Cross-modal Entity Consistency in News using Vision-language Models
por: Tahmasebi, Sahar, et al.
Publicado: (2025)
por: Tahmasebi, Sahar, et al.
Publicado: (2025)
Learning Item Representations Directly from Multimodal Features for Effective Recommendation
por: Zhou, Xin, et al.
Publicado: (2025)
por: Zhou, Xin, et al.
Publicado: (2025)
StePO-Rec: Towards Personalized Outfit Styling Assistant via Knowledge-Guided Multi-Step Reasoning
por: Bi, Yuxi, et al.
Publicado: (2025)
por: Bi, Yuxi, et al.
Publicado: (2025)
Does Multimodality Improve Recommender Systems as Expected? A Critical Analysis and Future Directions
por: Zhou, Hongyu, et al.
Publicado: (2025)
por: Zhou, Hongyu, et al.
Publicado: (2025)
Dual-Diffusional Generative Fashion Recommendation
por: Yu, Mingzhe, et al.
Publicado: (2026)
por: Yu, Mingzhe, et al.
Publicado: (2026)
Beyond Static Collision Handling: Adaptive Semantic ID Learning for Multimodal Recommendation at Industrial Scale
por: Pan, Yongsen, et al.
Publicado: (2026)
por: Pan, Yongsen, et al.
Publicado: (2026)
Modality-Aware Identity Construction and Counterfactual Structure Learning for ID-Free Multimodal Recommendation
por: Ma, Hongjian, et al.
Publicado: (2026)
por: Ma, Hongjian, et al.
Publicado: (2026)
Ejemplares similares
-
Attention on Personalized Clinical Decision Support System: Federated Learning Approach
por: Thwal, Chu Myaet, et al.
Publicado: (2024) -
Resource-efficient Layer-wise Federated Self-supervised Learning
por: Tun, Ye Lin, et al.
Publicado: (2024) -
Cross-Domain Federated Semantic Communication with Global Representation Alignment and Domain-Aware Aggregation
por: Nguyen, Loc X., et al.
Publicado: (2025) -
Resource-Efficient Federated Multimodal Learning via Layer-wise and Progressive Training
por: Tun, Ye Lin, et al.
Publicado: (2024) -
Cross-Modal Prototype based Multimodal Federated Learning under Severely Missing Modality
por: Le, Huy Q., et al.
Publicado: (2024)