Expand BERT Representation with Visual Information via Grounded Language Learning with Multimodal Partial Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nguyen, Cong-Duy, Vu-Le, The-Anh, Nguyen, Thong, Quan, Tho, Tuan, Luu Anh |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
KDMCSE: Knowledge Distillation Multimodal Sentence Embeddings with Adaptive Angular margin Contrastive Learning
par: Nguyen, Cong-Duy, et autres
Publié: (2024)
par: Nguyen, Cong-Duy, et autres
Publié: (2024)
More Bias, Less Bias: BiasPrompting for Enhanced Multiple-Choice Question Answering
par: Vu, Duc Anh, et autres
Publié: (2025)
par: Vu, Duc Anh, et autres
Publié: (2025)
CutPaste&Find: Efficient Multimodal Hallucination Detector with Visual-aid Knowledge Base
par: Nguyen, Cong-Duy, et autres
Publié: (2025)
par: Nguyen, Cong-Duy, et autres
Publié: (2025)
Enriching and Controlling Global Semantics for Text Summarization
par: Nguyen, Thong, et autres
Publié: (2021)
par: Nguyen, Thong, et autres
Publié: (2021)
Don't Read Everything: A Curvature-Conditioned Query for Linear Attention
par: Le, Dong, et autres
Publié: (2026)
par: Le, Dong, et autres
Publié: (2026)
READ: Recurrent Adapter with Partial Video-Language Alignment for Parameter-Efficient Transfer Learning in Low-Resource Video-Language Modeling
par: Nguyen, Thong, et autres
Publié: (2023)
par: Nguyen, Thong, et autres
Publié: (2023)
Adaptive Contrastive Learning on Multimodal Transformer for Review Helpfulness Predictions
par: Nguyen, Thong, et autres
Publié: (2022)
par: Nguyen, Thong, et autres
Publié: (2022)
Vision-and-Language Pretraining
par: Nguyen, Thong, et autres
Publié: (2022)
par: Nguyen, Thong, et autres
Publié: (2022)
DemaFormer: Damped Exponential Moving Average Transformer with Energy-Based Modeling for Temporal Language Grounding
par: Nguyen, Thong, et autres
Publié: (2023)
par: Nguyen, Thong, et autres
Publié: (2023)
Curriculum Demonstration Selection for In-Context Learning
par: Vu, Duc Anh, et autres
Publié: (2024)
par: Vu, Duc Anh, et autres
Publié: (2024)
Gradient-Boosted Decision Tree for Listwise Context Model in Multimodal Review Helpfulness Prediction
par: Nguyen, Thong, et autres
Publié: (2023)
par: Nguyen, Thong, et autres
Publié: (2023)
Learning Uncertainty from Sequential Internal Dispersion in Large Language Models
par: Srey, Ponhvoan, et autres
Publié: (2026)
par: Srey, Ponhvoan, et autres
Publié: (2026)
MAMA: Meta-optimized Angular Margin Contrastive Framework for Video-Language Representation Learning
par: Nguyen, Thong, et autres
Publié: (2024)
par: Nguyen, Thong, et autres
Publié: (2024)
A Survey on Neural Topic Models: Methods, Applications, and Challenges
par: Wu, Xiaobao, et autres
Publié: (2024)
par: Wu, Xiaobao, et autres
Publié: (2024)
Topic Modeling as Multi-Objective Contrastive Optimization
par: Nguyen, Thong, et autres
Publié: (2024)
par: Nguyen, Thong, et autres
Publié: (2024)
Enhancing Multimodal Entity Linking with Jaccard Distance-based Conditional Contrastive Learning and Contextual Visual Augmentation
par: Nguyen, Cong-Duy, et autres
Publié: (2025)
par: Nguyen, Cong-Duy, et autres
Publié: (2025)
On the Affinity, Rationality, and Diversity of Hierarchical Topic Modeling
par: Wu, Xiaobao, et autres
Publié: (2024)
par: Wu, Xiaobao, et autres
Publié: (2024)
LAMPAT: Low-Rank Adaption for Multilingual Paraphrasing Using Adversarial Training
par: Le, Khoi M., et autres
Publié: (2024)
par: Le, Khoi M., et autres
Publié: (2024)
When In-Distribution Gains Fail: Evaluating Weak-to-Strong Reward Models under Preference Shift
par: Le, Khoi, et autres
Publié: (2026)
par: Le, Khoi, et autres
Publié: (2026)
Read as You See: Guiding Unimodal LLMs for Low-Resource Explainable Harmful Meme Detection
par: Pan, Fengjun, et autres
Publié: (2025)
par: Pan, Fengjun, et autres
Publié: (2025)
Modeling Dynamic Topics in Chain-Free Fashion by Evolution-Tracking Contrastive Learning and Unassociated Word Exclusion
par: Wu, Xiaobao, et autres
Publié: (2024)
par: Wu, Xiaobao, et autres
Publié: (2024)
InfoCTM: A Mutual Information Maximization Perspective of Cross-Lingual Topic Modeling
par: Wu, Xiaobao, et autres
Publié: (2023)
par: Wu, Xiaobao, et autres
Publié: (2023)
Video-Language Understanding: A Survey from Model Architecture, Model Training, and Data Perspectives
par: Nguyen, Thong, et autres
Publié: (2024)
par: Nguyen, Thong, et autres
Publié: (2024)
A Comparative Analysis of Contextual Representation Flow in State-Space and Transformer Architectures
par: Hoang, Nhat M., et autres
Publié: (2025)
par: Hoang, Nhat M., et autres
Publié: (2025)
Multi-Scale Contrastive Learning for Video Temporal Grounding
par: Nguyen, Thong Thanh, et autres
Publié: (2024)
par: Nguyen, Thong Thanh, et autres
Publié: (2024)
RAPID: Retrieval-Augmented Parallel Inference Drafting for Text-Based Video Event Retrieval
par: Nguyen, Long, et autres
Publié: (2025)
par: Nguyen, Long, et autres
Publié: (2025)
Does Continued Pretraining on a Learner Corpus Improve Automated Essay Scoring on English Proficiency Tests? Evidence from EFCAMDAT
par: Nguyen, Duy Anh
Publié: (2026)
par: Nguyen, Duy Anh
Publié: (2026)
Temporal-Oriented Recipe for Transferring Large Vision-Language Model to Video Understanding
par: Nguyen, Thong, et autres
Publié: (2025)
par: Nguyen, Thong, et autres
Publié: (2025)
TI-JEPA: An Innovative Energy-based Joint Embedding Strategy for Text-Image Multimodal Systems
par: Vo, Khang H. N., et autres
Publié: (2025)
par: Vo, Khang H. N., et autres
Publié: (2025)
UniBridge: A Unified Approach to Cross-Lingual Transfer Learning for Low-Resource Languages
par: Pham, Trinh, et autres
Publié: (2024)
par: Pham, Trinh, et autres
Publié: (2024)
JEPA4Rec: Learning Effective Language Representations for Sequential Recommendation via Joint Embedding Predictive Architecture
par: Nguyen, Minh-Anh, et autres
Publié: (2025)
par: Nguyen, Minh-Anh, et autres
Publié: (2025)
FASTopic: Pretrained Transformer is a Fast, Adaptive, Stable, and Transferable Topic Model
par: Wu, Xiaobao, et autres
Publié: (2024)
par: Wu, Xiaobao, et autres
Publié: (2024)
XTRA: Cross-Lingual Topic Modeling with Topic and Representation Alignments
par: Nguyen, Tien Phat, et autres
Publié: (2025)
par: Nguyen, Tien Phat, et autres
Publié: (2025)
ClozeMath: Improving Mathematical Reasoning in Language Models by Learning to Fill Equations
par: Pham, Quang Hieu, et autres
Publié: (2025)
par: Pham, Quang Hieu, et autres
Publié: (2025)
ViConsFormer: Constituting Meaningful Phrases of Scene Texts using Transformer-based Method in Vietnamese Text-based Visual Question Answering
par: Nguyen, Nghia Hieu, et autres
Publié: (2024)
par: Nguyen, Nghia Hieu, et autres
Publié: (2024)
Motion-aware Contrastive Learning for Temporal Panoptic Scene Graph Generation
par: Nguyen, Thong Thanh, et autres
Publié: (2024)
par: Nguyen, Thong Thanh, et autres
Publié: (2024)
Distributional Surgery for Language Model Activations
par: Nguyen, Bao, et autres
Publié: (2025)
par: Nguyen, Bao, et autres
Publié: (2025)
Towards Reliable Truth-Aligned Uncertainty Estimation in Large Language Models
par: Srey, Ponhvoan, et autres
Publié: (2026)
par: Srey, Ponhvoan, et autres
Publié: (2026)
NeuroMax: Enhancing Neural Topic Modeling via Maximizing Mutual Information and Group Topic Regularization
par: Pham, Duy-Tung, et autres
Publié: (2024)
par: Pham, Duy-Tung, et autres
Publié: (2024)
VLegal-Bench: Cognitively Grounded Benchmark for Vietnamese Legal Reasoning of Large Language Models
par: Dong, Nguyen Tien, et autres
Publié: (2025)
par: Dong, Nguyen Tien, et autres
Publié: (2025)
Documents similaires
-
KDMCSE: Knowledge Distillation Multimodal Sentence Embeddings with Adaptive Angular margin Contrastive Learning
par: Nguyen, Cong-Duy, et autres
Publié: (2024) -
More Bias, Less Bias: BiasPrompting for Enhanced Multiple-Choice Question Answering
par: Vu, Duc Anh, et autres
Publié: (2025) -
CutPaste&Find: Efficient Multimodal Hallucination Detector with Visual-aid Knowledge Base
par: Nguyen, Cong-Duy, et autres
Publié: (2025) -
Enriching and Controlling Global Semantics for Text Summarization
par: Nguyen, Thong, et autres
Publié: (2021) -
Don't Read Everything: A Curvature-Conditioned Query for Linear Attention
par: Le, Dong, et autres
Publié: (2026)