DOSE: Data Selection for Multi-Modal LLMs via Off-the-Shelf Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Biao, Zhong, Yiwu, Fang, Meng, Chen, Ling |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Automotive-ENV: Benchmarking Multimodal Agents in Vehicle Interface Systems
par: Yan, Junfeng, et autres
Publié: (2025)
par: Yan, Junfeng, et autres
Publié: (2025)
Vision-Language Reasoning for Geolocalization: A Reinforcement Learning Approach
par: Wu, Biao, et autres
Publié: (2026)
par: Wu, Biao, et autres
Publié: (2026)
PaperVoyager : Building Interactive Web with Visual Language Models
par: Dai, Dasen, et autres
Publié: (2026)
par: Dai, Dasen, et autres
Publié: (2026)
I-WebGenBench : Evaluating Interactivity in LLM-Generated Scientific Web Applications
par: Dai, Dasen, et autres
Publié: (2026)
par: Dai, Dasen, et autres
Publié: (2026)
Infinity Parser: Layout Aware Reinforcement Learning for Scanned Document Parsing
par: Wang, Baode, et autres
Publié: (2025)
par: Wang, Baode, et autres
Publié: (2025)
UIPress: Bringing Optical Token Compression to UI-to-Code Generation
par: Dai, Dasen, et autres
Publié: (2026)
par: Dai, Dasen, et autres
Publié: (2026)
Story2Proposal: A Scaffold for Structured Scientific Paper Writing
par: Qian, Zhuoyang, et autres
Publié: (2026)
par: Qian, Zhuoyang, et autres
Publié: (2026)
Evaluating the efficacy of LLM Safety Solutions : The Palit Benchmark Dataset
par: Palit, Sayon, et autres
Publié: (2025)
par: Palit, Sayon, et autres
Publié: (2025)
From Pixels to Privacy: Temporally Consistent Video Anonymization via Token Pruning for Privacy Preserving Action Recognition
par: Aslam, Nazia, et autres
Publié: (2026)
par: Aslam, Nazia, et autres
Publié: (2026)
R-Genie: Reasoning-Guided Generative Image Editing
par: Zhang, Dong, et autres
Publié: (2025)
par: Zhang, Dong, et autres
Publié: (2025)
Factual Dialogue Summarization via Learning from Large Language Models
par: Zhu, Rongxin, et autres
Publié: (2024)
par: Zhu, Rongxin, et autres
Publié: (2024)
Robust Reward Modeling for Large Language Models via Causal Decomposition
par: Lu, Yunsheng, et autres
Publié: (2026)
par: Lu, Yunsheng, et autres
Publié: (2026)
Only Whats Necessary: Pareto Optimal Data Minimization for Privacy Preserving Video Anomaly Detection
par: Aslam, Nazia, et autres
Publié: (2026)
par: Aslam, Nazia, et autres
Publié: (2026)
CAMME: Adaptive Deepfake Image Detection with Multi-Modal Cross-Attention
par: Khan, Naseem, et autres
Publié: (2025)
par: Khan, Naseem, et autres
Publié: (2025)
Mobile Phone Sensor-based Nigerian Driving Dataset to Detect Alcohol-influenced Behaviours
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
Current LLMs still cannot 'talk much' about grammar modules: Evidence from syntax
par: Shormani, Mohammed Q., et autres
Publié: (2026)
par: Shormani, Mohammed Q., et autres
Publié: (2026)
Generative linguistics contribution to artificial intelligence: Where this contribution lies?
par: Shormani, Mohammed Q.
Publié: (2024)
par: Shormani, Mohammed Q.
Publié: (2024)
From Classification to Ranking: Enhancing LLM Reasoning Capabilities for MBTI Personality Detection
par: Cao, Yuan, et autres
Publié: (2026)
par: Cao, Yuan, et autres
Publié: (2026)
Corpus Considerations for Annotator Modeling and Scaling
par: Sarumi, Olufunke O., et autres
Publié: (2024)
par: Sarumi, Olufunke O., et autres
Publié: (2024)
A generalised editor calculus (Short Paper)
par: Bennetzen, Benjamin, et autres
Publié: (2025)
par: Bennetzen, Benjamin, et autres
Publié: (2025)
Do Large Language Models Speak All Languages Equally? A Comparative Study in Low-Resource Settings
par: Hasan, Md. Arid, et autres
Publié: (2024)
par: Hasan, Md. Arid, et autres
Publié: (2024)
The Syntax of qulk-clauses in Yemeni Ibbi Arabic: A Minimalist Approach
par: Albadani, Zubaida Mohammed, et autres
Publié: (2025)
par: Albadani, Zubaida Mohammed, et autres
Publié: (2025)
An End-to-End System for Culturally-Attuned Driving Feedback using a Dual-Component NLG Engine
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
par: Thompson, Iniakpokeikiye Peter, et autres
Publié: (2025)
The acquisition of English irregular inflections by Yemeni L1 Arabic learners: A Universal Grammar approach
par: Alsawsh, Muneef Y., et autres
Publié: (2026)
par: Alsawsh, Muneef Y., et autres
Publié: (2026)
Multilingual and Multimodal LLMs in the Wild: Building for Low-Resource Languages
par: Alam, Firoj, et autres
Publié: (2026)
par: Alam, Firoj, et autres
Publié: (2026)
PropXplain: Can LLMs Enable Explainable Propaganda Detection?
par: Hasanain, Maram, et autres
Publié: (2025)
par: Hasanain, Maram, et autres
Publié: (2025)
Revisiting the syntax of imperatives in Yemeni Arabic: An Agree across phases approach
par: Shormani, Mohammed Q.
Publié: (2026)
par: Shormani, Mohammed Q.
Publié: (2026)
RepoAgent: An LLM-Powered Open-Source Framework for Repository-level Code Documentation Generation
par: Luo, Qinyu, et autres
Publié: (2024)
par: Luo, Qinyu, et autres
Publié: (2024)
Unsupervised Band Selection Using Fused HSI and LiDAR Attention Integrating With Autoencoder
par: Yang, Judy X, et autres
Publié: (2024)
par: Yang, Judy X, et autres
Publié: (2024)
LLM-Based Multi-Task Bangla Hate Speech Detection: Type, Severity, and Target
par: Hasan, Md Arid, et autres
Publié: (2025)
par: Hasan, Md Arid, et autres
Publié: (2025)
Random Heterogeneous Neurochaos Learning Architecture for Data Classification
par: S, Remya Ajai A, et autres
Publié: (2024)
par: S, Remya Ajai A, et autres
Publié: (2024)
Propaganda to Hate: A Multimodal Analysis of Arabic Memes with Multi-Agent LLMs
par: Alam, Firoj, et autres
Publié: (2024)
par: Alam, Firoj, et autres
Publié: (2024)
A multilingual dataset for offensive language and hate speech detection for hausa, yoruba and igbo languages
par: Aliyu, Saminu Mohammad, et autres
Publié: (2024)
par: Aliyu, Saminu Mohammad, et autres
Publié: (2024)
Circularity and Symmetries of $p$ and $p^{2}$-polygons
par: Haag, Rolf
Publié: (2025)
par: Haag, Rolf
Publié: (2025)
TituLLMs: A Family of Bangla LLMs with Comprehensive Benchmarking
par: Nahin, Shahriar Kabir, et autres
Publié: (2025)
par: Nahin, Shahriar Kabir, et autres
Publié: (2025)
The impact of postediting on AI generative translation in Yemeni context: Translating literary prose by ChatGPT
par: Al-wagieh, Nasim, et autres
Publié: (2026)
par: Al-wagieh, Nasim, et autres
Publié: (2026)
Leveraging Translation For Optimal Recall: Tailoring LLM Personalization With User Profiles
par: Ravichandran, Karthik, et autres
Publié: (2024)
par: Ravichandran, Karthik, et autres
Publié: (2024)
Development and Preliminary Evaluation of a Domain-Specific Large Language Model for Tuberculosis Care in South Africa
par: Khosa, Thokozile, et autres
Publié: (2026)
par: Khosa, Thokozile, et autres
Publié: (2026)
Can ChatGPT capture swearing nuances? Evidence from translating Arabic oaths
par: Shormani, Mohammed Q.
Publié: (2024)
par: Shormani, Mohammed Q.
Publié: (2024)
Artificial intelligence contribution to translation industry: looking back and forward
par: Shormani, Mohammed Q., et autres
Publié: (2024)
par: Shormani, Mohammed Q., et autres
Publié: (2024)
Documents similaires
-
Automotive-ENV: Benchmarking Multimodal Agents in Vehicle Interface Systems
par: Yan, Junfeng, et autres
Publié: (2025) -
Vision-Language Reasoning for Geolocalization: A Reinforcement Learning Approach
par: Wu, Biao, et autres
Publié: (2026) -
PaperVoyager : Building Interactive Web with Visual Language Models
par: Dai, Dasen, et autres
Publié: (2026) -
I-WebGenBench : Evaluating Interactivity in LLM-Generated Scientific Web Applications
par: Dai, Dasen, et autres
Publié: (2026) -
Infinity Parser: Layout Aware Reinforcement Learning for Scanned Document Parsing
par: Wang, Baode, et autres
Publié: (2025)