Investigating the Scaling Effect of Instruction Templates for Training Multimodal Language Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Shijian, Song, Linxin, Zhang, Jieyu, Shimizu, Ryotaro, Jin, Jiarui, Luo, Ao, Lu, Yuan, Yao, Li, Chen, Cunjian, McAuley, Julian, Zhang, Wentao, Wu, Hanqian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Attributed Synthetic Data Generation for Zero-shot Domain-specific Image Classification
di: Wang, Shijian, et al.
Pubblicazione: (2025)
di: Wang, Shijian, et al.
Pubblicazione: (2025)
Adaptive In-conversation Team Building for Language Model Agents
di: Song, Linxin, et al.
Pubblicazione: (2024)
di: Song, Linxin, et al.
Pubblicazione: (2024)
Synthetic Curriculum Reinforces Compositional Text-to-Image Generation
di: Wang, Shijian, et al.
Pubblicazione: (2025)
di: Wang, Shijian, et al.
Pubblicazione: (2025)
Discovering Knowledge Deficiencies of Language Models on Massive Knowledge Base
di: Song, Linxin, et al.
Pubblicazione: (2025)
di: Song, Linxin, et al.
Pubblicazione: (2025)
Extending Input Contexts of Language Models through Training on Segmented Sequences
di: Karypis, Petros, et al.
Pubblicazione: (2023)
di: Karypis, Petros, et al.
Pubblicazione: (2023)
Train Once, Deploy Anywhere: Matryoshka Representation Learning for Multimodal Recommendation
di: Wang, Yueqi, et al.
Pubblicazione: (2024)
di: Wang, Yueqi, et al.
Pubblicazione: (2024)
A Fashion Item Recommendation Model in Hyperbolic Space
di: Shimizu, Ryotaro, et al.
Pubblicazione: (2024)
di: Shimizu, Ryotaro, et al.
Pubblicazione: (2024)
Reddit2Deezer: A Scalable Dataset for Real-World Grounded Conversational Music Recommendation
di: Kim, Haven, et al.
Pubblicazione: (2026)
di: Kim, Haven, et al.
Pubblicazione: (2026)
Imagery as Inquiry: Exploring A Multimodal Dataset for Conversational Recommendation
di: Yoon, Se-eun, et al.
Pubblicazione: (2024)
di: Yoon, Se-eun, et al.
Pubblicazione: (2024)
CoMMIT: Coordinated Multimodal Instruction Tuning
di: Li, Xintong, et al.
Pubblicazione: (2024)
di: Li, Xintong, et al.
Pubblicazione: (2024)
Three central limit theorems for the unbounded excursion component of a Gaussian field
di: McAuley, Michael
Pubblicazione: (2024)
di: McAuley, Michael
Pubblicazione: (2024)
Children in Custody
di: McAuley, Mary
Pubblicazione: (2022)
di: McAuley, Mary
Pubblicazione: (2022)
Politics and the Soviet Union / Mary McAuley
di: McAuley, Mary
di: McAuley, Mary
Limit theorems for non-local functionals of smooth Gaussian fields via quasi-association
di: McAuley, Michael
Pubblicazione: (2026)
di: McAuley, Michael
Pubblicazione: (2026)
LARE: Latent Augmentation using Regional Embedding with Vision-Language Model
di: Sakurai, Kosuke, et al.
Pubblicazione: (2024)
di: Sakurai, Kosuke, et al.
Pubblicazione: (2024)
GSPRec: Temporal-Aware Graph Spectral Filtering for Recommendation
di: Rabiah, Ahmad Bin, et al.
Pubblicazione: (2025)
di: Rabiah, Ahmad Bin, et al.
Pubblicazione: (2025)
The Hallucination Tax of Reinforcement Finetuning
di: Song, Linxin, et al.
Pubblicazione: (2025)
di: Song, Linxin, et al.
Pubblicazione: (2025)
InfoRank: Unbiased Learning-to-Rank via Conditional Mutual Information Minimization
di: Jin, Jiarui, et al.
Pubblicazione: (2024)
di: Jin, Jiarui, et al.
Pubblicazione: (2024)
Disentangling Likes and Dislikes in Personalized Generative Explainable Recommendation
di: Shimizu, Ryotaro, et al.
Pubblicazione: (2024)
di: Shimizu, Ryotaro, et al.
Pubblicazione: (2024)
InstructGraph: Boosting Large Language Models via Graph-centric Instruction Tuning and Preference Alignment
di: Wang, Jianing, et al.
Pubblicazione: (2024)
di: Wang, Jianing, et al.
Pubblicazione: (2024)
Composer Vector: Style-steering Symbolic Music Generation in a Latent Space
di: Jiang, Xunyi, et al.
Pubblicazione: (2026)
di: Jiang, Xunyi, et al.
Pubblicazione: (2026)
ProVision: Programmatically Scaling Vision-centric Instruction Data for Multimodal Language Models
di: Zhang, Jieyu, et al.
Pubblicazione: (2024)
di: Zhang, Jieyu, et al.
Pubblicazione: (2024)
Large Scale Knowledge Washing
di: Wang, Yu, et al.
Pubblicazione: (2024)
di: Wang, Yu, et al.
Pubblicazione: (2024)
Offline Training of Language Model Agents with Functions as Learnable Weights
di: Zhang, Shaokun, et al.
Pubblicazione: (2024)
di: Zhang, Shaokun, et al.
Pubblicazione: (2024)
On Generalization in Agentic Tool Calling: CoreThink Agentic Reasoner and MAVEN Dataset
di: Bhat, Vishvesh, et al.
Pubblicazione: (2025)
di: Bhat, Vishvesh, et al.
Pubblicazione: (2025)
FusID: Modality-Fused Semantic IDs for Generative Music Recommendation
di: Kim, Haven, et al.
Pubblicazione: (2026)
di: Kim, Haven, et al.
Pubblicazione: (2026)
Multi-Behavior Generative Recommendation
di: Liu, Zihan, et al.
Pubblicazione: (2024)
di: Liu, Zihan, et al.
Pubblicazione: (2024)
Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions
di: Hu, Yuanzhe, et al.
Pubblicazione: (2025)
di: Hu, Yuanzhe, et al.
Pubblicazione: (2025)
LVCHAT: Facilitating Long Video Comprehension
di: Wang, Yu, et al.
Pubblicazione: (2024)
di: Wang, Yu, et al.
Pubblicazione: (2024)
Purely Semantic Indexing for LLM-based Generative Recommendation and Retrieval
di: Zhang, Ruohan, et al.
Pubblicazione: (2025)
di: Zhang, Ruohan, et al.
Pubblicazione: (2025)
BiasEdit: Debiasing Stereotyped Language Models via Model Editing
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
PDMX: A Large-Scale Public Domain MusicXML Dataset for Symbolic Music Processing
di: Long, Phillip, et al.
Pubblicazione: (2024)
di: Long, Phillip, et al.
Pubblicazione: (2024)
Reinforcement Learning for Generative AI: A Survey
di: Cao, Yuanjiang, et al.
Pubblicazione: (2023)
di: Cao, Yuanjiang, et al.
Pubblicazione: (2023)
Bridging Conversational and Collaborative Signals for Conversational Recommendation
di: Rabiah, Ahmad Bin, et al.
Pubblicazione: (2024)
di: Rabiah, Ahmad Bin, et al.
Pubblicazione: (2024)
Calibration-Disentangled Learning and Relevance-Prioritized Reranking for Calibrated Sequential Recommendation
di: Jeon, Hyunsik, et al.
Pubblicazione: (2024)
di: Jeon, Hyunsik, et al.
Pubblicazione: (2024)
Limit theorems for the number of sign and level-set clusters of the Gaussian free field
di: McAuley, Michael, et al.
Pubblicazione: (2025)
di: McAuley, Michael, et al.
Pubblicazione: (2025)
Educating Young Children: A Structural Approach. Routledge Library Editions: Early Years
di: McAuley, Helen, et al.
Pubblicazione: (2022)
di: McAuley, Helen, et al.
Pubblicazione: (2022)
Video-Thinker: Sparking "Thinking with Videos" via Reinforcement Learning
di: Wang, Shijian, et al.
Pubblicazione: (2025)
di: Wang, Shijian, et al.
Pubblicazione: (2025)
SceneAlign: Aligning Multimodal Reasoning to Scene Graphs in Complex Visual Scenes
di: Wang, Chuhan, et al.
Pubblicazione: (2026)
di: Wang, Chuhan, et al.
Pubblicazione: (2026)
Foundation Models for Recommender Systems: A Survey and New Perspectives
di: Huang, Chengkai, et al.
Pubblicazione: (2024)
di: Huang, Chengkai, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Attributed Synthetic Data Generation for Zero-shot Domain-specific Image Classification
di: Wang, Shijian, et al.
Pubblicazione: (2025) -
Adaptive In-conversation Team Building for Language Model Agents
di: Song, Linxin, et al.
Pubblicazione: (2024) -
Synthetic Curriculum Reinforces Compositional Text-to-Image Generation
di: Wang, Shijian, et al.
Pubblicazione: (2025) -
Discovering Knowledge Deficiencies of Language Models on Massive Knowledge Base
di: Song, Linxin, et al.
Pubblicazione: (2025) -
Extending Input Contexts of Language Models through Training on Segmented Sequences
di: Karypis, Petros, et al.
Pubblicazione: (2023)