Boosting Text-To-Image Generation via Multilingual Prompting in Large Multimodal Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Mu, Yongyu, Li, Hengyu, Wang, Junxin, Zhou, Xiaoxuan, Wang, Chenglong, Luo, Yingfeng, He, Qiaozhi, Xiao, Tong, Chen, Guocheng, Zhu, Jingbo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DaPT: A Dual-Path Framework for Multilingual Multi-hop Question Answering
por: Wang, Yilin, et al.
Publicado: (2026)
por: Wang, Yilin, et al.
Publicado: (2026)
Cross-layer Attention Sharing for Pre-trained Large Language Models
por: Mu, Yongyu, et al.
Publicado: (2024)
por: Mu, Yongyu, et al.
Publicado: (2024)
Efficient Prompting Methods for Large Language Models: A Survey
por: Chang, Kaiyan, et al.
Publicado: (2024)
por: Chang, Kaiyan, et al.
Publicado: (2024)
APR: Penalizing Structural Redundancy in Large Reasoning Models via Anchor-based Process Rewards
por: Chang, Kaiyan, et al.
Publicado: (2026)
por: Chang, Kaiyan, et al.
Publicado: (2026)
GRAM: A Generative Foundation Reward Model for Reward Generalization
por: Wang, Chenglong, et al.
Publicado: (2025)
por: Wang, Chenglong, et al.
Publicado: (2025)
LRHP: Learning Representations for Human Preferences via Preference Pairs
por: Wang, Chenglong, et al.
Publicado: (2024)
por: Wang, Chenglong, et al.
Publicado: (2024)
Hybrid Alignment Training for Large Language Models
por: Wang, Chenglong, et al.
Publicado: (2024)
por: Wang, Chenglong, et al.
Publicado: (2024)
Translate-and-Revise: Boosting Large Language Models for Constrained Translation
por: Huang, Pengcheng, et al.
Publicado: (2024)
por: Huang, Pengcheng, et al.
Publicado: (2024)
Revealing the Parallel Multilingual Learning within Large Language Models
por: Mu, Yongyu, et al.
Publicado: (2024)
por: Mu, Yongyu, et al.
Publicado: (2024)
Language-Specific Layer Matters: Efficient Multilingual Enhancement for Large Vision-Language Models
por: Fan, Yuchun, et al.
Publicado: (2025)
por: Fan, Yuchun, et al.
Publicado: (2025)
MSRL: Scaling Generative Multimodal Reward Modeling via Multi-Stage Reinforcement Learning
por: Wang, Chenglong, et al.
Publicado: (2026)
por: Wang, Chenglong, et al.
Publicado: (2026)
RoVRM: A Robust Visual Reward Model Optimized via Auxiliary Textual Preference Data
por: Wang, Chenglong, et al.
Publicado: (2024)
por: Wang, Chenglong, et al.
Publicado: (2024)
Beyond Decoder-only: Large Language Models Can be Good Encoders for Machine Translation
por: Luo, Yingfeng, et al.
Publicado: (2025)
por: Luo, Yingfeng, et al.
Publicado: (2025)
Probing Preference Representations: A Multi-Dimensional Evaluation and Analysis Method for Reward Models
por: Wang, Chenglong, et al.
Publicado: (2025)
por: Wang, Chenglong, et al.
Publicado: (2025)
Step-level Verifier-guided Hybrid Test-Time Scaling for Large Language Models
por: Chang, Kaiyan, et al.
Publicado: (2025)
por: Chang, Kaiyan, et al.
Publicado: (2025)
SLAM: Towards Efficient Multilingual Reasoning via Selective Language Alignment
por: Fan, Yuchun, et al.
Publicado: (2025)
por: Fan, Yuchun, et al.
Publicado: (2025)
SPS: Steering Probability Squeezing for Better Exploration in Reinforcement Learning for Large Language Models
por: Huo, Yifu, et al.
Publicado: (2026)
por: Huo, Yifu, et al.
Publicado: (2026)
One Size Does Not Fit All: A Distribution-Aware Sparsification for More Precise Model Merging
por: Luo, Yingfeng, et al.
Publicado: (2025)
por: Luo, Yingfeng, et al.
Publicado: (2025)
RouteLMT: Learned Sample Routing for Hybrid LLM Translation Deployment
por: Luo, Yingfeng, et al.
Publicado: (2026)
por: Luo, Yingfeng, et al.
Publicado: (2026)
Prior Constraints-based Reward Model Training for Aligning Large Language Models
por: Zhou, Hang, et al.
Publicado: (2024)
por: Zhou, Hang, et al.
Publicado: (2024)
LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance
por: Fan, Yuchun, et al.
Publicado: (2026)
por: Fan, Yuchun, et al.
Publicado: (2026)
GRAM-R$^2$: Self-Training Generative Foundation Reward Models for Reward Reasoning
por: Wang, Chenglong, et al.
Publicado: (2025)
por: Wang, Chenglong, et al.
Publicado: (2025)
SERM: Self-Evolving Relevance Model with Agent-Driven Learning from Massive Query Streams
por: Wang, Chenglong, et al.
Publicado: (2026)
por: Wang, Chenglong, et al.
Publicado: (2026)
Early Exit Is a Natural Capability in Transformer-based Models: An Empirical Study on Early Exit without Joint Optimization
por: Shan, Weiqiao, et al.
Publicado: (2024)
por: Shan, Weiqiao, et al.
Publicado: (2024)
Foundations of Large Language Models
por: Xiao, Tong, et al.
Publicado: (2025)
por: Xiao, Tong, et al.
Publicado: (2025)
Dissecting Long-Chain-of-Thought Reasoning Models: An Empirical Study
por: Mu, Yongyu, et al.
Publicado: (2025)
por: Mu, Yongyu, et al.
Publicado: (2025)
Enhancing Speech Large Language Models with Prompt-Aware Mixture of Audio Encoders
por: Shan, Weiqiao, et al.
Publicado: (2025)
por: Shan, Weiqiao, et al.
Publicado: (2025)
NiuTrans.LMT: Toward Inclusive and Scalable Multilingual Machine Translation with LLMs
por: Luo, Yingfeng, et al.
Publicado: (2025)
por: Luo, Yingfeng, et al.
Publicado: (2025)
Learning Evaluation Models from Large Language Models for Sequence Generation
por: Wang, Chenglong, et al.
Publicado: (2023)
por: Wang, Chenglong, et al.
Publicado: (2023)
Recent Advances in End-to-End Simultaneous Speech Translation
por: Liu, Xiaoqian, et al.
Publicado: (2024)
por: Liu, Xiaoqian, et al.
Publicado: (2024)
ImageScope: Unifying Language-Guided Image Retrieval via Large Multimodal Model Collective Reasoning
por: Luo, Pengfei, et al.
Publicado: (2025)
por: Luo, Pengfei, et al.
Publicado: (2025)
Enabling DBSCAN for Very Large-Scale High-Dimensional Spaces
por: Wang, Yongyu
Publicado: (2024)
por: Wang, Yongyu
Publicado: (2024)
MRO: Enhancing Reasoning in Diffusion Language Models via Multi-Reward Optimization
por: Wang, Chenglong, et al.
Publicado: (2025)
por: Wang, Chenglong, et al.
Publicado: (2025)
STAR: Boosting Low-Resource Information Extraction by Structure-to-Text Data Generation with Large Language Models
por: Ma, Mingyu Derek, et al.
Publicado: (2023)
por: Ma, Mingyu Derek, et al.
Publicado: (2023)
jina-clip-v2: Multilingual Multimodal Embeddings for Text and Images
por: Koukounas, Andreas, et al.
Publicado: (2024)
por: Koukounas, Andreas, et al.
Publicado: (2024)
Offline Exploration-Aware Fine-Tuning for Long-Chain Mathematical Reasoning
por: Mu, Yongyu, et al.
Publicado: (2026)
por: Mu, Yongyu, et al.
Publicado: (2026)
PPBoost: Progressive Prompt Boosting for Text-Driven Medical Image Segmentation
por: Li, Xuchen, et al.
Publicado: (2025)
por: Li, Xuchen, et al.
Publicado: (2025)
Large-Vocabulary Segmentation for Medical Images with Text Prompts
por: Zhao, Ziheng, et al.
Publicado: (2023)
por: Zhao, Ziheng, et al.
Publicado: (2023)
Face-MakeUp: Multimodal Facial Prompts for Text-to-Image Generation
por: Dai, Dawei, et al.
Publicado: (2025)
por: Dai, Dawei, et al.
Publicado: (2025)
Large Language Model Guided Progressive Feature Alignment for Multimodal UAV Object Detection
por: Wu, Wentao, et al.
Publicado: (2025)
por: Wu, Wentao, et al.
Publicado: (2025)
Ejemplares similares
-
DaPT: A Dual-Path Framework for Multilingual Multi-hop Question Answering
por: Wang, Yilin, et al.
Publicado: (2026) -
Cross-layer Attention Sharing for Pre-trained Large Language Models
por: Mu, Yongyu, et al.
Publicado: (2024) -
Efficient Prompting Methods for Large Language Models: A Survey
por: Chang, Kaiyan, et al.
Publicado: (2024) -
APR: Penalizing Structural Redundancy in Large Reasoning Models via Anchor-based Process Rewards
por: Chang, Kaiyan, et al.
Publicado: (2026) -
GRAM: A Generative Foundation Reward Model for Reward Generalization
por: Wang, Chenglong, et al.
Publicado: (2025)