Salvato in:
| Autori principali: | Lei, Jingdi, Zhang, Di, Li, Junxian, Wang, Weida, Fan, Kaixuan, Liu, Xiang, Liu, Qihan, Ma, Xiaoteng, Chen, Baian, Poria, Soujanya |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2605.12357 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Exact Flow Linear Attention: Exact Solution from Continuous-Time Dynamics
di: Lei, Jingdi, et al.
Pubblicazione: (2025)
di: Lei, Jingdi, et al.
Pubblicazione: (2025)
OffTopicEval: When Large Language Models Enter the Wrong Chat, Almost Always!
di: Lei, Jingdi, et al.
Pubblicazione: (2025)
di: Lei, Jingdi, et al.
Pubblicazione: (2025)
Towards Robust Instruction Tuning on Multimodal Large Language Models
di: Han, Wei, et al.
Pubblicazione: (2024)
di: Han, Wei, et al.
Pubblicazione: (2024)
Large Language Models for Automated Open-domain Scientific Hypotheses Discovery
di: Yang, Zonglin, et al.
Pubblicazione: (2023)
di: Yang, Zonglin, et al.
Pubblicazione: (2023)
Language Models are Homer Simpson! Safety Re-Alignment of Fine-tuned Language Models through Task Arithmetic
di: Bhardwaj, Rishabh, et al.
Pubblicazione: (2024)
di: Bhardwaj, Rishabh, et al.
Pubblicazione: (2024)
Self-Adaptive Sampling for Efficient Video Question-Answering on Image--Text Models
di: Han, Wei, et al.
Pubblicazione: (2023)
di: Han, Wei, et al.
Pubblicazione: (2023)
Efficient Multi-agent Reinforcement Learning by Planning
di: Liu, Qihan, et al.
Pubblicazione: (2024)
di: Liu, Qihan, et al.
Pubblicazione: (2024)
Post Reasoning: Improving the Performance of Non-Thinking Models at No Cost
di: Xuan, Richmond Sin Jing, et al.
Pubblicazione: (2026)
di: Xuan, Richmond Sin Jing, et al.
Pubblicazione: (2026)
Video2Music: Suitable Music Generation from Videos using an Affective Multimodal Transformer model
di: Kang, Jaeyong, et al.
Pubblicazione: (2023)
di: Kang, Jaeyong, et al.
Pubblicazione: (2023)
Can-Do! A Dataset and Neuro-Symbolic Grounded Framework for Embodied Planning with Large Multimodal Models
di: Chia, Yew Ken, et al.
Pubblicazione: (2024)
di: Chia, Yew Ken, et al.
Pubblicazione: (2024)
MOOSE-Chem: Large Language Models for Rediscovering Unseen Chemistry Scientific Hypotheses
di: Yang, Zonglin, et al.
Pubblicazione: (2024)
di: Yang, Zonglin, et al.
Pubblicazione: (2024)
Are Language Models Puzzle Prodigies? Algorithmic Puzzles Unveil Serious Challenges in Multimodal Reasoning
di: Ghosal, Deepanway, et al.
Pubblicazione: (2024)
di: Ghosal, Deepanway, et al.
Pubblicazione: (2024)
Toward Robust Multimodal Learning using Multimodal Foundational Models
di: Zhao, Xianbing, et al.
Pubblicazione: (2024)
di: Zhao, Xianbing, et al.
Pubblicazione: (2024)
Stacked from One: Multi-Scale Self-Injection for Context Window Extension
di: Han, Wei, et al.
Pubblicazione: (2026)
di: Han, Wei, et al.
Pubblicazione: (2026)
Two are better than one: Context window extension with multi-grained self-injection
di: Han, Wei, et al.
Pubblicazione: (2024)
di: Han, Wei, et al.
Pubblicazione: (2024)
Training Vision-Language Process Reward Models for Test-Time Scaling in Multimodal Reasoning: Key Insights and Lessons Learned
di: Ong, Brandon, et al.
Pubblicazione: (2025)
di: Ong, Brandon, et al.
Pubblicazione: (2025)
Harnessing Large Language Models for Scientific Novelty Detection
di: Liu, Yan, et al.
Pubblicazione: (2025)
di: Liu, Yan, et al.
Pubblicazione: (2025)
Beyond What to Select: A Plug-and-play Oscillatory Data-Volume Scheduling for Efficient Model Training
di: Yang, Suorong, et al.
Pubblicazione: (2026)
di: Yang, Suorong, et al.
Pubblicazione: (2026)
E-mem: Multi-agent based Episodic Context Reconstruction for LLM Agent Memory
di: Wang, Kaixiang, et al.
Pubblicazione: (2026)
di: Wang, Kaixiang, et al.
Pubblicazione: (2026)
Error Typing for Smarter Rewards: Improving Process Reward Models with Error-Aware Hierarchical Supervision
di: Pala, Tej Deep, et al.
Pubblicazione: (2025)
di: Pala, Tej Deep, et al.
Pubblicazione: (2025)
DialogXpert: Driving Intelligent and Emotion-Aware Conversations through Online Value-Based Reinforcement Learning with LLM Priors
di: Rakib, Tazeek Bin Abdur, et al.
Pubblicazione: (2025)
di: Rakib, Tazeek Bin Abdur, et al.
Pubblicazione: (2025)
The Jumping Reasoning Curve? Tracking the Evolution of Reasoning Performance in GPT-[n] and o-[n] Models on Multimodal Puzzles
di: Toh, Vernon Y. H., et al.
Pubblicazione: (2025)
di: Toh, Vernon Y. H., et al.
Pubblicazione: (2025)
Control-R: Towards controllable test-time scaling
di: Zhang, Di, et al.
Pubblicazione: (2025)
di: Zhang, Di, et al.
Pubblicazione: (2025)
VRoPE: Rotary Position Embedding for Video Large Language Models
di: Liu, Zikang, et al.
Pubblicazione: (2025)
di: Liu, Zikang, et al.
Pubblicazione: (2025)
NORA-1.5: A Vision-Language-Action Model Trained using World Model- and Action-based Preference Rewards
di: Hung, Chia-Yu, et al.
Pubblicazione: (2025)
di: Hung, Chia-Yu, et al.
Pubblicazione: (2025)
Ruby Teaming: Improving Quality Diversity Search with Memory for Automated Red Teaming
di: Han, Vernon Toh Yan, et al.
Pubblicazione: (2024)
di: Han, Vernon Toh Yan, et al.
Pubblicazione: (2024)
Sowing the Wind, Reaping the Whirlwind: The Impact of Editing Language Models
di: Hazra, Rima, et al.
Pubblicazione: (2024)
di: Hazra, Rima, et al.
Pubblicazione: (2024)
DiffPO: Diffusion-styled Preference Optimization for Efficient Inference-Time Alignment of Large Language Models
di: Chen, Ruizhe, et al.
Pubblicazione: (2025)
di: Chen, Ruizhe, et al.
Pubblicazione: (2025)
PREMISE: Matching-based Prediction for Accurate Review Recommendation
di: Han, Wei, et al.
Pubblicazione: (2025)
di: Han, Wei, et al.
Pubblicazione: (2025)
Not All Votes Count! Programs as Verifiers Improve Self-Consistency of Language Models for Math Reasoning
di: Toh, Vernon Y. H., et al.
Pubblicazione: (2024)
di: Toh, Vernon Y. H., et al.
Pubblicazione: (2024)
Safety Arithmetic: A Framework for Test-time Safety Alignment of Language Models by Steering Parameters and Activations
di: Hazra, Rima, et al.
Pubblicazione: (2024)
di: Hazra, Rima, et al.
Pubblicazione: (2024)
Understanding the Capabilities and Limitations of Large Language Models for Cultural Commonsense
di: Shen, Siqi, et al.
Pubblicazione: (2024)
di: Shen, Siqi, et al.
Pubblicazione: (2024)
NORA: A Small Open-Sourced Generalist Vision Language Action Model for Embodied Tasks
di: Hung, Chia-Yu, et al.
Pubblicazione: (2025)
di: Hung, Chia-Yu, et al.
Pubblicazione: (2025)
Reasoning Paths Optimization: Learning to Reason and Explore From Diverse Paths
di: Chia, Yew Ken, et al.
Pubblicazione: (2024)
di: Chia, Yew Ken, et al.
Pubblicazione: (2024)
The Five Ws of Multi-Agent Communication: Who Talks to Whom, When, What, and Why -- A Survey from MARL to Emergent Language and LLMs
di: Chen, Jingdi, et al.
Pubblicazione: (2026)
di: Chen, Jingdi, et al.
Pubblicazione: (2026)
10 Open Challenges Steering the Future of Vision-Language-Action Models
di: Poria, Soujanya, et al.
Pubblicazione: (2025)
di: Poria, Soujanya, et al.
Pubblicazione: (2025)
DELLA-Merging: Reducing Interference in Model Merging through Magnitude-Based Sampling
di: Deep, Pala Tej, et al.
Pubblicazione: (2024)
di: Deep, Pala Tej, et al.
Pubblicazione: (2024)
WalledEval: A Comprehensive Safety Evaluation Toolkit for Large Language Models
di: Gupta, Prannaya, et al.
Pubblicazione: (2024)
di: Gupta, Prannaya, et al.
Pubblicazione: (2024)
PMG : Personalized Multimodal Generation with Large Language Models
di: Shen, Xiaoteng, et al.
Pubblicazione: (2024)
di: Shen, Xiaoteng, et al.
Pubblicazione: (2024)
Memory-Efficient LLM Training with Online Subspace Descent
di: Liang, Kaizhao, et al.
Pubblicazione: (2024)
di: Liang, Kaizhao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Exact Flow Linear Attention: Exact Solution from Continuous-Time Dynamics
di: Lei, Jingdi, et al.
Pubblicazione: (2025) -
OffTopicEval: When Large Language Models Enter the Wrong Chat, Almost Always!
di: Lei, Jingdi, et al.
Pubblicazione: (2025) -
Towards Robust Instruction Tuning on Multimodal Large Language Models
di: Han, Wei, et al.
Pubblicazione: (2024) -
Large Language Models for Automated Open-domain Scientific Hypotheses Discovery
di: Yang, Zonglin, et al.
Pubblicazione: (2023) -
Language Models are Homer Simpson! Safety Re-Alignment of Fine-tuned Language Models through Task Arithmetic
di: Bhardwaj, Rishabh, et al.
Pubblicazione: (2024)