Cross-model Control: Improving Multiple Large Language Models in One-time Training
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Jiayi, Sun, Hao, Cai, Hengyi, Su, Lixin, Wang, Shuaiqiang, Yin, Dawei, Li, Xiang, Gao, Ming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
di: Wu, Jiayi, et al.
Pubblicazione: (2024)
di: Wu, Jiayi, et al.
Pubblicazione: (2024)
AdaSwitch: Adaptive Switching between Small and Large Agents for Effective Cloud-Local Collaborative Learning
di: Sun, Hao, et al.
Pubblicazione: (2024)
di: Sun, Hao, et al.
Pubblicazione: (2024)
TP-RAG: Benchmarking Retrieval-Augmented Large Language Model Agents for Spatiotemporal-Aware Travel Planning
di: Ni, Hang, et al.
Pubblicazione: (2025)
di: Ni, Hang, et al.
Pubblicazione: (2025)
Tool Learning with Large Language Models: A Survey
di: Qu, Changle, et al.
Pubblicazione: (2024)
di: Qu, Changle, et al.
Pubblicazione: (2024)
XL$^2$Bench: A Benchmark for Extremely Long Context Understanding with Long-range Dependencies
di: Ni, Xuanfan, et al.
Pubblicazione: (2024)
di: Ni, Xuanfan, et al.
Pubblicazione: (2024)
Towards Completeness-Oriented Tool Retrieval for Large Language Models
di: Qu, Changle, et al.
Pubblicazione: (2024)
di: Qu, Changle, et al.
Pubblicazione: (2024)
Towards Verifiable Text Generation with Evolving Memory and Self-Reflection
di: Sun, Hao, et al.
Pubblicazione: (2023)
di: Sun, Hao, et al.
Pubblicazione: (2023)
MatchTIR: Fine-Grained Supervision for Tool-Integrated Reasoning via Bipartite Matching
di: Qu, Changle, et al.
Pubblicazione: (2026)
di: Qu, Changle, et al.
Pubblicazione: (2026)
CoRanking: Collaborative Ranking with Small and Large Ranking Agents
di: Liu, Wenhan, et al.
Pubblicazione: (2025)
di: Liu, Wenhan, et al.
Pubblicazione: (2025)
Improving the Robustness of Large Language Models via Consistency Alignment
di: Zhao, Yukun, et al.
Pubblicazione: (2024)
di: Zhao, Yukun, et al.
Pubblicazione: (2024)
AgentSkiller: Scaling Generalist Agent Intelligence through Semantically Integrated Cross-Domain Data Synthesis
di: Sun, Zexu, et al.
Pubblicazione: (2026)
di: Sun, Zexu, et al.
Pubblicazione: (2026)
Reasoning-to-Defend: Safety-Aware Reasoning Can Defend Large Language Models from Jailbreaking
di: Zhu, Junda, et al.
Pubblicazione: (2025)
di: Zhu, Junda, et al.
Pubblicazione: (2025)
AdaSwitch: Balancing Exploration and Guidance in Knowledge Distillation via Adaptive Switching
di: Peng, Jingyu, et al.
Pubblicazione: (2025)
di: Peng, Jingyu, et al.
Pubblicazione: (2025)
From Exploration to Mastery: Enabling LLMs to Master Tools via Self-Driven Interactions
di: Qu, Changle, et al.
Pubblicazione: (2024)
di: Qu, Changle, et al.
Pubblicazione: (2024)
RAG-Enhanced Large Language Models for Dynamic Content Expiration Prediction in Web Search
di: Chen, Tingyu, et al.
Pubblicazione: (2026)
di: Chen, Tingyu, et al.
Pubblicazione: (2026)
MILL: Mutual Verification with Large Language Models for Zero-Shot Query Expansion
di: Jia, Pengyue, et al.
Pubblicazione: (2023)
di: Jia, Pengyue, et al.
Pubblicazione: (2023)
Text-Video Retrieval via Variational Multi-Modal Hypergraph Networks
di: Li, Qian, et al.
Pubblicazione: (2024)
di: Li, Qian, et al.
Pubblicazione: (2024)
Large Language Model-Powered Query-Driven Event Timeline Summarization in Industrial Search
di: Wang, Mingyue, et al.
Pubblicazione: (2026)
di: Wang, Mingyue, et al.
Pubblicazione: (2026)
Is ChatGPT Good at Search? Investigating Large Language Models as Re-Ranking Agents
di: Sun, Weiwei, et al.
Pubblicazione: (2023)
di: Sun, Weiwei, et al.
Pubblicazione: (2023)
Behavior-Equivalent Token: Single-Token Replacement for Long Prompts in LLMs
di: Dong, Jiancheng, et al.
Pubblicazione: (2025)
di: Dong, Jiancheng, et al.
Pubblicazione: (2025)
Sliding Windows Are Not the End: Exploring Full Ranking with Long-Context Large Language Models
di: Liu, Wenhan, et al.
Pubblicazione: (2024)
di: Liu, Wenhan, et al.
Pubblicazione: (2024)
Leveraging Generative Models for Real-Time Query-Driven Text Summarization in Large-Scale Web Search
di: Xiong, Zeyu, et al.
Pubblicazione: (2025)
di: Xiong, Zeyu, et al.
Pubblicazione: (2025)
MARA: A Multimodal Adaptive Retrieval-Augmented Framework for Document Question Answering
di: Wu, Hui, et al.
Pubblicazione: (2026)
di: Wu, Hui, et al.
Pubblicazione: (2026)
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
di: Shi, Zhengliang, et al.
Pubblicazione: (2025)
di: Shi, Zhengliang, et al.
Pubblicazione: (2025)
GraphGPT: Graph Instruction Tuning for Large Language Models
di: Tang, Jiabin, et al.
Pubblicazione: (2023)
di: Tang, Jiabin, et al.
Pubblicazione: (2023)
DBR: Divergence-Based Regularization for Debiasing Natural Language Understanding Models
di: Li, Zihao, et al.
Pubblicazione: (2025)
di: Li, Zihao, et al.
Pubblicazione: (2025)
Mitigating Hallucinations in Large Vision-Language Models via Entity-Centric Multimodal Preference Optimization
di: Wu, Jiulong, et al.
Pubblicazione: (2025)
di: Wu, Jiulong, et al.
Pubblicazione: (2025)
Solving the Granularity Mismatch: Hierarchical Preference Learning for Long-Horizon LLM Agents
di: Gao, Heyang, et al.
Pubblicazione: (2025)
di: Gao, Heyang, et al.
Pubblicazione: (2025)
FltLM: An Intergrated Long-Context Large Language Model for Effective Context Filtering and Understanding
di: Deng, Jingyang, et al.
Pubblicazione: (2024)
di: Deng, Jingyang, et al.
Pubblicazione: (2024)
Thinking Forward and Backward: Multi-Objective Reinforcement Learning for Retrieval-Augmented Reasoning
di: Wei, Wenda, et al.
Pubblicazione: (2025)
di: Wei, Wenda, et al.
Pubblicazione: (2025)
Improving Retrieval-Augmented Generation through Multi-Agent Reinforcement Learning
di: Chen, Yiqun, et al.
Pubblicazione: (2025)
di: Chen, Yiqun, et al.
Pubblicazione: (2025)
Measuring Maximum Activations in Open Large Language Models
di: Chen, Luxuan, et al.
Pubblicazione: (2026)
di: Chen, Luxuan, et al.
Pubblicazione: (2026)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
di: Lyu, Yougang, et al.
Pubblicazione: (2024)
di: Lyu, Yougang, et al.
Pubblicazione: (2024)
Towards AI Search Paradigm
di: Li, Yuchen, et al.
Pubblicazione: (2025)
di: Li, Yuchen, et al.
Pubblicazione: (2025)
JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework
di: Liu, Fan, et al.
Pubblicazione: (2024)
di: Liu, Fan, et al.
Pubblicazione: (2024)
How to Utilize Complementary Vision-Text Information for 2D Structure Understanding
di: Dong, Jiancheng, et al.
Pubblicazione: (2026)
di: Dong, Jiancheng, et al.
Pubblicazione: (2026)
GRAF: Multi-turn Jailbreaking via Global Refinement and Active Fabrication
di: Tang, Hua, et al.
Pubblicazione: (2025)
di: Tang, Hua, et al.
Pubblicazione: (2025)
SMoA: Improving Multi-agent Large Language Models with Sparse Mixture-of-Agents
di: Li, Dawei, et al.
Pubblicazione: (2024)
di: Li, Dawei, et al.
Pubblicazione: (2024)
Escaping the Mode Lottery: Multi-Response Training Improves Language Model Generalization
di: Amin, Hasan, et al.
Pubblicazione: (2026)
di: Amin, Hasan, et al.
Pubblicazione: (2026)
Understanding and Mitigating Political Stance Cross-topic Generalization in Large Language Models
di: Zhang, Jiayi, et al.
Pubblicazione: (2025)
di: Zhang, Jiayi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
di: Wu, Jiayi, et al.
Pubblicazione: (2024) -
AdaSwitch: Adaptive Switching between Small and Large Agents for Effective Cloud-Local Collaborative Learning
di: Sun, Hao, et al.
Pubblicazione: (2024) -
TP-RAG: Benchmarking Retrieval-Augmented Large Language Model Agents for Spatiotemporal-Aware Travel Planning
di: Ni, Hang, et al.
Pubblicazione: (2025) -
Tool Learning with Large Language Models: A Survey
di: Qu, Changle, et al.
Pubblicazione: (2024) -
XL$^2$Bench: A Benchmark for Extremely Long Context Understanding with Long-range Dependencies
di: Ni, Xuanfan, et al.
Pubblicazione: (2024)