Cross-model Control: Improving Multiple Large Language Models in One-time Training
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Jiayi, Sun, Hao, Cai, Hengyi, Su, Lixin, Wang, Shuaiqiang, Yin, Dawei, Li, Xiang, Gao, Ming |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
por: Wu, Jiayi, et al.
Publicado: (2024)
por: Wu, Jiayi, et al.
Publicado: (2024)
AdaSwitch: Adaptive Switching between Small and Large Agents for Effective Cloud-Local Collaborative Learning
por: Sun, Hao, et al.
Publicado: (2024)
por: Sun, Hao, et al.
Publicado: (2024)
TP-RAG: Benchmarking Retrieval-Augmented Large Language Model Agents for Spatiotemporal-Aware Travel Planning
por: Ni, Hang, et al.
Publicado: (2025)
por: Ni, Hang, et al.
Publicado: (2025)
Tool Learning with Large Language Models: A Survey
por: Qu, Changle, et al.
Publicado: (2024)
por: Qu, Changle, et al.
Publicado: (2024)
XL$^2$Bench: A Benchmark for Extremely Long Context Understanding with Long-range Dependencies
por: Ni, Xuanfan, et al.
Publicado: (2024)
por: Ni, Xuanfan, et al.
Publicado: (2024)
Towards Completeness-Oriented Tool Retrieval for Large Language Models
por: Qu, Changle, et al.
Publicado: (2024)
por: Qu, Changle, et al.
Publicado: (2024)
Towards Verifiable Text Generation with Evolving Memory and Self-Reflection
por: Sun, Hao, et al.
Publicado: (2023)
por: Sun, Hao, et al.
Publicado: (2023)
MatchTIR: Fine-Grained Supervision for Tool-Integrated Reasoning via Bipartite Matching
por: Qu, Changle, et al.
Publicado: (2026)
por: Qu, Changle, et al.
Publicado: (2026)
CoRanking: Collaborative Ranking with Small and Large Ranking Agents
por: Liu, Wenhan, et al.
Publicado: (2025)
por: Liu, Wenhan, et al.
Publicado: (2025)
Improving the Robustness of Large Language Models via Consistency Alignment
por: Zhao, Yukun, et al.
Publicado: (2024)
por: Zhao, Yukun, et al.
Publicado: (2024)
AgentSkiller: Scaling Generalist Agent Intelligence through Semantically Integrated Cross-Domain Data Synthesis
por: Sun, Zexu, et al.
Publicado: (2026)
por: Sun, Zexu, et al.
Publicado: (2026)
Reasoning-to-Defend: Safety-Aware Reasoning Can Defend Large Language Models from Jailbreaking
por: Zhu, Junda, et al.
Publicado: (2025)
por: Zhu, Junda, et al.
Publicado: (2025)
AdaSwitch: Balancing Exploration and Guidance in Knowledge Distillation via Adaptive Switching
por: Peng, Jingyu, et al.
Publicado: (2025)
por: Peng, Jingyu, et al.
Publicado: (2025)
From Exploration to Mastery: Enabling LLMs to Master Tools via Self-Driven Interactions
por: Qu, Changle, et al.
Publicado: (2024)
por: Qu, Changle, et al.
Publicado: (2024)
RAG-Enhanced Large Language Models for Dynamic Content Expiration Prediction in Web Search
por: Chen, Tingyu, et al.
Publicado: (2026)
por: Chen, Tingyu, et al.
Publicado: (2026)
MILL: Mutual Verification with Large Language Models for Zero-Shot Query Expansion
por: Jia, Pengyue, et al.
Publicado: (2023)
por: Jia, Pengyue, et al.
Publicado: (2023)
Text-Video Retrieval via Variational Multi-Modal Hypergraph Networks
por: Li, Qian, et al.
Publicado: (2024)
por: Li, Qian, et al.
Publicado: (2024)
Large Language Model-Powered Query-Driven Event Timeline Summarization in Industrial Search
por: Wang, Mingyue, et al.
Publicado: (2026)
por: Wang, Mingyue, et al.
Publicado: (2026)
Is ChatGPT Good at Search? Investigating Large Language Models as Re-Ranking Agents
por: Sun, Weiwei, et al.
Publicado: (2023)
por: Sun, Weiwei, et al.
Publicado: (2023)
Behavior-Equivalent Token: Single-Token Replacement for Long Prompts in LLMs
por: Dong, Jiancheng, et al.
Publicado: (2025)
por: Dong, Jiancheng, et al.
Publicado: (2025)
Sliding Windows Are Not the End: Exploring Full Ranking with Long-Context Large Language Models
por: Liu, Wenhan, et al.
Publicado: (2024)
por: Liu, Wenhan, et al.
Publicado: (2024)
Leveraging Generative Models for Real-Time Query-Driven Text Summarization in Large-Scale Web Search
por: Xiong, Zeyu, et al.
Publicado: (2025)
por: Xiong, Zeyu, et al.
Publicado: (2025)
MARA: A Multimodal Adaptive Retrieval-Augmented Framework for Document Question Answering
por: Wu, Hui, et al.
Publicado: (2026)
por: Wu, Hui, et al.
Publicado: (2026)
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
por: Shi, Zhengliang, et al.
Publicado: (2025)
por: Shi, Zhengliang, et al.
Publicado: (2025)
GraphGPT: Graph Instruction Tuning for Large Language Models
por: Tang, Jiabin, et al.
Publicado: (2023)
por: Tang, Jiabin, et al.
Publicado: (2023)
DBR: Divergence-Based Regularization for Debiasing Natural Language Understanding Models
por: Li, Zihao, et al.
Publicado: (2025)
por: Li, Zihao, et al.
Publicado: (2025)
Mitigating Hallucinations in Large Vision-Language Models via Entity-Centric Multimodal Preference Optimization
por: Wu, Jiulong, et al.
Publicado: (2025)
por: Wu, Jiulong, et al.
Publicado: (2025)
Solving the Granularity Mismatch: Hierarchical Preference Learning for Long-Horizon LLM Agents
por: Gao, Heyang, et al.
Publicado: (2025)
por: Gao, Heyang, et al.
Publicado: (2025)
FltLM: An Intergrated Long-Context Large Language Model for Effective Context Filtering and Understanding
por: Deng, Jingyang, et al.
Publicado: (2024)
por: Deng, Jingyang, et al.
Publicado: (2024)
Thinking Forward and Backward: Multi-Objective Reinforcement Learning for Retrieval-Augmented Reasoning
por: Wei, Wenda, et al.
Publicado: (2025)
por: Wei, Wenda, et al.
Publicado: (2025)
Improving Retrieval-Augmented Generation through Multi-Agent Reinforcement Learning
por: Chen, Yiqun, et al.
Publicado: (2025)
por: Chen, Yiqun, et al.
Publicado: (2025)
Measuring Maximum Activations in Open Large Language Models
por: Chen, Luxuan, et al.
Publicado: (2026)
por: Chen, Luxuan, et al.
Publicado: (2026)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
por: Lyu, Yougang, et al.
Publicado: (2024)
por: Lyu, Yougang, et al.
Publicado: (2024)
Towards AI Search Paradigm
por: Li, Yuchen, et al.
Publicado: (2025)
por: Li, Yuchen, et al.
Publicado: (2025)
JAILJUDGE: A Comprehensive Jailbreak Judge Benchmark with Multi-Agent Enhanced Explanation Evaluation Framework
por: Liu, Fan, et al.
Publicado: (2024)
por: Liu, Fan, et al.
Publicado: (2024)
How to Utilize Complementary Vision-Text Information for 2D Structure Understanding
por: Dong, Jiancheng, et al.
Publicado: (2026)
por: Dong, Jiancheng, et al.
Publicado: (2026)
GRAF: Multi-turn Jailbreaking via Global Refinement and Active Fabrication
por: Tang, Hua, et al.
Publicado: (2025)
por: Tang, Hua, et al.
Publicado: (2025)
SMoA: Improving Multi-agent Large Language Models with Sparse Mixture-of-Agents
por: Li, Dawei, et al.
Publicado: (2024)
por: Li, Dawei, et al.
Publicado: (2024)
Escaping the Mode Lottery: Multi-Response Training Improves Language Model Generalization
por: Amin, Hasan, et al.
Publicado: (2026)
por: Amin, Hasan, et al.
Publicado: (2026)
Understanding and Mitigating Political Stance Cross-topic Generalization in Large Language Models
por: Zhang, Jiayi, et al.
Publicado: (2025)
por: Zhang, Jiayi, et al.
Publicado: (2025)
Ejemplares similares
-
PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
por: Wu, Jiayi, et al.
Publicado: (2024) -
AdaSwitch: Adaptive Switching between Small and Large Agents for Effective Cloud-Local Collaborative Learning
por: Sun, Hao, et al.
Publicado: (2024) -
TP-RAG: Benchmarking Retrieval-Augmented Large Language Model Agents for Spatiotemporal-Aware Travel Planning
por: Ni, Hang, et al.
Publicado: (2025) -
Tool Learning with Large Language Models: A Survey
por: Qu, Changle, et al.
Publicado: (2024) -
XL$^2$Bench: A Benchmark for Extremely Long Context Understanding with Long-range Dependencies
por: Ni, Xuanfan, et al.
Publicado: (2024)