Enregistré dans:
| Auteurs principaux: | Tian, Zihang, Li, Rui, Zhang, Jingsen, Bo, Xiaohe, Huo, Wei, Chen, Xu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2601.05903 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Prompt and Parameter Co-Optimization for Large Language Models
par: Bo, Xiaohe, et autres
Publié: (2025)
par: Bo, Xiaohe, et autres
Publié: (2025)
CAM: A Constructivist View of Agentic Memory for LLM-Based Reading Comprehension
par: Li, Rui, et autres
Publié: (2025)
par: Li, Rui, et autres
Publié: (2025)
Explainable Recommendation with Simulated Human Feedback
par: Tang, Jiakai, et autres
Publié: (2025)
par: Tang, Jiakai, et autres
Publié: (2025)
Towards Adaptive, Scalable, and Robust Coordination of LLM Agents: A Dynamic Ad-Hoc Networking Perspective
par: Li, Rui, et autres
Publié: (2026)
par: Li, Rui, et autres
Publié: (2026)
Learn to Memorize: Optimizing LLM-based Agents with Adaptive Memory Framework
par: Zhang, Zeyu, et autres
Publié: (2025)
par: Zhang, Zeyu, et autres
Publié: (2025)
MTRouter: Cost-Aware Multi-Turn LLM Routing with History-Model Joint Embeddings
par: Zhang, Yiqun, et autres
Publié: (2026)
par: Zhang, Yiqun, et autres
Publié: (2026)
CharacterEval: A Chinese Benchmark for Role-Playing Conversational Agent Evaluation
par: Tu, Quan, et autres
Publié: (2024)
par: Tu, Quan, et autres
Publié: (2024)
Instructing the Architecture Search for Spatial-temporal Sequence Forecasting with LLM
par: Xue, Xin, et autres
Publié: (2025)
par: Xue, Xin, et autres
Publié: (2025)
A Status Quo Investigation of Large Language Models towards Cost-Effective CFD Automation with OpenFOAMGPT: ChatGPT vs. Qwen vs. Deepseek
par: Wang, Wenkang, et autres
Publié: (2025)
par: Wang, Wenkang, et autres
Publié: (2025)
Mnemis: Dual-Route Retrieval on Hierarchical Graphs for Long-Term LLM Memory
par: Tang, Zihao, et autres
Publié: (2026)
par: Tang, Zihao, et autres
Publié: (2026)
Mediator: Memory-efficient LLM Merging with Less Parameter Conflicts and Uncertainty Based Routing
par: Lai, Kunfeng, et autres
Publié: (2025)
par: Lai, Kunfeng, et autres
Publié: (2025)
AgentSwift: Efficient LLM Agent Design via Value-guided Hierarchical Search
par: Li, Yu, et autres
Publié: (2025)
par: Li, Yu, et autres
Publié: (2025)
Select-then-Solve: Paradigm Routing as Inference-Time Optimization for LLM Agents
par: Zhou, Heng, et autres
Publié: (2026)
par: Zhou, Heng, et autres
Publié: (2026)
Expectation Confirmation Preference Optimization for Multi-Turn Conversational Recommendation Agent
par: Feng, Xueyang, et autres
Publié: (2025)
par: Feng, Xueyang, et autres
Publié: (2025)
LLM Performance Predictors are good initializers for Architecture Search
par: Jawahar, Ganesh, et autres
Publié: (2023)
par: Jawahar, Ganesh, et autres
Publié: (2023)
Recognizing Limits: Investigating Infeasibility in Large Language Models
par: Zhang, Wenbo, et autres
Publié: (2024)
par: Zhang, Wenbo, et autres
Publié: (2024)
Enhancing Recommendation Explanations through User-Centric Refinement
par: Zhang, Jingsen, et autres
Publié: (2025)
par: Zhang, Jingsen, et autres
Publié: (2025)
TweakLLM: A Routing Architecture for Dynamic Tailoring of Cached Responses
par: Cheema, Muhammad Taha, et autres
Publié: (2025)
par: Cheema, Muhammad Taha, et autres
Publié: (2025)
Route to Reason: Adaptive Routing for LLM and Reasoning Strategy Selection
par: Pan, Zhihong, et autres
Publié: (2025)
par: Pan, Zhihong, et autres
Publié: (2025)
TELEClass: Taxonomy Enrichment and LLM-Enhanced Hierarchical Text Classification with Minimal Supervision
par: Zhang, Yunyi, et autres
Publié: (2024)
par: Zhang, Yunyi, et autres
Publié: (2024)
DiSRouter: Distributed Self-Routing for LLM Selections
par: Zheng, Hang, et autres
Publié: (2025)
par: Zheng, Hang, et autres
Publié: (2025)
DecoupleSearch: Decouple Planning and Search via Hierarchical Reward Modeling
par: Sun, Hao, et autres
Publié: (2025)
par: Sun, Hao, et autres
Publié: (2025)
Turbo Sparse: Achieving LLM SOTA Performance with Minimal Activated Parameters
par: Song, Yixin, et autres
Publié: (2024)
par: Song, Yixin, et autres
Publié: (2024)
Dovetail: A CPU/GPU Heterogeneous Speculative Decoding for LLM inference
par: Zhang, Libo, et autres
Publié: (2024)
par: Zhang, Libo, et autres
Publié: (2024)
RouteProfile: Graph-Based Profiling for Cold-Start LLM Routing
par: Xu, Jingjun, et autres
Publié: (2026)
par: Xu, Jingjun, et autres
Publié: (2026)
Towards Efficient Multi-LLM Inference: Characterization and Analysis of LLM Routing and Hierarchical Techniques
par: Behera, Adarsh Prasad, et autres
Publié: (2025)
par: Behera, Adarsh Prasad, et autres
Publié: (2025)
EvoRoute: Experience-Driven Self-Routing LLM Agent Systems
par: Zhang, Guibin, et autres
Publié: (2026)
par: Zhang, Guibin, et autres
Publié: (2026)
RouteLMT: Learned Sample Routing for Hybrid LLM Translation Deployment
par: Luo, Yingfeng, et autres
Publié: (2026)
par: Luo, Yingfeng, et autres
Publié: (2026)
OmniRouter: Budget and Performance Controllable Multi-LLM Routing
par: Mei, Kai, et autres
Publié: (2025)
par: Mei, Kai, et autres
Publié: (2025)
From LLM to Conversational Agent: A Memory Enhanced Architecture with Fine-Tuning of Large Language Models
par: Liu, Na, et autres
Publié: (2024)
par: Liu, Na, et autres
Publié: (2024)
Evaluating and Calibrating LLM Confidence on Questions with Multiple Correct Answers
par: Wang, Yuhan, et autres
Publié: (2026)
par: Wang, Yuhan, et autres
Publié: (2026)
Modeling Uncertainty Trends for Timely Retrieval in Dynamic RAG
par: Li, Bo, et autres
Publié: (2025)
par: Li, Bo, et autres
Publié: (2025)
ZeroLM: Data-Free Transformer Architecture Search for Language Models
par: Chen, Zhen-Song, et autres
Publié: (2025)
par: Chen, Zhen-Song, et autres
Publié: (2025)
iFairy: the First 2-bit Complex LLM with All Parameters in $\{\pm1, \pm i\}$
par: Wang, Feiyu, et autres
Publié: (2025)
par: Wang, Feiyu, et autres
Publié: (2025)
RouteLLM: Learning to Route LLMs with Preference Data
par: Ong, Isaac, et autres
Publié: (2024)
par: Ong, Isaac, et autres
Publié: (2024)
LLM-JEPA: Large Language Models Meet Joint Embedding Predictive Architectures
par: Huang, Hai, et autres
Publié: (2025)
par: Huang, Hai, et autres
Publié: (2025)
D2LLM: Decomposed and Distilled Large Language Models for Semantic Search
par: Liao, Zihan, et autres
Publié: (2024)
par: Liao, Zihan, et autres
Publié: (2024)
Arch-Router: Aligning LLM Routing with Human Preferences
par: Tran, Co, et autres
Publié: (2025)
par: Tran, Co, et autres
Publié: (2025)
Inner-Probe: Discovering Copyright-related Data Generation in LLM Architecture
par: Ma, Qichao, et autres
Publié: (2024)
par: Ma, Qichao, et autres
Publié: (2024)
Subgraph Retrieval Enhanced by Graph-Text Alignment for Commonsense Question Answering
par: Peng, Boci, et autres
Publié: (2024)
par: Peng, Boci, et autres
Publié: (2024)
Documents similaires
-
Prompt and Parameter Co-Optimization for Large Language Models
par: Bo, Xiaohe, et autres
Publié: (2025) -
CAM: A Constructivist View of Agentic Memory for LLM-Based Reading Comprehension
par: Li, Rui, et autres
Publié: (2025) -
Explainable Recommendation with Simulated Human Feedback
par: Tang, Jiakai, et autres
Publié: (2025) -
Towards Adaptive, Scalable, and Robust Coordination of LLM Agents: A Dynamic Ad-Hoc Networking Perspective
par: Li, Rui, et autres
Publié: (2026) -
Learn to Memorize: Optimizing LLM-based Agents with Adaptive Memory Framework
par: Zhang, Zeyu, et autres
Publié: (2025)