Control LLM: Controlled Evolution for Intelligence Retention in LLM
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wei, Haichao, Ren, Yunxiang, Fu, Zhoutong, Lunia, Aman, Chen, Yi-Lin, Leung, Alice, Xu, Ya |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ModeSwitch-LLM: A Lightweight Phase-Aware Controller for Cross-Mode LLM Inference on a Single GPU
par: Sunesh, Aman, et autres
Publié: (2026)
par: Sunesh, Aman, et autres
Publié: (2026)
BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens
par: Wen, Hao, et autres
Publié: (2025)
par: Wen, Hao, et autres
Publié: (2025)
What's the Magic Word? A Control Theory of LLM Prompting
par: Bhargava, Aman, et autres
Publié: (2023)
par: Bhargava, Aman, et autres
Publié: (2023)
Rotation Control Unlearning: Quantifying and Controlling Continuous Unlearning for LLM with The Cognitive Rotation Space
par: Zhang, Xiang, et autres
Publié: (2025)
par: Zhang, Xiang, et autres
Publié: (2025)
Controlled LLM Training on Spectral Sphere
par: Xie, Tian, et autres
Publié: (2026)
par: Xie, Tian, et autres
Publié: (2026)
Interpreting and Controlling LLM Reasoning through Integrated Policy Gradient
par: Li, Changming, et autres
Publié: (2026)
par: Li, Changming, et autres
Publié: (2026)
Unsupervised Conformal Inference: Bootstrapping and Alignment to Control LLM Uncertainty
par: Pang, Lingyou, et autres
Publié: (2025)
par: Pang, Lingyou, et autres
Publié: (2025)
Async Control: Stress-testing Asynchronous Control Measures for LLM Agents
par: Stickland, Asa Cooper, et autres
Publié: (2025)
par: Stickland, Asa Cooper, et autres
Publié: (2025)
Chain-of-Memory: Lightweight Memory Construction with Dynamic Evolution for LLM Agents
par: Xu, Xiucheng, et autres
Publié: (2026)
par: Xu, Xiucheng, et autres
Publié: (2026)
AI Agents for Inventory Control: Human-LLM-OR Complementarity
par: Baek, Jackie, et autres
Publié: (2026)
par: Baek, Jackie, et autres
Publié: (2026)
On Entropy Control in LLM-RL Algorithms
par: Shen, Han
Publié: (2025)
par: Shen, Han
Publié: (2025)
An LLM-based Agentic Framework for Accessible Network Control
par: Lin, Samuel, et autres
Publié: (2025)
par: Lin, Samuel, et autres
Publié: (2025)
Think Just Enough: Sequence-Level Entropy as a Confidence Signal for LLM Reasoning
par: Sharma, Aman, et autres
Publié: (2025)
par: Sharma, Aman, et autres
Publié: (2025)
Learning Dynamics of LLM Finetuning
par: Ren, Yi, et autres
Publié: (2024)
par: Ren, Yi, et autres
Publié: (2024)
AttackLLM: LLM-based Attack Pattern Generation for an Industrial Control System
par: Ahmed, Chuadhry Mujeeb
Publié: (2025)
par: Ahmed, Chuadhry Mujeeb
Publié: (2025)
Beyond Test-Time Memory: State-Space Optimal Control for LLM Reasoning
par: Wang, Peihao, et autres
Publié: (2026)
par: Wang, Peihao, et autres
Publié: (2026)
Multimodal LLM for Intelligent Transportation Systems
par: Le, Dexter, et autres
Publié: (2024)
par: Le, Dexter, et autres
Publié: (2024)
SciPIP: An LLM-based Scientific Paper Idea Proposer
par: Wang, Wenxiao, et autres
Publié: (2024)
par: Wang, Wenxiao, et autres
Publié: (2024)
Flow-Controlled Scheduling for LLM Inference with Provable Stability Guarantees
par: Dong, Zhuolun, et autres
Publié: (2026)
par: Dong, Zhuolun, et autres
Publié: (2026)
ControlNET: A Firewall for RAG-based LLM System
par: Yao, Hongwei, et autres
Publié: (2025)
par: Yao, Hongwei, et autres
Publié: (2025)
Addressing Performance Saturation for LLM RL via Precise Entropy Curve Control
par: Li, Bolian, et autres
Publié: (2026)
par: Li, Bolian, et autres
Publié: (2026)
Lever: Speculative LLM Inference on Smartphones
par: Wang, Tuowei, et autres
Publié: (2026)
par: Wang, Tuowei, et autres
Publié: (2026)
MSD-LLM: Predicting Ship Detention in Port State Control Inspections with Large Language Model
par: Jin, Jiongchao, et autres
Publié: (2025)
par: Jin, Jiongchao, et autres
Publié: (2025)
CGCMA: Conditionally-Gated Cross-Modal Attention for Event-Conditioned Asynchronous Fusion
par: Guo, Yunxiang
Publié: (2026)
par: Guo, Yunxiang
Publié: (2026)
Robot Policy Learning with Temporal Optimal Transport Reward
par: Fu, Yuwei, et autres
Publié: (2024)
par: Fu, Yuwei, et autres
Publié: (2024)
Revisiting Robustness for LLM Safety Alignment via Selective Geometry Control
par: Yang, Yonghui, et autres
Publié: (2026)
par: Yang, Yonghui, et autres
Publié: (2026)
Matching Accuracy, Different Geometry: Evolution Strategies vs GRPO in LLM Post-Training
par: Hoy, William, et autres
Publié: (2026)
par: Hoy, William, et autres
Publié: (2026)
Auto-Prompt Ensemble for LLM Judge
par: Li, Jiajie, et autres
Publié: (2025)
par: Li, Jiajie, et autres
Publié: (2025)
IPR: Intelligent Prompt Routing with User-Controlled Quality-Cost Trade-offs
par: Feng, Aosong, et autres
Publié: (2025)
par: Feng, Aosong, et autres
Publié: (2025)
VoltanaLLM: Feedback-Driven Frequency Control and State-Space Routing for Energy-Efficient LLM Serving
par: Yu, Jiahuan, et autres
Publié: (2025)
par: Yu, Jiahuan, et autres
Publié: (2025)
DGRO: Enhancing LLM Reasoning via Exploration-Exploitation Control and Reward Variance Management
par: Su, Xuerui, et autres
Publié: (2025)
par: Su, Xuerui, et autres
Publié: (2025)
BoostLLM: Boosting-inspired LLM Fine-tuning for Few-shot Tabular Classification
par: Wang, Yi-Siang, et autres
Publié: (2026)
par: Wang, Yi-Siang, et autres
Publié: (2026)
The Surprising Effectiveness of Negative Reinforcement in LLM Reasoning
par: Zhu, Xinyu, et autres
Publié: (2025)
par: Zhu, Xinyu, et autres
Publié: (2025)
DipLLM: Fine-Tuning LLM for Strategic Decision-making in Diplomacy
par: Xu, Kaixuan, et autres
Publié: (2025)
par: Xu, Kaixuan, et autres
Publié: (2025)
PRISE: LLM-Style Sequence Compression for Learning Temporal Action Abstractions in Control
par: Zheng, Ruijie, et autres
Publié: (2024)
par: Zheng, Ruijie, et autres
Publié: (2024)
Demonstration-Free Robotic Control via LLM Agents
par: Tsui, Brian Y., et autres
Publié: (2026)
par: Tsui, Brian Y., et autres
Publié: (2026)
LLM and GNN are Complementary: Distilling LLM for Multimodal Graph Learning
par: Xu, Junjie, et autres
Publié: (2024)
par: Xu, Junjie, et autres
Publié: (2024)
EPO: Hierarchical LLM Agents with Environment Preference Optimization
par: Zhao, Qi, et autres
Publié: (2024)
par: Zhao, Qi, et autres
Publié: (2024)
Controlled LLM Decoding via Discrete Auto-regressive Biasing
par: Pynadath, Patrick, et autres
Publié: (2025)
par: Pynadath, Patrick, et autres
Publié: (2025)
Variance Control via Weight Rescaling in LLM Pre-training
par: Owen, Louis, et autres
Publié: (2025)
par: Owen, Louis, et autres
Publié: (2025)
Documents similaires
-
ModeSwitch-LLM: A Lightweight Phase-Aware Controller for Cross-Mode LLM Inference on a Single GPU
par: Sunesh, Aman, et autres
Publié: (2026) -
BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens
par: Wen, Hao, et autres
Publié: (2025) -
What's the Magic Word? A Control Theory of LLM Prompting
par: Bhargava, Aman, et autres
Publié: (2023) -
Rotation Control Unlearning: Quantifying and Controlling Continuous Unlearning for LLM with The Cognitive Rotation Space
par: Zhang, Xiang, et autres
Publié: (2025) -
Controlled LLM Training on Spectral Sphere
par: Xie, Tian, et autres
Publié: (2026)