Enregistré dans:
| Auteur principal: | Lin, Tao |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2601.16531 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning Query-Aware Budget-Tier Routing for Runtime Agent Memory
par: Zhang, Haozhen, et autres
Publié: (2026)
par: Zhang, Haozhen, et autres
Publié: (2026)
AdaFRUGAL: Adaptive Memory-Efficient Training with Dynamic Control
par: Bui, Quang-Hung, et autres
Publié: (2025)
par: Bui, Quang-Hung, et autres
Publié: (2025)
Training-Free Exponential Context Extension via Cascading KV Cache
par: Willette, Jeffrey, et autres
Publié: (2024)
par: Willette, Jeffrey, et autres
Publié: (2024)
InfLLM: Training-Free Long-Context Extrapolation for LLMs with an Efficient Context Memory
par: Xiao, Chaojun, et autres
Publié: (2024)
par: Xiao, Chaojun, et autres
Publié: (2024)
UltraEdit: Training-, Subject-, and Memory-Free Lifelong Editing in Language Models
par: Gu, Xiaojie, et autres
Publié: (2025)
par: Gu, Xiaojie, et autres
Publié: (2025)
Increasing Model Capacity for Free: A Simple Strategy for Parameter Efficient Fine-tuning
par: Song, Haobo, et autres
Publié: (2024)
par: Song, Haobo, et autres
Publié: (2024)
ThermoQA: A Three-Tier Benchmark for Evaluating Thermodynamic Reasoning in Large Language Models
par: Düzkar, Kemal
Publié: (2026)
par: Düzkar, Kemal
Publié: (2026)
StyleRec: A Benchmark Dataset for Prompt Recovery in Writing Style Transformation
par: Liu, Shenyang, et autres
Publié: (2025)
par: Liu, Shenyang, et autres
Publié: (2025)
TTKV: Temporal-Tiered KV Cache for Long-Context LLM Inference
par: Dzikanyanga, Gradwell, et autres
Publié: (2026)
par: Dzikanyanga, Gradwell, et autres
Publié: (2026)
2-Tier SimCSE: Elevating BERT for Robust Sentence Embeddings
par: Wang, Yumeng, et autres
Publié: (2025)
par: Wang, Yumeng, et autres
Publié: (2025)
Memory-Efficient LLM Training with Online Subspace Descent
par: Liang, Kaizhao, et autres
Publié: (2024)
par: Liang, Kaizhao, et autres
Publié: (2024)
Echo: A Large Language Model with Temporal Episodic Memory
par: Liu, WenTao, et autres
Publié: (2025)
par: Liu, WenTao, et autres
Publié: (2025)
Collaborative Memory: Multi-User Memory Sharing in LLM Agents with Dynamic Access Control
par: Rezazadeh, Alireza, et autres
Publié: (2025)
par: Rezazadeh, Alireza, et autres
Publié: (2025)
LEC: Linear Expectation Constraints for Selection-Conditioned Risk Control in Selective Prediction and Routing Systems
par: Wang, Zhiyuan, et autres
Publié: (2025)
par: Wang, Zhiyuan, et autres
Publié: (2025)
Train Small, Infer Large: Memory-Efficient LoRA Training for Large Language Models
par: Zhang, Jun, et autres
Publié: (2025)
par: Zhang, Jun, et autres
Publié: (2025)
A Framework for Inference Inspired by Human Memory Mechanisms
par: Zeng, Xiangyu, et autres
Publié: (2023)
par: Zeng, Xiangyu, et autres
Publié: (2023)
Cold-Start Personalization via Training-Free Priors from Structured World Models
par: Bose, Avinandan, et autres
Publié: (2026)
par: Bose, Avinandan, et autres
Publié: (2026)
POET-X: Memory-efficient LLM Training by Scaling Orthogonal Transformation
par: Qiu, Zeju, et autres
Publié: (2026)
par: Qiu, Zeju, et autres
Publié: (2026)
Correcting Mean Bias in Text Embeddings: A Refined Renormalization with Training-Free Improvements on MMTEB
par: Ren, Xingyu, et autres
Publié: (2025)
par: Ren, Xingyu, et autres
Publié: (2025)
TrimR: Verifier-based Training-Free Thinking Compression for Efficient Test-Time Scaling
par: Lin, Weizhe, et autres
Publié: (2025)
par: Lin, Weizhe, et autres
Publié: (2025)
ELSA: A Style Aligned Dataset for Emotionally Intelligent Language Generation
par: Gandhi, Vishal, et autres
Publié: (2025)
par: Gandhi, Vishal, et autres
Publié: (2025)
ChatGPT vs Human-authored Text: Insights into Controllable Text Summarization and Sentence Style Transfer
par: Liu, Dongqi, et autres
Publié: (2023)
par: Liu, Dongqi, et autres
Publié: (2023)
Query-Conditioned Test-Time Self-Training for Large Language Models
par: Song, Chaehee, et autres
Publié: (2026)
par: Song, Chaehee, et autres
Publié: (2026)
Training Reasoning Models on Saturated Problems via Failure-Prefix Conditioning
par: Kim, Minwu, et autres
Publié: (2026)
par: Kim, Minwu, et autres
Publié: (2026)
Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit
par: Goddard, Charles, et autres
Publié: (2025)
par: Goddard, Charles, et autres
Publié: (2025)
LLMem: Estimating GPU Memory Usage for Fine-Tuning Pre-Trained LLMs
par: Kim, Taeho, et autres
Publié: (2024)
par: Kim, Taeho, et autres
Publié: (2024)
Mini-batch Coresets for Memory-efficient Language Model Training on Data Mixtures
par: Nguyen, Dang, et autres
Publié: (2024)
par: Nguyen, Dang, et autres
Publié: (2024)
The Past Is Not Past: Memory-Enhanced Dynamic Reward Shaping
par: Liu, Yang, et autres
Publié: (2026)
par: Liu, Yang, et autres
Publié: (2026)
Improving Autoregressive Training with Dynamic Oracles
par: Yang, Jianing, et autres
Publié: (2024)
par: Yang, Jianing, et autres
Publié: (2024)
Diagnosing Medical Datasets with Training Dynamics
par: Wenderoth, Laura
Publié: (2024)
par: Wenderoth, Laura
Publié: (2024)
Probing the Limits of Compressive Memory: A Study of Infini-Attention in Small-Scale Pretraining
par: Huang, Ruizhe, et autres
Publié: (2025)
par: Huang, Ruizhe, et autres
Publié: (2025)
DRESSing Up LLM: Efficient Stylized Question-Answering via Style Subspace Editing
par: Ma, Xinyu, et autres
Publié: (2025)
par: Ma, Xinyu, et autres
Publié: (2025)
Training-Free Bayesianization for Low-Rank Adapters of Large Language Models
par: Shi, Haizhou, et autres
Publié: (2024)
par: Shi, Haizhou, et autres
Publié: (2024)
Memory-efficient Energy-adaptive Inference of Pre-Trained Models on Batteryless Embedded Systems
par: Farina, Pietro, et autres
Publié: (2024)
par: Farina, Pietro, et autres
Publié: (2024)
When Style Breaks Safety: Defending LLMs Against Superficial Style Alignment
par: Xiao, Yuxin, et autres
Publié: (2025)
par: Xiao, Yuxin, et autres
Publié: (2025)
T-FREE: Subword Tokenizer-Free Generative LLMs via Sparse Representations for Memory-Efficient Embeddings
par: Deiseroth, Björn, et autres
Publié: (2024)
par: Deiseroth, Björn, et autres
Publié: (2024)
Cloning Ideology and Style using Deep Learning
par: Beg, Omer, et autres
Publié: (2022)
par: Beg, Omer, et autres
Publié: (2022)
Disentangling Feature Structure: A Mathematically Provable Two-Stage Training Dynamics in Transformers
par: Gong, Zixuan, et autres
Publié: (2025)
par: Gong, Zixuan, et autres
Publié: (2025)
MMR-GRPO: Accelerating GRPO-Style Training through Diversity-Aware Reward Reweighting
par: Wei, Kangda, et autres
Publié: (2026)
par: Wei, Kangda, et autres
Publié: (2026)
Emergence of Episodic Memory in Transformers: Characterizing Changes in Temporal Structure of Attention Scores During Training
par: Mistry, Deven Mahesh, et autres
Publié: (2025)
par: Mistry, Deven Mahesh, et autres
Publié: (2025)
Documents similaires
-
Learning Query-Aware Budget-Tier Routing for Runtime Agent Memory
par: Zhang, Haozhen, et autres
Publié: (2026) -
AdaFRUGAL: Adaptive Memory-Efficient Training with Dynamic Control
par: Bui, Quang-Hung, et autres
Publié: (2025) -
Training-Free Exponential Context Extension via Cascading KV Cache
par: Willette, Jeffrey, et autres
Publié: (2024) -
InfLLM: Training-Free Long-Context Extrapolation for LLMs with an Efficient Context Memory
par: Xiao, Chaojun, et autres
Publié: (2024) -
UltraEdit: Training-, Subject-, and Memory-Free Lifelong Editing in Language Models
par: Gu, Xiaojie, et autres
Publié: (2025)