An Evolved Universal Transformer Memory
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Cetin, Edoardo, Sun, Qi, Zhao, Tianyu, Tang, Yujin |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Transformer-Squared: Self-adaptive LLMs
von: Sun, Qi, et al.
Veröffentlicht: (2025)
von: Sun, Qi, et al.
Veröffentlicht: (2025)
Reinforcement Learning Teachers of Test Time Scaling
von: Cetin, Edoardo, et al.
Veröffentlicht: (2025)
von: Cetin, Edoardo, et al.
Veröffentlicht: (2025)
Large Language Models to Diffusion Finetuning
von: Cetin, Edoardo, et al.
Veröffentlicht: (2025)
von: Cetin, Edoardo, et al.
Veröffentlicht: (2025)
Sudoku-Bench: Evaluating creative reasoning with Sudoku variants
von: Seely, Jeffrey, et al.
Veröffentlicht: (2025)
von: Seely, Jeffrey, et al.
Veröffentlicht: (2025)
Text-to-LoRA: Instant Transformer Adaption
von: Charakorn, Rujikorn, et al.
Veröffentlicht: (2025)
von: Charakorn, Rujikorn, et al.
Veröffentlicht: (2025)
MemSkill: Learning and Evolving Memory Skills for Self-Evolving Agents
von: Zhang, Haozhen, et al.
Veröffentlicht: (2026)
von: Zhang, Haozhen, et al.
Veröffentlicht: (2026)
Self-Evolving Critique Abilities in Large Language Models
von: Tang, Zhengyang, et al.
Veröffentlicht: (2025)
von: Tang, Zhengyang, et al.
Veröffentlicht: (2025)
Evolving Demonstration Optimization for Chain-of-Thought Feature Transformation
von: Wang, Xinyuan, et al.
Veröffentlicht: (2026)
von: Wang, Xinyuan, et al.
Veröffentlicht: (2026)
EvoMemBench: Benchmarking Agent Memory from a Self-Evolving Perspective
von: Wang, Yuyao, et al.
Veröffentlicht: (2026)
von: Wang, Yuyao, et al.
Veröffentlicht: (2026)
Universe Routing: Why Self-Evolving Agents Need Epistemic Control
von: Wang, Zhaohui Geoffrey
Veröffentlicht: (2026)
von: Wang, Zhaohui Geoffrey
Veröffentlicht: (2026)
Mixture of Chapters: Scaling Learnt Memory in Transformers
von: Tibrewal, Tasmay Pankaj, et al.
Veröffentlicht: (2026)
von: Tibrewal, Tasmay Pankaj, et al.
Veröffentlicht: (2026)
TTCS: Test-Time Curriculum Synthesis for Self-Evolving
von: Yang, Chengyi, et al.
Veröffentlicht: (2026)
von: Yang, Chengyi, et al.
Veröffentlicht: (2026)
Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models
von: Vendrell, Victor Conchello, et al.
Veröffentlicht: (2026)
von: Vendrell, Victor Conchello, et al.
Veröffentlicht: (2026)
Fundamental Limits of Prompt Tuning Transformers: Universality, Capacity and Efficiency
von: Hu, Jerry Yao-Chieh, et al.
Veröffentlicht: (2024)
von: Hu, Jerry Yao-Chieh, et al.
Veröffentlicht: (2024)
Think Before You Act: Decision Transformers with Working Memory
von: Kang, Jikun, et al.
Veröffentlicht: (2023)
von: Kang, Jikun, et al.
Veröffentlicht: (2023)
Optimizing Anytime Reasoning via Budget Relative Policy Optimization
von: Qi, Penghui, et al.
Veröffentlicht: (2025)
von: Qi, Penghui, et al.
Veröffentlicht: (2025)
Working Memory Constraints Scaffold Learning in Transformers under Data Scarcity
von: Madhyastha, Pranava, et al.
Veröffentlicht: (2026)
von: Madhyastha, Pranava, et al.
Veröffentlicht: (2026)
POET-X: Memory-efficient LLM Training by Scaling Orthogonal Transformation
von: Qiu, Zeju, et al.
Veröffentlicht: (2026)
von: Qiu, Zeju, et al.
Veröffentlicht: (2026)
Mixture of Universal Experts: Scaling Virtual Width via Depth-Width Transformation
von: Chen, Yilong, et al.
Veröffentlicht: (2026)
von: Chen, Yilong, et al.
Veröffentlicht: (2026)
Time and Memory Trade-off of KV-Cache Compression in Tensor Transformer Decoding
von: Chen, Yifang, et al.
Veröffentlicht: (2025)
von: Chen, Yifang, et al.
Veröffentlicht: (2025)
ShinkaEvolve: Towards Open-Ended And Sample-Efficient Program Evolution
von: Lange, Robert Tjarko, et al.
Veröffentlicht: (2025)
von: Lange, Robert Tjarko, et al.
Veröffentlicht: (2025)
Defeating the Training-Inference Mismatch via FP16
von: Qi, Penghui, et al.
Veröffentlicht: (2025)
von: Qi, Penghui, et al.
Veröffentlicht: (2025)
MUSE-Autoskill: Self-Evolving Agents via Skill Creation, Memory, Management, and Evaluation
von: Lin, Huawei, et al.
Veröffentlicht: (2026)
von: Lin, Huawei, et al.
Veröffentlicht: (2026)
CEM: A Data-Efficient Method for Large Language Models to Continue Evolving From Mistakes
von: Zhao, Haokun, et al.
Veröffentlicht: (2024)
von: Zhao, Haokun, et al.
Veröffentlicht: (2024)
DR Tulu: Reinforcement Learning with Evolving Rubrics for Deep Research
von: Shao, Rulin, et al.
Veröffentlicht: (2025)
von: Shao, Rulin, et al.
Veröffentlicht: (2025)
Symbolic Learning Enables Self-Evolving Agents
von: Zhou, Wangchunshu, et al.
Veröffentlicht: (2024)
von: Zhou, Wangchunshu, et al.
Veröffentlicht: (2024)
DeferMem: Query-Time Evidence Distillation via Reinforcement Learning for Long-Term Memory QA
von: Yin, Jianing, et al.
Veröffentlicht: (2026)
von: Yin, Jianing, et al.
Veröffentlicht: (2026)
RePo: Language Models with Context Re-Positioning
von: Li, Huayang, et al.
Veröffentlicht: (2025)
von: Li, Huayang, et al.
Veröffentlicht: (2025)
LifeAlign: Lifelong Alignment for Large Language Models with Memory-Augmented Focalized Preference Optimization
von: Li, Junsong, et al.
Veröffentlicht: (2025)
von: Li, Junsong, et al.
Veröffentlicht: (2025)
Emergence of Episodic Memory in Transformers: Characterizing Changes in Temporal Structure of Attention Scores During Training
von: Mistry, Deven Mahesh, et al.
Veröffentlicht: (2025)
von: Mistry, Deven Mahesh, et al.
Veröffentlicht: (2025)
MMG2Skill: Can Agents Distill In-the-Wild Guides into Self-Evolving Skills?
von: Che, Xinyu, et al.
Veröffentlicht: (2026)
von: Che, Xinyu, et al.
Veröffentlicht: (2026)
The Evolving Landscape of LLM- and VLM-Integrated Reinforcement Learning
von: Schoepp, Sheila, et al.
Veröffentlicht: (2025)
von: Schoepp, Sheila, et al.
Veröffentlicht: (2025)
TodoEvolve: Learning to Architect Agent Planning Systems
von: Liu, Jiaxi, et al.
Veröffentlicht: (2026)
von: Liu, Jiaxi, et al.
Veröffentlicht: (2026)
Guided Self-Evolving LLMs with Minimal Human Supervision
von: Yu, Wenhao, et al.
Veröffentlicht: (2025)
von: Yu, Wenhao, et al.
Veröffentlicht: (2025)
Understanding R1-Zero-Like Training: A Critical Perspective
von: Liu, Zichen, et al.
Veröffentlicht: (2025)
von: Liu, Zichen, et al.
Veröffentlicht: (2025)
Memory Injections: Correcting Multi-Hop Reasoning Failures during Inference in Transformer-Based Language Models
von: Sakarvadia, Mansi, et al.
Veröffentlicht: (2023)
von: Sakarvadia, Mansi, et al.
Veröffentlicht: (2023)
MoM: Linear Sequence Modeling with Mixture-of-Memories
von: Du, Jusen, et al.
Veröffentlicht: (2025)
von: Du, Jusen, et al.
Veröffentlicht: (2025)
AgentEvolver: Towards Efficient Self-Evolving Agent System
von: Zhai, Yunpeng, et al.
Veröffentlicht: (2025)
von: Zhai, Yunpeng, et al.
Veröffentlicht: (2025)
Agentic-imodels: Evolving agentic interpretability tools via autoresearch
von: Singh, Chandan, et al.
Veröffentlicht: (2026)
von: Singh, Chandan, et al.
Veröffentlicht: (2026)
ClawArena: Benchmarking AI Agents in Evolving Information Environments
von: Ji, Haonian, et al.
Veröffentlicht: (2026)
von: Ji, Haonian, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Transformer-Squared: Self-adaptive LLMs
von: Sun, Qi, et al.
Veröffentlicht: (2025) -
Reinforcement Learning Teachers of Test Time Scaling
von: Cetin, Edoardo, et al.
Veröffentlicht: (2025) -
Large Language Models to Diffusion Finetuning
von: Cetin, Edoardo, et al.
Veröffentlicht: (2025) -
Sudoku-Bench: Evaluating creative reasoning with Sudoku variants
von: Seely, Jeffrey, et al.
Veröffentlicht: (2025) -
Text-to-LoRA: Instant Transformer Adaption
von: Charakorn, Rujikorn, et al.
Veröffentlicht: (2025)