CoMeT: Collaborative Memory Transformer for Efficient Long Context Modeling
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Runsong, Liu, Shilei, Tang, Jiwei, Liu, Langming, Chen, Haibin, Zhang, Weidong, Yuan, Yujin, Xiao, Tong, Zhu, Jingbo, Su, Wenbo, Zheng, Bo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PoC: Performance-oriented Context Compression for Large Language Models via Performance Prediction
di: Zhao, Runsong, et al.
Pubblicazione: (2026)
di: Zhao, Runsong, et al.
Pubblicazione: (2026)
Data Distribution Matters: A Data-Centric Perspective on Context Compression for Large Language Model
di: Lv, Kangtao, et al.
Pubblicazione: (2026)
di: Lv, Kangtao, et al.
Pubblicazione: (2026)
Read As Human: Compressing Context via Parallelizable Close Reading and Skimming
di: Tang, Jiwei, et al.
Pubblicazione: (2026)
di: Tang, Jiwei, et al.
Pubblicazione: (2026)
ECKGBench: Benchmarking Large Language Models in E-commerce Leveraging Knowledge Graph
di: Liu, Langming, et al.
Pubblicazione: (2025)
di: Liu, Langming, et al.
Pubblicazione: (2025)
How to inject knowledge efficiently? Knowledge Infusion Scaling Law for Pre-training Large Language Models
di: Lv, Kangtao, et al.
Pubblicazione: (2025)
di: Lv, Kangtao, et al.
Pubblicazione: (2025)
PretrainRL: Alleviating Factuality Hallucination of Large Language Models at the Beginning
di: Liu, Langming, et al.
Pubblicazione: (2026)
di: Liu, Langming, et al.
Pubblicazione: (2026)
COMI: Coarse-to-fine Context Compression via Marginal Information Gain
di: Tang, Jiwei, et al.
Pubblicazione: (2026)
di: Tang, Jiwei, et al.
Pubblicazione: (2026)
Expert Divergence Learning for MoE-based Language Models
di: Li, Jiaang, et al.
Pubblicazione: (2026)
di: Li, Jiaang, et al.
Pubblicazione: (2026)
ChineseEcomQA: A Scalable E-commerce Concept Evaluation Benchmark for Large Language Models
di: Chen, Haibin, et al.
Pubblicazione: (2025)
di: Chen, Haibin, et al.
Pubblicazione: (2025)
Position IDs Matter: An Enhanced Position Layout for Efficient Context Compression in Large Language Models
di: Zhao, Runsong, et al.
Pubblicazione: (2024)
di: Zhao, Runsong, et al.
Pubblicazione: (2024)
CoMeT: Count-Min-Sketch-based Row Tracking to Mitigate RowHammer at Low Cost
di: Bostanci, F. Nisa, et al.
Pubblicazione: (2024)
di: Bostanci, F. Nisa, et al.
Pubblicazione: (2024)
Unlocking Scaling Law in Industrial Recommendation Systems with a Three-step Paradigm based Large User Model
di: Yan, Bencheng, et al.
Pubblicazione: (2025)
di: Yan, Bencheng, et al.
Pubblicazione: (2025)
UQABench: Evaluating User Embedding for Prompting LLMs in Personalized Question Answering
di: Liu, Langming, et al.
Pubblicazione: (2025)
di: Liu, Langming, et al.
Pubblicazione: (2025)
Forgetting Curve: A Reliable Method for Evaluating Memorization Capability for Long-context Models
di: Liu, Xinyu, et al.
Pubblicazione: (2024)
di: Liu, Xinyu, et al.
Pubblicazione: (2024)
Autoencoding-Free Context Compression for LLMs via Contextual Semantic Anchors
di: Liu, Xin, et al.
Pubblicazione: (2025)
di: Liu, Xin, et al.
Pubblicazione: (2025)
MemoSight: Unifying Context Compression and Multi Token Prediction for Reasoning Acceleration
di: Liu, Xinyu, et al.
Pubblicazione: (2026)
di: Liu, Xinyu, et al.
Pubblicazione: (2026)
MeSH: Memory-as-State-Highways for Recursive Transformers
di: Yu, Chengting, et al.
Pubblicazione: (2025)
di: Yu, Chengting, et al.
Pubblicazione: (2025)
CoServe: Efficient Collaboration-of-Experts (CoE) Model Inference with Limited Memory
di: Suo, Jiashun, et al.
Pubblicazione: (2025)
di: Suo, Jiashun, et al.
Pubblicazione: (2025)
ZSMerge: Zero-Shot KV Cache Compression for Memory-Efficient Long-Context LLMs
di: Liu, Xin, et al.
Pubblicazione: (2025)
di: Liu, Xin, et al.
Pubblicazione: (2025)
Analysis of regularized federated learning
di: Liu, Langming, et al.
Pubblicazione: (2024)
di: Liu, Langming, et al.
Pubblicazione: (2024)
MTP-S2UT: Enhancing Speech-to-Speech Translation Quality with Multi-token Prediction
di: Wang, Jianjin, et al.
Pubblicazione: (2025)
di: Wang, Jianjin, et al.
Pubblicazione: (2025)
InfLLM: Training-Free Long-Context Extrapolation for LLMs with an Efficient Context Memory
di: Xiao, Chaojun, et al.
Pubblicazione: (2024)
di: Xiao, Chaojun, et al.
Pubblicazione: (2024)
An Evolved Universal Transformer Memory
di: Cetin, Edoardo, et al.
Pubblicazione: (2024)
di: Cetin, Edoardo, et al.
Pubblicazione: (2024)
Evolution Transformer: In-Context Evolutionary Optimization
di: Lange, Robert Tjarko, et al.
Pubblicazione: (2024)
di: Lange, Robert Tjarko, et al.
Pubblicazione: (2024)
Multi-task Offline Reinforcement Learning for Online Advertising in Recommender Systems
di: Liu, Langming, et al.
Pubblicazione: (2025)
di: Liu, Langming, et al.
Pubblicazione: (2025)
Enhancement of Mechanical Properties of Low‐Density WC–TiC–Co Cemented Carbides
di: Shilei Xuan, et al.
Pubblicazione: (2025)
di: Shilei Xuan, et al.
Pubblicazione: (2025)
IIET: Efficient Numerical Transformer via Implicit Iterative Euler Method
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
di: Liu, Xinyu, et al.
Pubblicazione: (2025)
StreamMeCo: Long-Term Agent Memory Compression for Efficient Streaming Video Understanding
di: Wang, Junxi, et al.
Pubblicazione: (2026)
di: Wang, Junxi, et al.
Pubblicazione: (2026)
Efficient Prompt Compression with Evaluator Heads for Long-Context Transformer Inference
di: Fei, Weizhi, et al.
Pubblicazione: (2025)
di: Fei, Weizhi, et al.
Pubblicazione: (2025)
Fovea Transformer: Efficient Long-Context Modeling with Structured Fine-to-Coarse Attention
di: He, Ziwei, et al.
Pubblicazione: (2023)
di: He, Ziwei, et al.
Pubblicazione: (2023)
HMT: Hierarchical Memory Transformer for Efficient Long Context Language Processing
di: He, Zifan, et al.
Pubblicazione: (2024)
di: He, Zifan, et al.
Pubblicazione: (2024)
MKA: Memory-Keyed Attention for Efficient Long-Context Reasoning
di: Liu, Dong, et al.
Pubblicazione: (2026)
di: Liu, Dong, et al.
Pubblicazione: (2026)
CoMemo: LVLMs Need Image Context with Image Memory
di: Liu, Shi, et al.
Pubblicazione: (2025)
di: Liu, Shi, et al.
Pubblicazione: (2025)
SlimPipe: Memory-Thrifty and Efficient Pipeline Parallelism for Long-Context LLM Training
di: Li, Zhouyang, et al.
Pubblicazione: (2025)
di: Li, Zhouyang, et al.
Pubblicazione: (2025)
RMAAT: Astrocyte-Inspired Memory Compression and Replay for Efficient Long-Context Transformers
di: Mia, Md Zesun Ahmed, et al.
Pubblicazione: (2026)
di: Mia, Md Zesun Ahmed, et al.
Pubblicazione: (2026)
Deconstructing Long Chain-of-Thought: A Structured Reasoning Optimization Framework for Long CoT Distillation
di: Luo, Yijia, et al.
Pubblicazione: (2025)
di: Luo, Yijia, et al.
Pubblicazione: (2025)
$π$-Attention: Periodic Sparse Transformers for Efficient Long-Context Modeling
di: Liu, Dong, et al.
Pubblicazione: (2025)
di: Liu, Dong, et al.
Pubblicazione: (2025)
Self-Taught Agentic Long Context Understanding
di: Zhuang, Yufan, et al.
Pubblicazione: (2025)
di: Zhuang, Yufan, et al.
Pubblicazione: (2025)
AI-native Memory 2.0: Second Me
di: Wei, Jiale, et al.
Pubblicazione: (2025)
di: Wei, Jiale, et al.
Pubblicazione: (2025)
MeMOTR: Long-Term Memory-Augmented Transformer for Multi-Object Tracking
di: Gao, Ruopeng, et al.
Pubblicazione: (2023)
di: Gao, Ruopeng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
PoC: Performance-oriented Context Compression for Large Language Models via Performance Prediction
di: Zhao, Runsong, et al.
Pubblicazione: (2026) -
Data Distribution Matters: A Data-Centric Perspective on Context Compression for Large Language Model
di: Lv, Kangtao, et al.
Pubblicazione: (2026) -
Read As Human: Compressing Context via Parallelizable Close Reading and Skimming
di: Tang, Jiwei, et al.
Pubblicazione: (2026) -
ECKGBench: Benchmarking Large Language Models in E-commerce Leveraging Knowledge Graph
di: Liu, Langming, et al.
Pubblicazione: (2025) -
How to inject knowledge efficiently? Knowledge Infusion Scaling Law for Pre-training Large Language Models
di: Lv, Kangtao, et al.
Pubblicazione: (2025)