$\text{Memory}^3$: Language Modeling with Explicit Memory
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Hongkang, Lin, Zehao, Wang, Wenjin, Wu, Hao, Li, Zhiyu, Tang, Bo, Wei, Wenqiang, Wang, Jinbo, Tang, Zeyun, Song, Shichao, Xi, Chenyang, Yu, Yu, Chen, Kai, Xiong, Feiyu, Tang, Linpeng, E, Weinan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MedMemoryBench: Benchmarking Agent Memory in Personalized Healthcare
par: Wang, Yihao, et autres
Publié: (2026)
par: Wang, Yihao, et autres
Publié: (2026)
The Superalignment of Superhuman Intelligence with Large Language Models
par: Huang, Minlie, et autres
Publié: (2024)
par: Huang, Minlie, et autres
Publié: (2024)
The Personalization Trap: How User Memory Alters Emotional Reasoning in LLMs
par: Fang, Xi, et autres
Publié: (2025)
par: Fang, Xi, et autres
Publié: (2025)
A Survey of Text Watermarking in the Era of Large Language Models
par: Liu, Aiwei, et autres
Publié: (2023)
par: Liu, Aiwei, et autres
Publié: (2023)
Measuring text summarization factuality using atomic facts entailment metrics in the context of retrieval augmented generation
par: Kriman, N. E.
Publié: (2024)
par: Kriman, N. E.
Publié: (2024)
BMAM: Brain-inspired Multi-Agent Memory Framework
par: Li, Yang, et autres
Publié: (2026)
par: Li, Yang, et autres
Publié: (2026)
MerNav: A Highly Generalizable Memory-Execute-Review Framework for Zero-Shot Object Goal Navigation
par: Qi, Dekang, et autres
Publié: (2026)
par: Qi, Dekang, et autres
Publié: (2026)
ExpliCa: Evaluating Explicit Causal Reasoning in Large Language Models
par: Miliani, Martina, et autres
Publié: (2025)
par: Miliani, Martina, et autres
Publié: (2025)
D-SMART: Enhancing LLM Dialogue Consistency via Dynamic Structured Memory And Reasoning Tree
par: Lei, Xiang, et autres
Publié: (2025)
par: Lei, Xiang, et autres
Publié: (2025)
Efficient fine-tuning methodology of text embedding models for information retrieval: contrastive learning penalty (clp)
par: Yu, Jeongsu
Publié: (2024)
par: Yu, Jeongsu
Publié: (2024)
Cognitive Workspace: Active Memory Management for LLMs -- An Empirical Study of Functional Infinite Context
par: An, Tao
Publié: (2025)
par: An, Tao
Publié: (2025)
New Skills or Sharper Primitives? A Probabilistic Perspective on the Emergence of Reasoning in RLVR
par: Wang, Zhilin, et autres
Publié: (2026)
par: Wang, Zhilin, et autres
Publié: (2026)
When Retrieval Succeeds and Fails: Rethinking Retrieval-Augmented Generation for LLMs
par: Wang, Yongjie, et autres
Publié: (2025)
par: Wang, Yongjie, et autres
Publié: (2025)
Unveiling Attractor Cycles in Large Language Models: A Dynamical Systems View of Successive Paraphrasing
par: Wang, Zhilin, et autres
Publié: (2025)
par: Wang, Zhilin, et autres
Publié: (2025)
Prompt Engineering and the Effectiveness of Large Language Models in Enhancing Human Productivity
par: Anam, Rizal Khoirul
Publié: (2025)
par: Anam, Rizal Khoirul
Publié: (2025)
A Survey on Collaborating Small and Large Language Models for Performance, Cost-effectiveness, Cloud-edge Privacy, and Trustworthiness
par: Wang, Fali, et autres
Publié: (2025)
par: Wang, Fali, et autres
Publié: (2025)
Empowering Tabular Data Preparation with Language Models: Why and How?
par: Chen, Mengshi, et autres
Publié: (2025)
par: Chen, Mengshi, et autres
Publié: (2025)
A Survey on Natural Language Counterfactual Generation
par: Wang, Yongjie, et autres
Publié: (2024)
par: Wang, Yongjie, et autres
Publié: (2024)
ByteRover: Agent-Native Memory Through LLM-Curated Hierarchical Context
par: Nguyen, Andy, et autres
Publié: (2026)
par: Nguyen, Andy, et autres
Publié: (2026)
Give it Space! Explicit Disentangling of Positional and Semantic Representations in Encoders
par: Lequeu, Pierre-Antoine, et autres
Publié: (2026)
par: Lequeu, Pierre-Antoine, et autres
Publié: (2026)
SAGE: Sign-Adaptive Gradient for Memory-Efficient LLM Optimization
par: Lee, Wooin, et autres
Publié: (2026)
par: Lee, Wooin, et autres
Publié: (2026)
Beyond Many-Shot Translation: Scaling In-Context Demonstrations For Low-Resource Machine Translation
par: Salim, Luis Frentzen, et autres
Publié: (2026)
par: Salim, Luis Frentzen, et autres
Publié: (2026)
TIS-DPO: Token-level Importance Sampling for Direct Preference Optimization With Estimated Weights
par: Liu, Aiwei, et autres
Publié: (2024)
par: Liu, Aiwei, et autres
Publié: (2024)
Cache-to-Cache: Direct Semantic Communication Between Large Language Models
par: Fu, Tianyu, et autres
Publié: (2025)
par: Fu, Tianyu, et autres
Publié: (2025)
Fast Quiet-STaR: Thinking Without Thought Tokens
par: Huang, Wei, et autres
Publié: (2025)
par: Huang, Wei, et autres
Publié: (2025)
An Unforgeable Publicly Verifiable Watermark for Large Language Models
par: Liu, Aiwei, et autres
Publié: (2023)
par: Liu, Aiwei, et autres
Publié: (2023)
RoleRAG: Enhancing LLM Role-Playing via Graph Guided Retrieval
par: Wang, Yongjie, et autres
Publié: (2025)
par: Wang, Yongjie, et autres
Publié: (2025)
Can LLM Watermarks Robustly Prevent Unauthorized Knowledge Distillation?
par: Pan, Leyi, et autres
Publié: (2025)
par: Pan, Leyi, et autres
Publié: (2025)
UM_FHS at TREC 2024 PLABA: Exploration of Fine-tuning and AI agent approach for plain language adaptations of biomedical text
par: Kocbek, Primoz, et autres
Publié: (2025)
par: Kocbek, Primoz, et autres
Publié: (2025)
WaterSeeker: Pioneering Efficient Detection of Watermarked Segments in Large Documents
par: Pan, Leyi, et autres
Publié: (2024)
par: Pan, Leyi, et autres
Publié: (2024)
A Knowledge Enhanced Learning and Semantic Composition Model for Multi-Claim Fact Checking
par: Wang, Shuai, et autres
Publié: (2021)
par: Wang, Shuai, et autres
Publié: (2021)
Large Language Models(LLMs) on Tabular Data: Prediction, Generation, and Understanding -- A Survey
par: Fang, Xi, et autres
Publié: (2024)
par: Fang, Xi, et autres
Publié: (2024)
Parametric Social Identity Injection and Diversification in Public Opinion Simulation
par: Wang, Hexi, et autres
Publié: (2026)
par: Wang, Hexi, et autres
Publié: (2026)
Mapping the Web of Science, a large-scale graph and text-based dataset with LLM embeddings
par: Kunt, Tim, et autres
Publié: (2026)
par: Kunt, Tim, et autres
Publié: (2026)
Direct Large Language Model Alignment Through Self-Rewarding Contrastive Prompt Distillation
par: Liu, Aiwei, et autres
Publié: (2024)
par: Liu, Aiwei, et autres
Publié: (2024)
Late Chunking: Contextual Chunk Embeddings Using Long-Context Embedding Models
par: Günther, Michael, et autres
Publié: (2024)
par: Günther, Michael, et autres
Publié: (2024)
LLM-Assisted Crisis Management: Building Advanced LLM Platforms for Effective Emergency Response and Public Collaboration
par: Otal, Hakan T., et autres
Publié: (2024)
par: Otal, Hakan T., et autres
Publié: (2024)
RHealthTwin: Towards Responsible and Multimodal Digital Twins for Personalized Well-being
par: Ferdousi, Rahatara, et autres
Publié: (2025)
par: Ferdousi, Rahatara, et autres
Publié: (2025)
PairCFR: Enhancing Model Training on Paired Counterfactually Augmented Data through Contrastive Learning
par: Qiu, Xiaoqi, et autres
Publié: (2024)
par: Qiu, Xiaoqi, et autres
Publié: (2024)
An Iterative Optimizing Framework for Radiology Report Summarization with ChatGPT
par: Ma, Chong, et autres
Publié: (2023)
par: Ma, Chong, et autres
Publié: (2023)
Documents similaires
-
MedMemoryBench: Benchmarking Agent Memory in Personalized Healthcare
par: Wang, Yihao, et autres
Publié: (2026) -
The Superalignment of Superhuman Intelligence with Large Language Models
par: Huang, Minlie, et autres
Publié: (2024) -
The Personalization Trap: How User Memory Alters Emotional Reasoning in LLMs
par: Fang, Xi, et autres
Publié: (2025) -
A Survey of Text Watermarking in the Era of Large Language Models
par: Liu, Aiwei, et autres
Publié: (2023) -
Measuring text summarization factuality using atomic facts entailment metrics in the context of retrieval augmented generation
par: Kriman, N. E.
Publié: (2024)