On Memory Construction and Retrieval for Personalized Conversational Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pan, Zhuoshi, Wu, Qianhui, Jiang, Huiqiang, Luo, Xufang, Cheng, Hao, Li, Dongsheng, Yang, Yuqing, Lin, Chin-Yew, Zhao, H. Vicky, Qiu, Lili, Gao, Jianfeng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LongLLMLingua: Accelerating and Enhancing LLMs in Long Context Scenarios via Prompt Compression
par: Jiang, Huiqiang, et autres
Publié: (2023)
par: Jiang, Huiqiang, et autres
Publié: (2023)
Mitigate Position Bias in Large Language Models via Scaling a Single Dimension
par: Yu, Yijiong, et autres
Publié: (2024)
par: Yu, Yijiong, et autres
Publié: (2024)
LLMLingua-2: Data Distillation for Efficient and Faithful Task-Agnostic Prompt Compression
par: Pan, Zhuoshi, et autres
Publié: (2024)
par: Pan, Zhuoshi, et autres
Publié: (2024)
MInference 1.0: Accelerating Pre-filling for Long-Context LLMs via Dynamic Sparse Attention
par: Jiang, Huiqiang, et autres
Publié: (2024)
par: Jiang, Huiqiang, et autres
Publié: (2024)
MMInference: Accelerating Pre-filling for Long-Context VLMs via Modality-Aware Permutation Sparse Attention
par: Li, Yucheng, et autres
Publié: (2025)
par: Li, Yucheng, et autres
Publié: (2025)
SCBench: A KV Cache-Centric Analysis of Long-Context Methods
par: Li, Yucheng, et autres
Publié: (2024)
par: Li, Yucheng, et autres
Publié: (2024)
Exploratory Memory-Augmented LLM Agent via Hybrid On- and Off-Policy Optimization
par: Liu, Zeyuan, et autres
Publié: (2026)
par: Liu, Zeyuan, et autres
Publié: (2026)
SortedRL: Accelerating RL Training for LLMs through Online Length-Aware Scheduling
par: Zhang, Yiqi, et autres
Publié: (2026)
par: Zhang, Yiqi, et autres
Publié: (2026)
LLM-RadJudge: Achieving Radiologist-Level Evaluation for X-Ray Report Generation
par: Wang, Zilong, et autres
Publié: (2024)
par: Wang, Zilong, et autres
Publié: (2024)
VL Norm: Rethink Loss Aggregation in RLVR
par: He, Zhiyuan, et autres
Publié: (2025)
par: He, Zhiyuan, et autres
Publié: (2025)
Agent Lightning: Train ANY AI Agents with Reinforcement Learning
par: Luo, Xufang, et autres
Publié: (2025)
par: Luo, Xufang, et autres
Publié: (2025)
Unified Medical Image Pre-training in Language-Guided Common Semantic Space
par: He, Xiaoxuan, et autres
Publié: (2023)
par: He, Xiaoxuan, et autres
Publié: (2023)
Position Engineering: Boosting Large Language Models through Positional Information Manipulation
par: He, Zhiyuan, et autres
Publié: (2024)
par: He, Zhiyuan, et autres
Publié: (2024)
Accelerating Prefilling via Decoding-time Contribution Sparsity
par: He, Zhiyuan, et autres
Publié: (2025)
par: He, Zhiyuan, et autres
Publié: (2025)
MTraining: Distributed Dynamic Sparse Attention for Efficient Ultra-Long Context Training
par: Li, Wenxuan, et autres
Publié: (2025)
par: Li, Wenxuan, et autres
Publié: (2025)
pMoE: Prompting Diverse Experts Together Wins More in Visual Adaptation
par: Mo, Shentong, et autres
Publié: (2026)
par: Mo, Shentong, et autres
Publié: (2026)
VisRL: Intention-Driven Visual Perception via Reinforced Reasoning
par: Chen, Zhangquan, et autres
Publié: (2025)
par: Chen, Zhangquan, et autres
Publié: (2025)
SecurityLingua: Efficient Defense of LLM Jailbreak Attacks via Security-Aware Prompt Compression
par: Li, Yucheng, et autres
Publié: (2025)
par: Li, Yucheng, et autres
Publié: (2025)
Understanding Reasoning in LLMs through Strategic Information Allocation under Uncertainty
par: Kim, Jeonghye, et autres
Publié: (2026)
par: Kim, Jeonghye, et autres
Publié: (2026)
ReMe: Scaffolding Personalized Cognitive Training via Controllable LLM-Mediated Conversations
par: Wang, Zilong, et autres
Publié: (2024)
par: Wang, Zilong, et autres
Publié: (2024)
LeanK: Learnable K Cache Channel Pruning for Efficient Decoding
par: Zhang, Yike, et autres
Publié: (2025)
par: Zhang, Yike, et autres
Publié: (2025)
Designing Network Algorithms via Large Language Models
par: He, Zhiyuan, et autres
Publié: (2024)
par: He, Zhiyuan, et autres
Publié: (2024)
InvestAlign: Overcoming Data Scarcity in Aligning Large Language Models with Investor Decision-Making Processes under Herd Behavior
par: Wang, Huisheng, et autres
Publié: (2025)
par: Wang, Huisheng, et autres
Publié: (2025)
AutoSurfer -- Teaching Web Agents through Comprehensive Surfing, Learning, and Modeling
par: Faisal, Fazle Elahi, et autres
Publié: (2026)
par: Faisal, Fazle Elahi, et autres
Publié: (2026)
LSPT: Long-term Spatial Prompt Tuning for Visual Representation Learning
par: Mo, Shentong, et autres
Publié: (2024)
par: Mo, Shentong, et autres
Publié: (2024)
A Large-scale Medical Visual Task Adaptation Benchmark
par: Mo, Shentong, et autres
Publié: (2024)
par: Mo, Shentong, et autres
Publié: (2024)
The Tool Illusion: Rethinking Tool Use in Web Agents
par: Lou, Renze, et autres
Publié: (2026)
par: Lou, Renze, et autres
Publié: (2026)
RetrievalAttention: Accelerating Long-Context LLM Inference via Vector Retrieval
par: Liu, Di, et autres
Publié: (2024)
par: Liu, Di, et autres
Publié: (2024)
Why Does Self-Distillation (Sometimes) Degrade the Reasoning Capability of LLMs?
par: Kim, Jeonghye, et autres
Publié: (2026)
par: Kim, Jeonghye, et autres
Publié: (2026)
Mitigating Hallucinations in Large Vision-Language Models via DPO: On-Policy Data Hold the Key
par: Yang, Zhihe, et autres
Publié: (2025)
par: Yang, Zhihe, et autres
Publié: (2025)
Optimize Replica Server Placement in a Satellite Network
par: He, Zhiyuan, et autres
Publié: (2025)
par: He, Zhiyuan, et autres
Publié: (2025)
Dyna-Mind: Learning to Simulate from Experience for Better AI Agents
par: Yu, Xiao, et autres
Publié: (2025)
par: Yu, Xiao, et autres
Publié: (2025)
Crafting Personalized Agents through Retrieval-Augmented Generation on Editable Memory Graphs
par: Wang, Zheng, et autres
Publié: (2024)
par: Wang, Zheng, et autres
Publié: (2024)
OP-Bench: Benchmarking Over-Personalization for Memory-Augmented Personalized Conversational Agents
par: Hu, Yulin, et autres
Publié: (2026)
par: Hu, Yulin, et autres
Publié: (2026)
OpenWebRL: Demystifying Online Multi-turn Reinforcement Learning for Visual Web Agents
par: Yang, Rui, et autres
Publié: (2026)
par: Yang, Rui, et autres
Publié: (2026)
P‐3.9: The Influence of Parallax and Shape Type Factors on the Perception of AR Equipment in Dark Environment
par: Huiqiang Xia, et autres
Publié: (2024)
par: Huiqiang Xia, et autres
Publié: (2024)
Hear You in Silence: Designing for Active Listening in Human Interaction with Conversational Agents Using Context-Aware Pacing
par: Jiang, Zhihan, et autres
Publié: (2026)
par: Jiang, Zhihan, et autres
Publié: (2026)
Graph Retrieval-Augmented LLM for Conversational Recommendation Systems
par: Qiu, Zhangchi, et autres
Publié: (2025)
par: Qiu, Zhangchi, et autres
Publié: (2025)
GUI-Actor: Coordinate-Free Visual Grounding for GUI Agents
par: Wu, Qianhui, et autres
Publié: (2025)
par: Wu, Qianhui, et autres
Publié: (2025)
Retrieve, Schedule, Reflect: LLM Agents for Chip QoR Optimization
par: ouyang, Yikang, et autres
Publié: (2026)
par: ouyang, Yikang, et autres
Publié: (2026)
Documents similaires
-
LongLLMLingua: Accelerating and Enhancing LLMs in Long Context Scenarios via Prompt Compression
par: Jiang, Huiqiang, et autres
Publié: (2023) -
Mitigate Position Bias in Large Language Models via Scaling a Single Dimension
par: Yu, Yijiong, et autres
Publié: (2024) -
LLMLingua-2: Data Distillation for Efficient and Faithful Task-Agnostic Prompt Compression
par: Pan, Zhuoshi, et autres
Publié: (2024) -
MInference 1.0: Accelerating Pre-filling for Long-Context LLMs via Dynamic Sparse Attention
par: Jiang, Huiqiang, et autres
Publié: (2024) -
MMInference: Accelerating Pre-filling for Long-Context VLMs via Modality-Aware Permutation Sparse Attention
par: Li, Yucheng, et autres
Publié: (2025)