Fine-Mem: Fine-Grained Feedback Alignment for Long-Horizon Memory Management
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ma, Weitao, Feng, Xiaocheng, Huang, Lei, Feng, Xiachong, Ma, Zhanyu, Xu, Jun, Gao, Jiuchong, Hao, Jinghua, He, Renqing, Qin, Bing |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Silence the Judge: Reinforcement Learning with Self-Verifier via Latent Geometric Clustering
par: Zhang, Nonghai, et autres
Publié: (2026)
par: Zhang, Nonghai, et autres
Publié: (2026)
ImplicitMemBench: Measuring Unconscious Behavioral Adaptation in Large Language Models
par: Qin, Chonghan, et autres
Publié: (2026)
par: Qin, Chonghan, et autres
Publié: (2026)
Learning Fine-Grained Grounded Citations for Attributed Large Language Models
par: Huang, Lei, et autres
Publié: (2024)
par: Huang, Lei, et autres
Publié: (2024)
Efficient Paths and Dense Rewards: Probabilistic Flow Reasoning for Large Language Models
par: Liu, Yan, et autres
Publié: (2026)
par: Liu, Yan, et autres
Publié: (2026)
LTS-VoiceAgent: A Listen-Think-Speak Framework for Efficient Streaming Voice Interaction via Semantic Triggering and Incremental Reasoning
par: Zou, Wenhao, et autres
Publié: (2026)
par: Zou, Wenhao, et autres
Publié: (2026)
UserLM-R1: Modeling Human Reasoning in User Language Models with Multi-Reward Reinforcement Learning
par: Zhang, Feng, et autres
Publié: (2026)
par: Zhang, Feng, et autres
Publié: (2026)
Unveiling Entity-Level Unlearning for Large Language Models: A Comprehensive Analysis
par: Ma, Weitao, et autres
Publié: (2024)
par: Ma, Weitao, et autres
Publié: (2024)
Long-term Task-oriented Agent: Proactive Long-term Intent Maintenance in Dynamic Environments
par: Shi, Qinglong, et autres
Publié: (2026)
par: Shi, Qinglong, et autres
Publié: (2026)
GeoRA: Geometry-Aware Low-Rank Adaptation for RLVR
par: Zhang, Jiaying, et autres
Publié: (2026)
par: Zhang, Jiaying, et autres
Publié: (2026)
MUSE: Multi-Domain Chinese User Simulation via Self-Evolving Profiles and Rubric-Guided Alignment
par: Liu, Zihao, et autres
Publié: (2026)
par: Liu, Zihao, et autres
Publié: (2026)
State Rank Dynamics in Linear Attention LLMs
par: Sun, Ao, et autres
Publié: (2026)
par: Sun, Ao, et autres
Publié: (2026)
CC-Tuning: A Cross-Lingual Connection Mechanism for Improving Joint Multilingual Supervised Fine-Tuning
par: Ye, Yangfan, et autres
Publié: (2025)
par: Ye, Yangfan, et autres
Publié: (2025)
Adaptive Backtracking for Privacy Protection in Large Language Models
par: Yao, Zhihao, et autres
Publié: (2025)
par: Yao, Zhihao, et autres
Publié: (2025)
Causal Tracing of Object Representations in Large Vision Language Models: Mechanistic Interpretability and Hallucination Mitigation
par: Li, Qiming, et autres
Publié: (2025)
par: Li, Qiming, et autres
Publié: (2025)
MemFine: Memory-Aware Fine-Grained Scheduling for MoE Training
par: Zhao, Lu, et autres
Publié: (2025)
par: Zhao, Lu, et autres
Publié: (2025)
GlobeSumm: A Challenging Benchmark Towards Unifying Multi-lingual, Cross-lingual and Multi-document News Summarization
par: Ye, Yangfan, et autres
Publié: (2024)
par: Ye, Yangfan, et autres
Publié: (2024)
LangGPS: Language Separability Guided Data Pre-Selection for Joint Multilingual Instruction Tuning
par: Ye, Yangfan, et autres
Publié: (2025)
par: Ye, Yangfan, et autres
Publié: (2025)
Adapter-based Selective Knowledge Distillation for Federated Multi-domain Meeting Summarization
par: Feng, Xiachong, et autres
Publié: (2023)
par: Feng, Xiachong, et autres
Publié: (2023)
Unlocking Multilingual Reasoning Capability of LLMs and LVLMs through Representation Engineering
par: Li, Qiming, et autres
Publié: (2025)
par: Li, Qiming, et autres
Publié: (2025)
SAVOIR: Learning Social Savoir-Faire via Shapley-based Reward Attribution
par: Feng, Xiachong, et autres
Publié: (2026)
par: Feng, Xiachong, et autres
Publié: (2026)
x1: Learning to Think Adaptively Across Languages and Cultures
par: Ye, Yangfan, et autres
Publié: (2026)
par: Ye, Yangfan, et autres
Publié: (2026)
One for All: Update Parameterized Knowledge Across Multiple Models
par: Ma, Weitao, et autres
Publié: (2025)
par: Ma, Weitao, et autres
Publié: (2025)
Stratagem: Learning Transferable Reasoning via Trajectory-Modulated Game Self-Play
par: Feng, Xiachong, et autres
Publié: (2026)
par: Feng, Xiachong, et autres
Publié: (2026)
Improving Contextual Faithfulness of Large Language Models via Retrieval Heads-Induced Optimization
par: Huang, Lei, et autres
Publié: (2025)
par: Huang, Lei, et autres
Publié: (2025)
Towards Privacy-Preserving Fine-Grained Visual Classification via Hierarchical Learning from Label Proportions
par: Chang, Jinyi, et autres
Publié: (2025)
par: Chang, Jinyi, et autres
Publié: (2025)
Hidden States Know Where Reasoning Diverges: Credit Assignment via Span-Level Wasserstein Distance
par: Chen, Xinzhu, et autres
Publié: (2026)
par: Chen, Xinzhu, et autres
Publié: (2026)
Mem-T: Densifying Rewards for Long-Horizon Memory Agents
par: Yue, Yanwei, et autres
Publié: (2026)
par: Yue, Yanwei, et autres
Publié: (2026)
Exploring Cross-lingual Latent Transplantation: Mutual Opportunities and Open Challenges
par: Ye, Yangfan, et autres
Publié: (2024)
par: Ye, Yangfan, et autres
Publié: (2024)
WebAnchor: Anchoring Agent Planning to Stabilize Long-Horizon Web Reasoning
par: Yu, Xinmiao, et autres
Publié: (2026)
par: Yu, Xinmiao, et autres
Publié: (2026)
VoiceAgentEval: A Dual-Dimensional Benchmark for Expert-Level Intelligent Voice-Agent Evaluation of Xbench's Professional-Aligned Series
par: Xu, Pengyu, et autres
Publié: (2025)
par: Xu, Pengyu, et autres
Publié: (2025)
The Granularity Axis: A Micro-to-Macro Latent Direction for Social Roles in Language Models
par: Qin, Chonghan, et autres
Publié: (2026)
par: Qin, Chonghan, et autres
Publié: (2026)
StructMem: Structured Memory for Long-Horizon Behavior in LLMs
par: Xu, Buqiang, et autres
Publié: (2026)
par: Xu, Buqiang, et autres
Publié: (2026)
CogPortrait: Fine-Grained Eye-Region Control in Portrait Animation via Hierarchical Agent Planning
par: Feng, He, et autres
Publié: (2026)
par: Feng, He, et autres
Publié: (2026)
CultureForest: Understanding and Evaluating Cultural Norm Grounded Reasoning in LLMs
par: Ye, Yangfan, et autres
Publié: (2026)
par: Ye, Yangfan, et autres
Publié: (2026)
PERSONA: Dynamic and Compositional Inference-Time Personality Control via Activation Vector Algebra
par: Feng, Xiachong, et autres
Publié: (2026)
par: Feng, Xiachong, et autres
Publié: (2026)
From Hypothesis to Publication: A Comprehensive Survey of AI-Driven Research Support Systems
par: Zhou, Zekun, et autres
Publié: (2025)
par: Zhou, Zekun, et autres
Publié: (2025)
O-Mem: Omni Memory System for Personalized, Long Horizon, Self-Evolving Agents
par: Wang, Piaohong, et autres
Publié: (2025)
par: Wang, Piaohong, et autres
Publié: (2025)
SpatialMem: Metric-Aligned Long-Horizon Video Memory for Language Grounding and QA
par: Zheng, Xinyi, et autres
Publié: (2026)
par: Zheng, Xinyi, et autres
Publié: (2026)
EverMemOS: A Self-Organizing Memory Operating System for Structured Long-Horizon Reasoning
par: Hu, Chuanrui, et autres
Publié: (2026)
par: Hu, Chuanrui, et autres
Publié: (2026)
HiMem: Hierarchical Long-Term Memory for LLM Long-Horizon Agents
par: Zhang, Ningning, et autres
Publié: (2026)
par: Zhang, Ningning, et autres
Publié: (2026)
Documents similaires
-
Silence the Judge: Reinforcement Learning with Self-Verifier via Latent Geometric Clustering
par: Zhang, Nonghai, et autres
Publié: (2026) -
ImplicitMemBench: Measuring Unconscious Behavioral Adaptation in Large Language Models
par: Qin, Chonghan, et autres
Publié: (2026) -
Learning Fine-Grained Grounded Citations for Attributed Large Language Models
par: Huang, Lei, et autres
Publié: (2024) -
Efficient Paths and Dense Rewards: Probabilistic Flow Reasoning for Large Language Models
par: Liu, Yan, et autres
Publié: (2026) -
LTS-VoiceAgent: A Listen-Think-Speak Framework for Efficient Streaming Voice Interaction via Semantic Triggering and Incremental Reasoning
par: Zou, Wenhao, et autres
Publié: (2026)