Omni-SimpleMem: Autoresearch-Guided Discovery of Lifelong Multimodal Agent Memory
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Jiaqi, Ling, Zipeng, Qiu, Shi, Liu, Yanqing, Han, Siwei, Xia, Peng, Tu, Haoqin, Zheng, Zeyu, Xie, Cihang, Fleming, Charles, Ding, Mingyu, Yao, Huaxiu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SimpleMem: Efficient Lifelong Memory for LLM Agents
par: Liu, Jiaqi, et autres
Publié: (2026)
par: Liu, Jiaqi, et autres
Publié: (2026)
EvolveMem:Self-Evolving Memory Architecture via AutoResearch for LLM Agents
par: Liu, Jiaqi, et autres
Publié: (2026)
par: Liu, Jiaqi, et autres
Publié: (2026)
OpenVision: A Fully-Open, Cost-Effective Family of Advanced Vision Encoders for Multimodal Learning
par: Li, Xianhang, et autres
Publié: (2025)
par: Li, Xianhang, et autres
Publié: (2025)
MetaClaw: Just Talk -- An Agent That Meta-Learns and Evolves in the Wild
par: Xia, Peng, et autres
Publié: (2026)
par: Xia, Peng, et autres
Publié: (2026)
MemVerse: Multimodal Memory for Lifelong Learning Agents
par: Liu, Junming, et autres
Publié: (2025)
par: Liu, Junming, et autres
Publié: (2025)
Bilevel Autoresearch: Meta-Autoresearching Itself
par: Qu, Yaonan, et autres
Publié: (2026)
par: Qu, Yaonan, et autres
Publié: (2026)
ClawArena: Benchmarking AI Agents in Evolving Information Environments
par: Ji, Haonian, et autres
Publié: (2026)
par: Ji, Haonian, et autres
Publié: (2026)
AriadneMem: Threading the Maze of Lifelong Memory for LLM Agents
par: Zhu, Wenhui, et autres
Publié: (2026)
par: Zhu, Wenhui, et autres
Publié: (2026)
Kestrel: Grounding Self-Refinement for LVLM Hallucination Mitigation
par: Mao, Jiawei, et autres
Publié: (2026)
par: Mao, Jiawei, et autres
Publié: (2026)
SpatialThinker: Reinforcing 3D Reasoning in Multimodal LLMs via Spatial Rewards
par: Batra, Hunar, et autres
Publié: (2025)
par: Batra, Hunar, et autres
Publié: (2025)
SimpleOCR: Rendering Visualized Questions to Teach MLLMs to Read
par: Peng, Yibo, et autres
Publié: (2026)
par: Peng, Yibo, et autres
Publié: (2026)
CLIPS: An Enhanced CLIP Framework for Learning with Synthetic Captions
par: Liu, Yanqing, et autres
Publié: (2024)
par: Liu, Yanqing, et autres
Publié: (2024)
OpenVision 2: A Family of Generative Pretrained Visual Encoders for Multimodal Learning
par: Liu, Yanqing, et autres
Publié: (2025)
par: Liu, Yanqing, et autres
Publié: (2025)
ViLBench: A Suite for Vision-Language Process Reward Modeling
par: Tu, Haoqin, et autres
Publié: (2025)
par: Tu, Haoqin, et autres
Publié: (2025)
Alignment Tipping Process: How Self-Evolution Pushes LLM Agents Off the Rails
par: Han, Siwei, et autres
Publié: (2025)
par: Han, Siwei, et autres
Publié: (2025)
All-Mem: Agentic Lifelong Memory via Dynamic Topology Evolution
par: Lv, Can, et autres
Publié: (2026)
par: Lv, Can, et autres
Publié: (2026)
EgoMem: Lifelong Memory Agent for Full-duplex Omnimodal Models
par: Yao, Yiqun, et autres
Publié: (2025)
par: Yao, Yiqun, et autres
Publié: (2025)
STAR-1: Safer Alignment of Reasoning LLMs with 1K Data
par: Wang, Zijun, et autres
Publié: (2025)
par: Wang, Zijun, et autres
Publié: (2025)
Language Models Can See Better: Visual Contrastive Decoding For LLM Multimodal Reasoning
par: Pang, Yuqi, et autres
Publié: (2025)
par: Pang, Yuqi, et autres
Publié: (2025)
SkillRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning
par: Xia, Peng, et autres
Publié: (2026)
par: Xia, Peng, et autres
Publié: (2026)
Agent0-VL: Exploring Self-Evolving Agent for Tool-Integrated Vision-Language Reasoning
par: Liu, Jiaqi, et autres
Publié: (2025)
par: Liu, Jiaqi, et autres
Publié: (2025)
OpenVision 3: A Family of Unified Visual Encoder for Both Understanding and Generation
par: Zhang, Letian, et autres
Publié: (2026)
par: Zhang, Letian, et autres
Publié: (2026)
CHAI: Command Hijacking against embodied AI
par: Burbano, Luis, et autres
Publié: (2025)
par: Burbano, Luis, et autres
Publié: (2025)
OmniMem: Scalable and Adaptive Memory Retrieval for Long Video Generation
par: Zhao, Lin, et autres
Publié: (2026)
par: Zhao, Lin, et autres
Publié: (2026)
ClinSeekAgent: Automating Multimodal Evidence Seeking for Agentic Clinical Reasoning
par: Wu, Juncheng, et autres
Publié: (2026)
par: Wu, Juncheng, et autres
Publié: (2026)
Your Agent, Their Asset: A Real-World Safety Analysis of OpenClaw
par: Wang, Zijun, et autres
Publié: (2026)
par: Wang, Zijun, et autres
Publié: (2026)
A Preliminary Study of o1 in Medicine: Are We Closer to an AI Doctor?
par: Xie, Yunfei, et autres
Publié: (2024)
par: Xie, Yunfei, et autres
Publié: (2024)
LightFusion: A Light-weighted, Double Fusion Framework for Unified Multimodal Understanding and Generation
par: Wang, Zeyu, et autres
Publié: (2025)
par: Wang, Zeyu, et autres
Publié: (2025)
AttnGCG: Enhancing Jailbreaking Attacks on LLMs with Attention Manipulation
par: Wang, Zijun, et autres
Publié: (2024)
par: Wang, Zijun, et autres
Publié: (2024)
ClawForge: Generating Executable Interactive Benchmarks for Command-Line Agents
par: Lai, Yuxiang, et autres
Publié: (2026)
par: Lai, Yuxiang, et autres
Publié: (2026)
AHELM: A Holistic Evaluation of Audio-Language Models
par: Lee, Tony, et autres
Publié: (2025)
par: Lee, Tony, et autres
Publié: (2025)
O-Mem: Omni Memory System for Personalized, Long Horizon, Self-Evolving Agents
par: Wang, Piaohong, et autres
Publié: (2025)
par: Wang, Piaohong, et autres
Publié: (2025)
MMIE: Massive Multimodal Interleaved Comprehension Benchmark for Large Vision-Language Models
par: Xia, Peng, et autres
Publié: (2024)
par: Xia, Peng, et autres
Publié: (2024)
Leaf Spot on Pritchardia martii Caused by Nigrospora osmanthi in China
par: Haoqin Pan, et autres
Publié: (2026)
par: Haoqin Pan, et autres
Publié: (2026)
Where on Earth? A Vision-Language Benchmark for Probing Model Geolocation Skills Across Scales
par: Qian, Zhaofang, et autres
Publié: (2025)
par: Qian, Zhaofang, et autres
Publié: (2025)
When Visualizing is the First Step to Reasoning: MIRA, a Benchmark for Visual Chain-of-Thought
par: Zhou, Yiyang, et autres
Publié: (2025)
par: Zhou, Yiyang, et autres
Publié: (2025)
SFT or RL? An Early Investigation into Training R1-Like Reasoning Large Vision-Language Models
par: Chen, Hardy, et autres
Publié: (2025)
par: Chen, Hardy, et autres
Publié: (2025)
Knowledge or Reasoning? A Close Look at How LLMs Think Across Domains
par: Wu, Juncheng, et autres
Publié: (2025)
par: Wu, Juncheng, et autres
Publié: (2025)
MemEye: A Visual-Centric Evaluation Framework for Multimodal Agent Memory
par: Guo, Minghao, et autres
Publié: (2026)
par: Guo, Minghao, et autres
Publié: (2026)
AQA-Bench: An Interactive Benchmark for Evaluating LLMs' Sequential Reasoning Ability
par: Yang, Siwei, et autres
Publié: (2024)
par: Yang, Siwei, et autres
Publié: (2024)
Documents similaires
-
SimpleMem: Efficient Lifelong Memory for LLM Agents
par: Liu, Jiaqi, et autres
Publié: (2026) -
EvolveMem:Self-Evolving Memory Architecture via AutoResearch for LLM Agents
par: Liu, Jiaqi, et autres
Publié: (2026) -
OpenVision: A Fully-Open, Cost-Effective Family of Advanced Vision Encoders for Multimodal Learning
par: Li, Xianhang, et autres
Publié: (2025) -
MetaClaw: Just Talk -- An Agent That Meta-Learns and Evolves in the Wild
par: Xia, Peng, et autres
Publié: (2026) -
MemVerse: Multimodal Memory for Lifelong Learning Agents
par: Liu, Junming, et autres
Publié: (2025)