Online-PVLM: Advancing Personalized VLMs with Online Concept Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Bai, Huiyu, Wang, Runze, Du, Zhuoyun, Zhao, Yiyang, Zhang, Fengji, Chen, Haoyu, Zhu, Xiaoyong, Zheng, Bo, Zhao, Xuejiao |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
GEM: Generative Entropy-Guided Preference Modeling for Few-shot Alignment of LLMs
by: Zhao, Yiyang, et al.
Published: (2025)
by: Zhao, Yiyang, et al.
Published: (2025)
GFRIEND: Generative Few-shot Reward Inference through EfficieNt DPO
by: Zhao, Yiyang, et al.
Published: (2025)
by: Zhao, Yiyang, et al.
Published: (2025)
Enabling Agents to Communicate Entirely in Latent Space
by: Du, Zhuoyun, et al.
Published: (2025)
by: Du, Zhuoyun, et al.
Published: (2025)
REVISION:Reflective Intent Mining and Online Reasoning Auxiliary for E-commerce Visual Search System Optimization
by: Tang, Yiwen, et al.
Published: (2025)
by: Tang, Yiwen, et al.
Published: (2025)
Learning to Evolve: A Self-Improving Framework for Multi-Agent Systems via Textual Parameter Graph Optimization
by: He, Shan, et al.
Published: (2026)
by: He, Shan, et al.
Published: (2026)
PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization
by: Cao, Zouying, et al.
Published: (2025)
by: Cao, Zouying, et al.
Published: (2025)
A Hybrid Deep Learning Framework for Stock Price Prediction Considering the Investor Sentiment of Online Forum Enhanced by Popularity
by: Li, Huiyu, et al.
Published: (2024)
by: Li, Huiyu, et al.
Published: (2024)
Decompose, Look, and Reason: Reinforced Latent Reasoning for VLMs
by: Zhu, Mengdan, et al.
Published: (2026)
by: Zhu, Mengdan, et al.
Published: (2026)
OVEL: Large Language Model as Memory Manager for Online Video Entity Linking
by: Zhao, Haiquan, et al.
Published: (2024)
by: Zhao, Haiquan, et al.
Published: (2024)
Beyond Single Concept Vector: Modeling Concept Subspace in LLMs with Gaussian Distribution
by: Zhao, Haiyan, et al.
Published: (2024)
by: Zhao, Haiyan, et al.
Published: (2024)
Online Personalizing White-box LLMs Generation with Neural Bandits
by: Chen, Zekai, et al.
Published: (2024)
by: Chen, Zekai, et al.
Published: (2024)
MobileGUI-RL: Advancing Mobile GUI Agent through Reinforcement Learning in Online Environment
by: Shi, Yucheng, et al.
Published: (2025)
by: Shi, Yucheng, et al.
Published: (2025)
Have the VLMs Lost Confidence? A Study of Sycophancy in VLMs
by: Li, Shuo, et al.
Published: (2024)
by: Li, Shuo, et al.
Published: (2024)
Analysing Knowledge Construction in Online Learning: Adapting the Interaction Analysis Model for Unstructured Large-Scale Discourse
by: Wang, Jindi, et al.
Published: (2025)
by: Wang, Jindi, et al.
Published: (2025)
RLHF Workflow: From Reward Modeling to Online RLHF
by: Dong, Hanze, et al.
Published: (2024)
by: Dong, Hanze, et al.
Published: (2024)
Customer-R1: Personalized Simulation of Human Behaviors via RL-based LLM Agent in Online Shopping
by: Wang, Ziyi, et al.
Published: (2025)
by: Wang, Ziyi, et al.
Published: (2025)
Handling Students Dropouts in an LLM-driven Interactive Online Course Using Language Models
by: Wang, Yuanchun, et al.
Published: (2025)
by: Wang, Yuanchun, et al.
Published: (2025)
Removal of Hallucination on Hallucination: Debate-Augmented RAG
by: Hu, Wentao, et al.
Published: (2025)
by: Hu, Wentao, et al.
Published: (2025)
Bridging Offline and Online Reinforcement Learning for LLMs
by: Lanchantin, Jack, et al.
Published: (2025)
by: Lanchantin, Jack, et al.
Published: (2025)
Personalized Real-time Jargon Support for Online Meetings
by: Song, Yifan, et al.
Published: (2025)
by: Song, Yifan, et al.
Published: (2025)
SACRED: A Faithful Annotated Multimedia Multimodal Multilingual Dataset for Classifying Connectedness Types in Online Spirituality
by: Guan, Qinghao, et al.
Published: (2026)
by: Guan, Qinghao, et al.
Published: (2026)
Before the Outrage: Challenges and Advances in Predicting Online Antisocial Behavior
by: Ollagnier, Anaïs
Published: (2025)
by: Ollagnier, Anaïs
Published: (2025)
GeoSense: Evaluating Identification and Application of Geometric Principles in Multimodal Reasoning
by: Xu, Liangyu, et al.
Published: (2025)
by: Xu, Liangyu, et al.
Published: (2025)
Toward Robust Multimodal Learning using Multimodal Foundational Models
by: Zhao, Xianbing, et al.
Published: (2024)
by: Zhao, Xianbing, et al.
Published: (2024)
DoCIA: An Online Document-Level Context Incorporation Agent for Speech Translation
by: Lyu, Xinglin, et al.
Published: (2025)
by: Lyu, Xinglin, et al.
Published: (2025)
Denoising Concept Vectors with Sparse Autoencoders for Improved Language Model Steering
by: Zhao, Haiyan, et al.
Published: (2025)
by: Zhao, Haiyan, et al.
Published: (2025)
VSP: Assessing the dual challenges of perception and reasoning in spatial planning tasks for VLMs
by: Wu, Qiucheng, et al.
Published: (2024)
by: Wu, Qiucheng, et al.
Published: (2024)
Scaling In-Context Online Learning Capability of LLMs via Cross-Episode Meta-RL
by: Lin, Xiaofeng, et al.
Published: (2026)
by: Lin, Xiaofeng, et al.
Published: (2026)
ERA: Transforming VLMs into Embodied Agents via Embodied Prior Learning and Online Reinforcement Learning
by: Chen, Hanyang, et al.
Published: (2025)
by: Chen, Hanyang, et al.
Published: (2025)
Hallucination Mitigating for Medical Report Generation
by: Zhao, Ruoqing, et al.
Published: (2026)
by: Zhao, Ruoqing, et al.
Published: (2026)
OPTune: Efficient Online Preference Tuning
by: Chen, Lichang, et al.
Published: (2024)
by: Chen, Lichang, et al.
Published: (2024)
Online Experiential Learning for Language Models
by: Ye, Tianzhu, et al.
Published: (2026)
by: Ye, Tianzhu, et al.
Published: (2026)
Adaptive Rollout Allocation for Online Reinforcement Learning with Verifiable Rewards
by: Nguyen, Hieu Trung, et al.
Published: (2026)
by: Nguyen, Hieu Trung, et al.
Published: (2026)
LANE: Logic Alignment of Non-tuning Large Language Models and Online Recommendation Systems for Explainable Reason Generation
by: Zhao, Hongke, et al.
Published: (2024)
by: Zhao, Hongke, et al.
Published: (2024)
LECTOR: LLM-Enhanced Concept-based Test-Oriented Repetition for Adaptive Spaced Learning
by: Zhao, Jiahao
Published: (2025)
by: Zhao, Jiahao
Published: (2025)
Online Training of Large Language Models: Learn while chatting
by: Liang, Juhao, et al.
Published: (2024)
by: Liang, Juhao, et al.
Published: (2024)
Scaling Agentic Capabilities via Grounded Interaction Synthesis
by: Shi, Wenhang, et al.
Published: (2026)
by: Shi, Wenhang, et al.
Published: (2026)
What Makes AI Research Replicable? Executable Knowledge Graphs as Scientific Knowledge Representations
by: Luo, Yujie, et al.
Published: (2025)
by: Luo, Yujie, et al.
Published: (2025)
Memory-Efficient LLM Training with Online Subspace Descent
by: Liang, Kaizhao, et al.
Published: (2024)
by: Liang, Kaizhao, et al.
Published: (2024)
Investigating the Impact of Rationales for LLMs on Natural Language Understanding
by: Shi, Wenhang, et al.
Published: (2025)
by: Shi, Wenhang, et al.
Published: (2025)
Similar Items
-
GEM: Generative Entropy-Guided Preference Modeling for Few-shot Alignment of LLMs
by: Zhao, Yiyang, et al.
Published: (2025) -
GFRIEND: Generative Few-shot Reward Inference through EfficieNt DPO
by: Zhao, Yiyang, et al.
Published: (2025) -
Enabling Agents to Communicate Entirely in Latent Space
by: Du, Zhuoyun, et al.
Published: (2025) -
REVISION:Reflective Intent Mining and Online Reasoning Auxiliary for E-commerce Visual Search System Optimization
by: Tang, Yiwen, et al.
Published: (2025) -
Learning to Evolve: A Self-Improving Framework for Multi-Agent Systems via Textual Parameter Graph Optimization
by: He, Shan, et al.
Published: (2026)