HomeGuard: VLM-based Embodied Safeguard for Identifying Contextual Risk in Household Task
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lu, Xiaoya, Zhou, Yijin, Chen, Zeren, Wang, Ruocheng, Sima, Bingrui, Zhou, Enshen, Sheng, Lu, Liu, Dongrui, Shao, Jing |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
IS-Bench: Evaluating Interactive Safety of VLM-Driven Embodied Agents in Daily Household Tasks
par: Lu, Xiaoya, et autres
Publié: (2025)
par: Lu, Xiaoya, et autres
Publié: (2025)
INFA-Guard: Mitigating Malicious Propagation via Infection-Aware Safeguarding in LLM-Based Multi-Agent Systems
par: Zhou, Yijin, et autres
Publié: (2026)
par: Zhou, Yijin, et autres
Publié: (2026)
ProGuard: Towards Proactive Multimodal Safeguard
par: Yu, Shaohan, et autres
Publié: (2025)
par: Yu, Shaohan, et autres
Publié: (2025)
Geometrically-Constrained Agent for Spatial Reasoning
par: Chen, Zeren, et autres
Publié: (2025)
par: Chen, Zeren, et autres
Publié: (2025)
Systematic Reward Gap Optimization for Mitigating VLM Hallucinations
par: He, Lehan, et autres
Publié: (2024)
par: He, Lehan, et autres
Publié: (2024)
MP5: A Multi-modal Open-ended Embodied System in Minecraft via Active Perception
par: Qin, Yiran, et autres
Publié: (2023)
par: Qin, Yiran, et autres
Publié: (2023)
LlavaGuard: An Open VLM-based Framework for Safeguarding Vision Datasets and Models
par: Helff, Lukas, et autres
Publié: (2024)
par: Helff, Lukas, et autres
Publié: (2024)
X-Boundary: Establishing Exact Safety Boundary to Shield LLMs from Multi-Turn Jailbreaks without Compromising Usability
par: Lu, Xiaoya, et autres
Publié: (2025)
par: Lu, Xiaoya, et autres
Publié: (2025)
LLMs Deceive Unintentionally: Emergent Misalignment in Dishonesty from Misaligned Samples to Biased Human-AI Interactions
par: Hu, Xuhao, et autres
Publié: (2025)
par: Hu, Xuhao, et autres
Publié: (2025)
VLM-Guard: Safeguarding Vision-Language Models via Fulfilling Safety Alignment Gap
par: Liu, Qin, et autres
Publié: (2025)
par: Liu, Qin, et autres
Publié: (2025)
Self-Guard: Empower the LLM to Safeguard Itself
par: Wang, Zezhong, et autres
Publié: (2023)
par: Wang, Zezhong, et autres
Publié: (2023)
MineDreamer: Learning to Follow Instructions via Chain-of-Imagination for Simulated-World Control
par: Zhou, Enshen, et autres
Publié: (2024)
par: Zhou, Enshen, et autres
Publié: (2024)
GuardDoor: Safeguarding Against Malicious Diffusion Editing via Protective Backdoors
par: Zeng, Yaopei, et autres
Publié: (2025)
par: Zeng, Yaopei, et autres
Publié: (2025)
CrossGuard: Safeguarding MLLMs against Joint-Modal Implicit Malicious Attacks
par: Zhang, Xu, et autres
Publié: (2025)
par: Zhang, Xu, et autres
Publié: (2025)
RH20T-P: A Primitive-Level Robotic Dataset Towards Composable Generalization Agents
par: Chen, Zeren, et autres
Publié: (2024)
par: Chen, Zeren, et autres
Publié: (2024)
GuardReasoner: Towards Reasoning-based LLM Safeguards
par: Liu, Yue, et autres
Publié: (2025)
par: Liu, Yue, et autres
Publié: (2025)
HELP: Hierarchical Embodied Language Planner for Household Tasks
par: Korchemnyi, Alexandr V., et autres
Publié: (2025)
par: Korchemnyi, Alexandr V., et autres
Publié: (2025)
RiOSWorld: Benchmarking the Risk of Multimodal Computer-Use Agents
par: Yang, Jingyi, et autres
Publié: (2025)
par: Yang, Jingyi, et autres
Publié: (2025)
GrandGuard: Taxonomy, Benchmark, and Safeguards for Elderly-Chatbot Interaction Safety
par: Fan, Changxuan, et autres
Publié: (2026)
par: Fan, Changxuan, et autres
Publié: (2026)
Prune4Web: DOM Tree Pruning Programming for Web Agent
par: Zhang, Jiayuan, et autres
Publié: (2025)
par: Zhang, Jiayuan, et autres
Publié: (2025)
TrinityGuard: A Unified Framework for Safeguarding Multi-Agent Systems
par: Wang, Kai, et autres
Publié: (2026)
par: Wang, Kai, et autres
Publié: (2026)
PropGuard: Safeguarding LLM-MAS via Propagation-Aware Exploration and Remediation
par: Yan, Bingyu, et autres
Publié: (2026)
par: Yan, Bingyu, et autres
Publié: (2026)
VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models
par: Sima, Bingrui, et autres
Publié: (2025)
par: Sima, Bingrui, et autres
Publié: (2025)
ShieldVLM: Safeguarding the Multimodal Implicit Toxicity via Deliberative Reasoning with LVLMs
par: Cui, Shiyao, et autres
Publié: (2025)
par: Cui, Shiyao, et autres
Publié: (2025)
SafeAgent: Safeguarding LLM Agents via an Automated Risk Simulator
par: Zhou, Xueyang, et autres
Publié: (2025)
par: Zhou, Xueyang, et autres
Publié: (2025)
Growth characteristics of Dahurian larch (Larix gmelinii) in northeast China during 1965-2015
par: Jia, Bingrui, et autres
Publié: (2017)
par: Jia, Bingrui, et autres
Publié: (2017)
Octavius: Mitigating Task Interference in MLLMs via LoRA-MoE
par: Chen, Zeren, et autres
Publié: (2023)
par: Chen, Zeren, et autres
Publié: (2023)
GLiGuard: Schema-Conditioned Classification for LLM Safeguard
par: Zaratiana, Urchade, et autres
Publié: (2026)
par: Zaratiana, Urchade, et autres
Publié: (2026)
AlignBot: Aligning VLM-powered Customized Task Planning with User Reminders Through Fine-Tuning for Household Robots
par: Zhaxizhuoma, Zhaxizhuoma, et autres
Publié: (2024)
par: Zhaxizhuoma, Zhaxizhuoma, et autres
Publié: (2024)
ADVEDM:Fine-grained Adversarial Attack against VLM-based Embodied Agents
par: Wang, Yichen, et autres
Publié: (2025)
par: Wang, Yichen, et autres
Publié: (2025)
LLM-Empowered Embodied Agent for Memory-Augmented Task Planning in Household Robotics
par: Glocker, Marc, et autres
Publié: (2025)
par: Glocker, Marc, et autres
Publié: (2025)
MindPower: Enabling Theory-of-Mind Reasoning in VLM-based Embodied Agents
par: Zhang, Ruoxuan, et autres
Publié: (2025)
par: Zhang, Ruoxuan, et autres
Publié: (2025)
GuardAgent: Safeguard LLM Agents by a Guard Agent via Knowledge-Enabled Reasoning
par: Xiang, Zhen, et autres
Publié: (2024)
par: Xiang, Zhen, et autres
Publié: (2024)
Risks of AI Scientists: Prioritizing Safeguarding Over Autonomy
par: Tang, Xiangru, et autres
Publié: (2024)
par: Tang, Xiangru, et autres
Publié: (2024)
Compromising Embodied Agents with Contextual Backdoor Attacks
par: Liu, Aishan, et autres
Publié: (2024)
par: Liu, Aishan, et autres
Publié: (2024)
Brokerage and patronage: Regional chambers of commerce and firm subsidies in China
par: Zeren Li, et autres
Publié: (2025)
par: Zeren Li, et autres
Publié: (2025)
BlindGuard: Safeguarding LLM-based Multi-Agent Systems under Unknown Attacks
par: Miao, Rui, et autres
Publié: (2025)
par: Miao, Rui, et autres
Publié: (2025)
Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report v1.5
par: Liu, Dongrui, et autres
Publié: (2026)
par: Liu, Dongrui, et autres
Publié: (2026)
GuardReasoner-VL: Safeguarding VLMs via Reinforced Reasoning
par: Liu, Yue, et autres
Publié: (2025)
par: Liu, Yue, et autres
Publié: (2025)
SEA-Guard: Culturally Grounded Multilingual Safeguard for Southeast Asia
par: Tasawong, Panuthep, et autres
Publié: (2026)
par: Tasawong, Panuthep, et autres
Publié: (2026)
Documents similaires
-
IS-Bench: Evaluating Interactive Safety of VLM-Driven Embodied Agents in Daily Household Tasks
par: Lu, Xiaoya, et autres
Publié: (2025) -
INFA-Guard: Mitigating Malicious Propagation via Infection-Aware Safeguarding in LLM-Based Multi-Agent Systems
par: Zhou, Yijin, et autres
Publié: (2026) -
ProGuard: Towards Proactive Multimodal Safeguard
par: Yu, Shaohan, et autres
Publié: (2025) -
Geometrically-Constrained Agent for Spatial Reasoning
par: Chen, Zeren, et autres
Publié: (2025) -
Systematic Reward Gap Optimization for Mitigating VLM Hallucinations
par: He, Lehan, et autres
Publié: (2024)