LifeAgentBench: A Multi-dimensional Benchmark and Agent for Personal Health Assistants in Digital Health
Fuente:
arXiv
Salvato in:
| Autori principali: | Tian, Ye, Wang, Zihao, Gungor, Onat, Fan, Xiaoran, Rosing, Tajana |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FoodCHA: Multi-Modal LLM Agent for Fine-Grained Food Analysis
di: Lee, Woojin, et al.
Pubblicazione: (2026)
di: Lee, Woojin, et al.
Pubblicazione: (2026)
DailyLLM: Context-Aware Activity Log Generation Using Multi-Modal Sensors and LLMs
di: Tian, Ye, et al.
Pubblicazione: (2025)
di: Tian, Ye, et al.
Pubblicazione: (2025)
KLDrive: Fine-Grained 3D Scene Reasoning for Autonomous Driving based on Knowledge Graph
di: Tian, Ye, et al.
Pubblicazione: (2026)
di: Tian, Ye, et al.
Pubblicazione: (2026)
E-QUARTIC: Energy Efficient Edge Ensemble of Convolutional Neural Networks for Resource-Optimized Learning
di: Zhang, Le, et al.
Pubblicazione: (2024)
di: Zhang, Le, et al.
Pubblicazione: (2024)
ACORN-IDS: Adaptive Continual Novelty Detection for Intrusion Detection Systems
di: Fuhrman, Sean, et al.
Pubblicazione: (2026)
di: Fuhrman, Sean, et al.
Pubblicazione: (2026)
CND-IDS: Continual Novelty Detection for Intrusion Detection Systems
di: Fuhrman, Sean, et al.
Pubblicazione: (2025)
di: Fuhrman, Sean, et al.
Pubblicazione: (2025)
CAN-QA: A Question-Answering Benchmark for Reasoning over In-Vehicle CAN Traffic
di: Chen, Jing, et al.
Pubblicazione: (2026)
di: Chen, Jing, et al.
Pubblicazione: (2026)
CyberMaskQA: A Privacy-Aware Benchmark for Evaluating Large Language Models in Cybersecurity Question Answering
di: Gaddi, Matilda, et al.
Pubblicazione: (2026)
di: Gaddi, Matilda, et al.
Pubblicazione: (2026)
Offload Rethinking by Cloud Assistance for Efficient Environmental Sound Recognition on LPWANs
di: Zhang, Le, et al.
Pubblicazione: (2025)
di: Zhang, Le, et al.
Pubblicazione: (2025)
$π$-Bench: Evaluating Proactive Personal Assistant Agents in Long-Horizon Workflows
di: Zhang, Haoran, et al.
Pubblicazione: (2026)
di: Zhang, Haoran, et al.
Pubblicazione: (2026)
AQUA-LLM: Evaluating Accuracy, Quantization, and Adversarial Robustness Trade-offs in LLMs for Cybersecurity Question Answering
di: Gungor, Onat, et al.
Pubblicazione: (2025)
di: Gungor, Onat, et al.
Pubblicazione: (2025)
LIGHT-HIDS: A Lightweight and Effective Machine Learning-Based Framework for Robust Host Intrusion Detection
di: Gungor, Onat, et al.
Pubblicazione: (2025)
di: Gungor, Onat, et al.
Pubblicazione: (2025)
CITADEL: Continual Anomaly Detection for Enhanced Learning in IoT Intrusion Detection
di: Li, Elvin, et al.
Pubblicazione: (2025)
di: Li, Elvin, et al.
Pubblicazione: (2025)
EAGER: Edge-Aligned LLM Defense for Robust, Efficient, and Accurate Cybersecurity Question Answering
di: Gungor, Onat, et al.
Pubblicazione: (2025)
di: Gungor, Onat, et al.
Pubblicazione: (2025)
SAGE: Sample-Aware Guarding Engine for Robust Intrusion Detection Against Adversarial Attacks
di: Chen, Jing, et al.
Pubblicazione: (2025)
di: Chen, Jing, et al.
Pubblicazione: (2025)
SAFE: Self-Supervised Anomaly Detection Framework for Intrusion Detection
di: Li, Elvin, et al.
Pubblicazione: (2025)
di: Li, Elvin, et al.
Pubblicazione: (2025)
ESL-Bench: An Event-Driven Synthetic Longitudinal Benchmark for Health Agents
di: Li, Chao, et al.
Pubblicazione: (2026)
di: Li, Chao, et al.
Pubblicazione: (2026)
PSPA-Bench: A Personalized Benchmark for Smartphone GUI Agent
di: Nie, Hongyi, et al.
Pubblicazione: (2026)
di: Nie, Hongyi, et al.
Pubblicazione: (2026)
MicroHD: An Accuracy-Driven Optimization of Hyperdimensional Computing Algorithms for TinyML systems
di: Ponzina, Flavio, et al.
Pubblicazione: (2024)
di: Ponzina, Flavio, et al.
Pubblicazione: (2024)
INTARG: Informed Real-Time Adversarial Attack Generation for Time-Series Regression
di: Tokgoz, Gamze Kirman, et al.
Pubblicazione: (2026)
di: Tokgoz, Gamze Kirman, et al.
Pubblicazione: (2026)
TS-OOD: Evaluating Time-Series Out-of-Distribution Detection and Prospective Directions for Progress
di: Gungor, Onat, et al.
Pubblicazione: (2025)
di: Gungor, Onat, et al.
Pubblicazione: (2025)
ReLATE+: Unified Framework for Adversarial Attack Detection, Classification, and Resilient Model Selection in Time-Series Classification
di: Kocal, Cagla Ipek, et al.
Pubblicazione: (2025)
di: Kocal, Cagla Ipek, et al.
Pubblicazione: (2025)
From Assistant to Double Agent: Formalizing and Benchmarking Attacks on OpenClaw for Personalized Local AI Agent
di: Wang, Yuhang, et al.
Pubblicazione: (2026)
di: Wang, Yuhang, et al.
Pubblicazione: (2026)
SensorQA: A Question Answering Benchmark for Daily-Life Monitoring
di: Reichman, Benjamin, et al.
Pubblicazione: (2025)
di: Reichman, Benjamin, et al.
Pubblicazione: (2025)
Agent-ValueBench: A Comprehensive Benchmark for Evaluating Agent Values
di: Dong, Haonan, et al.
Pubblicazione: (2026)
di: Dong, Haonan, et al.
Pubblicazione: (2026)
AgentRecBench: Benchmarking LLM Agent-based Personalized Recommender Systems
di: Shang, Yu, et al.
Pubblicazione: (2025)
di: Shang, Yu, et al.
Pubblicazione: (2025)
TrimLLM: Progressive Layer Dropping for Domain-Specific LLMs
di: Hu, Lanxiang, et al.
Pubblicazione: (2024)
di: Hu, Lanxiang, et al.
Pubblicazione: (2024)
DYNAMITE: Dynamic Defense Selection for Enhancing Machine Learning-based Intrusion Detection Against Adversarial Attacks
di: Chen, Jing, et al.
Pubblicazione: (2025)
di: Chen, Jing, et al.
Pubblicazione: (2025)
LifeBench: A Benchmark for Long-Horizon Multi-Source Memory
di: Cheng, Zihao, et al.
Pubblicazione: (2026)
di: Cheng, Zihao, et al.
Pubblicazione: (2026)
Small Agent Group is the Future of Digital Health
di: Meng, Yuqiao, et al.
Pubblicazione: (2026)
di: Meng, Yuqiao, et al.
Pubblicazione: (2026)
OP-Bench: Benchmarking Over-Personalization for Memory-Augmented Personalized Conversational Agents
di: Hu, Yulin, et al.
Pubblicazione: (2026)
di: Hu, Yulin, et al.
Pubblicazione: (2026)
LiveClawBench: Benchmarking LLM Agents on Complex, Real-World Assistant Tasks
di: Long, Xiang, et al.
Pubblicazione: (2026)
di: Long, Xiang, et al.
Pubblicazione: (2026)
Claw-Anything: Benchmarking Always-On Personal Assistants with Broader Access to User's Digital World
di: Lin, Yusong, et al.
Pubblicazione: (2026)
di: Lin, Yusong, et al.
Pubblicazione: (2026)
MASLegalBench: Benchmarking Multi-Agent Systems in Deductive Legal Reasoning
di: Jing, Huihao, et al.
Pubblicazione: (2025)
di: Jing, Huihao, et al.
Pubblicazione: (2025)
Benchmarking Scientific Understanding and Reasoning for Video Generation using VideoScience-Bench
di: Hu, Lanxiang, et al.
Pubblicazione: (2025)
di: Hu, Lanxiang, et al.
Pubblicazione: (2025)
M^3-Bench: Multi-Modal, Multi-Hop, Multi-Threaded Tool-Using MLLM Agent Benchmark
di: Zhou, Yang, et al.
Pubblicazione: (2025)
di: Zhou, Yang, et al.
Pubblicazione: (2025)
BenchAgents: Multi-Agent Systems for Structured Benchmark Creation
di: Butt, Natasha, et al.
Pubblicazione: (2024)
di: Butt, Natasha, et al.
Pubblicazione: (2024)
The Anatomy of a Personal Health Agent
di: Heydari, A. Ali, et al.
Pubblicazione: (2025)
di: Heydari, A. Ali, et al.
Pubblicazione: (2025)
lmgame-Bench: How Good are LLMs at Playing Games?
di: Hu, Lanxiang, et al.
Pubblicazione: (2025)
di: Hu, Lanxiang, et al.
Pubblicazione: (2025)
A KL Lens on Quantization: Fast, Forward-Only Sensitivity for Mixed-Precision SSM-Transformer Models
di: Kong, Jason, et al.
Pubblicazione: (2026)
di: Kong, Jason, et al.
Pubblicazione: (2026)
Documenti analoghi
-
FoodCHA: Multi-Modal LLM Agent for Fine-Grained Food Analysis
di: Lee, Woojin, et al.
Pubblicazione: (2026) -
DailyLLM: Context-Aware Activity Log Generation Using Multi-Modal Sensors and LLMs
di: Tian, Ye, et al.
Pubblicazione: (2025) -
KLDrive: Fine-Grained 3D Scene Reasoning for Autonomous Driving based on Knowledge Graph
di: Tian, Ye, et al.
Pubblicazione: (2026) -
E-QUARTIC: Energy Efficient Edge Ensemble of Convolutional Neural Networks for Resource-Optimized Learning
di: Zhang, Le, et al.
Pubblicazione: (2024) -
ACORN-IDS: Adaptive Continual Novelty Detection for Intrusion Detection Systems
di: Fuhrman, Sean, et al.
Pubblicazione: (2026)