Towards Effective Human-in-the-Loop Assistive AI Agents
Fuente:
arXiv
Guardado en:
| Autores principales: | Bellos, Filippos, Li, Yayuan, Shu, Cary, Day, Ruey, Siskind, Jeffrey M., Corso, Jason J. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Consistent Long-Term Pose Generation
por: Li, Yayuan, et al.
Publicado: (2025)
por: Li, Yayuan, et al.
Publicado: (2025)
Mistake Attribution: Fine-Grained Mistake Understanding in Egocentric Videos
por: Li, Yayuan, et al.
Publicado: (2025)
por: Li, Yayuan, et al.
Publicado: (2025)
EchoVQA: Enabling Conversational Assistance for Point-of-Care Cardiac Ultrasound
por: Bellos, Filippos, et al.
Publicado: (2026)
por: Bellos, Filippos, et al.
Publicado: (2026)
HANDI: Hand-Centric Text-and-Image Conditioned Video Generation
por: Li, Yayuan, et al.
Publicado: (2024)
por: Li, Yayuan, et al.
Publicado: (2024)
When to Think and When to Look: Uncertainty-Guided Lookback
por: Bi, Jing, et al.
Publicado: (2025)
por: Bi, Jing, et al.
Publicado: (2025)
Omni-Judge: Can Omni-LLMs Serve as Human-Aligned Judges for Text-Conditioned Audio-Video Generation?
por: Liang, Susan, et al.
Publicado: (2026)
por: Liang, Susan, et al.
Publicado: (2026)
Measuring Physical Plausibility of 3D Human Poses Using Physics Simulation
por: Louis, Nathan, et al.
Publicado: (2025)
por: Louis, Nathan, et al.
Publicado: (2025)
Follow Your Heart: Landmark-Guided Transducer Pose Scoring for Point-of-Care Echocardiography
por: Guo, Zaiyang, et al.
Publicado: (2026)
por: Guo, Zaiyang, et al.
Publicado: (2026)
BiMotion: B-spline Motion for Text-guided Dynamic 3D Character Generation
por: Wang, Miaowei, et al.
Publicado: (2026)
por: Wang, Miaowei, et al.
Publicado: (2026)
Substantial, Decomposable, and Invisible: Visual Context Misalignment in Instructional Videos for Physical Tasks
por: Li, Yayuan, et al.
Publicado: (2026)
por: Li, Yayuan, et al.
Publicado: (2026)
@Bench: Benchmarking Vision-Language Models for Human-centered Assistive Technology
por: Jiang, Xin, et al.
Publicado: (2024)
por: Jiang, Xin, et al.
Publicado: (2024)
Zero-Shot Coreset Selection via Iterative Subspace Sampling
por: Griffin, Brent A., et al.
Publicado: (2024)
por: Griffin, Brent A., et al.
Publicado: (2024)
Text and Image Are Mutually Beneficial: Enhancing Training-Free Few-Shot Classification with CLIP
por: Li, Yayuan, et al.
Publicado: (2024)
por: Li, Yayuan, et al.
Publicado: (2024)
Taking Training Seriously: Human Guidance and Management-Based Regulation of Artificial Intelligence
por: Coglianese, Cary, et al.
Publicado: (2024)
por: Coglianese, Cary, et al.
Publicado: (2024)
Auto-Labeling Data for Object Detection
por: Griffin, Brent A., et al.
Publicado: (2025)
por: Griffin, Brent A., et al.
Publicado: (2025)
ArtisanGS: Interactive Tools for Gaussian Splat Selection with AI and Human in the Loop
por: Tsang, Clement Fuji, et al.
Publicado: (2026)
por: Tsang, Clement Fuji, et al.
Publicado: (2026)
VITRO: Vocabulary Inversion for Time-series Representation Optimization
por: Bellos, Filippos, et al.
Publicado: (2024)
por: Bellos, Filippos, et al.
Publicado: (2024)
Benchmarking Egocentric Multimodal Goal Inference for Assistive Wearable Agents
por: Veerabadran, Vijay, et al.
Publicado: (2025)
por: Veerabadran, Vijay, et al.
Publicado: (2025)
AIris: An AI-powered Wearable Assistive Device for the Visually Impaired
por: Brilli, Dionysia Danai, et al.
Publicado: (2024)
por: Brilli, Dionysia Danai, et al.
Publicado: (2024)
Class-wise Autoencoders Measure Classification Difficulty And Detect Label Mistakes
por: Marks, Jacob, et al.
Publicado: (2024)
por: Marks, Jacob, et al.
Publicado: (2024)
Embodied4C: Measuring What Matters for Embodied Vision-Language Navigation
por: Sohn, Tin Stribor, et al.
Publicado: (2025)
por: Sohn, Tin Stribor, et al.
Publicado: (2025)
R4: Retrieval-Augmented Reasoning for Vision-Language Models in 4D Spatio-Temporal Space
por: Sohn, Tin Stribor, et al.
Publicado: (2025)
por: Sohn, Tin Stribor, et al.
Publicado: (2025)
SNOW: Spatio-Temporal Scene Understanding with World Knowledge for Open-World Embodied Reasoning
por: Sohn, Tin Stribor, et al.
Publicado: (2025)
por: Sohn, Tin Stribor, et al.
Publicado: (2025)
Gen3DEval: Using vLLMs for Automatic Evaluation of Generated 3D Objects
por: Maiti, Shalini, et al.
Publicado: (2025)
por: Maiti, Shalini, et al.
Publicado: (2025)
LoopViT: Scaling Visual ARC with Looped Transformers
por: Shu, Wen-Jie, et al.
Publicado: (2026)
por: Shu, Wen-Jie, et al.
Publicado: (2026)
Towards Clinician-Preferred Segmentation: Leveraging Human-in-the-Loop for Test Time Adaptation in Medical Image Segmentation
por: Hu, Shishuai, et al.
Publicado: (2024)
por: Hu, Shishuai, et al.
Publicado: (2024)
RORem: Training a Robust Object Remover with Human-in-the-Loop
por: Li, Ruibin, et al.
Publicado: (2025)
por: Li, Ruibin, et al.
Publicado: (2025)
Egocentric Co-Pilot: Web-Native Smart-Glasses Agents for Assistive Egocentric AI
por: Yang, Sicheng, et al.
Publicado: (2026)
por: Yang, Sicheng, et al.
Publicado: (2026)
Hyperstroke: A Novel High-quality Stroke Representation for Assistive Artistic Drawing
por: Qin, Haoyun, et al.
Publicado: (2024)
por: Qin, Haoyun, et al.
Publicado: (2024)
MedUHIP: Towards Human-In-the-Loop Medical Segmentation
por: Zhu, Jiayuan, et al.
Publicado: (2024)
por: Zhu, Jiayuan, et al.
Publicado: (2024)
Robust Iris Centre Localisation for Assistive Eye-Gaze Tracking
por: Pathiranage, Nipun Sandamal Ranasekara, et al.
Publicado: (2024)
por: Pathiranage, Nipun Sandamal Ranasekara, et al.
Publicado: (2024)
Interactive Tracking: A Human-in-the-Loop Paradigm with Memory-Augmented Adaptation
por: Huang, Yuqing, et al.
Publicado: (2026)
por: Huang, Yuqing, et al.
Publicado: (2026)
AgentSteerTTS: A Multi-Agent Closed-Loop Framework for Composite-Instruction Text-to-Speech
por: Kang, Bin, et al.
Publicado: (2026)
por: Kang, Bin, et al.
Publicado: (2026)
TEM^3-Learning: Time-Efficient Multimodal Multi-Task Learning for Advanced Assistive Driving
por: Liu, Wenzhuo, et al.
Publicado: (2025)
por: Liu, Wenzhuo, et al.
Publicado: (2025)
Motor Focus: Fast Ego-Motion Prediction for Assistive Visual Navigation
por: Wang, Hao, et al.
Publicado: (2024)
por: Wang, Hao, et al.
Publicado: (2024)
Exploring Human-in-the-Loop Test-Time Adaptation by Synergizing Active Learning and Model Selection
por: Li, Yushu, et al.
Publicado: (2024)
por: Li, Yushu, et al.
Publicado: (2024)
Human-in-the-Loop Visual Re-ID for Population Size Estimation
por: Perez, Gustavo, et al.
Publicado: (2023)
por: Perez, Gustavo, et al.
Publicado: (2023)
Towards multi-modal forgery representation learning for AI-generated video detection and localization
por: Le, Dat, et al.
Publicado: (2026)
por: Le, Dat, et al.
Publicado: (2026)
MMTL-UniAD: A Unified Framework for Multimodal and Multi-Task Learning in Assistive Driving Perception
por: Liu, Wenzhuo, et al.
Publicado: (2025)
por: Liu, Wenzhuo, et al.
Publicado: (2025)
Robust Computer-Vision based Construction Site Detection for Assistive-Technology Applications
por: Feng, Junchi, et al.
Publicado: (2025)
por: Feng, Junchi, et al.
Publicado: (2025)
Ejemplares similares
-
Towards Consistent Long-Term Pose Generation
por: Li, Yayuan, et al.
Publicado: (2025) -
Mistake Attribution: Fine-Grained Mistake Understanding in Egocentric Videos
por: Li, Yayuan, et al.
Publicado: (2025) -
EchoVQA: Enabling Conversational Assistance for Point-of-Care Cardiac Ultrasound
por: Bellos, Filippos, et al.
Publicado: (2026) -
HANDI: Hand-Centric Text-and-Image Conditioned Video Generation
por: Li, Yayuan, et al.
Publicado: (2024) -
When to Think and When to Look: Uncertainty-Guided Lookback
por: Bi, Jing, et al.
Publicado: (2025)