IMPACT-CYCLE: A Contract-Based Multi-Agent System for Claim-Level Supervisory Correction of Long-Video Semantic Memory
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kong, Weitong, Wen, Di, Peng, Kunyu, Schneider, David, Zhong, Zeyun, Jaus, Alexander, Marinov, Zdravko, Wei, Jiale, Liu, Ruiping, Zheng, Junwei, Chen, Yufan, Qi, Lei, Stiefelhagen, Rainer |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
IMPACT-HOI: Supervisory Control for Onset-Anchored Partial HOI Event Construction
par: Zhang, Haoshen, et autres
Publié: (2026)
par: Zhang, Haoshen, et autres
Publié: (2026)
IMPACT-Scribe: Interactive Temporal Action Segmentation with Boundary Scribbles and Query Planning
par: Yin, Qian, et autres
Publié: (2026)
par: Yin, Qian, et autres
Publié: (2026)
OmniFall: From Staged Through Synthetic to Wild, A Unified Multi-Domain Dataset for Robust Fall Detection
par: Schneider, David, et autres
Publié: (2025)
par: Schneider, David, et autres
Publié: (2025)
Good Enough: Is it Worth Improving your Label Quality?
par: Jaus, Alexander, et autres
Publié: (2025)
par: Jaus, Alexander, et autres
Publié: (2025)
Rethinking Annotator Simulation: Realistic Evaluation of Whole-Body PET Lesion Interactive Segmentation Methods
par: Marinov, Zdravko, et autres
Publié: (2024)
par: Marinov, Zdravko, et autres
Publié: (2024)
LIMIS: Towards Language-based Interactive Medical Image Segmentation
par: Heinemann, Lena, et autres
Publié: (2024)
par: Heinemann, Lena, et autres
Publié: (2024)
Is Visual in-Context Learning for Compositional Medical Tasks within Reach?
par: Reiß, Simon, et autres
Publié: (2025)
par: Reiß, Simon, et autres
Publié: (2025)
Every Component Counts: Rethinking the Measure of Success for Medical Semantic Segmentation in Multi-Instance Segmentation Tasks
par: Jaus, Alexander, et autres
Publié: (2024)
par: Jaus, Alexander, et autres
Publié: (2024)
RoDLA: Benchmarking the Robustness of Document Layout Analysis Models
par: Chen, Yufan, et autres
Publié: (2024)
par: Chen, Yufan, et autres
Publié: (2024)
HybriDLA: Hybrid Generation for Document Layout Analysis
par: Chen, Yufan, et autres
Publié: (2025)
par: Chen, Yufan, et autres
Publié: (2025)
Graph-based Document Structure Analysis
par: Chen, Yufan, et autres
Publié: (2025)
par: Chen, Yufan, et autres
Publié: (2025)
MICA: Multi-Agent Industrial Coordination Assistant
par: Wen, Di, et autres
Publié: (2025)
par: Wen, Di, et autres
Publié: (2025)
Towards Multi-Source Domain Generalization for Sleep Staging with Noisy Labels
par: Wang, Kening, et autres
Publié: (2026)
par: Wang, Kening, et autres
Publié: (2026)
OneBEV: Using One Panoramic Image for Bird's-Eye-View Semantic Mapping
par: Wei, Jiale, et autres
Publié: (2024)
par: Wei, Jiale, et autres
Publié: (2024)
Exploring Single Domain Generalization of LiDAR-based Semantic Segmentation under Imperfect Labels
par: Kong, Weitong, et autres
Publié: (2025)
par: Kong, Weitong, et autres
Publié: (2025)
Deep Interactive Segmentation of Medical Images: A Systematic Review and Taxonomy
par: Marinov, Zdravko, et autres
Publié: (2023)
par: Marinov, Zdravko, et autres
Publié: (2023)
Open Panoramic Segmentation
par: Zheng, Junwei, et autres
Publié: (2024)
par: Zheng, Junwei, et autres
Publié: (2024)
Snap, Segment, Deploy: A Visual Data and Detection Pipeline for Wearable Industrial Assistants
par: Wen, Di, et autres
Publié: (2025)
par: Wen, Di, et autres
Publié: (2025)
SGR3 Model: Scene Graph Retrieval-Reasoning Model in 3D
par: Wang, Zirui, et autres
Publié: (2026)
par: Wang, Zirui, et autres
Publié: (2026)
EgoExoMem: Cross-View Memory Reasoning over Synchronized Egocentric and Exocentric Videos
par: Liu, Ruiping, et autres
Publié: (2026)
par: Liu, Ruiping, et autres
Publié: (2026)
Exploring Self-supervised Skeleton-based Action Recognition in Occluded Environments
par: Chen, Yifei, et autres
Publié: (2023)
par: Chen, Yifei, et autres
Publié: (2023)
Situat3DChange: Situated 3D Change Understanding Dataset for Multimodal Large Language Model
par: Liu, Ruiping, et autres
Publié: (2025)
par: Liu, Ruiping, et autres
Publié: (2025)
Elevating Skeleton-Based Action Recognition with Efficient Multi-Modality Self-Supervision
par: Wei, Yiping, et autres
Publié: (2023)
par: Wei, Yiping, et autres
Publié: (2023)
Rethinking Video Human-Object Interaction: Set Prediction over Time for Unified Detection and Anticipation
par: Luo, Yuanhao, et autres
Publié: (2026)
par: Luo, Yuanhao, et autres
Publié: (2026)
Fourier Prompt Tuning for Modality-Incomplete Scene Segmentation
par: Liu, Ruiping, et autres
Publié: (2024)
par: Liu, Ruiping, et autres
Publié: (2024)
IMPACT: A Dataset for Multi-Granularity Human Procedural Action Understanding in Industrial Assembly
par: Wen, Di, et autres
Publié: (2026)
par: Wen, Di, et autres
Publié: (2026)
Data Diet: Can Trimming PET/CT Datasets Enhance Lesion Segmentation?
par: Jaus, Alexander, et autres
Publié: (2024)
par: Jaus, Alexander, et autres
Publié: (2024)
GRASPing Anatomy to Improve Pathology Segmentation
par: Li, Keyi, et autres
Publié: (2025)
par: Li, Keyi, et autres
Publié: (2025)
Scene-agnostic Pose Regression for Visual Localization
par: Zheng, Junwei, et autres
Publié: (2025)
par: Zheng, Junwei, et autres
Publié: (2025)
RHO: Robust Holistic OSM-Based Metric Cross-View Geo-Localization
par: Zheng, Junwei, et autres
Publié: (2026)
par: Zheng, Junwei, et autres
Publié: (2026)
Skeleton-Based Human Action Recognition with Noisy Labels
par: Xu, Yi, et autres
Publié: (2024)
par: Xu, Yi, et autres
Publié: (2024)
Semantic Segmentation for Preoperative Planning in Transcatheter Aortic Valve Replacement
par: Zöllner, Cedric, et autres
Publié: (2025)
par: Zöllner, Cedric, et autres
Publié: (2025)
TransKD: Transformer Knowledge Distillation for Efficient Semantic Segmentation
par: Liu, Ruiping, et autres
Publié: (2022)
par: Liu, Ruiping, et autres
Publié: (2022)
Comb, Prune, Distill: Towards Unified Pruning for Vision Model Compression
par: Schmitt, Jonas, et autres
Publié: (2024)
par: Schmitt, Jonas, et autres
Publié: (2024)
MateRobot: Material Recognition in Wearable Robotics for People with Visual Impairments
par: Zheng, Junwei, et autres
Publié: (2023)
par: Zheng, Junwei, et autres
Publié: (2023)
RefAtomNet++: Advancing Referring Atomic Video Action Recognition using Semantic Retrieval based Multi-Trajectory Mamba
par: Peng, Kunyu, et autres
Publié: (2025)
par: Peng, Kunyu, et autres
Publié: (2025)
More than the Sum: Panorama-Language Models for Adverse Omni-Scenes
par: Fan, Weijia, et autres
Publié: (2026)
par: Fan, Weijia, et autres
Publié: (2026)
Exploring Video-Based Driver Activity Recognition under Noisy Labels
par: Fan, Linjuan, et autres
Publié: (2025)
par: Fan, Linjuan, et autres
Publié: (2025)
What if? Emulative Simulation with World Models for Situated Reasoning
par: Liu, Ruiping, et autres
Publié: (2026)
par: Liu, Ruiping, et autres
Publié: (2026)
RoHOI: Robustness Benchmark for Human-Object Interaction Detection
par: Wen, Di, et autres
Publié: (2025)
par: Wen, Di, et autres
Publié: (2025)
Documents similaires
-
IMPACT-HOI: Supervisory Control for Onset-Anchored Partial HOI Event Construction
par: Zhang, Haoshen, et autres
Publié: (2026) -
IMPACT-Scribe: Interactive Temporal Action Segmentation with Boundary Scribbles and Query Planning
par: Yin, Qian, et autres
Publié: (2026) -
OmniFall: From Staged Through Synthetic to Wild, A Unified Multi-Domain Dataset for Robust Fall Detection
par: Schneider, David, et autres
Publié: (2025) -
Good Enough: Is it Worth Improving your Label Quality?
par: Jaus, Alexander, et autres
Publié: (2025) -
Rethinking Annotator Simulation: Realistic Evaluation of Whole-Body PET Lesion Interactive Segmentation Methods
par: Marinov, Zdravko, et autres
Publié: (2024)