Multi-Object Tracking by Hierarchical Visual Representations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cao, Jinkun, Pang, Jiangmiao, Kitani, Kris |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MGF: Mixed Gaussian Flow for Diverse Trajectory Prediction
par: Chen, Jiahe, et autres
Publié: (2024)
par: Chen, Jiahe, et autres
Publié: (2024)
Joint Diffusion for Universal Hand-Object Grasp Generation
par: Cao, Jinkun, et autres
Publié: (2024)
par: Cao, Jinkun, et autres
Publié: (2024)
CacheFlow: Fast Human Motion Prediction by Cached Normalizing Flow
par: Maeda, Takahiro, et autres
Publié: (2025)
par: Maeda, Takahiro, et autres
Publié: (2025)
Harmony4D: A Video Dataset for In-The-Wild Close Human Interactions
par: Khirodkar, Rawal, et autres
Publié: (2024)
par: Khirodkar, Rawal, et autres
Publié: (2024)
Universal Humanoid Motion Representations for Physics-Based Control
par: Luo, Zhengyi, et autres
Publié: (2023)
par: Luo, Zhengyi, et autres
Publié: (2023)
DegustaBot: Zero-Shot Visual Preference Estimation for Personalized Multi-Object Rearrangement
par: Newman, Benjamin A., et autres
Publié: (2024)
par: Newman, Benjamin A., et autres
Publié: (2024)
G-HOP: Generative Hand-Object Prior for Interaction Reconstruction and Grasp Synthesis
par: Ye, Yufei, et autres
Publié: (2024)
par: Ye, Yufei, et autres
Publié: (2024)
Zero-Shot Multi-Object Scene Completion
par: Iwase, Shun, et autres
Publié: (2024)
par: Iwase, Shun, et autres
Publié: (2024)
Ground Reaction Inertial Poser: Physics-based Human Motion Capture from Sparse IMUs and Insole Pressure Sensors
par: Hori, Ryosuke, et autres
Publié: (2026)
par: Hori, Ryosuke, et autres
Publié: (2026)
Real-Time Simulated Avatar from Head-Mounted Sensors
par: Luo, Zhengyi, et autres
Publié: (2024)
par: Luo, Zhengyi, et autres
Publié: (2024)
Multi-Person 3D Pose Estimation from Multi-View Uncalibrated Depth Cameras
par: Li, Yu-Jhe, et autres
Publié: (2024)
par: Li, Yu-Jhe, et autres
Publié: (2024)
Unified Human-Scene Interaction via Prompted Chain-of-Contacts
par: Xiao, Zeqi, et autres
Publié: (2023)
par: Xiao, Zeqi, et autres
Publié: (2023)
UniTrack: Differentiable Graph Representation Learning for Multi-Object Tracking
par: Galoaa, Bishoy, et autres
Publié: (2026)
par: Galoaa, Bishoy, et autres
Publié: (2026)
ExpertAF: Expert Actionable Feedback from Video
par: Ashutosh, Kumar, et autres
Publié: (2024)
par: Ashutosh, Kumar, et autres
Publié: (2024)
Generalizable Neural Human Renderer
par: Masuda, Mana, et autres
Publié: (2024)
par: Masuda, Mana, et autres
Publié: (2024)
REST3D: Reconstructing Physically Stable 3D Scenes from a Single Image
par: Ma, Xiaoxuan, et autres
Publié: (2026)
par: Ma, Xiaoxuan, et autres
Publié: (2026)
Chat-Scene++: Exploiting Context-Rich Object Identification for 3D LLM
par: Huang, Haifeng, et autres
Publié: (2026)
par: Huang, Haifeng, et autres
Publié: (2026)
Representation Alignment Contrastive Regularization for Multi-Object Tracking
par: Liu, Zhonglin, et autres
Publié: (2024)
par: Liu, Zhonglin, et autres
Publié: (2024)
Language-to-Space Programming for Training-Free 3D Visual Grounding
par: Mi, Boyu, et autres
Publié: (2025)
par: Mi, Boyu, et autres
Publié: (2025)
RoboVIP: Multi-View Video Generation with Visual Identity Prompting Augments Robot Manipulation
par: Wang, Boyang, et autres
Publié: (2026)
par: Wang, Boyang, et autres
Publié: (2026)
UncTrack: Reliable Visual Object Tracking with Uncertainty-Aware Prototype Memory Network
par: Yao, Siyuan, et autres
Publié: (2025)
par: Yao, Siyuan, et autres
Publié: (2025)
Reading Relevant Feature from Global Representation Memory for Visual Object Tracking
par: Zhou, Xinyu, et autres
Publié: (2024)
par: Zhou, Xinyu, et autres
Publié: (2024)
Adaptive Perception for Unified Visual Multi-modal Object Tracking
par: Hu, Xiantao, et autres
Publié: (2025)
par: Hu, Xiantao, et autres
Publié: (2025)
STABLE: Simulation-Ready Tabletop Layout Generation via a Semantics-Physics Dual System
par: Luo, Zhen, et autres
Publié: (2026)
par: Luo, Zhen, et autres
Publié: (2026)
S2GO: Streaming Sparse Gaussian Occupancy Prediction
par: Park, Jinhyung, et autres
Publié: (2025)
par: Park, Jinhyung, et autres
Publié: (2025)
Explicit Visual Prompts for Visual Object Tracking
par: Shi, Liangtao, et autres
Publié: (2024)
par: Shi, Liangtao, et autres
Publié: (2024)
Unlocking Exocentric Video-Language Data for Egocentric Video Representation Learning
par: Dou, Zi-Yi, et autres
Publié: (2024)
par: Dou, Zi-Yi, et autres
Publié: (2024)
VastTrack: Vast Category Visual Object Tracking
par: Peng, Liang, et autres
Publié: (2024)
par: Peng, Liang, et autres
Publié: (2024)
SAM 3D Body: Robust Full-Body Human Mesh Recovery
par: Yang, Xitong, et autres
Publié: (2026)
par: Yang, Xitong, et autres
Publié: (2026)
Tracking by Detection and Query: An Efficient End-to-End Framework for Multi-Object Tracking
par: Jia, Shukun, et autres
Publié: (2024)
par: Jia, Shukun, et autres
Publié: (2024)
CLIPer: Hierarchically Improving Spatial Representation of CLIP for Open-Vocabulary Semantic Segmentation
par: Sun, Lin, et autres
Publié: (2024)
par: Sun, Lin, et autres
Publié: (2024)
Multi-Granularity Language-Guided Training for Multi-Object Tracking
par: Li, Yuhao, et autres
Publié: (2024)
par: Li, Yuhao, et autres
Publié: (2024)
Enhancing Visual Dialog State Tracking through Iterative Object-Entity Alignment in Multi-Round Conversations
par: Pang, Wei, et autres
Publié: (2024)
par: Pang, Wei, et autres
Publié: (2024)
Progressive Scaling Visual Object Tracking
par: Hong, Jack, et autres
Publié: (2025)
par: Hong, Jack, et autres
Publié: (2025)
VFlowOpt: A Token Pruning Framework for LMMs with Visual Information Flow-Guided Optimization
par: Yang, Sihan, et autres
Publié: (2025)
par: Yang, Sihan, et autres
Publié: (2025)
MV-CoLight: Efficient Object Compositing with Consistent Lighting and Shadow Generation
par: Ren, Kerui, et autres
Publié: (2025)
par: Ren, Kerui, et autres
Publié: (2025)
SMPLOlympics: Sports Environments for Physically Simulated Humanoids
par: Luo, Zhengyi, et autres
Publié: (2024)
par: Luo, Zhengyi, et autres
Publié: (2024)
Hierarchical Instruction-aware Embodied Visual Tracking
par: Wu, Kui, et autres
Publié: (2025)
par: Wu, Kui, et autres
Publié: (2025)
PKF: Probabilistic Data Association Kalman Filter for Multi-Object Tracking
par: Cao, Hanwen, et autres
Publié: (2024)
par: Cao, Hanwen, et autres
Publié: (2024)
EgoSim: Egocentric World Simulator for Embodied Interaction Generation
par: Hao, Jinkun, et autres
Publié: (2026)
par: Hao, Jinkun, et autres
Publié: (2026)
Documents similaires
-
MGF: Mixed Gaussian Flow for Diverse Trajectory Prediction
par: Chen, Jiahe, et autres
Publié: (2024) -
Joint Diffusion for Universal Hand-Object Grasp Generation
par: Cao, Jinkun, et autres
Publié: (2024) -
CacheFlow: Fast Human Motion Prediction by Cached Normalizing Flow
par: Maeda, Takahiro, et autres
Publié: (2025) -
Harmony4D: A Video Dataset for In-The-Wild Close Human Interactions
par: Khirodkar, Rawal, et autres
Publié: (2024) -
Universal Humanoid Motion Representations for Physics-Based Control
par: Luo, Zhengyi, et autres
Publié: (2023)