IFTR: An Instance-Level Fusion Transformer for Visual Collaborative Perception
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Shaohong, Bin, Lu, Xiao, Xinyu, Xiang, Zhiyu, Shan, Hangguan, Liu, Eryun |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RayFusion: Ray Fusion Enhanced Collaborative Visual Perception
par: Wang, Shaohong, et autres
Publié: (2025)
par: Wang, Shaohong, et autres
Publié: (2025)
CVFusion: Cross-View Fusion of 4D Radar and Camera for 3D Object Detection
par: Zhong, Hanzhi, et autres
Publié: (2025)
par: Zhong, Hanzhi, et autres
Publié: (2025)
INSTINCT: Instance-Level Interaction Architecture for Query-Based Collaborative Perception
par: Xu, Yunjiang, et autres
Publié: (2025)
par: Xu, Yunjiang, et autres
Publié: (2025)
MIDAS: Modeling Ground-Truth Distributions with Dark Knowledge for Domain Generalized Stereo Matching
par: Xu, Peng, et autres
Publié: (2025)
par: Xu, Peng, et autres
Publié: (2025)
Unsupervised Stereo via Multi-Baseline Geometry-Consistent Self-Training
par: Xu, Peng, et autres
Publié: (2025)
par: Xu, Peng, et autres
Publié: (2025)
EIMC: Efficient Instance-aware Multi-modal Collaborative Perception
par: Yang, Kang, et autres
Publié: (2026)
par: Yang, Kang, et autres
Publié: (2026)
IS-Fusion: Instance-Scene Collaborative Fusion for Multimodal 3D Object Detection
par: Yin, Junbo, et autres
Publié: (2024)
par: Yin, Junbo, et autres
Publié: (2024)
InstanceGaussian: Appearance-Semantic Joint Gaussian Representation for 3D Instance-Level Perception
par: Li, Haijie, et autres
Publié: (2024)
par: Li, Haijie, et autres
Publié: (2024)
Hierarchical Collaborative Fusion for 3D Instance-aware Referring Expression Segmentation
par: Zhou, Keshen, et autres
Publié: (2026)
par: Zhou, Keshen, et autres
Publié: (2026)
Is Discretization Fusion All You Need for Collaborative Perception?
par: Yang, Kang, et autres
Publié: (2025)
par: Yang, Kang, et autres
Publié: (2025)
VSFormer: Visual-Spatial Fusion Transformer for Correspondence Pruning
par: Liao, Tangfei, et autres
Publié: (2023)
par: Liao, Tangfei, et autres
Publié: (2023)
Instance Consistency Regularization for Semi-Supervised 3D Instance Segmentation
par: Wu, Yizheng, et autres
Publié: (2024)
par: Wu, Yizheng, et autres
Publié: (2024)
Cluster-Level Sparse Multi-Instance Learning for Whole-Slide Images
par: Zhang, Yuedi, et autres
Publié: (2025)
par: Zhang, Yuedi, et autres
Publié: (2025)
SeaVIS: Sound-Enhanced Association for Online Audio-Visual Instance Segmentation
par: Zhu, Yingjian, et autres
Publié: (2026)
par: Zhu, Yingjian, et autres
Publié: (2026)
Instance-Adaptive Keypoint Learning with Local-to-Global Geometric Aggregation for Category-Level Object Pose Estimation
par: Zhang, Xiao, et autres
Publié: (2025)
par: Zhang, Xiao, et autres
Publié: (2025)
Beyond the Final Layer: Hierarchical Query Fusion Transformer with Agent-Interpolation Initialization for 3D Instance Segmentation
par: Lu, Jiahao, et autres
Publié: (2025)
par: Lu, Jiahao, et autres
Publié: (2025)
Efficient Multimodal 3D Object Detector via Instance-Level Contrastive Distillation
par: Su, Zhuoqun, et autres
Publié: (2025)
par: Su, Zhuoqun, et autres
Publié: (2025)
The Instance-centric Transformer for the RVOS Track of LSVOS Challenge: 3rd Place Solution
par: Cao, Bin, et autres
Publié: (2024)
par: Cao, Bin, et autres
Publié: (2024)
Self-Localized Collaborative Perception
par: Ni, Zhenyang, et autres
Publié: (2024)
par: Ni, Zhenyang, et autres
Publié: (2024)
InstanceV: Instance-Level Video Generation
par: Chen, Yuheng, et autres
Publié: (2025)
par: Chen, Yuheng, et autres
Publié: (2025)
PA-Net: Precipitation-Adaptive Mixture-of-Experts for Long-Tail Rainfall Nowcasting
par: Xiao, Xinyu, et autres
Publié: (2026)
par: Xiao, Xinyu, et autres
Publié: (2026)
SmartCooper: Vehicular Collaborative Perception with Adaptive Fusion and Judger Mechanism
par: Zhang, Yuang, et autres
Publié: (2024)
par: Zhang, Yuang, et autres
Publié: (2024)
Visual Instance-aware Prompt Tuning
par: Xiao, Xi, et autres
Publié: (2025)
par: Xiao, Xi, et autres
Publié: (2025)
3DWG: 3D Weakly Supervised Visual Grounding via Category and Instance-Level Alignment
par: Li, Xiaoqi, et autres
Publié: (2025)
par: Li, Xiaoqi, et autres
Publié: (2025)
CATNet: Collaborative Alignment and Transformation Network for Cooperative Perception
par: Chen, Gong, et autres
Publié: (2026)
par: Chen, Gong, et autres
Publié: (2026)
An Extensible Framework for Open Heterogeneous Collaborative Perception
par: Lu, Yifan, et autres
Publié: (2024)
par: Lu, Yifan, et autres
Publié: (2024)
Uncertainty Estimation in Instance Segmentation of Affordances via Bayesian Visual Transformers
par: Mur-Labadia, Lorenzo, et autres
Publié: (2026)
par: Mur-Labadia, Lorenzo, et autres
Publié: (2026)
CGTGait: Collaborative Graph and Transformer for Gait Emotion Recognition
par: Zhou, Junjie, et autres
Publié: (2025)
par: Zhou, Junjie, et autres
Publié: (2025)
Training-Free Multi-Style Fusion Through Reference-Based Adaptive Modulation
par: Liu, Xu, et autres
Publié: (2025)
par: Liu, Xu, et autres
Publié: (2025)
Pragmatic Heterogeneous Collaborative Perception via Generative Communication Mechanism
par: Zhou, Junfei, et autres
Publié: (2025)
par: Zhou, Junfei, et autres
Publié: (2025)
Target-aware Bidirectional Fusion Transformer for Aerial Object Tracking
par: Sun, Xinglong, et autres
Publié: (2025)
par: Sun, Xinglong, et autres
Publié: (2025)
V2XPnP: Vehicle-to-Everything Spatio-Temporal Fusion for Multi-Agent Perception and Prediction
par: Zhou, Zewei, et autres
Publié: (2024)
par: Zhou, Zewei, et autres
Publié: (2024)
DATA: Domain-And-Time Alignment for High-Quality Feature Fusion in Collaborative Perception
par: Tian, Chengchang, et autres
Publié: (2025)
par: Tian, Chengchang, et autres
Publié: (2025)
CoRA: A Collaborative Robust Architecture with Hybrid Fusion for Efficient Perception
par: Chen, Gong, et autres
Publié: (2025)
par: Chen, Gong, et autres
Publié: (2025)
Cross-Level Multi-Instance Distillation for Self-Supervised Fine-Grained Visual Categorization
par: Bi, Qi, et autres
Publié: (2024)
par: Bi, Qi, et autres
Publié: (2024)
Is Intermediate Fusion All You Need for UAV-based Collaborative Perception?
par: Hao, Jiuwu, et autres
Publié: (2025)
par: Hao, Jiuwu, et autres
Publié: (2025)
Towards Efficient Information Fusion: Concentric Dual Fusion Attention Based Multiple Instance Learning for Whole Slide Images
par: Liu, Yujian, et autres
Publié: (2024)
par: Liu, Yujian, et autres
Publié: (2024)
CompetitorFormer: Competitor Transformer for 3D Instance Segmentation
par: Wang, Duanchu, et autres
Publié: (2024)
par: Wang, Duanchu, et autres
Publié: (2024)
Towards Pixel-Level VLM Perception via Simple Points Prediction
par: Song, Tianhui, et autres
Publié: (2026)
par: Song, Tianhui, et autres
Publié: (2026)
Instance-Level Moving Object Segmentation from a Single Image with Events
par: Wan, Zhexiong, et autres
Publié: (2025)
par: Wan, Zhexiong, et autres
Publié: (2025)
Documents similaires
-
RayFusion: Ray Fusion Enhanced Collaborative Visual Perception
par: Wang, Shaohong, et autres
Publié: (2025) -
CVFusion: Cross-View Fusion of 4D Radar and Camera for 3D Object Detection
par: Zhong, Hanzhi, et autres
Publié: (2025) -
INSTINCT: Instance-Level Interaction Architecture for Query-Based Collaborative Perception
par: Xu, Yunjiang, et autres
Publié: (2025) -
MIDAS: Modeling Ground-Truth Distributions with Dark Knowledge for Domain Generalized Stereo Matching
par: Xu, Peng, et autres
Publié: (2025) -
Unsupervised Stereo via Multi-Baseline Geometry-Consistent Self-Training
par: Xu, Peng, et autres
Publié: (2025)