3DWG: 3D Weakly Supervised Visual Grounding via Category and Instance-Level Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Xiaoqi, Liu, Jiaming, Han, Nuowei, Heng, Liang, Guo, Yandong, Dong, Hao, Liu, Yang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AlignCAT: Visual-Linguistic Alignment of Category and Attribute for Weakly Supervised Visual Grounding
par: Wang, Yidan, et autres
Publié: (2025)
par: Wang, Yidan, et autres
Publié: (2025)
Weakly-Supervised 3D Visual Grounding based on Visual Language Alignment
par: Xu, Xiaoxu, et autres
Publié: (2023)
par: Xu, Xiaoxu, et autres
Publié: (2023)
BEVUDA: Multi-geometric Space Alignments for Domain Adaptive BEV 3D Object Detection
par: Liu, Jiaming, et autres
Publié: (2022)
par: Liu, Jiaming, et autres
Publié: (2022)
Weakly Supervised 3D Object Detection via Multi-Level Visual Guidance
par: Huang, Kuan-Chih, et autres
Publié: (2023)
par: Huang, Kuan-Chih, et autres
Publié: (2023)
VSRD: Instance-Aware Volumetric Silhouette Rendering for Weakly Supervised 3D Object Detection
par: Liu, Zihua, et autres
Publié: (2024)
par: Liu, Zihua, et autres
Publié: (2024)
Complete Instances Mining for Weakly Supervised Instance Segmentation
par: Li, Zecheng, et autres
Publié: (2024)
par: Li, Zecheng, et autres
Publié: (2024)
DBGroup: Dual-Branch Point Grouping for Weakly Supervised 3D Semantic Instance Segmentation
par: Liu, Xuexun, et autres
Publié: (2025)
par: Liu, Xuexun, et autres
Publié: (2025)
Beyond Instance-Level Self-Supervision in 3D Multi-Modal Medical Imaging
par: Pan, Tan, et autres
Publié: (2026)
par: Pan, Tan, et autres
Publié: (2026)
Rethinking Multiple Instance Learning: Developing an Instance-Level Classifier via Weakly-Supervised Self-Training
par: Ma, Yingfan, et autres
Publié: (2024)
par: Ma, Yingfan, et autres
Publié: (2024)
MonoInstance: Enhancing Monocular Priors via Multi-view Instance Alignment for Neural Rendering and Reconstruction
par: Zhang, Wenyuan, et autres
Publié: (2025)
par: Zhang, Wenyuan, et autres
Publié: (2025)
NTO3D: Neural Target Object 3D Reconstruction with Segment Anything
par: Wei, Xiaobao, et autres
Publié: (2023)
par: Wei, Xiaobao, et autres
Publié: (2023)
RenderOcc: Vision-Centric 3D Occupancy Prediction with 2D Rendering Supervision
par: Pan, Mingjie, et autres
Publié: (2023)
par: Pan, Mingjie, et autres
Publié: (2023)
Consistent Supervised-Unsupervised Alignment for Generalized Category Discovery
par: Han, Jizhou, et autres
Publié: (2025)
par: Han, Jizhou, et autres
Publié: (2025)
IGGT: Instance-Grounded Geometry Transformer for Semantic 3D Reconstruction
par: Li, Hao, et autres
Publié: (2025)
par: Li, Hao, et autres
Publié: (2025)
You Only Click Once: Single Point Weakly Supervised 3D Instance Segmentation for Autonomous Driving
par: Jiang, Guangfeng, et autres
Publié: (2025)
par: Jiang, Guangfeng, et autres
Publié: (2025)
KineDiff3D: Kinematic-Aware Diffusion for Category-Level Articulated Object Shape Reconstruction and Generation
par: Xu, WenBo, et autres
Publié: (2025)
par: Xu, WenBo, et autres
Publié: (2025)
Solving Zero-Shot 3D Visual Grounding as Constraint Satisfaction Problems
par: Yuan, Qihao, et autres
Publié: (2024)
par: Yuan, Qihao, et autres
Publié: (2024)
Dual Attribute-Spatial Relation Alignment for 3D Visual Grounding
par: Xu, Yue, et autres
Publié: (2024)
par: Xu, Yue, et autres
Publié: (2024)
VastTrack: Vast Category Visual Object Tracking
par: Peng, Liang, et autres
Publié: (2024)
par: Peng, Liang, et autres
Publié: (2024)
Integrating SAM Supervision for 3D Weakly Supervised Point Cloud Segmentation
par: You, Lechun, et autres
Publié: (2025)
par: You, Lechun, et autres
Publié: (2025)
Instance Consistency Regularization for Semi-Supervised 3D Instance Segmentation
par: Wu, Yizheng, et autres
Publié: (2024)
par: Wu, Yizheng, et autres
Publié: (2024)
Sketchy Bounding-box Supervision for 3D Instance Segmentation
par: Deng, Qian, et autres
Publié: (2025)
par: Deng, Qian, et autres
Publié: (2025)
3EED: Ground Everything Everywhere in 3D
par: Li, Rong, et autres
Publié: (2025)
par: Li, Rong, et autres
Publié: (2025)
Improving Generalized Visual Grounding with Instance-aware Joint Learning
par: Dai, Ming, et autres
Publié: (2025)
par: Dai, Ming, et autres
Publié: (2025)
Joint Top-Down and Bottom-Up Frameworks for 3D Visual Grounding
par: Liu, Yang, et autres
Publié: (2024)
par: Liu, Yang, et autres
Publié: (2024)
Naturally Supervised 3D Visual Grounding with Language-Regularized Concept Learners
par: Feng, Chun, et autres
Publié: (2024)
par: Feng, Chun, et autres
Publié: (2024)
TabletopGen: Instance-Level Interactive 3D Tabletop Scene Generation from Text or Single Image
par: Wang, Ziqian, et autres
Publié: (2025)
par: Wang, Ziqian, et autres
Publié: (2025)
Weakly-Supervised Affordance Grounding Guided by Part-Level Semantic Priors
par: Xu, Peiran, et autres
Publié: (2025)
par: Xu, Peiran, et autres
Publié: (2025)
Instance-Adaptive and Geometric-Aware Keypoint Learning for Category-Level 6D Object Pose Estimation
par: Lin, Xiao, et autres
Publié: (2024)
par: Lin, Xiao, et autres
Publié: (2024)
DEGround: An Effective Baseline for Ego-centric 3D Visual Grounding with a Homogeneous Framework
par: Zhang, Yani, et autres
Publié: (2025)
par: Zhang, Yani, et autres
Publié: (2025)
Beyond Object Categories: Multi-Attribute Reference Understanding for Visual Grounding
par: Guo, Hao, et autres
Publié: (2025)
par: Guo, Hao, et autres
Publié: (2025)
Siamese Learning with Joint Alignment and Regression for Weakly-Supervised Video Paragraph Grounding
par: Tan, Chaolei, et autres
Publié: (2024)
par: Tan, Chaolei, et autres
Publié: (2024)
Weakly Supervised 3D Open-vocabulary Segmentation
par: Liu, Kunhao, et autres
Publié: (2023)
par: Liu, Kunhao, et autres
Publié: (2023)
RadioFormer3D: Weakly Supervised 3D Radio Map Estimation in Low-Altitude Airspace via Generative Modeling
par: Fang, Zheng, et autres
Publié: (2026)
par: Fang, Zheng, et autres
Publié: (2026)
AugRefer: Advancing 3D Visual Grounding via Cross-Modal Augmentation and Spatial Relation-based Referring
par: Wang, Xinyi, et autres
Publié: (2025)
par: Wang, Xinyi, et autres
Publié: (2025)
Weakly Supervised Temporal Sentence Grounding via Positive Sample Mining
par: Dong, Lu, et autres
Publié: (2025)
par: Dong, Lu, et autres
Publié: (2025)
Weakly Supervised Pixel-Level Annotation with Visual Interpretability
par: Nasir, Basma, et autres
Publié: (2025)
par: Nasir, Basma, et autres
Publié: (2025)
Scalable Adaptation of 3D Geometric Foundation Models via Weak Supervision from Internet Video
par: Gao, Zihui, et autres
Publié: (2026)
par: Gao, Zihui, et autres
Publié: (2026)
Prompt Categories Cluster for Weakly Supervised Semantic Segmentation
par: Wu, Wangyu, et autres
Publié: (2024)
par: Wu, Wangyu, et autres
Publié: (2024)
MK-Pose: Category-Level Object Pose Estimation via Multimodal-Based Keypoint Learning
par: Yang, Yifan, et autres
Publié: (2025)
par: Yang, Yifan, et autres
Publié: (2025)
Documents similaires
-
AlignCAT: Visual-Linguistic Alignment of Category and Attribute for Weakly Supervised Visual Grounding
par: Wang, Yidan, et autres
Publié: (2025) -
Weakly-Supervised 3D Visual Grounding based on Visual Language Alignment
par: Xu, Xiaoxu, et autres
Publié: (2023) -
BEVUDA: Multi-geometric Space Alignments for Domain Adaptive BEV 3D Object Detection
par: Liu, Jiaming, et autres
Publié: (2022) -
Weakly Supervised 3D Object Detection via Multi-Level Visual Guidance
par: Huang, Kuan-Chih, et autres
Publié: (2023) -
VSRD: Instance-Aware Volumetric Silhouette Rendering for Weakly Supervised 3D Object Detection
par: Liu, Zihua, et autres
Publié: (2024)