ACTRESS: Active Retraining for Semi-supervised Visual Grounding
Fuente:
arXiv
Salvato in:
| Autori principali: | Kang, Weitai, Qu, Mengxue, Wei, Yunchao, Yan, Yan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
3DResT: A Strong Baseline for Semi-Supervised 3D Referring Expression Segmentation
di: Chen, Wenxin, et al.
Pubblicazione: (2025)
di: Chen, Wenxin, et al.
Pubblicazione: (2025)
Intent3D: 3D Object Detection in RGB-D Scans Based on Human Intention
di: Kang, Weitai, et al.
Pubblicazione: (2024)
di: Kang, Weitai, et al.
Pubblicazione: (2024)
SegVG: Transferring Object Bounding Box to Segmentation for Visual Grounding
di: Kang, Weitai, et al.
Pubblicazione: (2024)
di: Kang, Weitai, et al.
Pubblicazione: (2024)
Visual Grounding with Attention-Driven Constraint Balancing
di: Kang, Weitai, et al.
Pubblicazione: (2024)
di: Kang, Weitai, et al.
Pubblicazione: (2024)
VGent: Visual Grounding via Modular Design for Disentangling Reasoning and Prediction
di: Kang, Weitai, et al.
Pubblicazione: (2025)
di: Kang, Weitai, et al.
Pubblicazione: (2025)
ExpVG: Investigating the Design Space of Visual Grounding in Multimodal Large Language Model
di: Kang, Weitai, et al.
Pubblicazione: (2025)
di: Kang, Weitai, et al.
Pubblicazione: (2025)
On the Faithfulness of Vision Transformer Explanations
di: Wu, Junyi, et al.
Pubblicazione: (2024)
di: Wu, Junyi, et al.
Pubblicazione: (2024)
Token Transformation Matters: Towards Faithful Post-hoc Explanation for Vision Transformer
di: Wu, Junyi, et al.
Pubblicazione: (2024)
di: Wu, Junyi, et al.
Pubblicazione: (2024)
A Unified Reasoning Framework for Holistic Zero-Shot Video Anomaly Analysis
di: Lin, Dongheng, et al.
Pubblicazione: (2025)
di: Lin, Dongheng, et al.
Pubblicazione: (2025)
ROSE: Revolutionizing Open-Set Dense Segmentation with Patch-Wise Perceptual Large Multimodal Model
di: Han, Kunyang, et al.
Pubblicazione: (2024)
di: Han, Kunyang, et al.
Pubblicazione: (2024)
Semi-supervised Active Learning for Video Action Detection
di: Singh, Ayush, et al.
Pubblicazione: (2023)
di: Singh, Ayush, et al.
Pubblicazione: (2023)
Robin3D: Improving 3D Large Language Model via Robust Instruction Tuning
di: Kang, Weitai, et al.
Pubblicazione: (2024)
di: Kang, Weitai, et al.
Pubblicazione: (2024)
PreFM: Online Audio-Visual Event Parsing via Predictive Future Modeling
di: Yu, Xiao, et al.
Pubblicazione: (2025)
di: Yu, Xiao, et al.
Pubblicazione: (2025)
SCOUT: Semi-supervised Camouflaged Object Detection by Utilizing Text and Adaptive Data Selection
di: Yan, Weiqi, et al.
Pubblicazione: (2025)
di: Yan, Weiqi, et al.
Pubblicazione: (2025)
Alleviating Class Imbalance in Semi-supervised Multi-organ Segmentation via Balanced Subclass Regularization
di: Feng, Zhenghao, et al.
Pubblicazione: (2024)
di: Feng, Zhenghao, et al.
Pubblicazione: (2024)
Collaborative Feature-Logits Contrastive Learning for Open-Set Semi-Supervised Object Detection
di: Zhong, Xinhao, et al.
Pubblicazione: (2024)
di: Zhong, Xinhao, et al.
Pubblicazione: (2024)
Sequential Visual and Semantic Consistency for Semi-supervised Text Recognition
di: Yang, Mingkun, et al.
Pubblicazione: (2024)
di: Yang, Mingkun, et al.
Pubblicazione: (2024)
BASIC: Semi-supervised Multi-organ Segmentation with Balanced Subclass Regularization and Semantic-conflict Penalty
di: Feng, Zhenghao, et al.
Pubblicazione: (2025)
di: Feng, Zhenghao, et al.
Pubblicazione: (2025)
ChatVTG: Video Temporal Grounding via Chat with Video Dialogue Large Language Models
di: Qu, Mengxue, et al.
Pubblicazione: (2024)
di: Qu, Mengxue, et al.
Pubblicazione: (2024)
IPSeg: Image Posterior Mitigates Semantic Drift in Class-Incremental Segmentation
di: Yu, Xiao, et al.
Pubblicazione: (2025)
di: Yu, Xiao, et al.
Pubblicazione: (2025)
Double Banking on Knowledge: Customized Modulation and Prototypes for Multi-Modality Semi-supervised Medical Image Segmentation
di: Chen, Yingyu, et al.
Pubblicazione: (2024)
di: Chen, Yingyu, et al.
Pubblicazione: (2024)
SemiCD-VL: Visual-Language Model Guidance Makes Better Semi-supervised Change Detector
di: Li, Kaiyu, et al.
Pubblicazione: (2024)
di: Li, Kaiyu, et al.
Pubblicazione: (2024)
DualFete: Revisiting Teacher-Student Interactions from a Feedback Perspective for Semi-supervised Medical Image Segmentation
di: Yi, Le, et al.
Pubblicazione: (2025)
di: Yi, Le, et al.
Pubblicazione: (2025)
Text-driven Multiplanar Visual Interaction for Semi-supervised Medical Image Segmentation
di: Huang, Kaiwen, et al.
Pubblicazione: (2025)
di: Huang, Kaiwen, et al.
Pubblicazione: (2025)
Semi-LAR: Semi-supervised Contrastive Learning with Linear Attention for Removal of Nighttime Flares
di: Zhu, Xiyu, et al.
Pubblicazione: (2026)
di: Zhu, Xiyu, et al.
Pubblicazione: (2026)
Semantic Visual Anomaly Detection and Reasoning in AI-Generated Images
di: Tan, Chuangchuang, et al.
Pubblicazione: (2025)
di: Tan, Chuangchuang, et al.
Pubblicazione: (2025)
4DGen: Grounded 4D Content Generation with Spatial-temporal Consistency
di: Yin, Yuyang, et al.
Pubblicazione: (2023)
di: Yin, Yuyang, et al.
Pubblicazione: (2023)
ALFred: An Active Learning Framework for Real-world Semi-supervised Anomaly Detection with Adaptive Thresholds
di: Yao, Shanle, et al.
Pubblicazione: (2025)
di: Yao, Shanle, et al.
Pubblicazione: (2025)
Inline Critic Steers Image Editing
di: Kang, Weitai, et al.
Pubblicazione: (2026)
di: Kang, Weitai, et al.
Pubblicazione: (2026)
Harnessing Group-Oriented Consistency Constraints for Semi-Supervised Semantic Segmentation in CdZnTe Semiconductors
di: Li, Peihao, et al.
Pubblicazione: (2025)
di: Li, Peihao, et al.
Pubblicazione: (2025)
Unifying Visual and Vision-Language Tracking via Contrastive Learning
di: Ma, Yinchao, et al.
Pubblicazione: (2024)
di: Ma, Yinchao, et al.
Pubblicazione: (2024)
Dynamic Sub-graph Distillation for Robust Semi-supervised Continual Learning
di: Fan, Yan, et al.
Pubblicazione: (2023)
di: Fan, Yan, et al.
Pubblicazione: (2023)
Beyond the Label Itself: Latent Labels Enhance Semi-supervised Point Cloud Panoptic Segmentation
di: Chen, Yujun, et al.
Pubblicazione: (2023)
di: Chen, Yujun, et al.
Pubblicazione: (2023)
Multi-Level Label Correction by Distilling Proximate Patterns for Semi-supervised Semantic Segmentation
di: Xiao, Hui, et al.
Pubblicazione: (2024)
di: Xiao, Hui, et al.
Pubblicazione: (2024)
Closed-Loop Transfer for Weakly-supervised Affordance Grounding
di: Tang, Jiajin, et al.
Pubblicazione: (2025)
di: Tang, Jiajin, et al.
Pubblicazione: (2025)
SIT-FER: Integration of Semantic-, Instance-, Text-level Information for Semi-supervised Facial Expression Recognition
di: Ding, Sixian, et al.
Pubblicazione: (2025)
di: Ding, Sixian, et al.
Pubblicazione: (2025)
Weakly Semi-supervised Whole Slide Image Classification by Two-level Cross Consistency Supervision
di: Qu, Linhao, et al.
Pubblicazione: (2025)
di: Qu, Linhao, et al.
Pubblicazione: (2025)
Color-$S^{4}L$: Self-supervised Semi-supervised Learning with Image Colorization
di: Chen, Hanxiao
Pubblicazione: (2024)
di: Chen, Hanxiao
Pubblicazione: (2024)
Dual-supervised Asymmetric Co-training for Semi-supervised Medical Domain Generalization
di: Song, Jincai, et al.
Pubblicazione: (2025)
di: Song, Jincai, et al.
Pubblicazione: (2025)
Semi-supervised Open-World Object Detection
di: Mullappilly, Sahal Shaji, et al.
Pubblicazione: (2024)
di: Mullappilly, Sahal Shaji, et al.
Pubblicazione: (2024)
Documenti analoghi
-
3DResT: A Strong Baseline for Semi-Supervised 3D Referring Expression Segmentation
di: Chen, Wenxin, et al.
Pubblicazione: (2025) -
Intent3D: 3D Object Detection in RGB-D Scans Based on Human Intention
di: Kang, Weitai, et al.
Pubblicazione: (2024) -
SegVG: Transferring Object Bounding Box to Segmentation for Visual Grounding
di: Kang, Weitai, et al.
Pubblicazione: (2024) -
Visual Grounding with Attention-Driven Constraint Balancing
di: Kang, Weitai, et al.
Pubblicazione: (2024) -
VGent: Visual Grounding via Modular Design for Disentangling Reasoning and Prediction
di: Kang, Weitai, et al.
Pubblicazione: (2025)