Salvato in:
| Autori principali: | Du, Chengyi, Jin, Keyan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2504.10048 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Siamese-DETR for Generic Multi-Object Tracking
di: Liu, Qiankun, et al.
Pubblicazione: (2023)
di: Liu, Qiankun, et al.
Pubblicazione: (2023)
CoTZero: Annotation-Free Human-Like Vision Reasoning via Hierarchical Synthetic CoT
di: Du, Chengyi, et al.
Pubblicazione: (2026)
di: Du, Chengyi, et al.
Pubblicazione: (2026)
Contrastive Learning for Multi-Object Tracking with Transformers
di: De Plaen, Pierre-François, et al.
Pubblicazione: (2023)
di: De Plaen, Pierre-François, et al.
Pubblicazione: (2023)
MotionGrounder: Grounded Multi-Object Motion Transfer via Diffusion Transformer
di: Teodoro, Samuel, et al.
Pubblicazione: (2026)
di: Teodoro, Samuel, et al.
Pubblicazione: (2026)
SiamMo: Siamese Motion-Centric 3D Object Tracking
di: Yang, Yuxiang, et al.
Pubblicazione: (2024)
di: Yang, Yuxiang, et al.
Pubblicazione: (2024)
Siamese Learning with Joint Alignment and Regression for Weakly-Supervised Video Paragraph Grounding
di: Tan, Chaolei, et al.
Pubblicazione: (2024)
di: Tan, Chaolei, et al.
Pubblicazione: (2024)
MAST: Video Polyp Segmentation with a Mixture-Attention Siamese Transformer
di: Chen, Geng, et al.
Pubblicazione: (2024)
di: Chen, Geng, et al.
Pubblicazione: (2024)
Asymmetrical Siamese Network for Point Clouds Normal Estimation
di: Jin, Wei, et al.
Pubblicazione: (2024)
di: Jin, Wei, et al.
Pubblicazione: (2024)
Multi-Rationale Explainable Object Recognition via Contrastive Conditional Inference
di: Rasekh, Ali, et al.
Pubblicazione: (2025)
di: Rasekh, Ali, et al.
Pubblicazione: (2025)
Sigma: Siamese Mamba Network for Multi-Modal Semantic Segmentation
di: Wan, Zifu, et al.
Pubblicazione: (2024)
di: Wan, Zifu, et al.
Pubblicazione: (2024)
Siamese Transformer Networks for Few-shot Image Classification
di: Jiang, Weihao, et al.
Pubblicazione: (2024)
di: Jiang, Weihao, et al.
Pubblicazione: (2024)
IDT: A Physically Grounded Transformer for Feed-Forward Multi-View Intrinsic Decomposition
di: Du, Kang, et al.
Pubblicazione: (2025)
di: Du, Kang, et al.
Pubblicazione: (2025)
CreatiLayout: Siamese Multimodal Diffusion Transformer for Creative Layout-to-Image Generation
di: Zhang, Hui, et al.
Pubblicazione: (2024)
di: Zhang, Hui, et al.
Pubblicazione: (2024)
Multi-Scale Contrastive Learning for Video Temporal Grounding
di: Nguyen, Thong Thanh, et al.
Pubblicazione: (2024)
di: Nguyen, Thong Thanh, et al.
Pubblicazione: (2024)
Open-Vocabulary Indoor Object Grounding with 3D Hierarchical Scene Graph
di: Linok, Sergey, et al.
Pubblicazione: (2025)
di: Linok, Sergey, et al.
Pubblicazione: (2025)
Object Hallucination-Free Reinforcement Unlearning for Vision-Language Models
di: Jia, Kaidi, et al.
Pubblicazione: (2026)
di: Jia, Kaidi, et al.
Pubblicazione: (2026)
T-SiamTPN: Temporal Siamese Transformer Pyramid Networks for Robust and Efficient UAV Tracking
di: Ardi, Hojat, et al.
Pubblicazione: (2025)
di: Ardi, Hojat, et al.
Pubblicazione: (2025)
Multi-Object Tracking by Hierarchical Visual Representations
di: Cao, Jinkun, et al.
Pubblicazione: (2024)
di: Cao, Jinkun, et al.
Pubblicazione: (2024)
Cross-Layer Feature Pyramid Transformer for Small Object Detection in Aerial Images
di: Du, Zewen, et al.
Pubblicazione: (2024)
di: Du, Zewen, et al.
Pubblicazione: (2024)
Interactive Instance Annotation with Siamese Networks
di: Xu, Xiang, et al.
Pubblicazione: (2025)
di: Xu, Xiang, et al.
Pubblicazione: (2025)
Lightweight Full-Convolutional Siamese Tracker
di: Li, Yunfeng, et al.
Pubblicazione: (2023)
di: Li, Yunfeng, et al.
Pubblicazione: (2023)
Representation Alignment Contrastive Regularization for Multi-Object Tracking
di: Liu, Zhonglin, et al.
Pubblicazione: (2024)
di: Liu, Zhonglin, et al.
Pubblicazione: (2024)
Exploring Simple Siamese Network for High-Resolution Video Quality Assessment
di: Shen, Guotao, et al.
Pubblicazione: (2025)
di: Shen, Guotao, et al.
Pubblicazione: (2025)
Dual Cross-Attention Siamese Transformer for Rectal Tumor Regrowth Assessment in Watch-and-Wait Endoscopy
di: Gomez, Jorge Tapias, et al.
Pubblicazione: (2025)
di: Gomez, Jorge Tapias, et al.
Pubblicazione: (2025)
Object Affordance Recognition and Grounding via Multi-scale Cross-modal Representation Learning
di: Wan, Xinhang, et al.
Pubblicazione: (2025)
di: Wan, Xinhang, et al.
Pubblicazione: (2025)
ContrastAlign: Toward Robust BEV Feature Alignment via Contrastive Learning for Multi-Modal 3D Object Detection
di: Song, Ziying, et al.
Pubblicazione: (2024)
di: Song, Ziying, et al.
Pubblicazione: (2024)
SiamGM: Siamese Geometry-Aware and Motion-Guided Network for Real-Time Satellite Video Object Tracking
di: Wen, Zixiao, et al.
Pubblicazione: (2026)
di: Wen, Zixiao, et al.
Pubblicazione: (2026)
Hierarchical Neural Collapse Detection Transformer for Class Incremental Object Detection
di: Pham, Duc Thanh, et al.
Pubblicazione: (2025)
di: Pham, Duc Thanh, et al.
Pubblicazione: (2025)
SeaDATE: Remedy Dual-Attention Transformer with Semantic Alignment via Contrast Learning for Multimodal Object Detection
di: Dong, Shuhan, et al.
Pubblicazione: (2024)
di: Dong, Shuhan, et al.
Pubblicazione: (2024)
Siamese Vision Transformers are Scalable Audio-visual Learners
di: Lin, Yan-Bo, et al.
Pubblicazione: (2024)
di: Lin, Yan-Bo, et al.
Pubblicazione: (2024)
Learning to Balance: Decoupled Siamese Diffusion Transformer for Reference-Based Remote Sensing Image Super-Resolution
di: Luo, Bin, et al.
Pubblicazione: (2026)
di: Luo, Bin, et al.
Pubblicazione: (2026)
THCRL: Trusted Hierarchical Contrastive Representation Learning for Multi-View Clustering
di: Zhu, Jian
Pubblicazione: (2025)
di: Zhu, Jian
Pubblicazione: (2025)
Smart Feature is What You Need
di: Hu, Zhaoxin, et al.
Pubblicazione: (2024)
di: Hu, Zhaoxin, et al.
Pubblicazione: (2024)
Hyperbolic Hierarchical Contrastive Hashing
di: Wei, Rukai, et al.
Pubblicazione: (2022)
di: Wei, Rukai, et al.
Pubblicazione: (2022)
Balanced Hierarchical Contrastive Learning with Decoupled Queries for Fine-grained Object Detection in Remote Sensing Images
di: Chen, Jingzhou, et al.
Pubblicazione: (2025)
di: Chen, Jingzhou, et al.
Pubblicazione: (2025)
Hierarchical Graph Interaction Transformer with Dynamic Token Clustering for Camouflaged Object Detection
di: Yao, Siyuan, et al.
Pubblicazione: (2024)
di: Yao, Siyuan, et al.
Pubblicazione: (2024)
Hierarchical Side-Tuning for Vision Transformers
di: Lin, Weifeng, et al.
Pubblicazione: (2023)
di: Lin, Weifeng, et al.
Pubblicazione: (2023)
Improving Object Detection via Local-global Contrastive Learning
di: Triantafyllidou, Danai, et al.
Pubblicazione: (2024)
di: Triantafyllidou, Danai, et al.
Pubblicazione: (2024)
Self-Supervised Siamese Autoencoders
di: Baier, Friederike, et al.
Pubblicazione: (2023)
di: Baier, Friederike, et al.
Pubblicazione: (2023)
Multi-Task Domain Adaptation for Language Grounding with 3D Objects
di: Sun, Penglei, et al.
Pubblicazione: (2024)
di: Sun, Penglei, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Siamese-DETR for Generic Multi-Object Tracking
di: Liu, Qiankun, et al.
Pubblicazione: (2023) -
CoTZero: Annotation-Free Human-Like Vision Reasoning via Hierarchical Synthetic CoT
di: Du, Chengyi, et al.
Pubblicazione: (2026) -
Contrastive Learning for Multi-Object Tracking with Transformers
di: De Plaen, Pierre-François, et al.
Pubblicazione: (2023) -
MotionGrounder: Grounded Multi-Object Motion Transfer via Diffusion Transformer
di: Teodoro, Samuel, et al.
Pubblicazione: (2026) -
SiamMo: Siamese Motion-Centric 3D Object Tracking
di: Yang, Yuxiang, et al.
Pubblicazione: (2024)