Salvato in:
| Autori principali: | Zhe, Ting, Zhang, Jing, Li, Yongqian, Luo, Yong, Hu, Han, Tao, Dacheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2306.10858 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Heuristic-inspired Reasoning Priors Facilitate Data-Efficient Referring Object Detection
di: Zhang, Xu, et al.
Pubblicazione: (2026)
di: Zhang, Xu, et al.
Pubblicazione: (2026)
LAB-Det: Language as a Domain-Invariant Bridge for Training-Free One-Shot Domain Generalization in Object Detection
di: Zhang, Xu, et al.
Pubblicazione: (2026)
di: Zhang, Xu, et al.
Pubblicazione: (2026)
HandRefiner: Refining Malformed Hands in Generated Images by Diffusion-based Conditional Inpainting
di: Lu, Wenquan, et al.
Pubblicazione: (2023)
di: Lu, Wenquan, et al.
Pubblicazione: (2023)
SimDistill: Simulated Multi-modal Distillation for BEV 3D Object Detection
di: Zhao, Haimei, et al.
Pubblicazione: (2023)
di: Zhao, Haimei, et al.
Pubblicazione: (2023)
On Geometry-Enhanced Parameter-Efficient Fine-Tuning for 3D Scene Segmentation
di: Tang, Liyao, et al.
Pubblicazione: (2025)
di: Tang, Liyao, et al.
Pubblicazione: (2025)
Merging Multi-Task Models via Weight-Ensembling Mixture of Experts
di: Tang, Anke, et al.
Pubblicazione: (2024)
di: Tang, Anke, et al.
Pubblicazione: (2024)
Exploring Plain ViT Reconstruction for Multi-class Unsupervised Anomaly Detection
di: Zhang, Jiangning, et al.
Pubblicazione: (2023)
di: Zhang, Jiangning, et al.
Pubblicazione: (2023)
MGFFD-VLM: Multi-Granularity Prompt Learning for Face Forgery Detection with VLM
di: Chen, Tao, et al.
Pubblicazione: (2025)
di: Chen, Tao, et al.
Pubblicazione: (2025)
Robust Domain Adaptive Object Detection with Unified Multi-Granularity Alignment
di: Zhang, Libo, et al.
Pubblicazione: (2023)
di: Zhang, Libo, et al.
Pubblicazione: (2023)
Learning Feature Inversion for Multi-class Anomaly Detection under General-purpose COCO-AD Benchmark
di: Zhang, Jiangning, et al.
Pubblicazione: (2024)
di: Zhang, Jiangning, et al.
Pubblicazione: (2024)
Neuron: Learning Context-Aware Evolving Representations for Zero-Shot Skeleton Action Recognition
di: Chen, Yang, et al.
Pubblicazione: (2024)
di: Chen, Yang, et al.
Pubblicazione: (2024)
VTON-HandFit: Virtual Try-on for Arbitrary Hand Pose Guided by Hand Priors Embedding
di: Liang, Yujie, et al.
Pubblicazione: (2024)
di: Liang, Yujie, et al.
Pubblicazione: (2024)
MTGA: Multi-View Temporal Granularity Aligned Aggregation for Event-Based Lip-Reading
di: Zhang, Wenhao, et al.
Pubblicazione: (2024)
di: Zhang, Wenhao, et al.
Pubblicazione: (2024)
Event-based Simultaneous Localization and Mapping: A Comprehensive Survey
di: Huang, Kunping, et al.
Pubblicazione: (2023)
di: Huang, Kunping, et al.
Pubblicazione: (2023)
CtrlAttack: A Unified Attack on World-Model Control in Diffusion Models
di: Xu, Shuhan, et al.
Pubblicazione: (2026)
di: Xu, Shuhan, et al.
Pubblicazione: (2026)
Dual DETRs for Multi-Label Temporal Action Detection
di: Zhu, Yuhan, et al.
Pubblicazione: (2024)
di: Zhu, Yuhan, et al.
Pubblicazione: (2024)
Retrieval-Augmented Perception: High-Resolution Image Perception Meets Visual RAG
di: Wang, Wenbin, et al.
Pubblicazione: (2025)
di: Wang, Wenbin, et al.
Pubblicazione: (2025)
Towards Modality-agnostic Label-efficient Segmentation with Entropy-Regularized Distribution Alignment
di: Tang, Liyao, et al.
Pubblicazione: (2024)
di: Tang, Liyao, et al.
Pubblicazione: (2024)
OpenFS: Multi-Hand-Capable Fingerspelling Recognition with Implicit Signing-Hand Detection and Frame-Wise Letter-Conditioned Synthesis
di: Cha, Junuk, et al.
Pubblicazione: (2026)
di: Cha, Junuk, et al.
Pubblicazione: (2026)
MGTR: Multi-Granular Transformer for Motion Prediction with LiDAR
di: Gan, Yiqian, et al.
Pubblicazione: (2023)
di: Gan, Yiqian, et al.
Pubblicazione: (2023)
Proto-Former: Unified Facial Landmark Detection by Prototype Transformer
di: Hu, Shengkai, et al.
Pubblicazione: (2025)
di: Hu, Shengkai, et al.
Pubblicazione: (2025)
Perceive, Verify and Understand Long Video: Multi-Granular Perception and Active Verification via Interactive Agents
di: Li, Jiahua, et al.
Pubblicazione: (2025)
di: Li, Jiahua, et al.
Pubblicazione: (2025)
Divide, Conquer and Combine: A Training-Free Framework for High-Resolution Image Perception in Multimodal Large Language Models
di: Wang, Wenbin, et al.
Pubblicazione: (2024)
di: Wang, Wenbin, et al.
Pubblicazione: (2024)
SAUGE: Taming SAM for Uncertainty-Aligned Multi-Granularity Edge Detection
di: Liufu, Xing, et al.
Pubblicazione: (2024)
di: Liufu, Xing, et al.
Pubblicazione: (2024)
RaCMC: Residual-Aware Compensation Network with Multi-Granularity Constraints for Fake News Detection
di: Yu, Xinquan, et al.
Pubblicazione: (2024)
di: Yu, Xinquan, et al.
Pubblicazione: (2024)
Confronting Reward Overoptimization for Diffusion Models: A Perspective of Inductive and Primacy Biases
di: Zhang, Ziyi, et al.
Pubblicazione: (2024)
di: Zhang, Ziyi, et al.
Pubblicazione: (2024)
Multi-Modal Multi-Granularity Tokenizer for Chu Bamboo Slip Scripts
di: Chen, Yingfa, et al.
Pubblicazione: (2024)
di: Chen, Yingfa, et al.
Pubblicazione: (2024)
On Robust Cross-View Consistency in Self-Supervised Monocular Depth Estimation
di: Zhao, Haimei, et al.
Pubblicazione: (2022)
di: Zhao, Haimei, et al.
Pubblicazione: (2022)
Rethink Sparse Signals for Pose-guided Text-to-image Generation
di: Xuan, Wenjie, et al.
Pubblicazione: (2025)
di: Xuan, Wenjie, et al.
Pubblicazione: (2025)
UniMix: Towards Domain Adaptive and Generalizable LiDAR Semantic Segmentation in Adverse Weather
di: Zhao, Haimei, et al.
Pubblicazione: (2024)
di: Zhao, Haimei, et al.
Pubblicazione: (2024)
Efficient and Effective Weight-Ensembling Mixture of Experts for Multi-Task Model Merging
di: Shen, Li, et al.
Pubblicazione: (2024)
di: Shen, Li, et al.
Pubblicazione: (2024)
UniICL: Systematizing Unified Multimodal In-context Learning through a Capability-Oriented Taxonomy
di: Xu, Yicheng, et al.
Pubblicazione: (2026)
di: Xu, Yicheng, et al.
Pubblicazione: (2026)
MSP-MVS: Multi-Granularity Segmentation Prior Guided Multi-View Stereo
di: Yuan, Zhenlong, et al.
Pubblicazione: (2024)
di: Yuan, Zhenlong, et al.
Pubblicazione: (2024)
Unified Unsupervised Anomaly Detection via Matching Cost Filtering
di: Zhang, Zhe, et al.
Pubblicazione: (2025)
di: Zhang, Zhe, et al.
Pubblicazione: (2025)
ClusIR: Towards Cluster-Guided All-in-One Image Restoration
di: Hu, Shengkai, et al.
Pubblicazione: (2025)
di: Hu, Shengkai, et al.
Pubblicazione: (2025)
Contact-aware Human Motion Generation from Textual Descriptions
di: Ma, Sihan, et al.
Pubblicazione: (2024)
di: Ma, Sihan, et al.
Pubblicazione: (2024)
PoseBench: Benchmarking the Robustness of Pose Estimation Models under Corruptions
di: Ma, Sihan, et al.
Pubblicazione: (2024)
di: Ma, Sihan, et al.
Pubblicazione: (2024)
MultiCounter: Multiple Action Agnostic Repetition Counting in Untrimmed Videos
di: Tang, Yin, et al.
Pubblicazione: (2024)
di: Tang, Yin, et al.
Pubblicazione: (2024)
Deepfake Generation and Detection: A Benchmark and Survey
di: Pei, Gan, et al.
Pubblicazione: (2024)
di: Pei, Gan, et al.
Pubblicazione: (2024)
MTP: Advancing Remote Sensing Foundation Model via Multi-Task Pretraining
di: Wang, Di, et al.
Pubblicazione: (2024)
di: Wang, Di, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Heuristic-inspired Reasoning Priors Facilitate Data-Efficient Referring Object Detection
di: Zhang, Xu, et al.
Pubblicazione: (2026) -
LAB-Det: Language as a Domain-Invariant Bridge for Training-Free One-Shot Domain Generalization in Object Detection
di: Zhang, Xu, et al.
Pubblicazione: (2026) -
HandRefiner: Refining Malformed Hands in Generated Images by Diffusion-based Conditional Inpainting
di: Lu, Wenquan, et al.
Pubblicazione: (2023) -
SimDistill: Simulated Multi-modal Distillation for BEV 3D Object Detection
di: Zhao, Haimei, et al.
Pubblicazione: (2023) -
On Geometry-Enhanced Parameter-Efficient Fine-Tuning for 3D Scene Segmentation
di: Tang, Liyao, et al.
Pubblicazione: (2025)