Salvato in:
| Autori principali: | Song, Peipei, Zhang, Jing, Koniusz, Piotr, Barnes, Nick |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2403.14821 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CHAIN: Enhancing Generalization in Data-Efficient GANs via lipsCHitz continuity constrAIned Normalization
di: Ni, Yao, et al.
Pubblicazione: (2024)
di: Ni, Yao, et al.
Pubblicazione: (2024)
OpenKD: Opening Prompt Diversity for Zero- and Few-shot Keypoint Detection
di: Lu, Changsheng, et al.
Pubblicazione: (2024)
di: Lu, Changsheng, et al.
Pubblicazione: (2024)
Possibilistic Predictive Uncertainty for Deep Learning
di: Ni, Yao, et al.
Pubblicazione: (2026)
di: Ni, Yao, et al.
Pubblicazione: (2026)
PACE: Marrying generalization in PArameter-efficient fine-tuning with Consistency rEgularization
di: Ni, Yao, et al.
Pubblicazione: (2024)
di: Ni, Yao, et al.
Pubblicazione: (2024)
Feature Hallucination for Self-supervised Action Recognition
di: Wang, Lei, et al.
Pubblicazione: (2025)
di: Wang, Lei, et al.
Pubblicazione: (2025)
Focus on Background: Exploring SAM's Potential in Few-shot Medical Image Segmentation with Background-centric Prompting
di: Bo, Yuntian, et al.
Pubblicazione: (2026)
di: Bo, Yuntian, et al.
Pubblicazione: (2026)
Open Eyes, Then Reason: Fine-grained Visual Mathematical Understanding in MLLMs
di: Zhang, Shan, et al.
Pubblicazione: (2025)
di: Zhang, Shan, et al.
Pubblicazione: (2025)
Learning Time in Static Classifiers
di: Ding, Xi, et al.
Pubblicazione: (2025)
di: Ding, Xi, et al.
Pubblicazione: (2025)
Subspace Kernel Learning on Tensor Sequences
di: Wang, Lei, et al.
Pubblicazione: (2026)
di: Wang, Lei, et al.
Pubblicazione: (2026)
Adaptive Multi-head Contrastive Learning
di: Wang, Lei, et al.
Pubblicazione: (2023)
di: Wang, Lei, et al.
Pubblicazione: (2023)
Video Understanding by Design: How Datasets Shape Architectures and Insights
di: Wang, Lei, et al.
Pubblicazione: (2025)
di: Wang, Lei, et al.
Pubblicazione: (2025)
ICED: Concept-level Machine Unlearning via Interpretable Concept Decomposition
di: Lin, Shen, et al.
Pubblicazione: (2026)
di: Lin, Shen, et al.
Pubblicazione: (2026)
Noise Consistency Regularization for Improved Subject-Driven Image Synthesis
di: Ni, Yao, et al.
Pubblicazione: (2025)
di: Ni, Yao, et al.
Pubblicazione: (2025)
Motion meets Attention: Video Motion Prompts
di: Chen, Qixiang, et al.
Pubblicazione: (2024)
di: Chen, Qixiang, et al.
Pubblicazione: (2024)
Graph Your Own Prompt
di: Ding, Xi, et al.
Pubblicazione: (2025)
di: Ding, Xi, et al.
Pubblicazione: (2025)
Pre-training with Random Orthogonal Projection Image Modeling
di: Haghighat, Maryam, et al.
Pubblicazione: (2023)
di: Haghighat, Maryam, et al.
Pubblicazione: (2023)
When Spatial meets Temporal in Action Recognition
di: Chen, Huilin, et al.
Pubblicazione: (2024)
di: Chen, Huilin, et al.
Pubblicazione: (2024)
Artemis: Structured Visual Reasoning for Perception Policy Learning
di: Tang, Wei, et al.
Pubblicazione: (2025)
di: Tang, Wei, et al.
Pubblicazione: (2025)
Through Their Eyes: Fixation-aligned Tuning for Personalized User Emulation
di: Huang, Lingfeng, et al.
Pubblicazione: (2026)
di: Huang, Lingfeng, et al.
Pubblicazione: (2026)
Uncertainty-DTW for Sequences and Visual Tokens
di: Wang, Lei, et al.
Pubblicazione: (2026)
di: Wang, Lei, et al.
Pubblicazione: (2026)
Fixation-based Self-calibration for Eye Tracking in VR Headsets
di: Uramune, Ryusei, et al.
Pubblicazione: (2023)
di: Uramune, Ryusei, et al.
Pubblicazione: (2023)
Hierarchically Robust Zero-shot Vision-language Models
di: Dong, Junhao, et al.
Pubblicazione: (2026)
di: Dong, Junhao, et al.
Pubblicazione: (2026)
Gaussian Graph Network: Learning Efficient and Generalizable Gaussian Representations from Multi-view Images
di: Zhang, Shengjun, et al.
Pubblicazione: (2025)
di: Zhang, Shengjun, et al.
Pubblicazione: (2025)
Meet JEANIE: a Similarity Measure for 3D Skeleton Sequences via Temporal-Viewpoint Alignment
di: Wang, Lei, et al.
Pubblicazione: (2024)
di: Wang, Lei, et al.
Pubblicazione: (2024)
Learnable Expansion of Graph Operators for Multi-Modal Feature Fusion
di: Ding, Dexuan, et al.
Pubblicazione: (2024)
di: Ding, Dexuan, et al.
Pubblicazione: (2024)
Point-PNG: Conditional Pseudo-Negatives Generation for Point Cloud Pre-Training
di: Mahendren, Sutharsan, et al.
Pubblicazione: (2024)
di: Mahendren, Sutharsan, et al.
Pubblicazione: (2024)
SmokeBench: Evaluating Multimodal Large Language Models for Wildfire Smoke Detection
di: Qi, Tianye, et al.
Pubblicazione: (2025)
di: Qi, Tianye, et al.
Pubblicazione: (2025)
Math Blind: Failures in Diagram Understanding Undermine Reasoning in MLLMs
di: Sun, Yanpeng, et al.
Pubblicazione: (2025)
di: Sun, Yanpeng, et al.
Pubblicazione: (2025)
NumGrad-Pull: Numerical Gradient Guided Tri-plane Representation for Surface Reconstruction from Point Clouds
di: Cui, Ruikai, et al.
Pubblicazione: (2024)
di: Cui, Ruikai, et al.
Pubblicazione: (2024)
MMT-ARD: Multimodal Multi-Teacher Adversarial Distillation for Robust Vision-Language Models
di: Li, Yuqi, et al.
Pubblicazione: (2025)
di: Li, Yuqi, et al.
Pubblicazione: (2025)
Deep Learning-Based Fixation Type Prediction for Quality Assurance in Digital Pathology
di: Thaeter, Oskar, et al.
Pubblicazione: (2026)
di: Thaeter, Oskar, et al.
Pubblicazione: (2026)
Self-Evolving Spatial Reasoning in Vision Language Models via Geometric Logic Consistency
di: Liu, Junming, et al.
Pubblicazione: (2026)
di: Liu, Junming, et al.
Pubblicazione: (2026)
NoiseSDF2NoiseSDF: Learning Clean Neural Fields from Noisy Supervision
di: Wang, Tengkai, et al.
Pubblicazione: (2025)
di: Wang, Tengkai, et al.
Pubblicazione: (2025)
Distinguishing Target and Non-Target Fixations with EEG and Eye Tracking in Realistic Visual Scenes
di: Sharma, Mansi, et al.
Pubblicazione: (2025)
di: Sharma, Mansi, et al.
Pubblicazione: (2025)
Enhancing Partially Relevant Video Retrieval with Robust Alignment Learning
di: Zhang, Long, et al.
Pubblicazione: (2025)
di: Zhang, Long, et al.
Pubblicazione: (2025)
SDI-Paste: Synthetic Dynamic Instance Copy-Paste for Video Instance Segmentation
di: Shrestha, Sahir, et al.
Pubblicazione: (2024)
di: Shrestha, Sahir, et al.
Pubblicazione: (2024)
Learning Unsupervised Gaze Representation via Eye Mask Driven Information Bottleneck
di: Jiang, Yangzhou, et al.
Pubblicazione: (2024)
di: Jiang, Yangzhou, et al.
Pubblicazione: (2024)
BEVFusion: Multi-Task Multi-Sensor Fusion with Unified Bird's-Eye View Representation
di: Liu, Zhijian, et al.
Pubblicazione: (2022)
di: Liu, Zhijian, et al.
Pubblicazione: (2022)
Rethinking Polyp Segmentation from an Out-of-Distribution Perspective
di: Ji, Ge-Peng, et al.
Pubblicazione: (2023)
di: Ji, Ge-Peng, et al.
Pubblicazione: (2023)
P2C: Self-Supervised Point Cloud Completion from Single Partial Clouds
di: Cui, Ruikai, et al.
Pubblicazione: (2023)
di: Cui, Ruikai, et al.
Pubblicazione: (2023)
Documenti analoghi
-
CHAIN: Enhancing Generalization in Data-Efficient GANs via lipsCHitz continuity constrAIned Normalization
di: Ni, Yao, et al.
Pubblicazione: (2024) -
OpenKD: Opening Prompt Diversity for Zero- and Few-shot Keypoint Detection
di: Lu, Changsheng, et al.
Pubblicazione: (2024) -
Possibilistic Predictive Uncertainty for Deep Learning
di: Ni, Yao, et al.
Pubblicazione: (2026) -
PACE: Marrying generalization in PArameter-efficient fine-tuning with Consistency rEgularization
di: Ni, Yao, et al.
Pubblicazione: (2024) -
Feature Hallucination for Self-supervised Action Recognition
di: Wang, Lei, et al.
Pubblicazione: (2025)