ViTree: Single-path Neural Tree for Step-wise Interpretable Fine-grained Visual Categorization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lao, Danning, Liu, Qi, Bu, Jiazi, Yan, Junchi, Shen, Wei |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Data-free Knowledge Distillation for Fine-grained Visual Categorization
par: Shao, Renrong, et autres
Publié: (2024)
par: Shao, Renrong, et autres
Publié: (2024)
Novel Class Discovery for Ultra-Fine-Grained Visual Categorization
par: Liu, Yu, et autres
Publié: (2024)
par: Liu, Yu, et autres
Publié: (2024)
Cross-Level Multi-Instance Distillation for Self-Supervised Fine-Grained Visual Categorization
par: Bi, Qi, et autres
Publié: (2024)
par: Bi, Qi, et autres
Publié: (2024)
Concept-wise Attention for Fine-grained Concept Bottleneck Models
par: Zhong, Minghong, et autres
Publié: (2026)
par: Zhong, Minghong, et autres
Publié: (2026)
SARE: Sample-wise Adaptive Reasoning for Training-free Fine-grained Visual Recognition
par: Yang, Jingxiao, et autres
Publié: (2026)
par: Yang, Jingxiao, et autres
Publié: (2026)
Car-1000: A New Large Scale Fine-Grained Visual Categorization Dataset
par: Hu, Yutao, et autres
Publié: (2025)
par: Hu, Yutao, et autres
Publié: (2025)
Boosting Order-Preserving and Transferability for Neural Architecture Search: a Joint Architecture Refined Search and Fine-tuning Approach
par: Zhang, Beichen, et autres
Publié: (2024)
par: Zhang, Beichen, et autres
Publié: (2024)
SwimVG: Step-wise Multimodal Fusion and Adaption for Visual Grounding
par: Shi, Liangtao, et autres
Publié: (2025)
par: Shi, Liangtao, et autres
Publié: (2025)
Towards Low-latency Event-based Visual Recognition with Hybrid Step-wise Distillation Spiking Neural Networks
par: Zhong, Xian, et autres
Publié: (2024)
par: Zhong, Xian, et autres
Publié: (2024)
NaturalVLM: Leveraging Fine-grained Natural Language for Affordance-Guided Visual Manipulation
par: Xu, Ran, et autres
Publié: (2024)
par: Xu, Ran, et autres
Publié: (2024)
SoLA-Vision: Fine-grained Layer-wise Linear Softmax Hybrid Attention
par: Li, Ruibang, et autres
Publié: (2026)
par: Li, Ruibang, et autres
Publié: (2026)
Uni-Classifier: Leveraging Video Diffusion Priors for Universal Guidance Classifier
par: Zhou, Yujie, et autres
Publié: (2026)
par: Zhou, Yujie, et autres
Publié: (2026)
Context-Semantic Quality Awareness Network for Fine-Grained Visual Categorization
par: Xu, Qin, et autres
Publié: (2024)
par: Xu, Qin, et autres
Publié: (2024)
Fine-Grained GRPO for Precise Preference Alignment in Flow Models
par: Zhou, Yujie, et autres
Publié: (2025)
par: Zhou, Yujie, et autres
Publié: (2025)
SAVAA: Mitigating Hallucinations in LVLMs via Step-wise Adaptive Visual Attention Amplification
par: Zhang, Jiacheng, et autres
Publié: (2026)
par: Zhang, Jiacheng, et autres
Publié: (2026)
ViGG: Robust RGB-D Point Cloud Registration using Visual-Geometric Mutual Guidance
par: Chen, Congjia, et autres
Publié: (2025)
par: Chen, Congjia, et autres
Publié: (2025)
Eval3D: Interpretable and Fine-grained Evaluation for 3D Generation
par: Duggal, Shivam, et autres
Publié: (2025)
par: Duggal, Shivam, et autres
Publié: (2025)
Fast and Interpretable 2D Homography Decomposition: Similarity-Kernel-Similarity and Affine-Core-Affine Transformations
par: Cai, Shen, et autres
Publié: (2024)
par: Cai, Shen, et autres
Publié: (2024)
Multi-modal Instruction Tuned LLMs with Fine-grained Visual Perception
par: He, Junwen, et autres
Publié: (2024)
par: He, Junwen, et autres
Publié: (2024)
FineViT: Progressively Unlocking Fine-Grained Perception with Dense Recaptions
par: Zhao, Peisen, et autres
Publié: (2026)
par: Zhao, Peisen, et autres
Publié: (2026)
Unveiling Chain of Step Reasoning for Vision-Language Models with Fine-grained Rewards
par: Chen, Honghao, et autres
Publié: (2025)
par: Chen, Honghao, et autres
Publié: (2025)
ExoViP: Step-by-step Verification and Exploration with Exoskeleton Modules for Compositional Visual Reasoning
par: Wang, Yuxuan, et autres
Publié: (2024)
par: Wang, Yuxuan, et autres
Publié: (2024)
Concept Drift and Long-Tailed Distribution in Fine-Grained Visual Categorization: Benchmark and Method
par: Ye, Shuo, et autres
Publié: (2023)
par: Ye, Shuo, et autres
Publié: (2023)
ViSurf: Visual Supervised-and-Reinforcement Fine-Tuning for Large Vision-and-Language Models
par: Liu, Yuqi, et autres
Publié: (2025)
par: Liu, Yuqi, et autres
Publié: (2025)
Detail Reinforcement Diffusion Model: Augmentation Fine-Grained Visual Categorization in Few-Shot Conditions
par: Wu, Tianxu, et autres
Publié: (2023)
par: Wu, Tianxu, et autres
Publié: (2023)
CausalFSFG: Rethinking Few-Shot Fine-Grained Visual Categorization from Causal Perspective
par: Yang, Zhiwen, et autres
Publié: (2025)
par: Yang, Zhiwen, et autres
Publié: (2025)
Democratizing Fine-grained Visual Recognition with Large Language Models
par: Liu, Mingxuan, et autres
Publié: (2024)
par: Liu, Mingxuan, et autres
Publié: (2024)
FriendsQA: A New Large-Scale Deep Video Understanding Dataset with Fine-grained Topic Categorization for Story Videos
par: Wu, Zhengqian, et autres
Publié: (2024)
par: Wu, Zhengqian, et autres
Publié: (2024)
Grounding and Enhancing Grid-based Models for Neural Fields
par: Zhao, Zelin, et autres
Publié: (2024)
par: Zhao, Zelin, et autres
Publié: (2024)
ViSpeak: Visual Instruction Feedback in Streaming Videos
par: Fu, Shenghao, et autres
Publié: (2025)
par: Fu, Shenghao, et autres
Publié: (2025)
Efficient Diffusion Transformer with Step-wise Dynamic Attention Mediators
par: Pu, Yifan, et autres
Publié: (2024)
par: Pu, Yifan, et autres
Publié: (2024)
DRM: Diffusion-based Reward Model With Step-wise Guidance
par: Zhang, Jaxon, et autres
Publié: (2026)
par: Zhang, Jaxon, et autres
Publié: (2026)
Open Eyes, Then Reason: Fine-grained Visual Mathematical Understanding in MLLMs
par: Zhang, Shan, et autres
Publié: (2025)
par: Zhang, Shan, et autres
Publié: (2025)
HiVG: Hierarchical Multimodal Fine-grained Modulation for Visual Grounding
par: Xiao, Linhui, et autres
Publié: (2024)
par: Xiao, Linhui, et autres
Publié: (2024)
DiCache: Let Diffusion Model Determine Its Own Cache
par: Bu, Jiazi, et autres
Publié: (2025)
par: Bu, Jiazi, et autres
Publié: (2025)
Unified Personalized Reward Model for Vision Generation
par: Wang, Yibin, et autres
Publié: (2026)
par: Wang, Yibin, et autres
Publié: (2026)
MLAE: Masked LoRA Experts for Visual Parameter-Efficient Fine-Tuning
par: Wang, Junjie, et autres
Publié: (2024)
par: Wang, Junjie, et autres
Publié: (2024)
Learning Contrastive Self-Distillation for Ultra-Fine-Grained Visual Categorization Targeting Limited Samples
par: Fang, Ziye, et autres
Publié: (2023)
par: Fang, Ziye, et autres
Publié: (2023)
GeoViS: Geospatially Rewarded Visual Search for Remote Sensing Visual Grounding
par: Zhang, Peirong, et autres
Publié: (2025)
par: Zhang, Peirong, et autres
Publié: (2025)
ViGoR: Improving Visual Grounding of Large Vision Language Models with Fine-Grained Reward Modeling
par: Yan, Siming, et autres
Publié: (2024)
par: Yan, Siming, et autres
Publié: (2024)
Documents similaires
-
Data-free Knowledge Distillation for Fine-grained Visual Categorization
par: Shao, Renrong, et autres
Publié: (2024) -
Novel Class Discovery for Ultra-Fine-Grained Visual Categorization
par: Liu, Yu, et autres
Publié: (2024) -
Cross-Level Multi-Instance Distillation for Self-Supervised Fine-Grained Visual Categorization
par: Bi, Qi, et autres
Publié: (2024) -
Concept-wise Attention for Fine-grained Concept Bottleneck Models
par: Zhong, Minghong, et autres
Publié: (2026) -
SARE: Sample-wise Adaptive Reasoning for Training-free Fine-grained Visual Recognition
par: Yang, Jingxiao, et autres
Publié: (2026)