Saved in:
| Main Authors: | Yuan, Shilu, Li, Dongfeng, Liu, Wei, Zhang, Xinxin, Chen, Meng, Zhang, Junjie, Gong, Yongshun |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2406.09710 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Multi-Head Encoding for Extreme Label Classification
by: Liang, Daojun, et al.
Published: (2024)
by: Liang, Daojun, et al.
Published: (2024)
Fine-Grained Traffic Inference from Road to Lane via Spatio-Temporal Graph Node Generation
by: Li, Shuhao, et al.
Published: (2025)
by: Li, Shuhao, et al.
Published: (2025)
3DBench: A Scalable 3D Benchmark and Instruction-Tuning Dataset
by: Zhang, Junjie, et al.
Published: (2024)
by: Zhang, Junjie, et al.
Published: (2024)
PSReg: Prior-guided Sparse Mixture of Experts for Point Cloud Registration
by: Huang, Xiaoshui, et al.
Published: (2025)
by: Huang, Xiaoshui, et al.
Published: (2025)
Fine-Grained Representation for Lane Topology Reasoning
by: Xu, Guoqing, et al.
Published: (2025)
by: Xu, Guoqing, et al.
Published: (2025)
AIFIND: Artifact-Aware Interpreting Fine-Grained Alignment for Incremental Face Forgery Detection
by: Wang, Hao, et al.
Published: (2026)
by: Wang, Hao, et al.
Published: (2026)
CGC: Compositional Grounded Contrast for Fine-Grained Multi-Image Understanding
by: Zheng, Lihao, et al.
Published: (2026)
by: Zheng, Lihao, et al.
Published: (2026)
Knowledge-enhanced Multi-perspective Video Representation Learning for Scene Recognition
by: Yu, Xuzheng, et al.
Published: (2024)
by: Yu, Xuzheng, et al.
Published: (2024)
MoVieDrive: Urban Scene Synthesis with Multi-Modal Multi-View Video Diffusion Transformer
by: Wu, Guile, et al.
Published: (2025)
by: Wu, Guile, et al.
Published: (2025)
LoFi: Location-Aware Fine-Grained Representation Learning for Chest X-ray
by: Kang, Myeongkyun, et al.
Published: (2026)
by: Kang, Myeongkyun, et al.
Published: (2026)
Towards Commonsense Knowledge based Fuzzy Systems for Supporting Size-Related Fine-Grained Object Detection
by: Zhang, Pu, et al.
Published: (2023)
by: Zhang, Pu, et al.
Published: (2023)
Visual-Oriented Fine-Grained Knowledge Editing for MultiModal Large Language Models
by: Zeng, Zhen, et al.
Published: (2024)
by: Zeng, Zhen, et al.
Published: (2024)
FAVOR-Bench: A Comprehensive Benchmark for Fine-Grained Video Motion Understanding
by: Tu, Chongjun, et al.
Published: (2025)
by: Tu, Chongjun, et al.
Published: (2025)
UrbanGraphEmbeddings: Learning and Evaluating Spatially Grounded Multimodal Embeddings for Urban Science
by: Zhang, Jie, et al.
Published: (2026)
by: Zhang, Jie, et al.
Published: (2026)
Multi-modal Representations for Fine-grained Multi-label Critical View of Safety Recognition
by: Baby, Britty, et al.
Published: (2025)
by: Baby, Britty, et al.
Published: (2025)
Learning Relative Representations for Fine-Grained Multimodal Alignment with Limited Data
by: Kim, Shiwon, et al.
Published: (2026)
by: Kim, Shiwon, et al.
Published: (2026)
VERIFIED: A Video Corpus Moment Retrieval Benchmark for Fine-Grained Video Understanding
by: Chen, Houlun, et al.
Published: (2024)
by: Chen, Houlun, et al.
Published: (2024)
MEET: A Million-Scale Dataset for Fine-Grained Geospatial Scene Classification with Zoom-Free Remote Sensing Imagery
by: Li, Yansheng, et al.
Published: (2025)
by: Li, Yansheng, et al.
Published: (2025)
DEMO: Disentangled Motion Latent Flow Matching for Fine-Grained Controllable Talking Portrait Synthesis
by: Chen, Peiyin, et al.
Published: (2025)
by: Chen, Peiyin, et al.
Published: (2025)
ArmGS: Composite Gaussian Appearance Refinement for Modeling Dynamic Urban Environments
by: Wu, Guile, et al.
Published: (2025)
by: Wu, Guile, et al.
Published: (2025)
SpatialLLM: From Multi-modality Data to Urban Spatial Intelligence
by: Chen, Jiabin, et al.
Published: (2025)
by: Chen, Jiabin, et al.
Published: (2025)
EFF-Grasp: Energy-Field Flow Matching for Physics-Aware Dexterous Grasp Generation
by: Zhao, Yukun, et al.
Published: (2026)
by: Zhao, Yukun, et al.
Published: (2026)
Fine-Grained Representation Learning via Multi-Level Contrastive Learning without Class Priors
by: Jiang, Houwang, et al.
Published: (2024)
by: Jiang, Houwang, et al.
Published: (2024)
Decomposed Vision-Language Alignment for Fine-Grained Open-Vocabulary Segmentation
by: Wang, Chenhao, et al.
Published: (2026)
by: Wang, Chenhao, et al.
Published: (2026)
TSNet:A Two-stage Network for Image Dehazing with Multi-scale Fusion and Adaptive Learning
by: Gong, Xiaolin, et al.
Published: (2024)
by: Gong, Xiaolin, et al.
Published: (2024)
TrajFlow: Multi-modal Motion Prediction via Flow Matching
by: Yan, Qi, et al.
Published: (2025)
by: Yan, Qi, et al.
Published: (2025)
Granular Concept Circuits: Toward a Fine-Grained Circuit Discovery for Concept Representations
by: Kwon, Dahee, et al.
Published: (2025)
by: Kwon, Dahee, et al.
Published: (2025)
UrbanVLP: Multi-Granularity Vision-Language Pretraining for Urban Socioeconomic Indicator Prediction
by: Hao, Xixuan, et al.
Published: (2024)
by: Hao, Xixuan, et al.
Published: (2024)
Fast and Memory-Efficient Video Diffusion Using Streamlined Inference
by: Zhan, Zheng, et al.
Published: (2024)
by: Zhan, Zheng, et al.
Published: (2024)
Med-CMR: A Fine-Grained Benchmark Integrating Visual Evidence and Clinical Logic for Medical Complex Multimodal Reasoning
by: Gong, Haozhen, et al.
Published: (2025)
by: Gong, Haozhen, et al.
Published: (2025)
Progressively Exploring and Exploiting Inference Data to Break Fine-Grained Classification Barrier
by: Zhao, Li-Jun, et al.
Published: (2024)
by: Zhao, Li-Jun, et al.
Published: (2024)
Fine-Grained Knowledge Structuring and Retrieval for Visual Question Answering
by: Zhang, Zhengxuan, et al.
Published: (2025)
by: Zhang, Zhengxuan, et al.
Published: (2025)
Learning from Noisy Preferences: A Semi-Supervised Learning Approach to Direct Preference Optimization
by: Liu, Xinxin, et al.
Published: (2026)
by: Liu, Xinxin, et al.
Published: (2026)
Face-D(^2)CL: Multi-Domain Synergistic Representation with Dual Continual Learning for Facial DeepFake Detection
by: Zhang, Yushuo, et al.
Published: (2026)
by: Zhang, Yushuo, et al.
Published: (2026)
YOLO-pdd: A Novel Multi-scale PCB Defect Detection Method Using Deep Representations with Sequential Images
by: Liu, Bowen, et al.
Published: (2024)
by: Liu, Bowen, et al.
Published: (2024)
MUG-V 10B: High-efficiency Training Pipeline for Large Video Generation Models
by: Zhang, Yongshun, et al.
Published: (2025)
by: Zhang, Yongshun, et al.
Published: (2025)
Fine-Grained Domain Generalization with Feature Structuralization
by: Yu, Wenlong, et al.
Published: (2024)
by: Yu, Wenlong, et al.
Published: (2024)
Fine-Grained Multi-View Hand Reconstruction Using Inverse Rendering
by: Gan, Qijun, et al.
Published: (2024)
by: Gan, Qijun, et al.
Published: (2024)
FG-CLIP: Fine-Grained Visual and Textual Alignment
by: Xie, Chunyu, et al.
Published: (2025)
by: Xie, Chunyu, et al.
Published: (2025)
Fine-Grained Controllable Apparel Showcase Image Generation via Garment-Centric Outpainting
by: Zhang, Rong, et al.
Published: (2025)
by: Zhang, Rong, et al.
Published: (2025)
Similar Items
-
Multi-Head Encoding for Extreme Label Classification
by: Liang, Daojun, et al.
Published: (2024) -
Fine-Grained Traffic Inference from Road to Lane via Spatio-Temporal Graph Node Generation
by: Li, Shuhao, et al.
Published: (2025) -
3DBench: A Scalable 3D Benchmark and Instruction-Tuning Dataset
by: Zhang, Junjie, et al.
Published: (2024) -
PSReg: Prior-guided Sparse Mixture of Experts for Point Cloud Registration
by: Huang, Xiaoshui, et al.
Published: (2025) -
Fine-Grained Representation for Lane Topology Reasoning
by: Xu, Guoqing, et al.
Published: (2025)