Guardado en:
| Autores principales: | Yuan, Shilu, Li, Dongfeng, Liu, Wei, Zhang, Xinxin, Chen, Meng, Zhang, Junjie, Gong, Yongshun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2406.09710 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Multi-Head Encoding for Extreme Label Classification
por: Liang, Daojun, et al.
Publicado: (2024)
por: Liang, Daojun, et al.
Publicado: (2024)
Fine-Grained Traffic Inference from Road to Lane via Spatio-Temporal Graph Node Generation
por: Li, Shuhao, et al.
Publicado: (2025)
por: Li, Shuhao, et al.
Publicado: (2025)
3DBench: A Scalable 3D Benchmark and Instruction-Tuning Dataset
por: Zhang, Junjie, et al.
Publicado: (2024)
por: Zhang, Junjie, et al.
Publicado: (2024)
PSReg: Prior-guided Sparse Mixture of Experts for Point Cloud Registration
por: Huang, Xiaoshui, et al.
Publicado: (2025)
por: Huang, Xiaoshui, et al.
Publicado: (2025)
Fine-Grained Representation for Lane Topology Reasoning
por: Xu, Guoqing, et al.
Publicado: (2025)
por: Xu, Guoqing, et al.
Publicado: (2025)
AIFIND: Artifact-Aware Interpreting Fine-Grained Alignment for Incremental Face Forgery Detection
por: Wang, Hao, et al.
Publicado: (2026)
por: Wang, Hao, et al.
Publicado: (2026)
CGC: Compositional Grounded Contrast for Fine-Grained Multi-Image Understanding
por: Zheng, Lihao, et al.
Publicado: (2026)
por: Zheng, Lihao, et al.
Publicado: (2026)
Knowledge-enhanced Multi-perspective Video Representation Learning for Scene Recognition
por: Yu, Xuzheng, et al.
Publicado: (2024)
por: Yu, Xuzheng, et al.
Publicado: (2024)
MoVieDrive: Urban Scene Synthesis with Multi-Modal Multi-View Video Diffusion Transformer
por: Wu, Guile, et al.
Publicado: (2025)
por: Wu, Guile, et al.
Publicado: (2025)
LoFi: Location-Aware Fine-Grained Representation Learning for Chest X-ray
por: Kang, Myeongkyun, et al.
Publicado: (2026)
por: Kang, Myeongkyun, et al.
Publicado: (2026)
Towards Commonsense Knowledge based Fuzzy Systems for Supporting Size-Related Fine-Grained Object Detection
por: Zhang, Pu, et al.
Publicado: (2023)
por: Zhang, Pu, et al.
Publicado: (2023)
Visual-Oriented Fine-Grained Knowledge Editing for MultiModal Large Language Models
por: Zeng, Zhen, et al.
Publicado: (2024)
por: Zeng, Zhen, et al.
Publicado: (2024)
FAVOR-Bench: A Comprehensive Benchmark for Fine-Grained Video Motion Understanding
por: Tu, Chongjun, et al.
Publicado: (2025)
por: Tu, Chongjun, et al.
Publicado: (2025)
UrbanGraphEmbeddings: Learning and Evaluating Spatially Grounded Multimodal Embeddings for Urban Science
por: Zhang, Jie, et al.
Publicado: (2026)
por: Zhang, Jie, et al.
Publicado: (2026)
Multi-modal Representations for Fine-grained Multi-label Critical View of Safety Recognition
por: Baby, Britty, et al.
Publicado: (2025)
por: Baby, Britty, et al.
Publicado: (2025)
Learning Relative Representations for Fine-Grained Multimodal Alignment with Limited Data
por: Kim, Shiwon, et al.
Publicado: (2026)
por: Kim, Shiwon, et al.
Publicado: (2026)
VERIFIED: A Video Corpus Moment Retrieval Benchmark for Fine-Grained Video Understanding
por: Chen, Houlun, et al.
Publicado: (2024)
por: Chen, Houlun, et al.
Publicado: (2024)
MEET: A Million-Scale Dataset for Fine-Grained Geospatial Scene Classification with Zoom-Free Remote Sensing Imagery
por: Li, Yansheng, et al.
Publicado: (2025)
por: Li, Yansheng, et al.
Publicado: (2025)
DEMO: Disentangled Motion Latent Flow Matching for Fine-Grained Controllable Talking Portrait Synthesis
por: Chen, Peiyin, et al.
Publicado: (2025)
por: Chen, Peiyin, et al.
Publicado: (2025)
ArmGS: Composite Gaussian Appearance Refinement for Modeling Dynamic Urban Environments
por: Wu, Guile, et al.
Publicado: (2025)
por: Wu, Guile, et al.
Publicado: (2025)
SpatialLLM: From Multi-modality Data to Urban Spatial Intelligence
por: Chen, Jiabin, et al.
Publicado: (2025)
por: Chen, Jiabin, et al.
Publicado: (2025)
EFF-Grasp: Energy-Field Flow Matching for Physics-Aware Dexterous Grasp Generation
por: Zhao, Yukun, et al.
Publicado: (2026)
por: Zhao, Yukun, et al.
Publicado: (2026)
Fine-Grained Representation Learning via Multi-Level Contrastive Learning without Class Priors
por: Jiang, Houwang, et al.
Publicado: (2024)
por: Jiang, Houwang, et al.
Publicado: (2024)
Decomposed Vision-Language Alignment for Fine-Grained Open-Vocabulary Segmentation
por: Wang, Chenhao, et al.
Publicado: (2026)
por: Wang, Chenhao, et al.
Publicado: (2026)
TSNet:A Two-stage Network for Image Dehazing with Multi-scale Fusion and Adaptive Learning
por: Gong, Xiaolin, et al.
Publicado: (2024)
por: Gong, Xiaolin, et al.
Publicado: (2024)
TrajFlow: Multi-modal Motion Prediction via Flow Matching
por: Yan, Qi, et al.
Publicado: (2025)
por: Yan, Qi, et al.
Publicado: (2025)
Granular Concept Circuits: Toward a Fine-Grained Circuit Discovery for Concept Representations
por: Kwon, Dahee, et al.
Publicado: (2025)
por: Kwon, Dahee, et al.
Publicado: (2025)
UrbanVLP: Multi-Granularity Vision-Language Pretraining for Urban Socioeconomic Indicator Prediction
por: Hao, Xixuan, et al.
Publicado: (2024)
por: Hao, Xixuan, et al.
Publicado: (2024)
Fast and Memory-Efficient Video Diffusion Using Streamlined Inference
por: Zhan, Zheng, et al.
Publicado: (2024)
por: Zhan, Zheng, et al.
Publicado: (2024)
Med-CMR: A Fine-Grained Benchmark Integrating Visual Evidence and Clinical Logic for Medical Complex Multimodal Reasoning
por: Gong, Haozhen, et al.
Publicado: (2025)
por: Gong, Haozhen, et al.
Publicado: (2025)
Progressively Exploring and Exploiting Inference Data to Break Fine-Grained Classification Barrier
por: Zhao, Li-Jun, et al.
Publicado: (2024)
por: Zhao, Li-Jun, et al.
Publicado: (2024)
Fine-Grained Knowledge Structuring and Retrieval for Visual Question Answering
por: Zhang, Zhengxuan, et al.
Publicado: (2025)
por: Zhang, Zhengxuan, et al.
Publicado: (2025)
Learning from Noisy Preferences: A Semi-Supervised Learning Approach to Direct Preference Optimization
por: Liu, Xinxin, et al.
Publicado: (2026)
por: Liu, Xinxin, et al.
Publicado: (2026)
Face-D(^2)CL: Multi-Domain Synergistic Representation with Dual Continual Learning for Facial DeepFake Detection
por: Zhang, Yushuo, et al.
Publicado: (2026)
por: Zhang, Yushuo, et al.
Publicado: (2026)
YOLO-pdd: A Novel Multi-scale PCB Defect Detection Method Using Deep Representations with Sequential Images
por: Liu, Bowen, et al.
Publicado: (2024)
por: Liu, Bowen, et al.
Publicado: (2024)
MUG-V 10B: High-efficiency Training Pipeline for Large Video Generation Models
por: Zhang, Yongshun, et al.
Publicado: (2025)
por: Zhang, Yongshun, et al.
Publicado: (2025)
Fine-Grained Domain Generalization with Feature Structuralization
por: Yu, Wenlong, et al.
Publicado: (2024)
por: Yu, Wenlong, et al.
Publicado: (2024)
Fine-Grained Multi-View Hand Reconstruction Using Inverse Rendering
por: Gan, Qijun, et al.
Publicado: (2024)
por: Gan, Qijun, et al.
Publicado: (2024)
FG-CLIP: Fine-Grained Visual and Textual Alignment
por: Xie, Chunyu, et al.
Publicado: (2025)
por: Xie, Chunyu, et al.
Publicado: (2025)
Fine-Grained Controllable Apparel Showcase Image Generation via Garment-Centric Outpainting
por: Zhang, Rong, et al.
Publicado: (2025)
por: Zhang, Rong, et al.
Publicado: (2025)
Ejemplares similares
-
Multi-Head Encoding for Extreme Label Classification
por: Liang, Daojun, et al.
Publicado: (2024) -
Fine-Grained Traffic Inference from Road to Lane via Spatio-Temporal Graph Node Generation
por: Li, Shuhao, et al.
Publicado: (2025) -
3DBench: A Scalable 3D Benchmark and Instruction-Tuning Dataset
por: Zhang, Junjie, et al.
Publicado: (2024) -
PSReg: Prior-guided Sparse Mixture of Experts for Point Cloud Registration
por: Huang, Xiaoshui, et al.
Publicado: (2025) -
Fine-Grained Representation for Lane Topology Reasoning
por: Xu, Guoqing, et al.
Publicado: (2025)