Cross-domain Multi-step Thinking: Zero-shot Fine-grained Traffic Sign Recognition in the Wild
Fuente:
arXiv
Guardado en:
| Autores principales: | Gan, Yaozong, Li, Guang, Togo, Ren, Maeda, Keisuke, Ogawa, Takahiro, Haseyama, Miki |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Cross-domain Few-shot In-context Learning for Enhancing Traffic Sign Recognition
por: Gan, Yaozong, et al.
Publicado: (2024)
por: Gan, Yaozong, et al.
Publicado: (2024)
Reinforcing Pre-trained Models Using Counterfactual Images
por: Li, Xiang, et al.
Publicado: (2024)
por: Li, Xiang, et al.
Publicado: (2024)
Decoupled Audio-Visual Dataset Distillation
por: Li, Wenyuan, et al.
Publicado: (2025)
por: Li, Wenyuan, et al.
Publicado: (2025)
Enhancing Generative Class Incremental Learning Performance with Model Forgetting Approach
por: Togo, Taro, et al.
Publicado: (2024)
por: Togo, Taro, et al.
Publicado: (2024)
Objectness Similarity: Capturing Object-Level Fidelity in 3D Scene Evaluation
por: Uchida, Yuiko, et al.
Publicado: (2025)
por: Uchida, Yuiko, et al.
Publicado: (2025)
Generative Dataset Distillation Based on Self-knowledge Distillation
por: Li, Longzhen, et al.
Publicado: (2025)
por: Li, Longzhen, et al.
Publicado: (2025)
Generative Dataset Distillation: Balancing Global Structure and Local Details
por: Li, Longzhen, et al.
Publicado: (2024)
por: Li, Longzhen, et al.
Publicado: (2024)
Foreground-Aware Dataset Distillation via Dynamic Patch Selection
por: Li, Longzhen, et al.
Publicado: (2026)
por: Li, Longzhen, et al.
Publicado: (2026)
Zero-shot Composed Image Retrieval Considering Query-target Relationship Leveraging Masked Image-text Pairs
por: Zhang, Huaying, et al.
Publicado: (2024)
por: Zhang, Huaying, et al.
Publicado: (2024)
Soft-Label Anonymous Gastric X-ray Image Distillation
por: Li, Guang, et al.
Publicado: (2021)
por: Li, Guang, et al.
Publicado: (2021)
Importance-Aware Adaptive Dataset Distillation
por: Li, Guang, et al.
Publicado: (2024)
por: Li, Guang, et al.
Publicado: (2024)
RGMIM: Region-Guided Masked Image Modeling for Learning Meaningful Representations from X-Ray Images
por: Li, Guang, et al.
Publicado: (2022)
por: Li, Guang, et al.
Publicado: (2022)
Few-shot Personalized Saliency Prediction Based on Interpersonal Gaze Patterns
por: Moroto, Yuya, et al.
Publicado: (2023)
por: Moroto, Yuya, et al.
Publicado: (2023)
Adaptive Shared Experts with LoRA-Based Mixture of Experts for Multi-Task Learning
por: Yang, Minghao, et al.
Publicado: (2025)
por: Yang, Minghao, et al.
Publicado: (2025)
L2R: Low-Rank and Lipschitz-Controlled Routing for Mixture-of-Experts
por: Yang, Minghao, et al.
Publicado: (2026)
por: Yang, Minghao, et al.
Publicado: (2026)
Which Client is Reliable?: A Reliable and Personalized Prompt-based Federated Learning for Medical Image Question Answering
por: Zhu, He, et al.
Publicado: (2024)
por: Zhu, He, et al.
Publicado: (2024)
Prompt-based Personalized Federated Learning for Medical Visual Question Answering
por: Zhu, He, et al.
Publicado: (2024)
por: Zhu, He, et al.
Publicado: (2024)
LLM is Knowledge Graph Reasoner: LLM's Intuition-aware Knowledge Graph Reasoning for Cold-start Sequential Recommendation
por: Sakurai, Keigo, et al.
Publicado: (2024)
por: Sakurai, Keigo, et al.
Publicado: (2024)
Fine-grained Knowledge Graph-driven Video-Language Learning for Action Recognition
por: Zhang, Rui, et al.
Publicado: (2024)
por: Zhang, Rui, et al.
Publicado: (2024)
AFL-Net: Integrating Audio, Facial, and Lip Modalities with a Two-step Cross-attention for Robust Speaker Diarization in the Wild
por: Yin, Yongkang, et al.
Publicado: (2023)
por: Yin, Yongkang, et al.
Publicado: (2023)
Predictive but Not Plannable: RC-aux for Latent World Models
por: Li, Wenyuan, et al.
Publicado: (2026)
por: Li, Wenyuan, et al.
Publicado: (2026)
Hyperbolic Dataset Distillation
por: Li, Wenyuan, et al.
Publicado: (2025)
por: Li, Wenyuan, et al.
Publicado: (2025)
StarMAP: Global Neighbor Embedding for Faithful Data Visualization
por: Watanabe, Koshi, et al.
Publicado: (2025)
por: Watanabe, Koshi, et al.
Publicado: (2025)
Personalized Federated Learning for Egocentric Video Gaze Estimation with Comprehensive Parameter Frezzing
por: Feng, Yuhu, et al.
Publicado: (2025)
por: Feng, Yuhu, et al.
Publicado: (2025)
Hyperboloid GPLVM for Discovering Continuous Hierarchies via Nonparametric Estimation
por: Watanabe, Koshi, et al.
Publicado: (2024)
por: Watanabe, Koshi, et al.
Publicado: (2024)
Discrete Prompt Tuning via Recursive Utilization of Black-box Multimodal Large Language Model for Personalized Visual Emotion Recognition
por: Takahashi, Ryo, et al.
Publicado: (2025)
por: Takahashi, Ryo, et al.
Publicado: (2025)
High-level Codes and Fine-grained Weights for Online Multi-modal Hashing Retrieval
por: Zhan, Yu-Wei, et al.
Publicado: (2024)
por: Zhan, Yu-Wei, et al.
Publicado: (2024)
Dual-Model Weight Selection and Self-Knowledge Distillation for Medical Image Classification
por: Tsutsumi, Ayaka, et al.
Publicado: (2025)
por: Tsutsumi, Ayaka, et al.
Publicado: (2025)
MMT-BERT: Chord-aware Symbolic Music Generation Based on Multitrack Music Transformer and MusicBERT
por: Zhu, Jinlong, et al.
Publicado: (2024)
por: Zhu, Jinlong, et al.
Publicado: (2024)
Towards Alleviating Text-to-Image Retrieval Hallucination for CLIP in Zero-shot Learning
por: Wang, Hanyao, et al.
Publicado: (2024)
por: Wang, Hanyao, et al.
Publicado: (2024)
GPT-4V with Emotion: A Zero-shot Benchmark for Generalized Emotion Recognition
por: Lian, Zheng, et al.
Publicado: (2023)
por: Lian, Zheng, et al.
Publicado: (2023)
Fine-grained Textual Inversion Network for Zero-Shot Composed Image Retrieval
por: Lin, Haoqiang, et al.
Publicado: (2025)
por: Lin, Haoqiang, et al.
Publicado: (2025)
Generalized Jersey Number Recognition Using Multi-task Learning With Orientation-guided Weight Refinement
por: Lin, Yung-Hui, et al.
Publicado: (2024)
por: Lin, Yung-Hui, et al.
Publicado: (2024)
CDI-DTI: A Strong Cross-domain Interpretable Drug-Target Interaction Prediction Framework Based on Multi-Strategy Fusion
por: Li, Xiangyu, et al.
Publicado: (2025)
por: Li, Xiangyu, et al.
Publicado: (2025)
CLAIP-Emo: Parameter-Efficient Adaptation of Language-supervised models for In-the-Wild Audiovisual Emotion Recognition
por: Chen, Yin, et al.
Publicado: (2025)
por: Chen, Yin, et al.
Publicado: (2025)
GAIA: Zero-shot Talking Avatar Generation
por: He, Tianyu, et al.
Publicado: (2023)
por: He, Tianyu, et al.
Publicado: (2023)
Triplet Synthesis For Enhancing Composed Image Retrieval via Counterfactual Image Generation
por: Uesugi, Kenta, et al.
Publicado: (2025)
por: Uesugi, Kenta, et al.
Publicado: (2025)
FineBadminton: A Multi-Level Dataset for Fine-Grained Badminton Video Understanding
por: He, Xusheng, et al.
Publicado: (2025)
por: He, Xusheng, et al.
Publicado: (2025)
Modularized Zero-shot VQA with Pre-trained Models
por: Cao, Rui, et al.
Publicado: (2023)
por: Cao, Rui, et al.
Publicado: (2023)
Generative Dataset Distillation Based on Diffusion Model
por: Su, Duo, et al.
Publicado: (2024)
por: Su, Duo, et al.
Publicado: (2024)
Ejemplares similares
-
Cross-domain Few-shot In-context Learning for Enhancing Traffic Sign Recognition
por: Gan, Yaozong, et al.
Publicado: (2024) -
Reinforcing Pre-trained Models Using Counterfactual Images
por: Li, Xiang, et al.
Publicado: (2024) -
Decoupled Audio-Visual Dataset Distillation
por: Li, Wenyuan, et al.
Publicado: (2025) -
Enhancing Generative Class Incremental Learning Performance with Model Forgetting Approach
por: Togo, Taro, et al.
Publicado: (2024) -
Objectness Similarity: Capturing Object-Level Fidelity in 3D Scene Evaluation
por: Uchida, Yuiko, et al.
Publicado: (2025)