Guardado en:
| Autores principales: | Liu, Sheng-Lan, Ding, Yu-Ning, Yan, Gang, Zhang, Si-Fan, Zhang, Jin-Rong, Chen, Wen-Yue, Xu, Xue-Hai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2307.02730 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
YourSkatingCoach: A Figure Skating Video Benchmark for Fine-Grained Element Analysis
por: Chen, Wei-Yi, et al.
Publicado: (2024)
por: Chen, Wei-Yi, et al.
Publicado: (2024)
Multi-modal Instruction Tuned LLMs with Fine-grained Visual Perception
por: He, Junwen, et al.
Publicado: (2024)
por: He, Junwen, et al.
Publicado: (2024)
Tokenization, Fusion, and Augmentation: Towards Fine-grained Multi-modal Entity Representation
por: Zhang, Yichi, et al.
Publicado: (2024)
por: Zhang, Yichi, et al.
Publicado: (2024)
Multi-modal Retrieval Augmented Multi-modal Generation: Datasets, Evaluation Metrics and Strong Baselines
por: Ma, Zi-Ao, et al.
Publicado: (2024)
por: Ma, Zi-Ao, et al.
Publicado: (2024)
$M^3EL$: A Multi-task Multi-topic Dataset for Multi-modal Entity Linking
por: Wang, Fang, et al.
Publicado: (2024)
por: Wang, Fang, et al.
Publicado: (2024)
Every Little Helps: Building Knowledge Graph Foundation Model with Fine-grained Transferable Multi-modal Tokens
por: Zhang, Yichi, et al.
Publicado: (2026)
por: Zhang, Yichi, et al.
Publicado: (2026)
Multi-modal Reference Learning for Fine-grained Text-to-Image Retrieval
por: Ma, Zehong, et al.
Publicado: (2025)
por: Ma, Zehong, et al.
Publicado: (2025)
Enhancing Web Service Anomaly Detection via Fine-grained Multi-modal Association and Frequency Domain Analysis
por: Yang, Xixuan, et al.
Publicado: (2025)
por: Yang, Xixuan, et al.
Publicado: (2025)
Enhancing Multi-modal Models with Heterogeneous MoE Adapters for Fine-tuning
por: Zhou, Sashuai, et al.
Publicado: (2025)
por: Zhou, Sashuai, et al.
Publicado: (2025)
FSBench: A Figure Skating Benchmark for Advancing Artistic Sports Understanding
por: Gao, Rong, et al.
Publicado: (2025)
por: Gao, Rong, et al.
Publicado: (2025)
MMHead: Towards Fine-grained Multi-modal 3D Facial Animation
por: Wu, Sijing, et al.
Publicado: (2024)
por: Wu, Sijing, et al.
Publicado: (2024)
3D Pose-Based Temporal Action Segmentation for Figure Skating: A Fine-Grained and Jump Procedure-Aware Annotation Approach
por: Tanaka, Ryota, et al.
Publicado: (2024)
por: Tanaka, Ryota, et al.
Publicado: (2024)
Fine-grained Knowledge Graph-driven Video-Language Learning for Action Recognition
por: Zhang, Rui, et al.
Publicado: (2024)
por: Zhang, Rui, et al.
Publicado: (2024)
VIFSS: View-Invariant and Figure Skating-Specific Pose Representation Learning for Temporal Action Segmentation
por: Tanaka, Ryota, et al.
Publicado: (2025)
por: Tanaka, Ryota, et al.
Publicado: (2025)
MFCLIP: Multi-modal Fine-grained CLIP for Generalizable Diffusion Face Forgery Detection
por: Zhang, Yaning, et al.
Publicado: (2024)
por: Zhang, Yaning, et al.
Publicado: (2024)
Fine-grained Context and Multi-modal Alignment for Freehand 3D Ultrasound Reconstruction
por: Yan, Zhongnuo, et al.
Publicado: (2024)
por: Yan, Zhongnuo, et al.
Publicado: (2024)
FineSkiing: A Fine-grained Benchmark for Skiing Action Quality Assessment
por: Zhang, Yongji, et al.
Publicado: (2025)
por: Zhang, Yongji, et al.
Publicado: (2025)
Multi-modal Representations for Fine-grained Multi-label Critical View of Safety Recognition
por: Baby, Britty, et al.
Publicado: (2025)
por: Baby, Britty, et al.
Publicado: (2025)
WHU-STree: A Multi-modal Benchmark Dataset for Street Tree Inventory
por: Ding, Ruifei, et al.
Publicado: (2025)
por: Ding, Ruifei, et al.
Publicado: (2025)
TaskGalaxy: Scaling Multi-modal Instruction Fine-tuning with Tens of Thousands Vision Task Types
por: Chen, Jiankang, et al.
Publicado: (2025)
por: Chen, Jiankang, et al.
Publicado: (2025)
Learning Long-Range Action Representation by Two-Stream Mamba Pyramid Network for Figure Skating Assessment
por: Wang, Fengshun, et al.
Publicado: (2025)
por: Wang, Fengshun, et al.
Publicado: (2025)
Advancing Single and Multi-task Text Classification through Large Language Model Fine-tuning
por: Zhao, Hang, et al.
Publicado: (2024)
por: Zhao, Hang, et al.
Publicado: (2024)
Multi-task Cross-modal Learning for Chest X-ray Image Retrieval
por: Liang, Zhaohui, et al.
Publicado: (2026)
por: Liang, Zhaohui, et al.
Publicado: (2026)
Fine-grained Multiple Supervisory Network for Multi-modal Manipulation Detecting and Grounding
por: Yu, Xinquan, et al.
Publicado: (2025)
por: Yu, Xinquan, et al.
Publicado: (2025)
BFA: Best-Feature-Aware Fusion for Multi-View Fine-grained Manipulation
por: Lan, Zihan, et al.
Publicado: (2025)
por: Lan, Zihan, et al.
Publicado: (2025)
MulCPred: Learning Multi-modal Concepts for Explainable Pedestrian Action Prediction
por: Feng, Yan, et al.
Publicado: (2024)
por: Feng, Yan, et al.
Publicado: (2024)
Multi-modal Data Spectrum: Multi-modal Datasets are Multi-dimensional
por: Madaan, Divyam, et al.
Publicado: (2025)
por: Madaan, Divyam, et al.
Publicado: (2025)
SkateFormer: Skeletal-Temporal Transformer for Human Action Recognition
por: Do, Jeonghyeok, et al.
Publicado: (2024)
por: Do, Jeonghyeok, et al.
Publicado: (2024)
Skate/worlds
Publicado: (2025)
Publicado: (2025)
Autoregressive Enzyme Function Prediction with Multi-scale Multi-modality Fusion
por: Rong, Dingyi, et al.
Publicado: (2024)
por: Rong, Dingyi, et al.
Publicado: (2024)
FineCLIPER: Multi-modal Fine-grained CLIP for Dynamic Facial Expression Recognition with AdaptERs
por: Chen, Haodong, et al.
Publicado: (2024)
por: Chen, Haodong, et al.
Publicado: (2024)
Multi-level and Multi-modal Action Anticipation
por: Kim, Seulgi, et al.
Publicado: (2025)
por: Kim, Seulgi, et al.
Publicado: (2025)
Oracle Bone Inscriptions Multi-modal Dataset
por: Li, Bang, et al.
Publicado: (2024)
por: Li, Bang, et al.
Publicado: (2024)
Multi-task Prompt Words Learning for Social Media Content Generation
por: Xue, Haochen, et al.
Publicado: (2024)
por: Xue, Haochen, et al.
Publicado: (2024)
Delving into Multi-modal Multi-task Foundation Models for Road Scene Understanding: From Learning Paradigm Perspectives
por: Luo, Sheng, et al.
Publicado: (2024)
por: Luo, Sheng, et al.
Publicado: (2024)
High-level Codes and Fine-grained Weights for Online Multi-modal Hashing Retrieval
por: Zhan, Yu-Wei, et al.
Publicado: (2024)
por: Zhan, Yu-Wei, et al.
Publicado: (2024)
Progressive Multi-task Anti-Noise Learning and Distilling Frameworks for Fine-grained Vehicle Recognition
por: Liu, Dichao
Publicado: (2024)
por: Liu, Dichao
Publicado: (2024)
Multi-task Visual Grounding with Coarse-to-Fine Consistency Constraints
por: Dai, Ming, et al.
Publicado: (2025)
por: Dai, Ming, et al.
Publicado: (2025)
Multi-modal, Multi-task, Multi-criteria Automatic Evaluation with Vision Language Models
por: Ohi, Masanari, et al.
Publicado: (2024)
por: Ohi, Masanari, et al.
Publicado: (2024)
Multi‐modality multiorgan image segmentation using continual learning with enhanced hard attention to the task
por: Ming‐Long Wu, et al.
Publicado: (2025)
por: Ming‐Long Wu, et al.
Publicado: (2025)
Ejemplares similares
-
YourSkatingCoach: A Figure Skating Video Benchmark for Fine-Grained Element Analysis
por: Chen, Wei-Yi, et al.
Publicado: (2024) -
Multi-modal Instruction Tuned LLMs with Fine-grained Visual Perception
por: He, Junwen, et al.
Publicado: (2024) -
Tokenization, Fusion, and Augmentation: Towards Fine-grained Multi-modal Entity Representation
por: Zhang, Yichi, et al.
Publicado: (2024) -
Multi-modal Retrieval Augmented Multi-modal Generation: Datasets, Evaluation Metrics and Strong Baselines
por: Ma, Zi-Ao, et al.
Publicado: (2024) -
$M^3EL$: A Multi-task Multi-topic Dataset for Multi-modal Entity Linking
por: Wang, Fang, et al.
Publicado: (2024)