Guardado en:
| Autores principales: | Sheng, Lei, Xu, Shuai-Shuai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2409.05125 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ALScope: A Unified Toolkit for Deep Active Learning
por: Wu, Chenkai, et al.
Publicado: (2025)
por: Wu, Chenkai, et al.
Publicado: (2025)
UniVS: Unified and Universal Video Segmentation with Prompts as Queries
por: Li, Minghan, et al.
Publicado: (2024)
por: Li, Minghan, et al.
Publicado: (2024)
Cross-view geo-localization, Image retrieval, Multiscale geometric modeling, Frequency domain enhancement
por: Zhang, Hongying, et al.
Publicado: (2026)
por: Zhang, Hongying, et al.
Publicado: (2026)
OmniParser: A Unified Framework for Text Spotting, Key Information Extraction and Table Recognition
por: Wan, Jianqiang, et al.
Publicado: (2024)
por: Wan, Jianqiang, et al.
Publicado: (2024)
Self-Supervised Skeleton-Based Action Representation Learning: A Benchmark and Beyond
por: Zhang, Jiahang, et al.
Publicado: (2024)
por: Zhang, Jiahang, et al.
Publicado: (2024)
Active Learning for Multilingual Fingerspelling Corpora
por: Wang, Shuai, et al.
Publicado: (2023)
por: Wang, Shuai, et al.
Publicado: (2023)
Student Classroom Behavior Recognition Based on Improved YOLOv8s
por: Gao, Xiang, et al.
Publicado: (2026)
por: Gao, Xiang, et al.
Publicado: (2026)
MSCI: Addressing CLIP's Inherent Limitations for Compositional Zero-Shot Learning
por: Wang, Yue, et al.
Publicado: (2025)
por: Wang, Yue, et al.
Publicado: (2025)
GCT: Graph Co-Training for Semi-Supervised Few-Shot Learning
por: Xu, Rui, et al.
Publicado: (2022)
por: Xu, Rui, et al.
Publicado: (2022)
CPiRi: Channel Permutation-Invariant Relational Interaction for Multivariate Time Series Forecasting
por: Xu, Jiyuan, et al.
Publicado: (2026)
por: Xu, Jiyuan, et al.
Publicado: (2026)
Absolute-Unified Multi-Class Anomaly Detection via Class-Agnostic Distribution Alignment
por: Guo, Jia, et al.
Publicado: (2024)
por: Guo, Jia, et al.
Publicado: (2024)
The Evolution of Video Anomaly Detection: A Unified Framework from DNN to MLLM
por: Gao, Shibo, et al.
Publicado: (2025)
por: Gao, Shibo, et al.
Publicado: (2025)
Post-Processing Mask-Based Table Segmentation for Structural Coordinate Extraction
por: Bandara, Suren
Publicado: (2025)
por: Bandara, Suren
Publicado: (2025)
Wave-Particle (Continuous-Discrete) Dualistic Visual Tokenization for Unified Understanding and Generation
por: Chen, Yizhu, et al.
Publicado: (2025)
por: Chen, Yizhu, et al.
Publicado: (2025)
Financial Table Extraction in Image Documents
por: Watson, William, et al.
Publicado: (2024)
por: Watson, William, et al.
Publicado: (2024)
Forgedit: Text Guided Image Editing via Learning and Forgetting
por: Zhang, Shiwen, et al.
Publicado: (2023)
por: Zhang, Shiwen, et al.
Publicado: (2023)
EffectMaker: Unifying Reasoning and Generation for Customized Visual Effect Creation
por: Yang, Shiyuan, et al.
Publicado: (2026)
por: Yang, Shiyuan, et al.
Publicado: (2026)
CASP: Few-Shot Class-Incremental Learning with CLS Token Attention Steering Prompts
por: Huang, Shuai, et al.
Publicado: (2026)
por: Huang, Shuai, et al.
Publicado: (2026)
PhysRVG: Physics-Aware Unified Reinforcement Learning for Video Generative Models
por: Zhang, Qiyuan, et al.
Publicado: (2026)
por: Zhang, Qiyuan, et al.
Publicado: (2026)
Unleashing the Power of Pre-trained Encoders for Universal Adversarial Attack Detection
por: Zhang, Yinghe, et al.
Publicado: (2025)
por: Zhang, Yinghe, et al.
Publicado: (2025)
EduStory: A Unified Framework for Pedagogically-Consistent Multi-Shot STEM Instructional Video Generation
por: Wu, Xinyi, et al.
Publicado: (2026)
por: Wu, Xinyi, et al.
Publicado: (2026)
Backbones-Review: Feature Extraction Networks for Deep Learning and Deep Reinforcement Learning Approaches
por: Elharrouss, Omar, et al.
Publicado: (2022)
por: Elharrouss, Omar, et al.
Publicado: (2022)
EDTalk++: Full Disentanglement for Controllable Talking Head Synthesis
por: Tan, Shuai, et al.
Publicado: (2025)
por: Tan, Shuai, et al.
Publicado: (2025)
UniDWM: Towards a Unified Driving World Model via Multifaceted Representation Learning
por: Liu, Shuai, et al.
Publicado: (2026)
por: Liu, Shuai, et al.
Publicado: (2026)
UniTable: Towards a Unified Framework for Table Recognition via Self-Supervised Pretraining
por: Peng, ShengYun, et al.
Publicado: (2024)
por: Peng, ShengYun, et al.
Publicado: (2024)
Slimmable Networks for Contrastive Self-supervised Learning
por: Zhao, Shuai, et al.
Publicado: (2022)
por: Zhao, Shuai, et al.
Publicado: (2022)
PROFIT: A Specialized Optimizer for Deep Fine Tuning
por: Chakravarthy, Anirudh S, et al.
Publicado: (2024)
por: Chakravarthy, Anirudh S, et al.
Publicado: (2024)
Random Registers for Cross-Domain Few-Shot Learning
por: Yi, Shuai, et al.
Publicado: (2025)
por: Yi, Shuai, et al.
Publicado: (2025)
Open Vocabulary 3D Scene Understanding via Geometry Guided Self-Distillation
por: Wang, Pengfei, et al.
Publicado: (2024)
por: Wang, Pengfei, et al.
Publicado: (2024)
Self-Supervised High Dynamic Range Imaging with Multi-Exposure Images in Dynamic Scenes
por: Zhang, Zhilu, et al.
Publicado: (2023)
por: Zhang, Zhilu, et al.
Publicado: (2023)
One Dinomaly2 Detect Them All: A Unified Framework for Full-Spectrum Unsupervised Anomaly Detection
por: Guo, Jia, et al.
Publicado: (2025)
por: Guo, Jia, et al.
Publicado: (2025)
Revisiting Continuity of Image Tokens for Cross-domain Few-shot Learning
por: Yi, Shuai, et al.
Publicado: (2025)
por: Yi, Shuai, et al.
Publicado: (2025)
High-Precision Fabric Defect Detection via Adaptive Shape Convolutions and Large Kernel Spatial Modeling
por: Wang, Shuai, et al.
Publicado: (2025)
por: Wang, Shuai, et al.
Publicado: (2025)
Language-based Image Colorization: A Benchmark and Beyond
por: Li, Yifan, et al.
Publicado: (2025)
por: Li, Yifan, et al.
Publicado: (2025)
Learning a Neural Association Network for Self-supervised Multi-Object Tracking
por: Li, Shuai, et al.
Publicado: (2024)
por: Li, Shuai, et al.
Publicado: (2024)
UniD-Shift: Towards Unified Semantic Segmentation via Interpretable Share-Private Multimodal Decomposition
por: Zhang, Shuai, et al.
Publicado: (2026)
por: Zhang, Shuai, et al.
Publicado: (2026)
Addressing Exacerbated Attention Sink for Source-Free Cross-Domain Few-Shot Learning
por: Yi, Shuai, et al.
Publicado: (2026)
por: Yi, Shuai, et al.
Publicado: (2026)
Multi-scale Semantic Prior Features Guided Deep Neural Network for Urban Street-view Image
por: Zeng, Jianshun, et al.
Publicado: (2024)
por: Zeng, Jianshun, et al.
Publicado: (2024)
Improving CLIP Adaptation by Breaking Tail Alignment for Source-Free Cross-Domain Few-Shot Learning
por: Yi, Shuai, et al.
Publicado: (2026)
por: Yi, Shuai, et al.
Publicado: (2026)
Uni-MuMER: Unified Multi-Task Fine-Tuning of Vision-Language Model for Handwritten Mathematical Expression Recognition
por: Li, Yu, et al.
Publicado: (2025)
por: Li, Yu, et al.
Publicado: (2025)
Ejemplares similares
-
ALScope: A Unified Toolkit for Deep Active Learning
por: Wu, Chenkai, et al.
Publicado: (2025) -
UniVS: Unified and Universal Video Segmentation with Prompts as Queries
por: Li, Minghan, et al.
Publicado: (2024) -
Cross-view geo-localization, Image retrieval, Multiscale geometric modeling, Frequency domain enhancement
por: Zhang, Hongying, et al.
Publicado: (2026) -
OmniParser: A Unified Framework for Text Spotting, Key Information Extraction and Table Recognition
por: Wan, Jianqiang, et al.
Publicado: (2024) -
Self-Supervised Skeleton-Based Action Representation Learning: A Benchmark and Beyond
por: Zhang, Jiahang, et al.
Publicado: (2024)