Saved in:
| Main Authors: | Chen, Jr-Jen, Liao, Yu-Chien, Lin, Hsi-Che, Yu, Yu-Chu, Chen, Yen-Chun, Wang, Yu-Chiang Frank |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2406.19392 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
EMLoC: Emulator-based Memory-efficient Fine-tuning with LoRA Correction
by: Lin, Hsi-Che, et al.
Published: (2025)
by: Lin, Hsi-Che, et al.
Published: (2025)
Continual Personalization for Diffusion Models
by: Liao, Yu-Chien, et al.
Published: (2025)
by: Liao, Yu-Chien, et al.
Published: (2025)
RobustVisRAG: Causality-Aware Vision-Based Retrieval-Augmented Generation under Visual Degradations
by: Chen, I-Hsiang, et al.
Published: (2026)
by: Chen, I-Hsiang, et al.
Published: (2026)
Few-Shot Semantic Segmentation Meets SAM3
by: Tsai, Yi-Jen, et al.
Published: (2026)
by: Tsai, Yi-Jen, et al.
Published: (2026)
VBench++: Comprehensive and Versatile Benchmark Suite for Video Generative Models
by: Huang, Ziqi, et al.
Published: (2024)
by: Huang, Ziqi, et al.
Published: (2024)
Resolution Enhancement Processing on Low Quality Images Using Swin Transformer Based on Interval Dense Connection Strategy
by: Ju, Rui-Yang, et al.
Published: (2023)
by: Ju, Rui-Yang, et al.
Published: (2023)
Select and Distill: Selective Dual-Teacher Knowledge Transfer for Continual Learning on Vision-Language Models
by: Yu, Yu-Chu, et al.
Published: (2024)
by: Yu, Yu-Chu, et al.
Published: (2024)
Three-stage binarization of color document images based on discrete wavelet transform and generative adversarial networks
by: Ju, Rui-Yang, et al.
Published: (2022)
by: Ju, Rui-Yang, et al.
Published: (2022)
TCMM: Token Constraint and Multi-Scale Memory Bank of Contrastive Learning for Unsupervised Person Re-identification
by: Zhu, Zheng-An, et al.
Published: (2025)
by: Zhu, Zheng-An, et al.
Published: (2025)
Strong Baseline: Multi-UAV Tracking via YOLOv12 with BoT-SORT-ReID
by: Chen, Yu-Hsi
Published: (2025)
by: Chen, Yu-Hsi
Published: (2025)
DaMO: A Data-Efficient Multimodal Orchestrator for Temporal Reasoning with Video LLMs
by: Chiu, Bo-Cheng, et al.
Published: (2025)
by: Chiu, Bo-Cheng, et al.
Published: (2025)
V-ReasonBench: Toward Unified Reasoning Benchmark Suite for Video Generation Models
by: Luo, Yang, et al.
Published: (2025)
by: Luo, Yang, et al.
Published: (2025)
R2SM: Referring and Reasoning for Selective Masks
by: Shih, Yu-Lin, et al.
Published: (2025)
by: Shih, Yu-Lin, et al.
Published: (2025)
YOLOv8-ResCBAM: YOLOv8 Based on An Effective Attention Module for Pediatric Wrist Fracture Detection
by: Ju, Rui-Yang, et al.
Published: (2024)
by: Ju, Rui-Yang, et al.
Published: (2024)
Temporal Prompting Matters: Rethinking Referring Video Object Segmentation
by: Lin, Ci-Siang, et al.
Published: (2025)
by: Lin, Ci-Siang, et al.
Published: (2025)
GroPrompt: Efficient Grounded Prompting and Adaptation for Referring Video Object Segmentation
by: Lin, Ci-Siang, et al.
Published: (2024)
by: Lin, Ci-Siang, et al.
Published: (2024)
Deep Learning-based Animal Behavior Analysis: Insights from Mouse Chronic Pain Models
by: Chen, Yu-Hsi, et al.
Published: (2025)
by: Chen, Yu-Hsi, et al.
Published: (2025)
3AM: 3egment Anything with Geometric Consistency in Videos
by: Sun, Yang-Che, et al.
Published: (2026)
by: Sun, Yang-Che, et al.
Published: (2026)
Global Context Modeling in YOLOv8 for Pediatric Wrist Fracture Detection
by: Ju, Rui-Yang, et al.
Published: (2024)
by: Ju, Rui-Yang, et al.
Published: (2024)
Semantic Prompt Learning for Weakly-Supervised Semantic Segmentation
by: Lin, Ci-Siang, et al.
Published: (2024)
by: Lin, Ci-Siang, et al.
Published: (2024)
Pediatric Wrist Fracture Detection Using Feature Context Excitation Modules in X-ray Images
by: Ju, Rui-Yang, et al.
Published: (2024)
by: Ju, Rui-Yang, et al.
Published: (2024)
ORFormer: Occlusion-Robust Transformer for Accurate Facial Landmark Detection
by: Chiang, Jui-Che, et al.
Published: (2024)
by: Chiang, Jui-Che, et al.
Published: (2024)
UAVDB: Point-Guided Masks for UAV Detection and Segmentation
by: Chen, Yu-Hsi
Published: (2024)
by: Chen, Yu-Hsi
Published: (2024)
Frequency Switching Mechanism for Parameter-E!cient Multi-Task Learning
by: Liu, Shih-Wen, et al.
Published: (2026)
by: Liu, Shih-Wen, et al.
Published: (2026)
LEAML: Label-Efficient Adaptation to Out-of-Distribution Visual Tasks for Multimodal Large Language Models
by: Lin, Ci-Siang, et al.
Published: (2025)
by: Lin, Ci-Siang, et al.
Published: (2025)
ViStoryBench: Comprehensive Benchmark Suite for Story Visualization
by: Zhuang, Cailin, et al.
Published: (2025)
by: Zhuang, Cailin, et al.
Published: (2025)
ReaMOT: A Benchmark and Framework for Reasoning-based Multi-Object Tracking
by: Chen, Sijia, et al.
Published: (2025)
by: Chen, Sijia, et al.
Published: (2025)
Towards Affordance-Aware Articulation Synthesis for Rigged Objects
by: Yu, Yu-Chu, et al.
Published: (2025)
by: Yu, Yu-Chu, et al.
Published: (2025)
VBench-2.0: Advancing Video Generation Benchmark Suite for Intrinsic Faithfulness
by: Zheng, Dian, et al.
Published: (2025)
by: Zheng, Dian, et al.
Published: (2025)
ExpVid: A Benchmark for Experiment Video Understanding & Reasoning
by: Xu, Yicheng, et al.
Published: (2025)
by: Xu, Yicheng, et al.
Published: (2025)
Data-Efficient 3D Visual Grounding via Order-Aware Referring
by: Wu, Tung-Yu, et al.
Published: (2024)
by: Wu, Tung-Yu, et al.
Published: (2024)
MotionMatcher: Motion Customization of Text-to-Video Diffusion Models via Motion Feature Matching
by: Wu, Yen-Siang, et al.
Published: (2025)
by: Wu, Yen-Siang, et al.
Published: (2025)
PCR-ORB: Enhanced ORB-SLAM3 with Point Cloud Refinement Using Deep Learning-Based Dynamic Object Filtering
by: Chen, Sheng-Kai, et al.
Published: (2025)
by: Chen, Sheng-Kai, et al.
Published: (2025)
VideoMage: Multi-Subject and Motion Customization of Text-to-Video Diffusion Models
by: Huang, Chi-Pin, et al.
Published: (2025)
by: Huang, Chi-Pin, et al.
Published: (2025)
Zoom-Zero: Reinforced Coarse-to-Fine Video Understanding via Temporal Zoom-in
by: Shen, Xiaoqian, et al.
Published: (2025)
by: Shen, Xiaoqian, et al.
Published: (2025)
Iterative Refinement Strategy for Automated Data Labeling: Facial Landmark Diagnosis in Medical Imaging
by: Chen, Yu-Hsi
Published: (2024)
by: Chen, Yu-Hsi
Published: (2024)
Data Stream Sampling with Fuzzy Task Boundaries and Noisy Labels
by: Chen, Yu-Hsi
Published: (2024)
by: Chen, Yu-Hsi
Published: (2024)
Efficient Convolutional Neural Networks on Raspberry Pi for Image Classification
by: Ju, Rui-Yang, et al.
Published: (2022)
by: Ju, Rui-Yang, et al.
Published: (2022)
Seeing Fast and Slow: Learning the Flow of Time in Videos
by: Wu, Yen-Siang, et al.
Published: (2026)
by: Wu, Yen-Siang, et al.
Published: (2026)
TANet: Triplet Attention Network for All-In-One Adverse Weather Image Restoration
by: Wang, Hsing-Hua, et al.
Published: (2024)
by: Wang, Hsing-Hua, et al.
Published: (2024)
Similar Items
-
EMLoC: Emulator-based Memory-efficient Fine-tuning with LoRA Correction
by: Lin, Hsi-Che, et al.
Published: (2025) -
Continual Personalization for Diffusion Models
by: Liao, Yu-Chien, et al.
Published: (2025) -
RobustVisRAG: Causality-Aware Vision-Based Retrieval-Augmented Generation under Visual Degradations
by: Chen, I-Hsiang, et al.
Published: (2026) -
Few-Shot Semantic Segmentation Meets SAM3
by: Tsai, Yi-Jen, et al.
Published: (2026) -
VBench++: Comprehensive and Versatile Benchmark Suite for Video Generative Models
by: Huang, Ziqi, et al.
Published: (2024)