Single-image driven 3d viewpoint training data augmentation for effective wine label recognition
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Yueh-Cheng, Chen, Hsin-Yi, Hung, Cheng-Jui, Chuang, Jen-Hui, Hwang, Jenq-Neng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reasoning Matters for 3D Visual Grounding
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2026)
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2026)
Technical Report for ReID-SAM on SkiTB Visual Tracking Challenge 2025
di: Li, Kunjun, et al.
Pubblicazione: (2025)
di: Li, Kunjun, et al.
Pubblicazione: (2025)
Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression
di: Li, Kunjun, et al.
Pubblicazione: (2025)
di: Li, Kunjun, et al.
Pubblicazione: (2025)
Recent Advances in Embedding Methods for Multi-Object Tracking: A Survey
di: Wang, Gaoang, et al.
Pubblicazione: (2022)
di: Wang, Gaoang, et al.
Pubblicazione: (2022)
Cultural structures that perpetuate silence: an East Asian reflection on bullying in the operating theatre
di: Pei‐Yi Hung, et al.
Pubblicazione: (2025)
di: Pei‐Yi Hung, et al.
Pubblicazione: (2025)
SAMURAI: Adapting Segment Anything Model for Zero-Shot Visual Tracking with Motion-Aware Memory
di: Yang, Cheng-Yen, et al.
Pubblicazione: (2024)
di: Yang, Cheng-Yen, et al.
Pubblicazione: (2024)
MambaMOT: State-Space Model as Motion Predictor for Multi-Object Tracking
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2024)
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2024)
GTA: Global Tracklet Association for Multi-Object Tracking in Sports
di: Sun, Jiacheng, et al.
Pubblicazione: (2024)
di: Sun, Jiacheng, et al.
Pubblicazione: (2024)
ToSA: Token Merging with Spatial Awareness
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2025)
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2025)
DAug: Diffusion-based Channel Augmentation for Radiology Image Retrieval and Classification
di: Jin, Ying, et al.
Pubblicazione: (2024)
di: Jin, Ying, et al.
Pubblicazione: (2024)
Variation of Camera Parameters due to Common Physical Changes in Focal Length and Camera Pose
di: Chen, Hsin-Yi, et al.
Pubblicazione: (2024)
di: Chen, Hsin-Yi, et al.
Pubblicazione: (2024)
PackDiT: Joint Human Motion and Text Generation via Mutual Prompting
di: Jiang, Zhongyu, et al.
Pubblicazione: (2025)
di: Jiang, Zhongyu, et al.
Pubblicazione: (2025)
A Density-Guided Temporal Attention Transformer for Indiscernible Object Counting in Underwater Video
di: Yang, Cheng-Yen, et al.
Pubblicazione: (2024)
di: Yang, Cheng-Yen, et al.
Pubblicazione: (2024)
Modeling LLM Agent Reviewer Dynamics in Elo-Ranked Review System
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2026)
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2026)
TVMC: Time-Varying Mesh Compression via Multi-Stage Anchor Mesh Generation
di: Huang, He, et al.
Pubblicazione: (2025)
di: Huang, He, et al.
Pubblicazione: (2025)
UniHPR: Unified Human Pose Representation via Singular Value Contrastive Learning
di: Jiang, Zhongyu, et al.
Pubblicazione: (2025)
di: Jiang, Zhongyu, et al.
Pubblicazione: (2025)
Boosting Online 3D Multi-Object Tracking through Camera-Radar Cross Check
di: Kuan, Sheng-Yao, et al.
Pubblicazione: (2024)
di: Kuan, Sheng-Yao, et al.
Pubblicazione: (2024)
ProTPS: Prototype-Guided Text Prompt Selection for Continual Learning
di: Mei, Jie, et al.
Pubblicazione: (2026)
di: Mei, Jie, et al.
Pubblicazione: (2026)
CaMo: Camera Motion Grounded Evaluation and Training for Vision-Language Models
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2026)
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2026)
Exploring space efficiency in a tree-based linear model for extreme multi-label classification
di: Lin, He-Zhe, et al.
Pubblicazione: (2024)
di: Lin, He-Zhe, et al.
Pubblicazione: (2024)
RT-Pose: A 4D Radar Tensor-based 3D Human Pose Estimation and Localization Benchmark
di: Ho, Yuan-Hao, et al.
Pubblicazione: (2024)
di: Ho, Yuan-Hao, et al.
Pubblicazione: (2024)
Adapting SAM 2 for Visual Object Tracking: 1st Place Solution for MMVPR Challenge Multi-Modal Tracking
di: Yang, Cheng-Yen, et al.
Pubblicazione: (2025)
di: Yang, Cheng-Yen, et al.
Pubblicazione: (2025)
SpeechCLIP+: Self-supervised multi-task representation learning for speech via CLIP and speech-image data
di: Wang, Hsuan-Fu, et al.
Pubblicazione: (2024)
di: Wang, Hsuan-Fu, et al.
Pubblicazione: (2024)
Warehouse Spatial Question Answering with LLM Agent
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2025)
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2025)
Attention Consistency for LLMs Explanation
di: Lan, Tian, et al.
Pubblicazione: (2025)
di: Lan, Tian, et al.
Pubblicazione: (2025)
From Global to Local: Rethinking CLIP Feature Aggregation for Person Re-Identification
di: Zheng, Aotian, et al.
Pubblicazione: (2026)
di: Zheng, Aotian, et al.
Pubblicazione: (2026)
Understanding Identity Continuity in Thermal Video through Scene-Level Consistency
di: Sun, Wei-Chieh, et al.
Pubblicazione: (2026)
di: Sun, Wei-Chieh, et al.
Pubblicazione: (2026)
ToddlerAct: A Toddler Action Recognition Dataset for Gross Motor Development Assessment
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2024)
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2024)
Suppression of Migration and Invasion by 4-Carbomethoxyl-10-Epigyrosanoldie E from the Cultured Soft Coral Sinularia sandensis through the MAPKs Pathway on Oral Cancer Cells
di: Rou-Yi Fang, et al.
Pubblicazione: (2024)
di: Rou-Yi Fang, et al.
Pubblicazione: (2024)
EVAN: Evolutional Video Streaming Adaptation via Neural Representation
di: Liu, Mufan, et al.
Pubblicazione: (2024)
di: Liu, Mufan, et al.
Pubblicazione: (2024)
The effects of image augmentations when training machine learning models in astronomy
di: Butterworth, Leon H., et al.
Pubblicazione: (2026)
di: Butterworth, Leon H., et al.
Pubblicazione: (2026)
Effects of Autoimmune Thyroiditis on Pregnancy Outcomes: Analysis of the Nationwide Inpatient Sample, 2016–2020
di: Chung‐Jen Teng, et al.
Pubblicazione: (2026)
di: Chung‐Jen Teng, et al.
Pubblicazione: (2026)
MonoTAKD: Teaching Assistant Knowledge Distillation for Monocular 3D Object Detection
di: Liu, Hou-I, et al.
Pubblicazione: (2024)
di: Liu, Hou-I, et al.
Pubblicazione: (2024)
Gradient Imbalance in Direct Preference Optimization
di: Ma, Qinwei, et al.
Pubblicazione: (2025)
di: Ma, Qinwei, et al.
Pubblicazione: (2025)
Causal Reasoning Elicits Controllable 3D Scene Generation
di: Chen, Shen, et al.
Pubblicazione: (2025)
di: Chen, Shen, et al.
Pubblicazione: (2025)
Video Streaming with Kairos: An MPC-Based ABR with Streaming-Aware Throughput Prediction
di: Zhong, Ziyu, et al.
Pubblicazione: (2025)
di: Zhong, Ziyu, et al.
Pubblicazione: (2025)
Learning to Learn Weight Generation via Local Consistency Diffusion
di: Guan, Yunchuan, et al.
Pubblicazione: (2025)
di: Guan, Yunchuan, et al.
Pubblicazione: (2025)
MovieChat+: Question-aware Sparse Memory for Long Video Question Answering
di: Song, Enxin, et al.
Pubblicazione: (2024)
di: Song, Enxin, et al.
Pubblicazione: (2024)
Acoustic and linguistic effects in synthesized speech augmentation for speech recognition
di: Yohan Lim, et al.
Pubblicazione: (2025)
di: Yohan Lim, et al.
Pubblicazione: (2025)
PartDistill: 3D Shape Part Segmentation by Vision-Language Model Distillation
di: Umam, Ardian, et al.
Pubblicazione: (2023)
di: Umam, Ardian, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Reasoning Matters for 3D Visual Grounding
di: Huang, Hsiang-Wei, et al.
Pubblicazione: (2026) -
Technical Report for ReID-SAM on SkiTB Visual Tracking Challenge 2025
di: Li, Kunjun, et al.
Pubblicazione: (2025) -
Memory-Efficient Visual Autoregressive Modeling with Scale-Aware KV Cache Compression
di: Li, Kunjun, et al.
Pubblicazione: (2025) -
Recent Advances in Embedding Methods for Multi-Object Tracking: A Survey
di: Wang, Gaoang, et al.
Pubblicazione: (2022) -
Cultural structures that perpetuate silence: an East Asian reflection on bullying in the operating theatre
di: Pei‐Yi Hung, et al.
Pubblicazione: (2025)