RacketVision: A Multiple Racket Sports Benchmark for Unified Ball and Racket Analysis
Fuente:
arXiv
Saved in:
| Main Authors: | Dong, Linfeng, Yang, Yuchen, Wu, Hao, Wang, Wei, Hou, Yuenan, Zhong, Zhihang, Sun, Xiao |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Locating Tennis Ball Impact on the Racket in Real Time Using an Event Camera
by: Kase, Yuto, et al.
Published: (2025)
by: Kase, Yuto, et al.
Published: (2025)
CyboRacket: A Perception-to-Action Framework for Humanoid Racket Sports
by: Ren, Peng, et al.
Published: (2026)
by: Ren, Peng, et al.
Published: (2026)
BST: Badminton Stroke-type Transformer for Skeleton-based Action Recognition in Racket Sports
by: Chang, Jing-Yuan
Published: (2025)
by: Chang, Jing-Yuan
Published: (2025)
International Journal of Racket Sports Science
Published: (2022)
Published: (2022)
Smart Racket – Instrumented Racket as Real-time Feedback Device in Table Tennis
by: Blank, Peter
Published: (2025)
by: Blank, Peter
Published: (2025)
Parallel Vision Token Scheduling for Fast and Accurate Multimodal LMMs Inference
by: Zhan, Wengyi, et al.
Published: (2025)
by: Zhan, Wengyi, et al.
Published: (2025)
Macro-embedding Compiler Intermediate Languages in Racket
by: Bowman, William J.
Published: (2025)
by: Bowman, William J.
Published: (2025)
Racket sociality: investigating intimidation in North India
by: Lucia Michelutti
Published: (2024)
by: Lucia Michelutti
Published: (2024)
Logic Unseen: Revealing the Logical Blindspots of Vision-Language Models
by: Zhou, Yuchen, et al.
Published: (2025)
by: Zhou, Yuchen, et al.
Published: (2025)
Towards Better Dental AI: A Multimodal Benchmark and Instruction Dataset for Panoramic X-ray Analysis
by: Hao, Jing, et al.
Published: (2025)
by: Hao, Jing, et al.
Published: (2025)
Learning Racket-Ball Bounce Dynamics Across Diverse Rubbers for Robotic Table Tennis
by: Gossard, Thomas
Published: (2026)
by: Gossard, Thomas
Published: (2026)
Unified Generative and Discriminative Training for Multi-modal Large Language Models
by: Chow, Wei, et al.
Published: (2024)
by: Chow, Wei, et al.
Published: (2024)
One Framework to Rule Them All: Unifying Multimodal Tasks with LLM Neural-Tuning
by: Sun, Hao, et al.
Published: (2024)
by: Sun, Hao, et al.
Published: (2024)
UniCode$^2$: Cascaded Large-scale Codebooks for Unified Multimodal Understanding and Generation
by: Chen, Yanzhe, et al.
Published: (2025)
by: Chen, Yanzhe, et al.
Published: (2025)
Emotion-Qwen: A Unified Framework for Emotion and Vision Understanding
by: Huang, Dawei, et al.
Published: (2025)
by: Huang, Dawei, et al.
Published: (2025)
AToken: A Unified Tokenizer for Vision
by: Lu, Jiasen, et al.
Published: (2025)
by: Lu, Jiasen, et al.
Published: (2025)
Augment Before Copy-Paste: Data and Memory Efficiency-Oriented Instance Segmentation Framework for Sport-scenes
by: Hsu, Chih-Chung, et al.
Published: (2024)
by: Hsu, Chih-Chung, et al.
Published: (2024)
GPT-4V with Emotion: A Zero-shot Benchmark for Generalized Emotion Recognition
by: Lian, Zheng, et al.
Published: (2023)
by: Lian, Zheng, et al.
Published: (2023)
Rendering-Oriented 3D Point Cloud Attribute Compression using Sparse Tensor-based Transformer
by: Huo, Xiao, et al.
Published: (2024)
by: Huo, Xiao, et al.
Published: (2024)
InstructFLIP: Exploring Unified Vision-Language Model for Face Anti-spoofing
by: Lin, Kun-Hsiang, et al.
Published: (2025)
by: Lin, Kun-Hsiang, et al.
Published: (2025)
UniTalking: A Unified Audio-Video Framework for Talking Portrait Generation
by: Li, Hebeizi, et al.
Published: (2026)
by: Li, Hebeizi, et al.
Published: (2026)
SM3Det: A Unified Model for Multi-Modal Remote Sensing Object Detection
by: Li, Yuxuan, et al.
Published: (2024)
by: Li, Yuxuan, et al.
Published: (2024)
Serial Low-rank Adaptation of Vision Transformer
by: Zhong, Houqiang, et al.
Published: (2025)
by: Zhong, Houqiang, et al.
Published: (2025)
VIoTGPT: Learning to Schedule Vision Tools in LLMs towards Intelligent Video Internet of Things
by: Zhong, Yaoyao, et al.
Published: (2023)
by: Zhong, Yaoyao, et al.
Published: (2023)
HiDream-O1-Image: A Natively Unified Image Generative Foundation Model with Pixel-level Unified Transformer
by: Cai, Qi, et al.
Published: (2026)
by: Cai, Qi, et al.
Published: (2026)
Unify-Agent: A Unified Multimodal Agent for World-Grounded Image Synthesis
by: Chen, Shuang, et al.
Published: (2026)
by: Chen, Shuang, et al.
Published: (2026)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
by: Zhang, Zhenxing, et al.
Published: (2024)
by: Zhang, Zhenxing, et al.
Published: (2024)
MAGE: Multimodal Alignment and Generation Enhancement via Bridging Visual and Semantic Spaces
by: E, Shaojun, et al.
Published: (2025)
by: E, Shaojun, et al.
Published: (2025)
ExposureEngine: Oriented Logo Detection and Sponsor Visibility Analytics in Sports Broadcasts
by: Sarkhoosh, Mehdi Houshmand, et al.
Published: (2025)
by: Sarkhoosh, Mehdi Houshmand, et al.
Published: (2025)
STEAR: Layer-Aware Spatiotemporal Evidence Intervention for Hallucination Mitigation in Video Large Language Models
by: Fan, Linfeng, et al.
Published: (2026)
by: Fan, Linfeng, et al.
Published: (2026)
Publication : La Priorité Scientifique Contre le Racket Institutionnalisé
by: FRADIER, Kevin
Published: (2026)
by: FRADIER, Kevin
Published: (2026)
Drugs, Violence, and State-Sponsored Protection Rackets in Mexico and Colombia
by: Richard Snyder
Published: (2009)
by: Richard Snyder
Published: (2009)
Exploring the Distinctiveness and Fidelity of the Descriptions Generated by Large Vision-Language Models
by: Huang, Yuhang, et al.
Published: (2024)
by: Huang, Yuhang, et al.
Published: (2024)
Learnable SMPLify: A Neural Solution for Optimization-Free Human Pose Inverse Kinematics
by: Yang, Yuchen, et al.
Published: (2025)
by: Yang, Yuchen, et al.
Published: (2025)
TAVGBench: Benchmarking Text to Audible-Video Generation
by: Mao, Yuxin, et al.
Published: (2024)
by: Mao, Yuxin, et al.
Published: (2024)
Error Analyses of Auto-Regressive Video Diffusion Models: A Unified Framework
by: Wang, Jing, et al.
Published: (2025)
by: Wang, Jing, et al.
Published: (2025)
Vision as a Dialect: Unifying Visual Understanding and Generation via Text-Aligned Representations
by: Han, Jiaming, et al.
Published: (2025)
by: Han, Jiaming, et al.
Published: (2025)
Q-Bench: A Benchmark for General-Purpose Foundation Models on Low-level Vision
by: Wu, Haoning, et al.
Published: (2023)
by: Wu, Haoning, et al.
Published: (2023)
MoPE-CLIP: Structured Pruning for Efficient Vision-Language Models with Module-wise Pruning Error Metric
by: Lin, Haokun, et al.
Published: (2024)
by: Lin, Haokun, et al.
Published: (2024)
TR-DETR: Task-Reciprocal Transformer for Joint Moment Retrieval and Highlight Detection
by: Sun, Hao, et al.
Published: (2024)
by: Sun, Hao, et al.
Published: (2024)
Similar Items
-
Locating Tennis Ball Impact on the Racket in Real Time Using an Event Camera
by: Kase, Yuto, et al.
Published: (2025) -
CyboRacket: A Perception-to-Action Framework for Humanoid Racket Sports
by: Ren, Peng, et al.
Published: (2026) -
BST: Badminton Stroke-type Transformer for Skeleton-based Action Recognition in Racket Sports
by: Chang, Jing-Yuan
Published: (2025) -
International Journal of Racket Sports Science
Published: (2022) -
Smart Racket – Instrumented Racket as Real-time Feedback Device in Table Tennis
by: Blank, Peter
Published: (2025)