Machine Learning Modeling for Multi-order Human Visual Motion Processing
Fuente:
arXiv
Guardado en:
| Autores principales: | Sun, Zitang, Chen, Yen-Ju, Yang, Yung-Hao, Li, Yuan, Nishida, Shin'ya |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Investigate the Low-level Visual Perception in Vision-Language based Image Quality Assessment
por: Li, Yuan, et al.
Publicado: (2025)
por: Li, Yuan, et al.
Publicado: (2025)
Building Reasonable Inference for Vision-Language Models in Blind Image Quality Assessment
por: Li, Yuan, et al.
Publicado: (2025)
por: Li, Yuan, et al.
Publicado: (2025)
Understanding Pure Textual Reasoning for Blind Image Quality Assessment
por: Li, Yuan, et al.
Publicado: (2026)
por: Li, Yuan, et al.
Publicado: (2026)
Explanation Bottleneck Models
por: Yamaguchi, Shin'ya, et al.
Publicado: (2024)
por: Yamaguchi, Shin'ya, et al.
Publicado: (2024)
Rationale-Enhanced Decoding for Multi-modal Chain-of-Thought
por: Yamaguchi, Shin'ya, et al.
Publicado: (2025)
por: Yamaguchi, Shin'ya, et al.
Publicado: (2025)
Guiding Perception-Reasoning Closer to Human in Blind Image Quality Assessment
por: Li, Yuan, et al.
Publicado: (2025)
por: Li, Yuan, et al.
Publicado: (2025)
MultiModal Fine-tuning with Synthetic Captions
por: Enomoto, Shohei, et al.
Publicado: (2026)
por: Enomoto, Shohei, et al.
Publicado: (2026)
Zero-shot Concept Bottleneck Models
por: Yamaguchi, Shin'ya, et al.
Publicado: (2025)
por: Yamaguchi, Shin'ya, et al.
Publicado: (2025)
HAPI: A Model for Learning Robot Facial Expressions from Human Preferences
por: Yang, Dongsheng, et al.
Publicado: (2025)
por: Yang, Dongsheng, et al.
Publicado: (2025)
Uniformity First: Uniformity-aware Test-time Adaptation of Vision-language Models against Image Corruption
por: Adachi, Kazuki, et al.
Publicado: (2025)
por: Adachi, Kazuki, et al.
Publicado: (2025)
Learning Robust Convolutional Neural Networks with Relevant Feature Focusing via Explanations
por: Adachi, Kazuki, et al.
Publicado: (2022)
por: Adachi, Kazuki, et al.
Publicado: (2022)
Parallel In-context Learning for Large Vision Language Models
por: Yamaguchi, Shin'ya, et al.
Publicado: (2026)
por: Yamaguchi, Shin'ya, et al.
Publicado: (2026)
Test-time Similarity Modification for Person Re-identification toward Temporal Distribution Shift
por: Adachi, Kazuki, et al.
Publicado: (2024)
por: Adachi, Kazuki, et al.
Publicado: (2024)
Adaptive Random Feature Regularization on Fine-tuning Deep Neural Networks
por: Yamaguchi, Shin'ya, et al.
Publicado: (2024)
por: Yamaguchi, Shin'ya, et al.
Publicado: (2024)
Post-pre-training for Modality Alignment in Vision-Language Foundation Models
por: Yamaguchi, Shin'ya, et al.
Publicado: (2025)
por: Yamaguchi, Shin'ya, et al.
Publicado: (2025)
HumanMM: Global Human Motion Recovery from Multi-shot Videos
por: Zhang, Yuhong, et al.
Publicado: (2025)
por: Zhang, Yuhong, et al.
Publicado: (2025)
Multi-Camera Self-Calibration in Sports Motion Capture: Leveraging Human and Stick Poses
por: Yang, Fan, et al.
Publicado: (2026)
por: Yang, Fan, et al.
Publicado: (2026)
MotionLLM: Understanding Human Behaviors from Human Motions and Videos
por: Chen, Ling-Hao, et al.
Publicado: (2024)
por: Chen, Ling-Hao, et al.
Publicado: (2024)
Do vision models perceive illusory motion in static images like humans?
por: Rosario, Isabella Elaine, et al.
Publicado: (2026)
por: Rosario, Isabella Elaine, et al.
Publicado: (2026)
Online Data Curation for Object Detection via Marginal Contributions to Dataset-level Average Precision
por: Sun, Zitang, et al.
Publicado: (2025)
por: Sun, Zitang, et al.
Publicado: (2025)
Efficient Motion Prompt Learning for Robust Visual Tracking
por: Zhao, Jie, et al.
Publicado: (2025)
por: Zhao, Jie, et al.
Publicado: (2025)
SAMURAI: Adapting Segment Anything Model for Zero-Shot Visual Tracking with Motion-Aware Memory
por: Yang, Cheng-Yen, et al.
Publicado: (2024)
por: Yang, Cheng-Yen, et al.
Publicado: (2024)
MambaMOT: State-Space Model as Motion Predictor for Multi-Object Tracking
por: Huang, Hsiang-Wei, et al.
Publicado: (2024)
por: Huang, Hsiang-Wei, et al.
Publicado: (2024)
GenM$^3$: Generative Pretrained Multi-path Motion Model for Text Conditional Human Motion Generation
por: Shi, Junyu, et al.
Publicado: (2025)
por: Shi, Junyu, et al.
Publicado: (2025)
MotionWavelet: Human Motion Prediction via Wavelet Manifold Learning
por: Feng, Yuming, et al.
Publicado: (2024)
por: Feng, Yuming, et al.
Publicado: (2024)
The Roles of Contextual Semantic Relevance Metrics in Human Visual Processing
por: Sun, Kun, et al.
Publicado: (2024)
por: Sun, Kun, et al.
Publicado: (2024)
Multi-Transmotion: Pre-trained Model for Human Motion Prediction
por: Gao, Yang, et al.
Publicado: (2024)
por: Gao, Yang, et al.
Publicado: (2024)
Pose-Aware Multi-Level Motion Parsing for Action Quality Assessment
por: Zhu, Shuaikang, et al.
Publicado: (2025)
por: Zhu, Shuaikang, et al.
Publicado: (2025)
Efficient Large Multi-modal Models via Visual Context Compression
por: Chen, Jieneng, et al.
Publicado: (2024)
por: Chen, Jieneng, et al.
Publicado: (2024)
Simultaneously Recovering Multi-Person Meshes and Multi-View Cameras with Human Semantics
por: Huang, Buzhen, et al.
Publicado: (2024)
por: Huang, Buzhen, et al.
Publicado: (2024)
Text-driven Human Motion Generation with Motion Masked Diffusion Model
por: Chen, Xingyu
Publicado: (2024)
por: Chen, Xingyu
Publicado: (2024)
MVP-Bench: Can Large Vision--Language Models Conduct Multi-level Visual Perception Like Humans?
por: Li, Guanzhen, et al.
Publicado: (2024)
por: Li, Guanzhen, et al.
Publicado: (2024)
MotionRL: Align Text-to-Motion Generation to Human Preferences with Multi-Reward Reinforcement Learning
por: Liu, Xiaoyang, et al.
Publicado: (2024)
por: Liu, Xiaoyang, et al.
Publicado: (2024)
Learning Efficient and Generalizable Human Representation with Human Gaussian Model
por: Liu, Yifan, et al.
Publicado: (2025)
por: Liu, Yifan, et al.
Publicado: (2025)
Test-time Adaptation Meets Image Enhancement: Improving Accuracy via Uncertainty-aware Logit Switching
por: Enomoto, Shohei, et al.
Publicado: (2024)
por: Enomoto, Shohei, et al.
Publicado: (2024)
VideoMage: Multi-Subject and Motion Customization of Text-to-Video Diffusion Models
por: Huang, Chi-Pin, et al.
Publicado: (2025)
por: Huang, Chi-Pin, et al.
Publicado: (2025)
AtomicMotion: Learning Human Motion From Different Human Parts
por: Liu, Runzhen, et al.
Publicado: (2026)
por: Liu, Runzhen, et al.
Publicado: (2026)
Time-series Meets Complex Motion Modeling: Robust and Computational-effective Motion Predictor for Multi-object Tracking
por: Do, Nhat-Tan, et al.
Publicado: (2026)
por: Do, Nhat-Tan, et al.
Publicado: (2026)
SegMo: Segment-aligned Text to 3D Human Motion Generation
por: Dang, Bowen, et al.
Publicado: (2025)
por: Dang, Bowen, et al.
Publicado: (2025)
AR-VRM: Imitating Human Motions for Visual Robot Manipulation with Analogical Reasoning
por: Yang, Dejie, et al.
Publicado: (2025)
por: Yang, Dejie, et al.
Publicado: (2025)
Ejemplares similares
-
Investigate the Low-level Visual Perception in Vision-Language based Image Quality Assessment
por: Li, Yuan, et al.
Publicado: (2025) -
Building Reasonable Inference for Vision-Language Models in Blind Image Quality Assessment
por: Li, Yuan, et al.
Publicado: (2025) -
Understanding Pure Textual Reasoning for Blind Image Quality Assessment
por: Li, Yuan, et al.
Publicado: (2026) -
Explanation Bottleneck Models
por: Yamaguchi, Shin'ya, et al.
Publicado: (2024) -
Rationale-Enhanced Decoding for Multi-modal Chain-of-Thought
por: Yamaguchi, Shin'ya, et al.
Publicado: (2025)