DGME-T: Directional Grid Motion Encoding for Transformer-Based Historical Camera Movement Classification
Fuente:
arXiv
Saved in:
| Main Authors: | Lin, Tingyu, Dadras, Armin, Kleber, Florian, Sablatnig, Robert |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Camera Movement Classification in Historical Footage: A Comparative Study of Deep Video Models
by: Lin, Tingyu, et al.
Published: (2025)
by: Lin, Tingyu, et al.
Published: (2025)
Enhancing Historical Image Retrieval with Compositional Cues
by: Lin, Tingyu, et al.
Published: (2024)
by: Lin, Tingyu, et al.
Published: (2024)
ClapperText: A Benchmark for Text Recognition in Low-Resource Archival Documents
by: Lin, Tingyu, et al.
Published: (2025)
by: Lin, Tingyu, et al.
Published: (2025)
U-Motion: Learned Point Cloud Video Compression with U-Structured Temporal Context Generation
by: Fan, Tingyu, et al.
Published: (2024)
by: Fan, Tingyu, et al.
Published: (2024)
Compressive Imaging Reconstruction via Tensor Decomposed Multi-Resolution Grid Encoding
by: Jin, Zhenyu, et al.
Published: (2025)
by: Jin, Zhenyu, et al.
Published: (2025)
In2SET: Intra-Inter Similarity Exploiting Transformer for Dual-Camera Compressive Hyperspectral Imaging
by: Wang, Xin, et al.
Published: (2023)
by: Wang, Xin, et al.
Published: (2023)
Multi-Camera Self-Calibration in Sports Motion Capture: Leveraging Human and Stick Poses
by: Yang, Fan, et al.
Published: (2026)
by: Yang, Fan, et al.
Published: (2026)
Susceptibility Distortion Correction of Diffusion MRI with a single Phase-Encoding Direction
by: Dargahi, Sedigheh, et al.
Published: (2025)
by: Dargahi, Sedigheh, et al.
Published: (2025)
Segmentation Guided Sparse Transformer for Under-Display Camera Image Restoration
by: Xue, Jingyun, et al.
Published: (2024)
by: Xue, Jingyun, et al.
Published: (2024)
VMLoc: Variational Fusion For Learning-Based Multimodal Camera Localization
by: Zhou, Kaichen, et al.
Published: (2020)
by: Zhou, Kaichen, et al.
Published: (2020)
Simultaneous Motion And Noise Estimation with Event Cameras
by: Shiba, Shintaro, et al.
Published: (2025)
by: Shiba, Shintaro, et al.
Published: (2025)
Inter-event Interval Microscopy for Event Cameras
by: Su, Changqing, et al.
Published: (2025)
by: Su, Changqing, et al.
Published: (2025)
Rethinking Generative Human Video Coding with Implicit Motion Transformation
by: Chen, Bolin, et al.
Published: (2025)
by: Chen, Bolin, et al.
Published: (2025)
Characterizing Motion Encoding in Video Diffusion Timesteps
by: Baherwani, Vatsal, et al.
Published: (2025)
by: Baherwani, Vatsal, et al.
Published: (2025)
Investigating a Policy-Based Formulation for Endoscopic Camera Pose Recovery
by: Mangulabnan, Jan Emily, et al.
Published: (2026)
by: Mangulabnan, Jan Emily, et al.
Published: (2026)
Enhancing MRI-Based Classification of Alzheimer's Disease with Explainable 3D Hybrid Compact Convolutional Transformers
by: Majee, Arindam, et al.
Published: (2024)
by: Majee, Arindam, et al.
Published: (2024)
Generalized Event Cameras
by: Sundar, Varun, et al.
Published: (2024)
by: Sundar, Varun, et al.
Published: (2024)
SurfelSoup: Learned Point Cloud Geometry Compression With a Probablistic SurfelTree Representation
by: Fan, Tingyu, et al.
Published: (2026)
by: Fan, Tingyu, et al.
Published: (2026)
A Robust Anchor-based Method for Multi-Camera Pedestrian Localization
by: Zhang, Wanyu, et al.
Published: (2024)
by: Zhang, Wanyu, et al.
Published: (2024)
Semiconductor Wafer Map Defect Classification with Tiny Vision Transformers
by: Mohammad, Faisal, et al.
Published: (2025)
by: Mohammad, Faisal, et al.
Published: (2025)
Transformers Fusion across Disjoint Samples for Hyperspectral Image Classification
by: Ahmad, Muhammad, et al.
Published: (2024)
by: Ahmad, Muhammad, et al.
Published: (2024)
Event Camera Demosaicing via Swin Transformer and Pixel-focus Loss
by: Lu, Yunfan, et al.
Published: (2024)
by: Lu, Yunfan, et al.
Published: (2024)
Learned Compression of Encoding Distributions
by: Ulhaq, Mateen, et al.
Published: (2024)
by: Ulhaq, Mateen, et al.
Published: (2024)
A Novel Implicit Neural Representation for Volume Data
by: Sheibanifard, Armin, et al.
Published: (2024)
by: Sheibanifard, Armin, et al.
Published: (2024)
DSVTLA: Deep Swin Vision Transformer-Based Transfer Learning Architecture for Multi-Type Cancer Histopathological Cancer Image Classification
by: Khan, Muazzem Hussain, et al.
Published: (2026)
by: Khan, Muazzem Hussain, et al.
Published: (2026)
GastroViT: A Vision Transformer Based Ensemble Learning Approach for Gastrointestinal Disease Classification with Grad CAM & SHAP Visualization
by: Tabassum, Sumaiya, et al.
Published: (2025)
by: Tabassum, Sumaiya, et al.
Published: (2025)
Multispectral Demosaicing via Dual Cameras
by: Tedla, SaiKiran, et al.
Published: (2025)
by: Tedla, SaiKiran, et al.
Published: (2025)
Classification of Endoscopy and Video Capsule Images using CNN-Transformer Model
by: Subedi, Aliza, et al.
Published: (2024)
by: Subedi, Aliza, et al.
Published: (2024)
Importance of Disjoint Sampling in Conventional and Transformer Models for Hyperspectral Image Classification
by: Ahmad, Muhammad, et al.
Published: (2024)
by: Ahmad, Muhammad, et al.
Published: (2024)
Hash Grid Feature Pruning
by: Ma, Yangzhi, et al.
Published: (2025)
by: Ma, Yangzhi, et al.
Published: (2025)
YOND: Practical Blind Raw Image Denoising Free from Camera-Specific Data Dependency
by: Feng, Hansen, et al.
Published: (2025)
by: Feng, Hansen, et al.
Published: (2025)
MetricGrids: Arbitrary Nonlinear Approximation with Elementary Metric Grids based Implicit Neural Representation
by: Wang, Shu, et al.
Published: (2025)
by: Wang, Shu, et al.
Published: (2025)
LiRCDepth: Lightweight Radar-Camera Depth Estimation via Knowledge Distillation and Uncertainty Guidance
by: Sun, Huawei, et al.
Published: (2024)
by: Sun, Huawei, et al.
Published: (2024)
Markerless Tracking-Based Registration for Medical Image Motion Correction
by: Neubig, Luisa, et al.
Published: (2025)
by: Neubig, Luisa, et al.
Published: (2025)
Integrative Graph-Transformer Framework for Histopathology Whole Slide Image Representation and Classification
by: Shi, Zhan, et al.
Published: (2024)
by: Shi, Zhan, et al.
Published: (2024)
TranSOP: Transformer-based Multimodal Classification for Stroke Treatment Outcome Prediction
by: Samak, Zeynel A., et al.
Published: (2023)
by: Samak, Zeynel A., et al.
Published: (2023)
Developing a Dual-Stage Vision Transformer Model for Lung Disease Classification
by: Mazumder, Anirudh, et al.
Published: (2024)
by: Mazumder, Anirudh, et al.
Published: (2024)
Comprehensive Modeling of Camera Spectral and Color Behavior
by: Abeysekera, Sanush K, et al.
Published: (2025)
by: Abeysekera, Sanush K, et al.
Published: (2025)
Efficient Visual Computing with Camera RAW Snapshots
by: Li, Zhihao, et al.
Published: (2022)
by: Li, Zhihao, et al.
Published: (2022)
Generic Camera Calibration using Blurry Images
by: Shi, Zezhun
Published: (2026)
by: Shi, Zezhun
Published: (2026)
Similar Items
-
Camera Movement Classification in Historical Footage: A Comparative Study of Deep Video Models
by: Lin, Tingyu, et al.
Published: (2025) -
Enhancing Historical Image Retrieval with Compositional Cues
by: Lin, Tingyu, et al.
Published: (2024) -
ClapperText: A Benchmark for Text Recognition in Low-Resource Archival Documents
by: Lin, Tingyu, et al.
Published: (2025) -
U-Motion: Learned Point Cloud Video Compression with U-Structured Temporal Context Generation
by: Fan, Tingyu, et al.
Published: (2024) -
Compressive Imaging Reconstruction via Tensor Decomposed Multi-Resolution Grid Encoding
by: Jin, Zhenyu, et al.
Published: (2025)