FootFormer: Estimating Stability from Visual Input
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kraiger, Keaton, Li, Jingjing, Bharadwaj, Skanda, Scott, Jesse, Collins, Robert T., Liu, Yanxi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Recurrence-based Vanishing Point Detection
par: Bharadwaj, Skanda, et autres
Publié: (2024)
par: Bharadwaj, Skanda, et autres
Publié: (2024)
Understanding Robustness of Visual State Space Models for Image Classification
par: Du, Chengbin, et autres
Publié: (2024)
par: Du, Chengbin, et autres
Publié: (2024)
UniFormer: Unifying Convolution and Self-attention for Visual Recognition
par: Li, Kunchang, et autres
Publié: (2022)
par: Li, Kunchang, et autres
Publié: (2022)
iConFormer: Dynamic Parameter-Efficient Tuning with Input-Conditioned Adaptation
par: Jo, Hayeon, et autres
Publié: (2024)
par: Jo, Hayeon, et autres
Publié: (2024)
SeaFormer++: Squeeze-enhanced Axial Transformer for Mobile Visual Recognition
par: Wan, Qiang, et autres
Publié: (2023)
par: Wan, Qiang, et autres
Publié: (2023)
VoxelFormer: Parameter-Efficient Multi-Subject Visual Decoding from fMRI
par: Le, Chenqian, et autres
Publié: (2025)
par: Le, Chenqian, et autres
Publié: (2025)
CauSight: Learning to Supersense for Visual Causal Discovery
par: Zhang, Yize, et autres
Publié: (2025)
par: Zhang, Yize, et autres
Publié: (2025)
STGFormer: Spatio-Temporal GraphFormer for 3D Human Pose Estimation in Video
par: Liu, Yang, et autres
Publié: (2024)
par: Liu, Yang, et autres
Publié: (2024)
Best Foot Forward: Robust Foot Reconstruction in-the-wild
par: Fogarty, Kyle, et autres
Publié: (2025)
par: Fogarty, Kyle, et autres
Publié: (2025)
CLIP-Gaze: Towards General Gaze Estimation via Visual-Linguistic Model
par: Yin, Pengwei, et autres
Publié: (2024)
par: Yin, Pengwei, et autres
Publié: (2024)
FuseFormer: A Transformer for Visual and Thermal Image Fusion
par: Erdogan, Aytekin, et autres
Publié: (2024)
par: Erdogan, Aytekin, et autres
Publié: (2024)
ConMatFormer: A Multi-attention and Transformer Integrated ConvNext based Deep Learning Model for Enhanced Diabetic Foot Ulcer Classification
par: Rifat, Raihan Ahamed, et autres
Publié: (2025)
par: Rifat, Raihan Ahamed, et autres
Publié: (2025)
Transfer Learning-Based CNN Models for Plant Species Identification Using Leaf Venation Patterns
par: Bharadwaj, Bandita, et autres
Publié: (2025)
par: Bharadwaj, Bandita, et autres
Publié: (2025)
Shoe Style-Invariant and Ground-Aware Learning for Dense Foot Contact Estimation
par: Jung, Daniel Sungho, et autres
Publié: (2025)
par: Jung, Daniel Sungho, et autres
Publié: (2025)
TreeFormer: Single-view Plant Skeleton Estimation via Tree-constrained Graph Generation
par: Liu, Xinpeng, et autres
Publié: (2024)
par: Liu, Xinpeng, et autres
Publié: (2024)
SkillFormer: Unified Multi-View Video Understanding for Proficiency Estimation
par: Bianchi, Edoardo, et autres
Publié: (2025)
par: Bianchi, Edoardo, et autres
Publié: (2025)
RadioFormer: A Multiple-Granularity Radio Map Estimation Transformer with 1\textpertenthousand Spatial Sampling
par: Fang, Zheng, et autres
Publié: (2025)
par: Fang, Zheng, et autres
Publié: (2025)
GridFormer: Point-Grid Transformer for Surface Reconstruction
par: Li, Shengtao, et autres
Publié: (2024)
par: Li, Shengtao, et autres
Publié: (2024)
Unbiased Visual Reasoning with Controlled Visual Inputs
par: Li, Zhaonan, et autres
Publié: (2025)
par: Li, Zhaonan, et autres
Publié: (2025)
Adapt PointFormer: 3D Point Cloud Analysis via Adapting 2D Visual Transformers
par: Li, Mengke, et autres
Publié: (2024)
par: Li, Mengke, et autres
Publié: (2024)
RadarSplat: Radar Gaussian Splatting for High-Fidelity Data Synthesis and 3D Reconstruction of Autonomous Driving Scenes
par: Kung, Pou-Chun, et autres
Publié: (2025)
par: Kung, Pou-Chun, et autres
Publié: (2025)
Joint Audio-Visual Idling Vehicle Detection with Streamlined Input Dependencies
par: Li, Xiwen, et autres
Publié: (2024)
par: Li, Xiwen, et autres
Publié: (2024)
M2Former: Multi-Scale Patch Selection for Fine-Grained Visual Recognition
par: Moon, Jiyong, et autres
Publié: (2023)
par: Moon, Jiyong, et autres
Publié: (2023)
Can Visual Input Be Compressed? A Visual Token Compression Benchmark for Large Multimodal Models
par: Peng, Tianfan, et autres
Publié: (2025)
par: Peng, Tianfan, et autres
Publié: (2025)
SkelFormer: Markerless 3D Pose and Shape Estimation using Skeletal Transformers
par: Davoodnia, Vandad, et autres
Publié: (2024)
par: Davoodnia, Vandad, et autres
Publié: (2024)
Memory Consolidation Enables Long-Context Video Understanding
par: Balažević, Ivana, et autres
Publié: (2024)
par: Balažević, Ivana, et autres
Publié: (2024)
Accelerating SfM-based Pose Estimation with Dominating Set
par: Joseph, Joji, et autres
Publié: (2025)
par: Joseph, Joji, et autres
Publié: (2025)
RadioFormer3D: Weakly Supervised 3D Radio Map Estimation in Low-Altitude Airspace via Generative Modeling
par: Fang, Zheng, et autres
Publié: (2026)
par: Fang, Zheng, et autres
Publié: (2026)
GeoFormer: A Lightweight Swin Transformer for Joint Building Height and Footprint Estimation from Sentinel Imagery
par: Jinzhen, Han, et autres
Publié: (2026)
par: Jinzhen, Han, et autres
Publié: (2026)
Comprehension of Multilingual Expressions Referring to Target Objects in Visual Inputs
par: Nogueira, Francisco, et autres
Publié: (2025)
par: Nogueira, Francisco, et autres
Publié: (2025)
HyLiFormer: Hyperbolic Linear Attention for Skeleton-based Human Action Recognition
par: Li, Yue, et autres
Publié: (2025)
par: Li, Yue, et autres
Publié: (2025)
Block-level Text Spotting with LLMs
par: Bannur, Ganesh, et autres
Publié: (2024)
par: Bannur, Ganesh, et autres
Publié: (2024)
ShapeGraFormer: GraFormer-Based Network for Hand-Object Reconstruction from a Single Depth Map
par: Aboukhadra, Ahmed Tawfik, et autres
Publié: (2023)
par: Aboukhadra, Ahmed Tawfik, et autres
Publié: (2023)
360U-Former: HDR Illumination Estimation with Panoramic Adapted Vision Transformers
par: Hilliard, Jack, et autres
Publié: (2024)
par: Hilliard, Jack, et autres
Publié: (2024)
EgoPoseFormer: A Simple Baseline for Stereo Egocentric 3D Human Pose Estimation
par: Yang, Chenhongyi, et autres
Publié: (2024)
par: Yang, Chenhongyi, et autres
Publié: (2024)
VROOM - Visual Reconstruction over Onboard Multiview
par: Yadav, Yajat, et autres
Publié: (2025)
par: Yadav, Yajat, et autres
Publié: (2025)
ScanFormer: Referring Expression Comprehension by Iteratively Scanning
par: Su, Wei, et autres
Publié: (2024)
par: Su, Wei, et autres
Publié: (2024)
LoFormer: Local Frequency Transformer for Image Deblurring
par: Mao, Xintian, et autres
Publié: (2024)
par: Mao, Xintian, et autres
Publié: (2024)
Bootstrapping SparseFormers from Vision Foundation Models
par: Gao, Ziteng, et autres
Publié: (2023)
par: Gao, Ziteng, et autres
Publié: (2023)
Survey on Hand Gesture Recognition from Visual Input
par: Linardakis, Manousos, et autres
Publié: (2025)
par: Linardakis, Manousos, et autres
Publié: (2025)
Documents similaires
-
Recurrence-based Vanishing Point Detection
par: Bharadwaj, Skanda, et autres
Publié: (2024) -
Understanding Robustness of Visual State Space Models for Image Classification
par: Du, Chengbin, et autres
Publié: (2024) -
UniFormer: Unifying Convolution and Self-attention for Visual Recognition
par: Li, Kunchang, et autres
Publié: (2022) -
iConFormer: Dynamic Parameter-Efficient Tuning with Input-Conditioned Adaptation
par: Jo, Hayeon, et autres
Publié: (2024) -
SeaFormer++: Squeeze-enhanced Axial Transformer for Mobile Visual Recognition
par: Wan, Qiang, et autres
Publié: (2023)