Salvato in:
| Autori principali: | Schmitt-Koopmann, Felix M., Huang, Elaine M., Hutter, Hans-Peter, Stadelmann, Thilo, Darvishy, Alireza |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2404.13667 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards More Accessible Scientific PDFs for People with Visual Impairments: Step-by-Step PDF Remediation to Improve Tag Accuracy
di: Schmitt-Koopmann, Felix M., et al.
Pubblicazione: (2025)
di: Schmitt-Koopmann, Felix M., et al.
Pubblicazione: (2025)
InCrowd-VI: A Realistic Visual-Inertial Dataset for Evaluating SLAM in Indoor Pedestrian-Rich Spaces for Human Navigation
di: Bamdad, Marziyeh, et al.
Pubblicazione: (2024)
di: Bamdad, Marziyeh, et al.
Pubblicazione: (2024)
Deep Learning-Powered Visual SLAM Aimed at Assisting Visually Impaired Navigation
di: Bamdad, Marziyeh, et al.
Pubblicazione: (2025)
di: Bamdad, Marziyeh, et al.
Pubblicazione: (2025)
Deep Neural Networks for Automatic Speaker Recognition Do Not Learn Supra-Segmental Temporal Features
di: Neururer, Daniel, et al.
Pubblicazione: (2023)
di: Neururer, Daniel, et al.
Pubblicazione: (2023)
SLAM for Visually Impaired People: a Survey
di: Bamdad, Marziyeh, et al.
Pubblicazione: (2022)
di: Bamdad, Marziyeh, et al.
Pubblicazione: (2022)
MathWriting: A Dataset For Handwritten Mathematical Expression Recognition
di: Gervais, Philippe, et al.
Pubblicazione: (2024)
di: Gervais, Philippe, et al.
Pubblicazione: (2024)
MathNet: a Global Multimodal Benchmark for Mathematical Reasoning and Retrieval
di: Alshammari, Shaden, et al.
Pubblicazione: (2026)
di: Alshammari, Shaden, et al.
Pubblicazione: (2026)
A Hybrid Vision Transformer Approach for Mathematical Expression Recognition
di: Le, Anh Duy, et al.
Pubblicazione: (2026)
di: Le, Anh Duy, et al.
Pubblicazione: (2026)
The Return of Structural Handwritten Mathematical Expression Recognition
di: Seitz, Jakob, et al.
Pubblicazione: (2025)
di: Seitz, Jakob, et al.
Pubblicazione: (2025)
Attention Guidance Mechanism for Handwritten Mathematical Expression Recognition
di: Liu, Yutian, et al.
Pubblicazione: (2024)
di: Liu, Yutian, et al.
Pubblicazione: (2024)
MFH: Marrying Frequency Domain with Handwritten Mathematical Expression Recognition
di: Yang, Huanxin, et al.
Pubblicazione: (2025)
di: Yang, Huanxin, et al.
Pubblicazione: (2025)
TAMER: Tree-Aware Transformer for Handwritten Mathematical Expression Recognition
di: Zhu, Jianhua, et al.
Pubblicazione: (2024)
di: Zhu, Jianhua, et al.
Pubblicazione: (2024)
Towards Scalable Training for Handwritten Mathematical Expression Recognition
di: Li, Haoyang, et al.
Pubblicazione: (2025)
di: Li, Haoyang, et al.
Pubblicazione: (2025)
ICGNet: A Unified Approach for Instance-Centric Grasping
di: Zurbrügg, René, et al.
Pubblicazione: (2024)
di: Zurbrügg, René, et al.
Pubblicazione: (2024)
Web-Scale Visual Entity Recognition: An LLM-Driven Data Approach
di: Caron, Mathilde, et al.
Pubblicazione: (2024)
di: Caron, Mathilde, et al.
Pubblicazione: (2024)
MMHMER:Multi-viewer and Multi-task for Handwritten Mathematical Expression Recognition
di: Chen, Kehua, et al.
Pubblicazione: (2025)
di: Chen, Kehua, et al.
Pubblicazione: (2025)
Ordinal Adaptive Correction: A Data-Centric Approach to Ordinal Image Classification with Noisy Labels
di: Moghaddam, Alireza Sedighi, et al.
Pubblicazione: (2025)
di: Moghaddam, Alireza Sedighi, et al.
Pubblicazione: (2025)
NAMER: Non-Autoregressive Modeling for Handwritten Mathematical Expression Recognition
di: Liu, Chenyu, et al.
Pubblicazione: (2024)
di: Liu, Chenyu, et al.
Pubblicazione: (2024)
VisioMath: Benchmarking Figure-based Mathematical Reasoning in LMMs
di: Li, Can, et al.
Pubblicazione: (2025)
di: Li, Can, et al.
Pubblicazione: (2025)
MathFlow: Enhancing the Perceptual Flow of MLLMs for Visual Mathematical Problems
di: Chen, Shuhang, et al.
Pubblicazione: (2025)
di: Chen, Shuhang, et al.
Pubblicazione: (2025)
ICAL: Implicit Character-Aided Learning for Enhanced Handwritten Mathematical Expression Recognition
di: Zhu, Jianhua, et al.
Pubblicazione: (2024)
di: Zhu, Jianhua, et al.
Pubblicazione: (2024)
UniMERNet: A Universal Network for Real-World Mathematical Expression Recognition
di: Wang, Bin, et al.
Pubblicazione: (2024)
di: Wang, Bin, et al.
Pubblicazione: (2024)
The Cooperative Network Architecture: Learning Structured Networks as Representation of Sensory Patterns
di: Sager, Pascal J., et al.
Pubblicazione: (2024)
di: Sager, Pascal J., et al.
Pubblicazione: (2024)
VAD-Net: Multidimensional Facial Expression Recognition in Intelligent Education System
di: Huo, Yi, et al.
Pubblicazione: (2025)
di: Huo, Yi, et al.
Pubblicazione: (2025)
OccludeNet: A Causal Journey into Mixed-View Actor-Centric Video Action Recognition under Occlusions
di: Zhou, Guanyu, et al.
Pubblicazione: (2024)
di: Zhou, Guanyu, et al.
Pubblicazione: (2024)
Bidirectional Trained Tree-Structured Decoder for Handwritten Mathematical Expression Recognition
di: Cheng, Hanbo, et al.
Pubblicazione: (2023)
di: Cheng, Hanbo, et al.
Pubblicazione: (2023)
AffectNet+: A Database for Enhancing Facial Expression Recognition with Soft-Labels
di: Fard, Ali Pourramezan, et al.
Pubblicazione: (2024)
di: Fard, Ali Pourramezan, et al.
Pubblicazione: (2024)
A document is worth a structured record: Principled inductive bias design for document recognition
di: Meyer, Benjamin, et al.
Pubblicazione: (2025)
di: Meyer, Benjamin, et al.
Pubblicazione: (2025)
Complex Mathematical Expression Recognition: Benchmark, Large-Scale Dataset and Strong Baseline
di: Bai, Weikang, et al.
Pubblicazione: (2025)
di: Bai, Weikang, et al.
Pubblicazione: (2025)
Symbol-Aware Reasoning with Masked Discrete Diffusion for Handwritten Mathematical Expression Recognition
di: Kawakatsu, Takaya, et al.
Pubblicazione: (2026)
di: Kawakatsu, Takaya, et al.
Pubblicazione: (2026)
MathCanvas: Intrinsic Visual Chain-of-Thought for Multimodal Mathematical Reasoning
di: Shi, Weikang, et al.
Pubblicazione: (2025)
di: Shi, Weikang, et al.
Pubblicazione: (2025)
V-Math: An Agentic Approach to the Vietnamese National High School Graduation Mathematics Exams
di: Nguyen, Duong Q., et al.
Pubblicazione: (2025)
di: Nguyen, Duong Q., et al.
Pubblicazione: (2025)
A Data-Centric Approach to Pedestrian Attribute Recognition: Synthetic Augmentation via Prompt-driven Diffusion Models
di: Alonso, Alejandro, et al.
Pubblicazione: (2025)
di: Alonso, Alejandro, et al.
Pubblicazione: (2025)
Assessing the Efficacy of Deep Learning Approaches for Facial Expression Recognition in Individuals with Intellectual Disabilities
di: Gaya-Morey, F. Xavier, et al.
Pubblicazione: (2024)
di: Gaya-Morey, F. Xavier, et al.
Pubblicazione: (2024)
Well-Conditioned Polynomial Representations for Mathematical Handwriting Recognition
di: Corless, Robert M., et al.
Pubblicazione: (2025)
di: Corless, Robert M., et al.
Pubblicazione: (2025)
Data Augmentation and Transfer Learning Approaches Applied to Facial Expressions Recognition
di: Randellini, Enrico, et al.
Pubblicazione: (2024)
di: Randellini, Enrico, et al.
Pubblicazione: (2024)
PAtt-Lite: Lightweight Patch and Attention MobileNet for Challenging Facial Expression Recognition
di: Ngwe, Jia Le, et al.
Pubblicazione: (2023)
di: Ngwe, Jia Le, et al.
Pubblicazione: (2023)
AHMSA-Net: Adaptive Hierarchical Multi-Scale Attention Network for Micro-Expression Recognition
di: Zhang, Lijun, et al.
Pubblicazione: (2025)
di: Zhang, Lijun, et al.
Pubblicazione: (2025)
SemiHMER: Semi-supervised Handwritten Mathematical Expression Recognition using pseudo-labels
di: Chen, Kehua, et al.
Pubblicazione: (2025)
di: Chen, Kehua, et al.
Pubblicazione: (2025)
A Generative Approach for Wikipedia-Scale Visual Entity Recognition
di: Caron, Mathilde, et al.
Pubblicazione: (2024)
di: Caron, Mathilde, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Towards More Accessible Scientific PDFs for People with Visual Impairments: Step-by-Step PDF Remediation to Improve Tag Accuracy
di: Schmitt-Koopmann, Felix M., et al.
Pubblicazione: (2025) -
InCrowd-VI: A Realistic Visual-Inertial Dataset for Evaluating SLAM in Indoor Pedestrian-Rich Spaces for Human Navigation
di: Bamdad, Marziyeh, et al.
Pubblicazione: (2024) -
Deep Learning-Powered Visual SLAM Aimed at Assisting Visually Impaired Navigation
di: Bamdad, Marziyeh, et al.
Pubblicazione: (2025) -
Deep Neural Networks for Automatic Speaker Recognition Do Not Learn Supra-Segmental Temporal Features
di: Neururer, Daniel, et al.
Pubblicazione: (2023) -
SLAM for Visually Impaired People: a Survey
di: Bamdad, Marziyeh, et al.
Pubblicazione: (2022)