Image-to-LaTeX Converter for Mathematical Formulas and Text
Fuente:
arXiv
Guardado en:
| Autores principales: | Gurgurov, Daniil, Morshnev, Aleksey |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Automated LaTeX Code Generation from Handwritten Math Expressions Using Vision Transformer
por: Sundararaj, Jayaprakash, et al.
Publicado: (2024)
por: Sundararaj, Jayaprakash, et al.
Publicado: (2024)
Speech-to-LaTeX: New Models and Datasets for Converting Spoken Equations and Sentences
por: Korzh, Dmitrii, et al.
Publicado: (2025)
por: Korzh, Dmitrii, et al.
Publicado: (2025)
$A^2R^2$: Advancing Img2LaTeX Conversion via Visual Reasoning with Attention-Guided Refinement
por: Li, Zhecheng, et al.
Publicado: (2025)
por: Li, Zhecheng, et al.
Publicado: (2025)
Image Over Text: Transforming Formula Recognition Evaluation with Character Detection Matching
por: Wang, Bin, et al.
Publicado: (2024)
por: Wang, Bin, et al.
Publicado: (2024)
Image2Text2Image: A Novel Framework for Label-Free Evaluation of Image-to-Text Generation with Text-to-Image Diffusion Models
por: Huang, Jia-Hong, et al.
Publicado: (2024)
por: Huang, Jia-Hong, et al.
Publicado: (2024)
TextTIGER: Text-based Intelligent Generation with Entity Prompt Refinement for Text-to-Image Generation
por: Ozaki, Shintaro, et al.
Publicado: (2025)
por: Ozaki, Shintaro, et al.
Publicado: (2025)
Optimizing Prompts for Text-to-Image Generation
por: Hao, Yaru, et al.
Publicado: (2022)
por: Hao, Yaru, et al.
Publicado: (2022)
IW-Bench: Evaluating Large Multimodal Models for Converting Image-to-Web
por: Guo, Hongcheng, et al.
Publicado: (2024)
por: Guo, Hongcheng, et al.
Publicado: (2024)
Fast Prompt Alignment for Text-to-Image Generation
por: Mrini, Khalil, et al.
Publicado: (2024)
por: Mrini, Khalil, et al.
Publicado: (2024)
Precision or Recall? An Analysis of Image Captions for Training Text-to-Image Generation Model
por: Cheng, Sheng, et al.
Publicado: (2024)
por: Cheng, Sheng, et al.
Publicado: (2024)
Quality-Aware Image-Text Alignment for Opinion-Unaware Image Quality Assessment
por: Agnolucci, Lorenzo, et al.
Publicado: (2024)
por: Agnolucci, Lorenzo, et al.
Publicado: (2024)
Emergent Visual-Semantic Hierarchies in Image-Text Representations
por: Alper, Morris, et al.
Publicado: (2024)
por: Alper, Morris, et al.
Publicado: (2024)
Universal Prompt Optimizer for Safe Text-to-Image Generation
por: Wu, Zongyu, et al.
Publicado: (2024)
por: Wu, Zongyu, et al.
Publicado: (2024)
Evaluating the Evaluators: Metrics for Compositional Text-to-Image Generation
por: Kasaei, Seyed Amir, et al.
Publicado: (2025)
por: Kasaei, Seyed Amir, et al.
Publicado: (2025)
DiffChat: Learning to Chat with Text-to-Image Synthesis Models for Interactive Image Creation
por: Wang, Jiapeng, et al.
Publicado: (2024)
por: Wang, Jiapeng, et al.
Publicado: (2024)
Improving Text-to-Image Consistency via Automatic Prompt Optimization
por: Mañas, Oscar, et al.
Publicado: (2024)
por: Mañas, Oscar, et al.
Publicado: (2024)
VIXEN: Visual Text Comparison Network for Image Difference Captioning
por: Black, Alexander, et al.
Publicado: (2024)
por: Black, Alexander, et al.
Publicado: (2024)
Navigating Text-to-Image Generative Bias across Indic Languages
por: Mittal, Surbhi, et al.
Publicado: (2024)
por: Mittal, Surbhi, et al.
Publicado: (2024)
Interleaved Scene Graphs for Interleaved Text-and-Image Generation Assessment
por: Chen, Dongping, et al.
Publicado: (2024)
por: Chen, Dongping, et al.
Publicado: (2024)
Composition and Deformance: Measuring Imageability with a Text-to-Image Model
por: Wu, Si, et al.
Publicado: (2023)
por: Wu, Si, et al.
Publicado: (2023)
Mismatch Quest: Visual and Textual Feedback for Image-Text Misalignment
por: Gordon, Brian, et al.
Publicado: (2023)
por: Gordon, Brian, et al.
Publicado: (2023)
Multimodal Representation Alignment for Image Generation: Text-Image Interleaved Control Is Easier Than You Think
por: Chen, Liang, et al.
Publicado: (2025)
por: Chen, Liang, et al.
Publicado: (2025)
Beyond Filtering: Adaptive Image-Text Quality Enhancement for MLLM Pretraining
por: Huang, Han, et al.
Publicado: (2024)
por: Huang, Han, et al.
Publicado: (2024)
Multi-Modal 3D Mesh Reconstruction from Images and Text
por: Reka, Melvin, et al.
Publicado: (2025)
por: Reka, Melvin, et al.
Publicado: (2025)
Improving Brain-to-Image Reconstruction via Fine-Grained Text Bridging
por: Xia, Runze, et al.
Publicado: (2025)
por: Xia, Runze, et al.
Publicado: (2025)
Hallucination as an Upper Bound: A New Perspective on Text-to-Image Evaluation
por: Kasaei, Seyed Amir, et al.
Publicado: (2025)
por: Kasaei, Seyed Amir, et al.
Publicado: (2025)
VisRet: Visualization Improves Knowledge-Intensive Text-to-Image Retrieval
por: Wu, Di, et al.
Publicado: (2025)
por: Wu, Di, et al.
Publicado: (2025)
Leopard: A Vision Language Model For Text-Rich Multi-Image Tasks
por: Jia, Mengzhao, et al.
Publicado: (2024)
por: Jia, Mengzhao, et al.
Publicado: (2024)
FINEMATCH: Aspect-based Fine-grained Image and Text Mismatch Detection and Correction
por: Hua, Hang, et al.
Publicado: (2024)
por: Hua, Hang, et al.
Publicado: (2024)
MVAM: Multi-View Attention Method for Fine-grained Image-Text Matching
por: Cui, Wanqing, et al.
Publicado: (2024)
por: Cui, Wanqing, et al.
Publicado: (2024)
Finetuned Multimodal Language Models Are High-Quality Image-Text Data Filters
por: Wang, Weizhi, et al.
Publicado: (2024)
por: Wang, Weizhi, et al.
Publicado: (2024)
Erasing 'Ugly' from the Internet: Propagation of the Beauty Myth in Text-Image Models
por: Dinkar, Tanvi, et al.
Publicado: (2025)
por: Dinkar, Tanvi, et al.
Publicado: (2025)
LLaVAR: Enhanced Visual Instruction Tuning for Text-Rich Image Understanding
por: Zhang, Yanzhe, et al.
Publicado: (2023)
por: Zhang, Yanzhe, et al.
Publicado: (2023)
Text-Only Training for Image Captioning with Retrieval Augmentation and Modality Gap Correction
por: Fonseca, Rui, et al.
Publicado: (2025)
por: Fonseca, Rui, et al.
Publicado: (2025)
R2I-Bench: Benchmarking Reasoning-Driven Text-to-Image Generation
por: Chen, Kaijie, et al.
Publicado: (2025)
por: Chen, Kaijie, et al.
Publicado: (2025)
MoTe: Learning Motion-Text Diffusion Model for Multiple Generation Tasks
por: Wu, Yiming, et al.
Publicado: (2024)
por: Wu, Yiming, et al.
Publicado: (2024)
MedCLIP-SAMv2: Towards Universal Text-Driven Medical Image Segmentation
por: Koleilat, Taha, et al.
Publicado: (2024)
por: Koleilat, Taha, et al.
Publicado: (2024)
BIMCV-R: A Landmark Dataset for 3D CT Text-Image Retrieval
por: Chen, Yinda, et al.
Publicado: (2024)
por: Chen, Yinda, et al.
Publicado: (2024)
Beyond Image-Text Matching: Verb Understanding in Multimodal Transformers Using Guided Masking
por: Beňová, Ivana, et al.
Publicado: (2024)
por: Beňová, Ivana, et al.
Publicado: (2024)
Multimodal RewardBench 2: Evaluating Omni Reward Models for Interleaved Text and Image
por: Hu, Yushi, et al.
Publicado: (2025)
por: Hu, Yushi, et al.
Publicado: (2025)
Ejemplares similares
-
Automated LaTeX Code Generation from Handwritten Math Expressions Using Vision Transformer
por: Sundararaj, Jayaprakash, et al.
Publicado: (2024) -
Speech-to-LaTeX: New Models and Datasets for Converting Spoken Equations and Sentences
por: Korzh, Dmitrii, et al.
Publicado: (2025) -
$A^2R^2$: Advancing Img2LaTeX Conversion via Visual Reasoning with Attention-Guided Refinement
por: Li, Zhecheng, et al.
Publicado: (2025) -
Image Over Text: Transforming Formula Recognition Evaluation with Character Detection Matching
por: Wang, Bin, et al.
Publicado: (2024) -
Image2Text2Image: A Novel Framework for Label-Free Evaluation of Image-to-Text Generation with Text-to-Image Diffusion Models
por: Huang, Jia-Hong, et al.
Publicado: (2024)