RanLayNet: A Dataset for Document Layout Detection used for Domain Adaptation and Generalization
Fuente:
arXiv
Salvato in:
| Autori principali: | Anand, Avinash, Jaiswal, Raj, Gupta, Mohit, Bangar, Siddhesh S, Bhuyan, Pijush, Lal, Naman, Singh, Rajeev, Jha, Ritika, Shah, Rajiv Ratn, Satoh, Shin'ichi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TC-OCR: TableCraft OCR for Efficient Detection & Recognition of Table Structure & Content
di: Anand, Avinash, et al.
Pubblicazione: (2024)
di: Anand, Avinash, et al.
Pubblicazione: (2024)
Certified Zeroth-order Black-Box Defense with Robust UNet Denoiser
di: Verma, Astha, et al.
Pubblicazione: (2023)
di: Verma, Astha, et al.
Pubblicazione: (2023)
Advancements in Scientific Controllable Text Generation Methods
di: Goel, Arnav, et al.
Pubblicazione: (2023)
di: Goel, Arnav, et al.
Pubblicazione: (2023)
KG-CTG: Citation Generation through Knowledge Graph-guided Large Language Models
di: Anand, Avinash, et al.
Pubblicazione: (2024)
di: Anand, Avinash, et al.
Pubblicazione: (2024)
Context-Enhanced Language Models for Generating Multi-Paper Citations
di: Anand, Avinash, et al.
Pubblicazione: (2024)
di: Anand, Avinash, et al.
Pubblicazione: (2024)
Keystroke Dynamics Against Academic Dishonesty in the Age of LLMs
di: Kundu, Debnath, et al.
Pubblicazione: (2024)
di: Kundu, Debnath, et al.
Pubblicazione: (2024)
Su-RoBERTa: A Semi-supervised Approach to Predicting Suicide Risk through Social Media using Base Language Models
di: Tank, Chayan, et al.
Pubblicazione: (2024)
di: Tank, Chayan, et al.
Pubblicazione: (2024)
Improving Physics Reasoning in Large Language Models Using Mixture of Refinement Agents
di: Jaiswal, Raj, et al.
Pubblicazione: (2024)
di: Jaiswal, Raj, et al.
Pubblicazione: (2024)
Multilingual Mathematical Reasoning: Advancing Open-Source LLMs in Hindi and English
di: Anand, Avinash, et al.
Pubblicazione: (2024)
di: Anand, Avinash, et al.
Pubblicazione: (2024)
MM-PhyRLHF: Reinforcement Learning Framework for Multimodal Physics Question-Answering
di: Kapuriya, Janak, et al.
Pubblicazione: (2024)
di: Kapuriya, Janak, et al.
Pubblicazione: (2024)
Med-CoDE: Medical Critique based Disagreement Evaluation Framework
di: Gupta, Mohit, et al.
Pubblicazione: (2025)
di: Gupta, Mohit, et al.
Pubblicazione: (2025)
Mathify: Evaluating Large Language Models on Mathematical Problem Solving Tasks
di: Anand, Avinash, et al.
Pubblicazione: (2024)
di: Anand, Avinash, et al.
Pubblicazione: (2024)
Improving Multimodal LLMs Ability In Geometry Problem Solving, Reasoning, And Multistep Scoring
di: Anand, Avinash, et al.
Pubblicazione: (2024)
di: Anand, Avinash, et al.
Pubblicazione: (2024)
Depression Detection and Analysis using Large Language Models on Textual and Audio-Visual Modalities
di: Tank, Chayan, et al.
Pubblicazione: (2024)
di: Tank, Chayan, et al.
Pubblicazione: (2024)
MM-PhyQA: Multimodal Physics Question-Answering With Multi-Image CoT Prompting
di: Anand, Avinash, et al.
Pubblicazione: (2024)
di: Anand, Avinash, et al.
Pubblicazione: (2024)
On Optimal Steering to Achieve Exact Fairness
di: Sharma, Mohit, et al.
Pubblicazione: (2025)
di: Sharma, Mohit, et al.
Pubblicazione: (2025)
Enhancing LLMs for Physics Problem-Solving using Reinforcement Learning with Human-AI Feedback
di: Anand, Avinash, et al.
Pubblicazione: (2024)
di: Anand, Avinash, et al.
Pubblicazione: (2024)
Speech Representation Learning Revisited: The Necessity of Separate Learnable Parameters and Robust Data Augmentation
di: Yadav, Hemant, et al.
Pubblicazione: (2024)
di: Yadav, Hemant, et al.
Pubblicazione: (2024)
LittiChoQA: Literary Texts in Indic Languages Chosen for Question Answering
di: Khandelwal, Aarya, et al.
Pubblicazione: (2026)
di: Khandelwal, Aarya, et al.
Pubblicazione: (2026)
RConE: Rough Cone Embedding for Multi-Hop Logical Query Answering on Multi-Modal Knowledge Graphs
di: Kharbanda, Mayank, et al.
Pubblicazione: (2024)
di: Kharbanda, Mayank, et al.
Pubblicazione: (2024)
Analysing the Masked predictive coding training criterion for pre-training a Speech Representation Model
di: Yadav, Hemant, et al.
Pubblicazione: (2023)
di: Yadav, Hemant, et al.
Pubblicazione: (2023)
Long-context Non-factoid Question Answering in Indic Languages
di: Mishra, Ritwik, et al.
Pubblicazione: (2025)
di: Mishra, Ritwik, et al.
Pubblicazione: (2025)
MS-HuBERT: Mitigating Pre-training and Inference Mismatch in Masked Language Modelling methods for learning Speech Representations
di: Yadav, Hemant, et al.
Pubblicazione: (2024)
di: Yadav, Hemant, et al.
Pubblicazione: (2024)
JOOCI: a Framework for Learning Comprehensive Speech Representations
di: Yadav, Hemant, et al.
Pubblicazione: (2024)
di: Yadav, Hemant, et al.
Pubblicazione: (2024)
Steps are all you need: Rethinking STEM Education with Prompt Engineering
di: Addala, Krishnasai, et al.
Pubblicazione: (2024)
di: Addala, Krishnasai, et al.
Pubblicazione: (2024)
Better and Worse with Scale: How Contextual Entrainment Diverges with Model Size
di: Kukreja, Dikshant, et al.
Pubblicazione: (2026)
di: Kukreja, Dikshant, et al.
Pubblicazione: (2026)
ReSeDis: A Dataset for Referring-based Object Search across Large-Scale Image Collections
di: Huang, Ziling, et al.
Pubblicazione: (2025)
di: Huang, Ziling, et al.
Pubblicazione: (2025)
Structured Definitions and Segmentations for Legal Reasoning in LLMs: A Study on Indian Legal Data
di: Khatri, Mann, et al.
Pubblicazione: (2025)
di: Khatri, Mann, et al.
Pubblicazione: (2025)
Multilingual Coreference Resolution in Low-resource South Asian Languages
di: Mishra, Ritwik, et al.
Pubblicazione: (2024)
di: Mishra, Ritwik, et al.
Pubblicazione: (2024)
Spiritual-LLM : Gita Inspired Mental Health Therapy In the Era of LLMs
di: Kapuriya, Janak, et al.
Pubblicazione: (2025)
di: Kapuriya, Janak, et al.
Pubblicazione: (2025)
Multilingual Non-Factoid Question Answering with Answer Paragraph Selection
di: Mishra, Ritwik, et al.
Pubblicazione: (2024)
di: Mishra, Ritwik, et al.
Pubblicazione: (2024)
DubWise: Video-Guided Speech Duration Control in Multimodal LLM-based Text-to-Speech for Dubbing
di: Sahipjohn, Neha, et al.
Pubblicazione: (2024)
di: Sahipjohn, Neha, et al.
Pubblicazione: (2024)
VECL-TTS: Voice identity and Emotional style controllable Cross-Lingual Text-to-Speech
di: Gudmalwar, Ashishkumar, et al.
Pubblicazione: (2024)
di: Gudmalwar, Ashishkumar, et al.
Pubblicazione: (2024)
Knowledge Graphs are all you need: Leveraging KGs in Physics Question Answering
di: Addala, Krishnasai, et al.
Pubblicazione: (2024)
di: Addala, Krishnasai, et al.
Pubblicazione: (2024)
EmoReg: Directional Latent Vector Modeling for Emotional Intensity Regularization in Diffusion-based Voice Conversion
di: Gudmalwar, Ashishkumar, et al.
Pubblicazione: (2024)
di: Gudmalwar, Ashishkumar, et al.
Pubblicazione: (2024)
Reconstruction Guided Few-shot Network For Remote Sensing Image Classification
di: Jaiswal, Mohit, et al.
Pubblicazione: (2026)
di: Jaiswal, Mohit, et al.
Pubblicazione: (2026)
The Effects of Short Video-Sharing Services on Video Copy Detection
di: Yanagi, Rintaro, et al.
Pubblicazione: (2024)
di: Yanagi, Rintaro, et al.
Pubblicazione: (2024)
Probabilistic Online Event Downsampling
di: Girbau-Xalabarder, Andreu, et al.
Pubblicazione: (2025)
di: Girbau-Xalabarder, Andreu, et al.
Pubblicazione: (2025)
Enhancing Scientific Visual Question Answering via Vision-Caption aware Supervised Fine-Tuning
di: Kapuriya, Janak, et al.
Pubblicazione: (2025)
di: Kapuriya, Janak, et al.
Pubblicazione: (2025)
Advances in Nanomaterial Synthesis for Enhanced Latent Fingerprint Visualization: A Comprehensive Review
di: Priyanka Chhabra, et al.
Pubblicazione: (2026)
di: Priyanka Chhabra, et al.
Pubblicazione: (2026)
Documenti analoghi
-
TC-OCR: TableCraft OCR for Efficient Detection & Recognition of Table Structure & Content
di: Anand, Avinash, et al.
Pubblicazione: (2024) -
Certified Zeroth-order Black-Box Defense with Robust UNet Denoiser
di: Verma, Astha, et al.
Pubblicazione: (2023) -
Advancements in Scientific Controllable Text Generation Methods
di: Goel, Arnav, et al.
Pubblicazione: (2023) -
KG-CTG: Citation Generation through Knowledge Graph-guided Large Language Models
di: Anand, Avinash, et al.
Pubblicazione: (2024) -
Context-Enhanced Language Models for Generating Multi-Paper Citations
di: Anand, Avinash, et al.
Pubblicazione: (2024)