Order-Based Pre-training Strategies for Procedural Text Understanding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nandy, Abhilash, Kulkarni, Yash, Goyal, Pawan, Ganguly, Niloy |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
$FastDoc$: Domain-Specific Fast Continual Pre-training Technique using Document-Level Metadata and Taxonomy
par: Nandy, Abhilash, et autres
Publié: (2023)
par: Nandy, Abhilash, et autres
Publié: (2023)
YesBut: A High-Quality Annotated Multimodal Dataset for evaluating Satire Comprehension capability of Vision-Language Models
par: Nandy, Abhilash, et autres
Publié: (2024)
par: Nandy, Abhilash, et autres
Publié: (2024)
REFINE-AF: A Task-Agnostic Framework to Align Language Models via Self-Generated Instructions using Reinforcement Learning from Automated Feedback
par: Roy, Aniruddha, et autres
Publié: (2025)
par: Roy, Aniruddha, et autres
Publié: (2025)
MEDVOC: Vocabulary Adaptation for Fine-tuning Pre-trained Language Models on Medical Text Summarization
par: Balde, Gunjan, et autres
Publié: (2024)
par: Balde, Gunjan, et autres
Publié: (2024)
Program of Thoughts for Financial Reasoning: Leveraging Dynamic In-Context Examples and Generative Retrieval
par: Khatuya, Subhendu, et autres
Publié: (2025)
par: Khatuya, Subhendu, et autres
Publié: (2025)
Known Intents, New Combinations: Clause-Factorized Decoding for Compositional Multi-Intent Detection
par: Nandy, Abhilash
Publié: (2026)
par: Nandy, Abhilash
Publié: (2026)
A Pointer Network-based Approach for Joint Extraction and Detection of Multi-Label Multi-Class Intents
par: Mullick, Ankan, et autres
Publié: (2024)
par: Mullick, Ankan, et autres
Publié: (2024)
IDALC: A Semi-Supervised Framework for Intent Detection and Active Learning based Correction
par: Mullick, Ankan, et autres
Publié: (2025)
par: Mullick, Ankan, et autres
Publié: (2025)
How Robust are the Tabular QA Models for Scientific Tables? A Study using Customized Dataset
par: Ghosh, Akash, et autres
Publié: (2024)
par: Ghosh, Akash, et autres
Publié: (2024)
Efficient Continual Pre-training of LLMs for Low-resource Languages
par: Nag, Arijit, et autres
Publié: (2024)
par: Nag, Arijit, et autres
Publié: (2024)
Label-semantics Aware Generative Approach for Domain-Agnostic Multilabel Classification
par: Khatuya, Subhendu, et autres
Publié: (2025)
par: Khatuya, Subhendu, et autres
Publié: (2025)
Instruction-Guided Bullet Point Summarization of Long Financial Earnings Call Transcripts
par: Khatuya, Subhendu, et autres
Publié: (2024)
par: Khatuya, Subhendu, et autres
Publié: (2024)
SERPENT-VLM : Self-Refining Radiology Report Generation Using Vision Language Models
par: Kapadnis, Manav Nitin, et autres
Publié: (2024)
par: Kapadnis, Manav Nitin, et autres
Publié: (2024)
Leveraging Self-Attention for Input-Dependent Soft Prompting in LLMs
par: Muppidi, Ananth, et autres
Publié: (2025)
par: Muppidi, Ananth, et autres
Publié: (2025)
Long Dialog Summarization: An Analysis
par: Mullick, Ankan, et autres
Publié: (2024)
par: Mullick, Ankan, et autres
Publié: (2024)
Evaluation of LLMs in Medical Text Summarization: The Role of Vocabulary Adaptation in High OOV Settings
par: Balde, Gunjan, et autres
Publié: (2025)
par: Balde, Gunjan, et autres
Publié: (2025)
Parameter-Efficient Instruction Tuning of Large Language Models For Extreme Financial Numeral Labelling
par: Khatuya, Subhendu, et autres
Publié: (2024)
par: Khatuya, Subhendu, et autres
Publié: (2024)
On The Persona-based Summarization of Domain-Specific Documents
par: Mullick, Ankan, et autres
Publié: (2024)
par: Mullick, Ankan, et autres
Publié: (2024)
Learning Faster with Better Tokens: Parameter-Efficient Vocabulary Adaptation for Specialized Text Summarization
par: Balde, Gunjan, et autres
Publié: (2026)
par: Balde, Gunjan, et autres
Publié: (2026)
Introducing Spotlight: A Novel Approach for Generating Captivating Key Information from Documents
par: Mullick, Ankan, et autres
Publié: (2025)
par: Mullick, Ankan, et autres
Publié: (2025)
Leveraging the Power of LLMs: A Fine-Tuning Approach for High-Quality Aspect-Based Summarization
par: Mullick, Ankan, et autres
Publié: (2024)
par: Mullick, Ankan, et autres
Publié: (2024)
$\left|\,\circlearrowright\,\boxed{\text{BUS}}\,\right|$: A Large and Diverse Multimodal Benchmark for evaluating the ability of Vision-Language Models to understand Rebus Puzzles
par: Das, Trishanu, et autres
Publié: (2025)
par: Das, Trishanu, et autres
Publié: (2025)
Leveraging Large Language Models for Predictive Analysis of Human Misery
par: Seal, Bishanka, et autres
Publié: (2025)
par: Seal, Bishanka, et autres
Publié: (2025)
Unlocking Efficiency: Adaptive Masking for Gene Transformer Models
par: Roy, Soumyadeep, et autres
Publié: (2024)
par: Roy, Soumyadeep, et autres
Publié: (2024)
Text Takes Over: A Study of Modality Bias in Multimodal Intent Detection
par: Mullick, Ankan, et autres
Publié: (2025)
par: Mullick, Ankan, et autres
Publié: (2025)
IL-TUR: Benchmark for Indian Legal Text Understanding and Reasoning
par: Joshi, Abhinav, et autres
Publié: (2024)
par: Joshi, Abhinav, et autres
Publié: (2024)
Cost-Performance Optimization for Processing Low-Resource Language Tasks Using Commercial LLMs
par: Nag, Arijit, et autres
Publié: (2024)
par: Nag, Arijit, et autres
Publié: (2024)
Adaptive BPE Tokenization for Enhanced Vocabulary Adaptation in Finetuning Pretrained Language Models
par: Balde, Gunjan, et autres
Publié: (2024)
par: Balde, Gunjan, et autres
Publié: (2024)
Breaking Token Into Concepts: Exploring Extreme Compression in Token Representation Via Compositional Shared Semantics
par: R V, Kavin, et autres
Publié: (2025)
par: R V, Kavin, et autres
Publié: (2025)
Intent Detection and Entity Extraction from BioMedical Literature
par: Mullick, Ankan, et autres
Publié: (2024)
par: Mullick, Ankan, et autres
Publié: (2024)
Error-Aware Curriculum Learning for Biomedical Relation Classification
par: Chakraborty, Sinchani, et autres
Publié: (2025)
par: Chakraborty, Sinchani, et autres
Publié: (2025)
Text-to-Code Generation with Modality-relative Pre-training
par: Christopoulou, Fenia, et autres
Publié: (2024)
par: Christopoulou, Fenia, et autres
Publié: (2024)
Reasoning Core: A Scalable Procedural Data Generation Suite for Symbolic Pre-training and Post-Training
par: Lacombe, Valentin, et autres
Publié: (2026)
par: Lacombe, Valentin, et autres
Publié: (2026)
Reinforcing Code Generation: Improving Text-to-SQL with Execution-Based Learning
par: Kulkarni, Atharv, et autres
Publié: (2025)
par: Kulkarni, Atharv, et autres
Publié: (2025)
CSSL: Contrastive Self-Supervised Learning for Dependency Parsing on Relatively Free Word Ordered and Morphologically Rich Low Resource Languages
par: Ray, Pretam, et autres
Publié: (2024)
par: Ray, Pretam, et autres
Publié: (2024)
ILSIC: Corpora for Identifying Indian Legal Statutes from Queries by Laypeople
par: Paul, Shounak, et autres
Publié: (2026)
par: Paul, Shounak, et autres
Publié: (2026)
EduVidQA: Generating and Evaluating Long-form Answers to Student Questions based on Lecture Videos
par: Ray, Sourjyadip, et autres
Publié: (2025)
par: Ray, Sourjyadip, et autres
Publié: (2025)
A Survey of Pre-trained Language Models for Processing Scientific Text
par: Ho, Xanh, et autres
Publié: (2024)
par: Ho, Xanh, et autres
Publié: (2024)
Benchmarking the Energy Savings with Speculative Decoding Strategies
par: Dutta, Rohit, et autres
Publié: (2026)
par: Dutta, Rohit, et autres
Publié: (2026)
Text Embeddings by Weakly-Supervised Contrastive Pre-training
par: Wang, Liang, et autres
Publié: (2022)
par: Wang, Liang, et autres
Publié: (2022)
Documents similaires
-
$FastDoc$: Domain-Specific Fast Continual Pre-training Technique using Document-Level Metadata and Taxonomy
par: Nandy, Abhilash, et autres
Publié: (2023) -
YesBut: A High-Quality Annotated Multimodal Dataset for evaluating Satire Comprehension capability of Vision-Language Models
par: Nandy, Abhilash, et autres
Publié: (2024) -
REFINE-AF: A Task-Agnostic Framework to Align Language Models via Self-Generated Instructions using Reinforcement Learning from Automated Feedback
par: Roy, Aniruddha, et autres
Publié: (2025) -
MEDVOC: Vocabulary Adaptation for Fine-tuning Pre-trained Language Models on Medical Text Summarization
par: Balde, Gunjan, et autres
Publié: (2024) -
Program of Thoughts for Financial Reasoning: Leveraging Dynamic In-Context Examples and Generative Retrieval
par: Khatuya, Subhendu, et autres
Publié: (2025)