ABEX: Data Augmentation for Low-Resource NLU via Expanding Abstract Descriptions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ghosh, Sreyan, Tyagi, Utkarsh, Kumar, Sonal, Evuru, C. K., Ramaneswaran, S, Sakshi, S, Manocha, Dinesh |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CoDa: Constrained Generation based Data Augmentation for Low-Resource NLP
par: Evuru, Chandra Kiran Reddy, et autres
Publié: (2024)
par: Evuru, Chandra Kiran Reddy, et autres
Publié: (2024)
ASPIRE: Language-Guided Data Augmentation for Improving Robustness Against Spurious Correlations
par: Ghosh, Sreyan, et autres
Publié: (2023)
par: Ghosh, Sreyan, et autres
Publié: (2023)
CompA: Addressing the Gap in Compositional Reasoning in Audio-Language Models
par: Ghosh, Sreyan, et autres
Publié: (2023)
par: Ghosh, Sreyan, et autres
Publié: (2023)
Do Vision-Language Models Understand Compound Nouns?
par: Kumar, Sonal, et autres
Publié: (2024)
par: Kumar, Sonal, et autres
Publié: (2024)
Visual Description Grounding Reduces Hallucinations and Boosts Reasoning in LVLMs
par: Ghosh, Sreyan, et autres
Publié: (2024)
par: Ghosh, Sreyan, et autres
Publié: (2024)
EH-MAM: Easy-to-Hard Masked Acoustic Modeling for Self-Supervised Speech Representation Learning
par: Seth, Ashish, et autres
Publié: (2024)
par: Seth, Ashish, et autres
Publié: (2024)
MMAU: A Massive Multi-Task Audio Understanding and Reasoning Benchmark
par: Sakshi, S, et autres
Publié: (2024)
par: Sakshi, S, et autres
Publié: (2024)
RECAP: Retrieval-Augmented Audio Captioning
par: Ghosh, Sreyan, et autres
Publié: (2023)
par: Ghosh, Sreyan, et autres
Publié: (2023)
GAMA: A Large Audio-Language Model with Advanced Audio Understanding and Complex Reasoning Abilities
par: Ghosh, Sreyan, et autres
Publié: (2024)
par: Ghosh, Sreyan, et autres
Publié: (2024)
A Closer Look at the Limitations of Instruction Tuning
par: Ghosh, Sreyan, et autres
Publié: (2024)
par: Ghosh, Sreyan, et autres
Publié: (2024)
MultiVox: A Benchmark for Evaluating Voice Assistants for Multimodal Interactions
par: Selvakumar, Ramaneswaran, et autres
Publié: (2025)
par: Selvakumar, Ramaneswaran, et autres
Publié: (2025)
LipGER: Visually-Conditioned Generative Error Correction for Robust Automatic Speech Recognition
par: Ghosh, Sreyan, et autres
Publié: (2024)
par: Ghosh, Sreyan, et autres
Publié: (2024)
Synthio: Augmenting Small-Scale Audio Classification Datasets with Synthetic Data
par: Ghosh, Sreyan, et autres
Publié: (2024)
par: Ghosh, Sreyan, et autres
Publié: (2024)
EGOILLUSION: Benchmarking Hallucinations in Egocentric Video Understanding
par: Seth, Ashish, et autres
Publié: (2025)
par: Seth, Ashish, et autres
Publié: (2025)
Do Audio-Visual Large Language Models Really See and Hear?
par: Selvakumar, Ramaneswaran, et autres
Publié: (2026)
par: Selvakumar, Ramaneswaran, et autres
Publié: (2026)
ReCLAP: Improving Zero Shot Audio Classification by Describing Sounds
par: Ghosh, Sreyan, et autres
Publié: (2024)
par: Ghosh, Sreyan, et autres
Publié: (2024)
PAT: Parameter-Free Audio-Text Aligner to Boost Zero-Shot Audio Classification
par: Seth, Ashish, et autres
Publié: (2024)
par: Seth, Ashish, et autres
Publié: (2024)
ProSE: Diffusion Priors for Speech Enhancement
par: Kumar, Sonal, et autres
Publié: (2025)
par: Kumar, Sonal, et autres
Publié: (2025)
Audio Flamingo 2: An Audio-Language Model with Long-Audio Understanding and Expert Reasoning Abilities
par: Ghosh, Sreyan, et autres
Publié: (2025)
par: Ghosh, Sreyan, et autres
Publié: (2025)
Do Audio-Language Models Understand Linguistic Variations?
par: Selvakumar, Ramaneswaran, et autres
Publié: (2024)
par: Selvakumar, Ramaneswaran, et autres
Publié: (2024)
Audio Hallucination Attacks: Probing the Reliability of Large Audio Language Models
par: Seth, Ashish, et autres
Publié: (2026)
par: Seth, Ashish, et autres
Publié: (2026)
AV-RIR: Audio-Visual Room Impulse Response Estimation
par: Ratnarajah, Anton, et autres
Publié: (2023)
par: Ratnarajah, Anton, et autres
Publié: (2023)
SPUR: A Plug-and-Play Framework for Integrating Spatial Audio Understanding and Reasoning into Large Audio-Language Models
par: Sakshi, S, et autres
Publié: (2025)
par: Sakshi, S, et autres
Publié: (2025)
Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples
par: Ghosal, Soumya Suvra, et autres
Publié: (2025)
par: Ghosal, Soumya Suvra, et autres
Publié: (2025)
Failing Forward: Improving Generative Error Correction for ASR with Synthetic Data and Retrieval Augmentation
par: Ghosh, Sreyan, et autres
Publié: (2024)
par: Ghosh, Sreyan, et autres
Publié: (2024)
Audio Flamingo 3: Advancing Audio Intelligence with Fully Open Large Audio Language Models
par: Goel, Arushi, et autres
Publié: (2025)
par: Goel, Arushi, et autres
Publié: (2025)
PromptRefine: Enhancing Few-Shot Performance on Low-Resource Indic Languages with Example Selection from Related Example Banks
par: Ghosal, Soumya Suvra, et autres
Publié: (2024)
par: Ghosal, Soumya Suvra, et autres
Publié: (2024)
Eigen Attention: Attention in Low-Rank Space for KV Cache Compression
par: Saxena, Utkarsh, et autres
Publié: (2024)
par: Saxena, Utkarsh, et autres
Publié: (2024)
Multi-Domain Audio Question Answering Benchmark Toward Acoustic Content Reasoning
par: Yang, Chao-Han Huck, et autres
Publié: (2025)
par: Yang, Chao-Han Huck, et autres
Publié: (2025)
Video-Robin: Autoregressive Diffusion Planning for Intent-Grounded Video-to-Music Generation
par: Lokegaonkar, Vaibhavi, et autres
Publié: (2026)
par: Lokegaonkar, Vaibhavi, et autres
Publié: (2026)
LLM-Augmented Symbolic NLU System for More Reliable Continuous Causal Statement Interpretation
par: Lian, Xin, et autres
Publié: (2025)
par: Lian, Xin, et autres
Publié: (2025)
What Drives Representation Steering? A Mechanistic Case Study on Steering Refusal
par: Cheng, Stephen, et autres
Publié: (2026)
par: Cheng, Stephen, et autres
Publié: (2026)
Retrieval-Augmented Data Augmentation for Low-Resource Domain Tasks
par: Seo, Minju, et autres
Publié: (2024)
par: Seo, Minju, et autres
Publié: (2024)
Can LLMs Augment Low-Resource Reading Comprehension Datasets? Opportunities and Challenges
par: Samuel, Vinay, et autres
Publié: (2023)
par: Samuel, Vinay, et autres
Publié: (2023)
Conditional Semi-Supervised Data Augmentation for Spam Message Detection with Low Resource Data
par: Nuha, Ulin, et autres
Publié: (2024)
par: Nuha, Ulin, et autres
Publié: (2024)
PANER: A Paraphrase-Augmented Framework for Low-Resource Named Entity Recognition
par: Rengarajan, Nanda Kumar, et autres
Publié: (2025)
par: Rengarajan, Nanda Kumar, et autres
Publié: (2025)
An Effective Deployment of Diffusion LM for Data Augmentation in Low-Resource Sentiment Classification
par: Chen, Zhuowei, et autres
Publié: (2024)
par: Chen, Zhuowei, et autres
Publié: (2024)
Can an Embodied Agent Find Your "Cat-shaped Mug"? LLM-Guided Exploration for Zero-Shot Object Navigation
par: Dorbala, Vishnu Sashank, et autres
Publié: (2023)
par: Dorbala, Vishnu Sashank, et autres
Publié: (2023)
Targeted Augmentation for Low-Resource Event Extraction
par: Wang, Sijia, et autres
Publié: (2024)
par: Wang, Sijia, et autres
Publié: (2024)
Learning Shortcuts: On the Misleading Promise of NLU in Language Models
par: Bihani, Geetanjali, et autres
Publié: (2024)
par: Bihani, Geetanjali, et autres
Publié: (2024)
Documents similaires
-
CoDa: Constrained Generation based Data Augmentation for Low-Resource NLP
par: Evuru, Chandra Kiran Reddy, et autres
Publié: (2024) -
ASPIRE: Language-Guided Data Augmentation for Improving Robustness Against Spurious Correlations
par: Ghosh, Sreyan, et autres
Publié: (2023) -
CompA: Addressing the Gap in Compositional Reasoning in Audio-Language Models
par: Ghosh, Sreyan, et autres
Publié: (2023) -
Do Vision-Language Models Understand Compound Nouns?
par: Kumar, Sonal, et autres
Publié: (2024) -
Visual Description Grounding Reduces Hallucinations and Boosts Reasoning in LVLMs
par: Ghosh, Sreyan, et autres
Publié: (2024)