Universal Cross-Lingual Text Classification
Fuente:
arXiv
Salvato in:
| Autori principali: | Savant, Riya, Shelke, Anushka, Todmal, Sakshi, Kanphade, Sanskruti, Joshi, Ananya, Joshi, Raviraj |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards Building Efficient Sentence BERT Models using Layer Pruning
di: Shelke, Anushka, et al.
Pubblicazione: (2024)
di: Shelke, Anushka, et al.
Pubblicazione: (2024)
L3Cube-MahaSTS: A Marathi Sentence Similarity Dataset and Models
di: Mirashi, Aishwarya, et al.
Pubblicazione: (2025)
di: Mirashi, Aishwarya, et al.
Pubblicazione: (2025)
A Data Selection Approach for Enhancing Low Resource Machine Translation Using Cross-Lingual Sentence Representations
di: Kowtal, Nidhi, et al.
Pubblicazione: (2024)
di: Kowtal, Nidhi, et al.
Pubblicazione: (2024)
MahaParaphrase: A Marathi Paraphrase Detection Corpus and BERT-based Models
di: Jadhav, Suramya, et al.
Pubblicazione: (2025)
di: Jadhav, Suramya, et al.
Pubblicazione: (2025)
L3Cube-MahaEmotions: A Marathi Emotion Recognition Dataset with Synthetic Annotations using CoTR prompting and Large Language Models
di: Kowtal, Nidhi, et al.
Pubblicazione: (2025)
di: Kowtal, Nidhi, et al.
Pubblicazione: (2025)
Topic Modeling in Marathi
di: Shinde, Sanket, et al.
Pubblicazione: (2025)
di: Shinde, Sanket, et al.
Pubblicazione: (2025)
Leveraging Parameter Efficient Training Methods for Low Resource Text Classification: A Case Study in Marathi
di: Deshmukh, Pranita, et al.
Pubblicazione: (2024)
di: Deshmukh, Pranita, et al.
Pubblicazione: (2024)
L3Cube-MahaNews: News-based Short Text and Long Document Classification Datasets in Marathi
di: Mittal, Saloni, et al.
Pubblicazione: (2024)
di: Mittal, Saloni, et al.
Pubblicazione: (2024)
L3Cube-IndicNews: News-based Short Text and Long Document Classification Datasets in Indic Languages
di: Mirashi, Aishwarya, et al.
Pubblicazione: (2024)
di: Mirashi, Aishwarya, et al.
Pubblicazione: (2024)
Improving the Efficiency of Long Document Classification using Sentence Ranking Approach
di: Kokate, Prathamesh, et al.
Pubblicazione: (2025)
di: Kokate, Prathamesh, et al.
Pubblicazione: (2025)
Curating Stopwords in Marathi: A TF-IDF Approach for Improved Text Analysis and Information Retrieval
di: Chavan, Rohan, et al.
Pubblicazione: (2024)
di: Chavan, Rohan, et al.
Pubblicazione: (2024)
Chain-of-Translation Prompting (CoTR): A Novel Prompting Technique for Low Resource Languages
di: Deshpande, Tejas, et al.
Pubblicazione: (2024)
di: Deshpande, Tejas, et al.
Pubblicazione: (2024)
Non-Contextual BERT or FastText? A Comparative Analysis
di: Shanbhag, Abhay, et al.
Pubblicazione: (2024)
di: Shanbhag, Abhay, et al.
Pubblicazione: (2024)
Efficient Zero-Shot Long Document Classification by Reducing Context Through Sentence Ranking
di: Kokate, Prathamesh, et al.
Pubblicazione: (2025)
di: Kokate, Prathamesh, et al.
Pubblicazione: (2025)
L3Cube-MahaSum: A Comprehensive Dataset and BART Models for Abstractive Text Summarization in Marathi
di: Deshmukh, Pranita, et al.
Pubblicazione: (2024)
di: Deshmukh, Pranita, et al.
Pubblicazione: (2024)
Better To Ask in English? Evaluating Factual Accuracy of Multilingual LLMs in English and Low-Resource Languages
di: Rohera, Pritika, et al.
Pubblicazione: (2025)
di: Rohera, Pritika, et al.
Pubblicazione: (2025)
TextGram: Towards a better domain-adaptive pretraining
di: Hiwarkhedkar, Sharayu, et al.
Pubblicazione: (2024)
di: Hiwarkhedkar, Sharayu, et al.
Pubblicazione: (2024)
On Importance of Code-Mixed Embeddings for Hate Speech Identification
di: Jagdale, Shruti, et al.
Pubblicazione: (2024)
di: Jagdale, Shruti, et al.
Pubblicazione: (2024)
On Limitations of LLM as Annotator for Low Resource Languages
di: Jadhav, Suramya, et al.
Pubblicazione: (2024)
di: Jadhav, Suramya, et al.
Pubblicazione: (2024)
Challenges in Adapting Multilingual LLMs to Low-Resource Languages using LoRA PEFT Tuning
di: Khade, Omkar, et al.
Pubblicazione: (2024)
di: Khade, Omkar, et al.
Pubblicazione: (2024)
MahaSQuAD: Bridging Linguistic Divides in Marathi Question-Answering
di: Ghatage, Ruturaj, et al.
Pubblicazione: (2024)
di: Ghatage, Ruturaj, et al.
Pubblicazione: (2024)
L3Cube-IndicQuest: A Benchmark Question Answering Dataset for Evaluating Knowledge of LLMs in Indic Context
di: Rohera, Pritika, et al.
Pubblicazione: (2024)
di: Rohera, Pritika, et al.
Pubblicazione: (2024)
Comparative Study of Pre-Trained BERT and Large Language Models for Code-Mixed Named Entity Recognition
di: Shirke, Mayur, et al.
Pubblicazione: (2025)
di: Shirke, Mayur, et al.
Pubblicazione: (2025)
IndicSQuAD: A Comprehensive Multilingual Question Answering Dataset for Indic Languages
di: Endait, Sharvi, et al.
Pubblicazione: (2025)
di: Endait, Sharvi, et al.
Pubblicazione: (2025)
On Importance of Layer Pruning for Smaller BERT Models and Low Resource Languages
di: Shirke, Mayur, et al.
Pubblicazione: (2025)
di: Shirke, Mayur, et al.
Pubblicazione: (2025)
L3Cube-IndicHeadline-ID: A Dataset for Headline Identification and Semantic Evaluation in Low-Resource Indian Languages
di: Tanksale, Nishant, et al.
Pubblicazione: (2025)
di: Tanksale, Nishant, et al.
Pubblicazione: (2025)
L3Cube-MahaSocialNER: A Social Media based Marathi NER Dataset and BERT models
di: Chaudhari, Harsh, et al.
Pubblicazione: (2023)
di: Chaudhari, Harsh, et al.
Pubblicazione: (2023)
Long Range Named Entity Recognition for Marathi Documents
di: Deshmukh, Pranita, et al.
Pubblicazione: (2024)
di: Deshmukh, Pranita, et al.
Pubblicazione: (2024)
On Importance of Pruning and Distillation for Efficient Low Resource NLP
di: Mirashi, Aishwarya, et al.
Pubblicazione: (2024)
di: Mirashi, Aishwarya, et al.
Pubblicazione: (2024)
Aligning Large Language Models to Low-Resource Languages through LLM-Based Selective Translation: A Systematic Study
di: Paul, Rakesh, et al.
Pubblicazione: (2025)
di: Paul, Rakesh, et al.
Pubblicazione: (2025)
Benchmarking Hindi LLMs: A New Suite of Datasets and a Comparative Analysis
di: Kamath, Anusha, et al.
Pubblicazione: (2025)
di: Kamath, Anusha, et al.
Pubblicazione: (2025)
Evaluating the Robustness and Accuracy of Text Watermarking Under Real-World Cross-Lingual Manipulations
di: Ghanim, Mansour Al, et al.
Pubblicazione: (2025)
di: Ghanim, Mansour Al, et al.
Pubblicazione: (2025)
CREST: Universal Safety Guardrails Through Cluster-Guided Cross-Lingual Transfer
di: Bansal, Lavish, et al.
Pubblicazione: (2025)
di: Bansal, Lavish, et al.
Pubblicazione: (2025)
SABER: Uncovering Vulnerabilities in Safety Alignment via Cross-Layer Residual Connection
di: Joshi, Maithili, et al.
Pubblicazione: (2025)
di: Joshi, Maithili, et al.
Pubblicazione: (2025)
MKA: Leveraging Cross-Lingual Consensus for Model Abstention
di: Duwal, Sharad
Pubblicazione: (2025)
di: Duwal, Sharad
Pubblicazione: (2025)
Adapting Multilingual LLMs to Low-Resource Languages using Continued Pre-training and Synthetic Corpus
di: Joshi, Raviraj, et al.
Pubblicazione: (2024)
di: Joshi, Raviraj, et al.
Pubblicazione: (2024)
HGNet: Scalable Foundation Model for Automated Knowledge Graph Generation from Scientific Literature
di: Joshi, Devvrat, et al.
Pubblicazione: (2026)
di: Joshi, Devvrat, et al.
Pubblicazione: (2026)
Description-based Controllable Text-to-Speech with Cross-Lingual Voice Control
di: Yamamoto, Ryuichi, et al.
Pubblicazione: (2024)
di: Yamamoto, Ryuichi, et al.
Pubblicazione: (2024)
Evaluating Cross-Lingual Classification Approaches Enabling Topic Discovery for Multilingual Social Media Data
di: Uniyal, Deepak, et al.
Pubblicazione: (2026)
di: Uniyal, Deepak, et al.
Pubblicazione: (2026)
Extending Beacon to Hindi: Cultural Adaptation Drives Cross-Lingual Sycophancy
di: Sattigeri, Sarthak
Pubblicazione: (2026)
di: Sattigeri, Sarthak
Pubblicazione: (2026)
Documenti analoghi
-
Towards Building Efficient Sentence BERT Models using Layer Pruning
di: Shelke, Anushka, et al.
Pubblicazione: (2024) -
L3Cube-MahaSTS: A Marathi Sentence Similarity Dataset and Models
di: Mirashi, Aishwarya, et al.
Pubblicazione: (2025) -
A Data Selection Approach for Enhancing Low Resource Machine Translation Using Cross-Lingual Sentence Representations
di: Kowtal, Nidhi, et al.
Pubblicazione: (2024) -
MahaParaphrase: A Marathi Paraphrase Detection Corpus and BERT-based Models
di: Jadhav, Suramya, et al.
Pubblicazione: (2025) -
L3Cube-MahaEmotions: A Marathi Emotion Recognition Dataset with Synthetic Annotations using CoTR prompting and Large Language Models
di: Kowtal, Nidhi, et al.
Pubblicazione: (2025)