Salvato in:
| Autori principali: | Agarwal, Mehul, Aggarwal, Aditya, Goel, Arnav, Hira, Medha, Gupta, Anubha |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2604.18914 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Exploring Multilingual Unseen Speaker Emotion Recognition: Leveraging Co-Attention Cues in Multitask Learning
di: Goel, Arnav, et al.
Pubblicazione: (2024)
di: Goel, Arnav, et al.
Pubblicazione: (2024)
Multilingual Prosody Transfer: Comparing Supervised & Transfer Learning
di: Goel, Arnav, et al.
Pubblicazione: (2024)
di: Goel, Arnav, et al.
Pubblicazione: (2024)
CrossVoice: Crosslingual Prosody Preserving Cascade-S2ST using Transfer Learning
di: Hira, Medha, et al.
Pubblicazione: (2024)
di: Hira, Medha, et al.
Pubblicazione: (2024)
MorphNAS: Differentiable Architecture Search for Morphologically-Aware Multilingual NER
di: Devadiga, Prathamesh, et al.
Pubblicazione: (2025)
di: Devadiga, Prathamesh, et al.
Pubblicazione: (2025)
Latency and Token-Aware Test-Time Compute
di: Huang, Jenny Y., et al.
Pubblicazione: (2025)
di: Huang, Jenny Y., et al.
Pubblicazione: (2025)
Languages are Modalities: Cross-Lingual Alignment via Encoder Injection
di: Agarwal, Rajan, et al.
Pubblicazione: (2025)
di: Agarwal, Rajan, et al.
Pubblicazione: (2025)
G-Loss: Graph-Guided Fine-Tuning of Language Models
di: Sharma, Aditya, et al.
Pubblicazione: (2026)
di: Sharma, Aditya, et al.
Pubblicazione: (2026)
Faster and Lighter LLMs: A Survey on Current Challenges and Way Forward
di: Chavan, Arnav, et al.
Pubblicazione: (2024)
di: Chavan, Arnav, et al.
Pubblicazione: (2024)
Pruning as a Defense: Reducing Memorization in Large Language Models
di: Gupta, Mansi, et al.
Pubblicazione: (2025)
di: Gupta, Mansi, et al.
Pubblicazione: (2025)
Generation and De-Identification of Indian Clinical Discharge Summaries using LLMs
di: Singh, Sanjeet, et al.
Pubblicazione: (2024)
di: Singh, Sanjeet, et al.
Pubblicazione: (2024)
BenchHub: A Unified Benchmark Suite for Holistic and Customizable LLM Evaluation
di: Kim, Eunsu, et al.
Pubblicazione: (2025)
di: Kim, Eunsu, et al.
Pubblicazione: (2025)
MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2024)
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2024)
LLMGuard: Guarding Against Unsafe LLM Behavior
di: Goyal, Shubh, et al.
Pubblicazione: (2024)
di: Goyal, Shubh, et al.
Pubblicazione: (2024)
Beyond LLM-as-a-Judge: Deterministic Metrics for Multilingual Generative Text Evaluation
di: Alam, Firoj, et al.
Pubblicazione: (2026)
di: Alam, Firoj, et al.
Pubblicazione: (2026)
HLDC: Hindi Legal Documents Corpus
di: Kapoor, Arnav, et al.
Pubblicazione: (2022)
di: Kapoor, Arnav, et al.
Pubblicazione: (2022)
Improving Model Evaluation using SMART Filtering of Benchmark Datasets
di: Gupta, Vipul, et al.
Pubblicazione: (2024)
di: Gupta, Vipul, et al.
Pubblicazione: (2024)
Investigating Bias: A Multilingual Pipeline for Generating, Solving, and Evaluating Math Problems with LLMs
di: Mahran, Mariam, et al.
Pubblicazione: (2025)
di: Mahran, Mariam, et al.
Pubblicazione: (2025)
Towards Multilingual LLM Evaluation for European Languages
di: Thellmann, Klaudia, et al.
Pubblicazione: (2024)
di: Thellmann, Klaudia, et al.
Pubblicazione: (2024)
PoPE: Legendre Orthogonal Polynomials Based Position Encoding for Large Language Models
di: Aggarwal, Arpit
Pubblicazione: (2024)
di: Aggarwal, Arpit
Pubblicazione: (2024)
Learning How Hard to Think: Input-Adaptive Allocation of LM Computation
di: Damani, Mehul, et al.
Pubblicazione: (2024)
di: Damani, Mehul, et al.
Pubblicazione: (2024)
Answer Matching Outperforms Multiple Choice for Language Model Evaluation
di: Chandak, Nikhil, et al.
Pubblicazione: (2025)
di: Chandak, Nikhil, et al.
Pubblicazione: (2025)
MOSLD-Bench: Multilingual Open-Set Learning and Discovery Benchmark for Text Categorization
di: Costache, Adriana-Valentina, et al.
Pubblicazione: (2026)
di: Costache, Adriana-Valentina, et al.
Pubblicazione: (2026)
FanChuan: A Multilingual and Graph-Structured Benchmark For Parody Detection and Analysis
di: Zheng, Yilun, et al.
Pubblicazione: (2025)
di: Zheng, Yilun, et al.
Pubblicazione: (2025)
NusaAksara: A Multimodal and Multilingual Benchmark for Preserving Indonesian Indigenous Scripts
di: Adilazuarda, Muhammad Farid, et al.
Pubblicazione: (2025)
di: Adilazuarda, Muhammad Farid, et al.
Pubblicazione: (2025)
ReadMe++: Benchmarking Multilingual Language Models for Multi-Domain Readability Assessment
di: Naous, Tarek, et al.
Pubblicazione: (2023)
di: Naous, Tarek, et al.
Pubblicazione: (2023)
Advancements in Scientific Controllable Text Generation Methods
di: Goel, Arnav, et al.
Pubblicazione: (2023)
di: Goel, Arnav, et al.
Pubblicazione: (2023)
AgentKernelArena: Generalization-Aware Benchmarking of GPU Kernel Optimization Agents
di: Younesian, Sharareh, et al.
Pubblicazione: (2026)
di: Younesian, Sharareh, et al.
Pubblicazione: (2026)
Evaluating the Limits of Large Language Models in Multilingual Legal Reasoning
di: Ioannou, Antreas, et al.
Pubblicazione: (2025)
di: Ioannou, Antreas, et al.
Pubblicazione: (2025)
M-RewardBench: Evaluating Reward Models in Multilingual Settings
di: Gureja, Srishti, et al.
Pubblicazione: (2024)
di: Gureja, Srishti, et al.
Pubblicazione: (2024)
Fine-Grained Benchmark Generation for Comprehensive Evaluation of Foundation Models
di: Islam, Mohammed Saidul, et al.
Pubblicazione: (2026)
di: Islam, Mohammed Saidul, et al.
Pubblicazione: (2026)
Episodic Memories Generation and Evaluation Benchmark for Large Language Models
di: Huet, Alexis, et al.
Pubblicazione: (2025)
di: Huet, Alexis, et al.
Pubblicazione: (2025)
Beyond the Singular: Revealing the Value of Multiple Generations in Benchmark Evaluation
di: Zhang, Wenbo, et al.
Pubblicazione: (2025)
di: Zhang, Wenbo, et al.
Pubblicazione: (2025)
Evaluating the Generalization Ability of Quantized LLMs: Benchmark, Analysis, and Toolbox
di: Liu, Yijun, et al.
Pubblicazione: (2024)
di: Liu, Yijun, et al.
Pubblicazione: (2024)
Multi-Turn Code Generation Through Single-Step Rewards
di: Jain, Arnav Kumar, et al.
Pubblicazione: (2025)
di: Jain, Arnav Kumar, et al.
Pubblicazione: (2025)
NoFunEval: Funny How Code LMs Falter on Requirements Beyond Functional Correctness
di: Singhal, Manav, et al.
Pubblicazione: (2024)
di: Singhal, Manav, et al.
Pubblicazione: (2024)
EUROPA: A Legal Multilingual Keyphrase Generation Dataset
di: Salaün, Olivier, et al.
Pubblicazione: (2024)
di: Salaün, Olivier, et al.
Pubblicazione: (2024)
Reaching Beyond the Mode: RL for Distributional Reasoning in Language Models
di: Puri, Isha, et al.
Pubblicazione: (2026)
di: Puri, Isha, et al.
Pubblicazione: (2026)
Analyzing the Evaluation of Cross-Lingual Knowledge Transfer in Multilingual Language Models
di: Rajaee, Sara, et al.
Pubblicazione: (2024)
di: Rajaee, Sara, et al.
Pubblicazione: (2024)
Beyond Fertility: Analyzing STRR as a Metric for Multilingual Tokenization Evaluation
di: Nayeem, Mir Tafseer, et al.
Pubblicazione: (2025)
di: Nayeem, Mir Tafseer, et al.
Pubblicazione: (2025)
L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2025)
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Exploring Multilingual Unseen Speaker Emotion Recognition: Leveraging Co-Attention Cues in Multitask Learning
di: Goel, Arnav, et al.
Pubblicazione: (2024) -
Multilingual Prosody Transfer: Comparing Supervised & Transfer Learning
di: Goel, Arnav, et al.
Pubblicazione: (2024) -
CrossVoice: Crosslingual Prosody Preserving Cascade-S2ST using Transfer Learning
di: Hira, Medha, et al.
Pubblicazione: (2024) -
MorphNAS: Differentiable Architecture Search for Morphologically-Aware Multilingual NER
di: Devadiga, Prathamesh, et al.
Pubblicazione: (2025) -
Latency and Token-Aware Test-Time Compute
di: Huang, Jenny Y., et al.
Pubblicazione: (2025)