XL-Suite: Cross-Lingual Synthetic Training and Evaluation Data for Open-Ended Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Iyer, Vivek, Chen, Pinzhen, Rei, Ricardo, Birch, Alexandra |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Latxa: An Open Language Model and Evaluation Suite for Basque
di: Etxaniz, Julen, et al.
Pubblicazione: (2024)
di: Etxaniz, Julen, et al.
Pubblicazione: (2024)
MLR-Bench: Evaluating AI Agents on Open-Ended Machine Learning Research
di: Chen, Hui, et al.
Pubblicazione: (2025)
di: Chen, Hui, et al.
Pubblicazione: (2025)
Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts
di: Samvelyan, Mikayel, et al.
Pubblicazione: (2024)
di: Samvelyan, Mikayel, et al.
Pubblicazione: (2024)
Evaluating Cross-Lingual Classification Approaches Enabling Topic Discovery for Multilingual Social Media Data
di: Uniyal, Deepak, et al.
Pubblicazione: (2026)
di: Uniyal, Deepak, et al.
Pubblicazione: (2026)
A Semantic-Sampling Framework for Evaluating Calibration in Open-Ended Question Answering
di: Wang, Zhanliang, et al.
Pubblicazione: (2026)
di: Wang, Zhanliang, et al.
Pubblicazione: (2026)
Analyzing the Evaluation of Cross-Lingual Knowledge Transfer in Multilingual Language Models
di: Rajaee, Sara, et al.
Pubblicazione: (2024)
di: Rajaee, Sara, et al.
Pubblicazione: (2024)
G-Zero: Self-Play for Open-Ended Generation from Zero Data
di: Huang, Chengsong, et al.
Pubblicazione: (2026)
di: Huang, Chengsong, et al.
Pubblicazione: (2026)
Dreaming in Code for Curriculum Learning in Open-Ended Worlds
di: Mitsides, Konstantinos, et al.
Pubblicazione: (2026)
di: Mitsides, Konstantinos, et al.
Pubblicazione: (2026)
Reasoning-Driven Synthetic Data Generation and Evaluation
di: Davidson, Tim R., et al.
Pubblicazione: (2026)
di: Davidson, Tim R., et al.
Pubblicazione: (2026)
DIVERGE: Diversity-Enhanced RAG for Open-Ended Information Seeking
di: Hu, Tianyi, et al.
Pubblicazione: (2026)
di: Hu, Tianyi, et al.
Pubblicazione: (2026)
MCU: An Evaluation Framework for Open-Ended Game Agents
di: Zheng, Xinyue, et al.
Pubblicazione: (2023)
di: Zheng, Xinyue, et al.
Pubblicazione: (2023)
HelpSteer3: Human-Annotated Feedback and Edit Data to Empower Inference-Time Scaling in Open-Ended General-Domain Tasks
di: Wang, Zhilin, et al.
Pubblicazione: (2025)
di: Wang, Zhilin, et al.
Pubblicazione: (2025)
Distributional Open-Ended Evaluation of LLM Cultural Value Alignment Based on Value Codebook
di: Lee, Jaehyeok, et al.
Pubblicazione: (2026)
di: Lee, Jaehyeok, et al.
Pubblicazione: (2026)
Self-Rewarding Rubric-Based Reinforcement Learning for Open-Ended Reasoning
di: Ye, Zhiling, et al.
Pubblicazione: (2025)
di: Ye, Zhiling, et al.
Pubblicazione: (2025)
The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery
di: Lu, Chris, et al.
Pubblicazione: (2024)
di: Lu, Chris, et al.
Pubblicazione: (2024)
Generalizing From Short to Long: Effective Data Synthesis for Long-Context Instruction Tuning
di: Zhu, Wenhao, et al.
Pubblicazione: (2025)
di: Zhu, Wenhao, et al.
Pubblicazione: (2025)
GRLO: Towards Generalizable Reinforcement Learning in Open-Ended Environments from Zero
di: Yin, Shangjian, et al.
Pubblicazione: (2026)
di: Yin, Shangjian, et al.
Pubblicazione: (2026)
AutoLibra: Agent Metric Induction from Open-Ended Human Feedback
di: Zhu, Hao, et al.
Pubblicazione: (2025)
di: Zhu, Hao, et al.
Pubblicazione: (2025)
Language-specific Neurons Do Not Facilitate Cross-Lingual Transfer
di: Mondal, Soumen Kumar, et al.
Pubblicazione: (2025)
di: Mondal, Soumen Kumar, et al.
Pubblicazione: (2025)
Languages are Modalities: Cross-Lingual Alignment via Encoder Injection
di: Agarwal, Rajan, et al.
Pubblicazione: (2025)
di: Agarwal, Rajan, et al.
Pubblicazione: (2025)
CLR-voyance: Reinforcing Open-Ended Reasoning for Inpatient Clinical Decision Support with Outcome-Aware Rubrics
di: Nagar, Aishik, et al.
Pubblicazione: (2026)
di: Nagar, Aishik, et al.
Pubblicazione: (2026)
A New Method for Cross-Lingual-based Semantic Role Labeling
di: Ebrahimi, Mohammad, et al.
Pubblicazione: (2024)
di: Ebrahimi, Mohammad, et al.
Pubblicazione: (2024)
Knowledge Localization in Mixture-of-Experts LLMs Using Cross-Lingual Inconsistency
di: Bandarkar, Lucas, et al.
Pubblicazione: (2026)
di: Bandarkar, Lucas, et al.
Pubblicazione: (2026)
Rethinking Suicidal Ideation Detection: A Trustworthy Annotation Framework and Cross-Lingual Model Evaluation
di: Dzafic, Amina, et al.
Pubblicazione: (2025)
di: Dzafic, Amina, et al.
Pubblicazione: (2025)
Flexible Agent Alignment with Goal Inference from Open-Ended Dialog
di: Ma, Rachel, et al.
Pubblicazione: (2025)
di: Ma, Rachel, et al.
Pubblicazione: (2025)
Hard2Verify: A Step-Level Verification Benchmark for Open-Ended Frontier Math
di: Pandit, Shrey, et al.
Pubblicazione: (2025)
di: Pandit, Shrey, et al.
Pubblicazione: (2025)
Does Training on Synthetic Data Make Models Less Robust?
di: Zhang, Lingze, et al.
Pubblicazione: (2025)
di: Zhang, Lingze, et al.
Pubblicazione: (2025)
Enhancing Domain-Specific Retrieval-Augmented Generation: Synthetic Data Generation and Evaluation using Reasoning Models
di: Jadon, Aryan, et al.
Pubblicazione: (2025)
di: Jadon, Aryan, et al.
Pubblicazione: (2025)
Shared Doubt: Zero-shot Cross-Lingual Confidence Estimation for Language Models
di: Kyriakou, Athina, et al.
Pubblicazione: (2026)
di: Kyriakou, Athina, et al.
Pubblicazione: (2026)
Layer Swapping for Zero-Shot Cross-Lingual Transfer in Large Language Models
di: Bandarkar, Lucas, et al.
Pubblicazione: (2024)
di: Bandarkar, Lucas, et al.
Pubblicazione: (2024)
Training and Evaluating Language Models with Template-based Data Generation
di: Zhang, Yifan
Pubblicazione: (2024)
di: Zhang, Yifan
Pubblicazione: (2024)
How Bad is Training on Synthetic Data? A Statistical Analysis of Language Model Collapse
di: Seddik, Mohamed El Amine, et al.
Pubblicazione: (2024)
di: Seddik, Mohamed El Amine, et al.
Pubblicazione: (2024)
KASER: Knowledge-Aligned Student Error Simulator for Open-Ended Coding Tasks
di: Duan, Zhangqi, et al.
Pubblicazione: (2026)
di: Duan, Zhangqi, et al.
Pubblicazione: (2026)
A Multi-Faceted Evaluation Framework for Assessing Synthetic Data Generated by Large Language Models
di: Yuan, Yefeng, et al.
Pubblicazione: (2024)
di: Yuan, Yefeng, et al.
Pubblicazione: (2024)
Lightweight Safety Guardrails via Synthetic Data and RL-guided Adversarial Training
di: Ilin, Aleksei, et al.
Pubblicazione: (2025)
di: Ilin, Aleksei, et al.
Pubblicazione: (2025)
BenchHub: A Unified Benchmark Suite for Holistic and Customizable LLM Evaluation
di: Kim, Eunsu, et al.
Pubblicazione: (2025)
di: Kim, Eunsu, et al.
Pubblicazione: (2025)
Multi-Target Cross-Lingual Summarization: a novel task and a language-neutral approach
di: Pernes, Diogo, et al.
Pubblicazione: (2024)
di: Pernes, Diogo, et al.
Pubblicazione: (2024)
Few-Shot Cross-Lingual Transfer for Prompting Large Language Models in Low-Resource Languages
di: Toukmaji, Christopher
Pubblicazione: (2024)
di: Toukmaji, Christopher
Pubblicazione: (2024)
Identifying the Correlation Between Language Distance and Cross-Lingual Transfer in a Multilingual Representation Space
di: Philippy, Fred, et al.
Pubblicazione: (2023)
di: Philippy, Fred, et al.
Pubblicazione: (2023)
Can LLMs Reliably Simulate Human Learner Actions? A Simulation Authoring Framework for Open-Ended Learning Environments
di: Mannekote, Amogh, et al.
Pubblicazione: (2024)
di: Mannekote, Amogh, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Latxa: An Open Language Model and Evaluation Suite for Basque
di: Etxaniz, Julen, et al.
Pubblicazione: (2024) -
MLR-Bench: Evaluating AI Agents on Open-Ended Machine Learning Research
di: Chen, Hui, et al.
Pubblicazione: (2025) -
Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts
di: Samvelyan, Mikayel, et al.
Pubblicazione: (2024) -
Evaluating Cross-Lingual Classification Approaches Enabling Topic Discovery for Multilingual Social Media Data
di: Uniyal, Deepak, et al.
Pubblicazione: (2026) -
A Semantic-Sampling Framework for Evaluating Calibration in Open-Ended Question Answering
di: Wang, Zhanliang, et al.
Pubblicazione: (2026)