Salvato in:
| Autori principali: | Wang, Weixuan, Wu, Minghao, Haddow, Barry, Birch, Alexandra |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2502.12663 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HBO: Hierarchical Balancing Optimization for Fine-Tuning Large Language Models
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
Bridging the Language Gaps in Large Language Models with Inference-Time Cross-Lingual Intervention
di: Wang, Weixuan, et al.
Pubblicazione: (2024)
di: Wang, Weixuan, et al.
Pubblicazione: (2024)
ExpertSteer: Intervening in LLMs through Expert Knowledge
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
Learning to Summarize by Learning to Quiz: Adversarial Agentic Collaboration for Long Document Summarization
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
Sharing Matters: Analysing Neurons Across Languages and Tasks in LLMs
di: Wang, Weixuan, et al.
Pubblicazione: (2024)
di: Wang, Weixuan, et al.
Pubblicazione: (2024)
Multilingual Retrieval-Augmented Generation for Knowledge-Intensive Task
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
When Does Monolingual Data Help Multilingual Translation: The Role of Domain and Model Scale
di: Baziotis, Christos, et al.
Pubblicazione: (2023)
di: Baziotis, Christos, et al.
Pubblicazione: (2023)
Improving Multilingual Retrieval-Augmented Language Models through Dialectic Reasoning Argumentations
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
The Ups and Downs of Large Language Model Inference with Vocabulary Trimming by Language Heuristics
di: Bogoychev, Nikolay, et al.
Pubblicazione: (2023)
di: Bogoychev, Nikolay, et al.
Pubblicazione: (2023)
Compact Speech Translation Models via Discrete Speech Units Pretraining
di: Lam, Tsz Kin, et al.
Pubblicazione: (2024)
di: Lam, Tsz Kin, et al.
Pubblicazione: (2024)
MGen: Millions of Naturally Occurring Generics in Context
di: Cilleruelo, Gustavo, et al.
Pubblicazione: (2025)
di: Cilleruelo, Gustavo, et al.
Pubblicazione: (2025)
The Prosody of Emojis
di: Zhou, Giulio, et al.
Pubblicazione: (2025)
di: Zhou, Giulio, et al.
Pubblicazione: (2025)
Prosody in Cascade and Direct Speech-to-Text Translation: a case study on Korean Wh-Phrases
di: Zhou, Giulio, et al.
Pubblicazione: (2024)
di: Zhou, Giulio, et al.
Pubblicazione: (2024)
Generics are puzzling. Can language models find the missing piece?
di: Calderón, Gustavo Cilleruelo, et al.
Pubblicazione: (2024)
di: Calderón, Gustavo Cilleruelo, et al.
Pubblicazione: (2024)
Quality or Quantity? On Data Scale and Diversity in Adapting Large Language Models for Low-Resource Translation
di: Iyer, Vivek, et al.
Pubblicazione: (2024)
di: Iyer, Vivek, et al.
Pubblicazione: (2024)
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
di: Chen, Pinzhen, et al.
Pubblicazione: (2024)
di: Chen, Pinzhen, et al.
Pubblicazione: (2024)
Liaozhai through the Looking-Glass: On Paratextual Explicitation of Culture-Bound Terms in Machine Translation
di: Shen, Sherrie, et al.
Pubblicazione: (2025)
di: Shen, Sherrie, et al.
Pubblicazione: (2025)
Demystifying Chains, Trees, and Graphs of Thoughts
di: Besta, Maciej, et al.
Pubblicazione: (2024)
di: Besta, Maciej, et al.
Pubblicazione: (2024)
Demystifying Long Chain-of-Thought Reasoning in LLMs
di: Yeo, Edward, et al.
Pubblicazione: (2025)
di: Yeo, Edward, et al.
Pubblicazione: (2025)
EuroLLM: Multilingual Language Models for Europe
di: Martins, Pedro Henrique, et al.
Pubblicazione: (2024)
di: Martins, Pedro Henrique, et al.
Pubblicazione: (2024)
Context and System Fusion in Post-ASR Emotion Recognition with Large Language Models
di: Stepachev, Pavel, et al.
Pubblicazione: (2024)
di: Stepachev, Pavel, et al.
Pubblicazione: (2024)
Monolingual or Multilingual Instruction Tuning: Which Makes a Better Alpaca
di: Chen, Pinzhen, et al.
Pubblicazione: (2023)
di: Chen, Pinzhen, et al.
Pubblicazione: (2023)
DocHPLT: A Massively Multilingual Document-Level Translation Dataset
di: O'Brien, Dayyán, et al.
Pubblicazione: (2025)
di: O'Brien, Dayyán, et al.
Pubblicazione: (2025)
Pushing on Multilingual Reasoning Models with Language-Mixed Chain-of-Thought
di: Son, Guijin, et al.
Pubblicazione: (2025)
di: Son, Guijin, et al.
Pubblicazione: (2025)
The Bitter Lesson Learned from 2,000+ Multilingual Benchmarks
di: Wu, Minghao, et al.
Pubblicazione: (2025)
di: Wu, Minghao, et al.
Pubblicazione: (2025)
Iterative Translation Refinement with Large Language Models
di: Chen, Pinzhen, et al.
Pubblicazione: (2023)
di: Chen, Pinzhen, et al.
Pubblicazione: (2023)
EMMA-500: Enhancing Massively Multilingual Adaptation of Large Language Models
di: Ji, Shaoxiong, et al.
Pubblicazione: (2024)
di: Ji, Shaoxiong, et al.
Pubblicazione: (2024)
Teaching Models to Verbalize Reward Hacking in Chain-of-Thought Reasoning
di: Turpin, Miles, et al.
Pubblicazione: (2025)
di: Turpin, Miles, et al.
Pubblicazione: (2025)
ETR: Entropy Trend Reward for Efficient Chain-of-Thought Reasoning
di: Xiong, Xuan, et al.
Pubblicazione: (2026)
di: Xiong, Xuan, et al.
Pubblicazione: (2026)
Demystifying Instruction Mixing for Fine-tuning Large Language Models
di: Wang, Renxi, et al.
Pubblicazione: (2023)
di: Wang, Renxi, et al.
Pubblicazione: (2023)
On the Representational Capacity of Neural Language Models with Chain-of-Thought Reasoning
di: Nowak, Franz, et al.
Pubblicazione: (2024)
di: Nowak, Franz, et al.
Pubblicazione: (2024)
Question Translation Training for Better Multilingual Reasoning
di: Zhu, Wenhao, et al.
Pubblicazione: (2024)
di: Zhu, Wenhao, et al.
Pubblicazione: (2024)
Fine-Tuning Large Language Models to Translate: Will a Touch of Noisy Data in Misaligned Languages Suffice?
di: Zhu, Dawei, et al.
Pubblicazione: (2024)
di: Zhu, Dawei, et al.
Pubblicazione: (2024)
MatheMagic: Generating Dynamic Mathematics Benchmarks Robust to Memorization
di: O'Brien, Dayyán, et al.
Pubblicazione: (2025)
di: O'Brien, Dayyán, et al.
Pubblicazione: (2025)
Pitfalls and Outlooks in Using COMET
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
di: Zouhar, Vilém, et al.
Pubblicazione: (2024)
Kakugo: Distillation of Low-Resource Languages into Small Language Models
di: Devine, Peter, et al.
Pubblicazione: (2026)
di: Devine, Peter, et al.
Pubblicazione: (2026)
The Molecular Structure of Thought: Mapping the Topology of Long Chain-of-Thought Reasoning
di: Chen, Qiguang, et al.
Pubblicazione: (2026)
di: Chen, Qiguang, et al.
Pubblicazione: (2026)
The Power of Question Translation Training in Multilingual Reasoning: Broadened Scope and Deepened Insights
di: Zhu, Wenhao, et al.
Pubblicazione: (2024)
di: Zhu, Wenhao, et al.
Pubblicazione: (2024)
Enhancing Chain of Thought Prompting in Large Language Models via Reasoning Patterns
di: Zhang, Yufeng, et al.
Pubblicazione: (2024)
di: Zhang, Yufeng, et al.
Pubblicazione: (2024)
Scaling Code-Assisted Chain-of-Thoughts and Instructions for Model Reasoning
di: Lin, Honglin, et al.
Pubblicazione: (2025)
di: Lin, Honglin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
HBO: Hierarchical Balancing Optimization for Fine-Tuning Large Language Models
di: Wang, Weixuan, et al.
Pubblicazione: (2025) -
Bridging the Language Gaps in Large Language Models with Inference-Time Cross-Lingual Intervention
di: Wang, Weixuan, et al.
Pubblicazione: (2024) -
ExpertSteer: Intervening in LLMs through Expert Knowledge
di: Wang, Weixuan, et al.
Pubblicazione: (2025) -
Learning to Summarize by Learning to Quiz: Adversarial Agentic Collaboration for Long Document Summarization
di: Wang, Weixuan, et al.
Pubblicazione: (2025) -
Sharing Matters: Analysing Neurons Across Languages and Tasks in LLMs
di: Wang, Weixuan, et al.
Pubblicazione: (2024)