Efficient Minimum Bayes Risk Decoding using Low-Rank Matrix Completion Algorithms
Fuente:
arXiv
Salvato in:
| Autori principali: | Trabelsi, Firas, Vilar, David, Finkelstein, Mara, Freitag, Markus |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learning from others' mistakes: Finetuning machine translation models with span-level error annotations
di: Zhang, Lily H., et al.
Pubblicazione: (2024)
di: Zhang, Lily H., et al.
Pubblicazione: (2024)
Introducing the NewsPaLM MBR and QE Dataset: LLM-Generated High-Quality Parallel Data Outperforms Traditional Web-Crawled Data
di: Finkelstein, Mara, et al.
Pubblicazione: (2024)
di: Finkelstein, Mara, et al.
Pubblicazione: (2024)
Uncertainty-Aware Decoding with Minimum Bayes Risk
di: Daheim, Nico, et al.
Pubblicazione: (2025)
di: Daheim, Nico, et al.
Pubblicazione: (2025)
Mitigating Metric Bias in Minimum Bayes Risk Decoding
di: Kovacs, Geza, et al.
Pubblicazione: (2024)
di: Kovacs, Geza, et al.
Pubblicazione: (2024)
Agreement-Constrained Probabilistic Minimum Bayes Risk Decoding
di: Natsumi, Koki, et al.
Pubblicazione: (2025)
di: Natsumi, Koki, et al.
Pubblicazione: (2025)
Re-evaluating Minimum Bayes Risk Decoding for Automatic Speech Recognition
di: Jinnai, Yuu
Pubblicazione: (2025)
di: Jinnai, Yuu
Pubblicazione: (2025)
Chasing COMET: Leveraging Minimum Bayes Risk Decoding for Self-Improving Machine Translation
di: Guttmann, Kamil, et al.
Pubblicazione: (2024)
di: Guttmann, Kamil, et al.
Pubblicazione: (2024)
Minimum Bayes Risk Decoding for Error Span Detection in Reference-Free Automatic Machine Translation Evaluation
di: Lyu, Boxuan, et al.
Pubblicazione: (2025)
di: Lyu, Boxuan, et al.
Pubblicazione: (2025)
LSR-Adapt: Ultra-Efficient Parameter Tuning with Matrix Low Separation Rank Kernel Adaptation
di: Li, Xin, et al.
Pubblicazione: (2025)
di: Li, Xin, et al.
Pubblicazione: (2025)
MBR and QE Finetuning: Training-time Distillation of the Best and Most Expensive Decoding Methods
di: Finkelstein, Mara, et al.
Pubblicazione: (2023)
di: Finkelstein, Mara, et al.
Pubblicazione: (2023)
Feeding Two Birds or Favoring One? Adequacy-Fluency Tradeoffs in Evaluation and Meta-Evaluation of Machine Translation
di: Shayegh, Behzad, et al.
Pubblicazione: (2025)
di: Shayegh, Behzad, et al.
Pubblicazione: (2025)
SlimSpec: Low-Rank Draft LM-Head for Accelerated Speculative Decoding
di: Plaksin, Anton, et al.
Pubblicazione: (2026)
di: Plaksin, Anton, et al.
Pubblicazione: (2026)
Quality-Aware Translation Models: Efficient Generation and Quality Estimation in a Single Model
di: Tomani, Christian, et al.
Pubblicazione: (2023)
di: Tomani, Christian, et al.
Pubblicazione: (2023)
Centroid-Based Efficient Minimum Bayes Risk Decoding
di: Deguchi, Hiroyuki, et al.
Pubblicazione: (2024)
di: Deguchi, Hiroyuki, et al.
Pubblicazione: (2024)
Beyond Higher Rank: Token-wise Input-Output Projections for Efficient Low-Rank Adaptation
di: Li, Shiwei, et al.
Pubblicazione: (2025)
di: Li, Shiwei, et al.
Pubblicazione: (2025)
SoftLMs: Efficient Adaptive Low-Rank Approximation of Language Models using Soft-Thresholding Mechanism
di: Bhatnagar, Priyansh, et al.
Pubblicazione: (2024)
di: Bhatnagar, Priyansh, et al.
Pubblicazione: (2024)
Low-Rank Quantization-Aware Training for LLMs
di: Bondarenko, Yelysei, et al.
Pubblicazione: (2024)
di: Bondarenko, Yelysei, et al.
Pubblicazione: (2024)
MetricX-24: The Google Submission to the WMT 2024 Metrics Shared Task
di: Juraska, Juraj, et al.
Pubblicazione: (2024)
di: Juraska, Juraj, et al.
Pubblicazione: (2024)
AutoLoRA: Automatically Tuning Matrix Ranks in Low-Rank Adaptation Based on Meta Learning
di: Zhang, Ruiyi, et al.
Pubblicazione: (2024)
di: Zhang, Ruiyi, et al.
Pubblicazione: (2024)
Improving Minimum Bayes Risk Decoding with Multi-Prompt
di: Heineman, David, et al.
Pubblicazione: (2024)
di: Heineman, David, et al.
Pubblicazione: (2024)
New Hardness Results for Low-Rank Matrix Completion
di: Chawin, Dror, et al.
Pubblicazione: (2025)
di: Chawin, Dror, et al.
Pubblicazione: (2025)
Robust and Efficient Fine-tuning of LLMs with Bayesian Reparameterization of Low-Rank Adaptation
di: Sengupta, Ayan, et al.
Pubblicazione: (2024)
di: Sengupta, Ayan, et al.
Pubblicazione: (2024)
Activation-Informed Pareto-Guided Low-Rank Compression for Efficient LLM/VLM
di: Solgi, Ryan, et al.
Pubblicazione: (2025)
di: Solgi, Ryan, et al.
Pubblicazione: (2025)
Review Based Entity Ranking using Fuzzy Logic Algorithmic Approach: Analysis
di: Kalamkar, Pratik N., et al.
Pubblicazione: (2025)
di: Kalamkar, Pratik N., et al.
Pubblicazione: (2025)
DropLoRA: Sparse Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
di: Zhang, Haojie
Pubblicazione: (2025)
di: Zhang, Haojie
Pubblicazione: (2025)
Structure-Conditional Minimum Bayes Risk Decoding
di: Eikema, Bryan, et al.
Pubblicazione: (2025)
di: Eikema, Bryan, et al.
Pubblicazione: (2025)
Theoretical Guarantees for Minimum Bayes Risk Decoding
di: Ichihara, Yuki, et al.
Pubblicazione: (2025)
di: Ichihara, Yuki, et al.
Pubblicazione: (2025)
FLoE: Fisher-Based Layer Selection for Efficient Sparse Adaptation of Low-Rank Experts
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
Accelerating the Low-Rank Decomposed Models
di: Hajimolahoseini, Habib, et al.
Pubblicazione: (2024)
di: Hajimolahoseini, Habib, et al.
Pubblicazione: (2024)
Fast Forwarding Low-Rank Training
di: Rahamim, Adir, et al.
Pubblicazione: (2024)
di: Rahamim, Adir, et al.
Pubblicazione: (2024)
Efficient Federated Low Rank Matrix Completion
di: Abbasi, Ahmed Ali, et al.
Pubblicazione: (2024)
di: Abbasi, Ahmed Ali, et al.
Pubblicazione: (2024)
Decoder-Hybrid-Decoder Architecture for Efficient Reasoning with Long Generation
di: Ren, Liliang, et al.
Pubblicazione: (2025)
di: Ren, Liliang, et al.
Pubblicazione: (2025)
LoRA+: Efficient Low Rank Adaptation of Large Models
di: Hayou, Soufiane, et al.
Pubblicazione: (2024)
di: Hayou, Soufiane, et al.
Pubblicazione: (2024)
Initialization using Update Approximation is a Silver Bullet for Extremely Efficient Low-Rank Fine-Tuning
di: Ponkshe, Kaustubh, et al.
Pubblicazione: (2024)
di: Ponkshe, Kaustubh, et al.
Pubblicazione: (2024)
Training Acceleration of Low-Rank Decomposed Networks using Sequential Freezing and Rank Quantization
di: Hajimolahoseini, Habib, et al.
Pubblicazione: (2023)
di: Hajimolahoseini, Habib, et al.
Pubblicazione: (2023)
QDyLoRA: Quantized Dynamic Low-Rank Adaptation for Efficient Large Language Model Tuning
di: Rajabzadeh, Hossein, et al.
Pubblicazione: (2024)
di: Rajabzadeh, Hossein, et al.
Pubblicazione: (2024)
LQ-LoRA: Low-rank Plus Quantized Matrix Decomposition for Efficient Language Model Finetuning
di: Guo, Han, et al.
Pubblicazione: (2023)
di: Guo, Han, et al.
Pubblicazione: (2023)
Unlocking the Global Synergies in Low-Rank Adapters
di: Zhang, Zixi, et al.
Pubblicazione: (2024)
di: Zhang, Zixi, et al.
Pubblicazione: (2024)
mbrs: A Library for Minimum Bayes Risk Decoding
di: Deguchi, Hiroyuki, et al.
Pubblicazione: (2024)
di: Deguchi, Hiroyuki, et al.
Pubblicazione: (2024)
Hardware-Efficient Attention for Fast Decoding
di: Zadouri, Ted, et al.
Pubblicazione: (2025)
di: Zadouri, Ted, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Learning from others' mistakes: Finetuning machine translation models with span-level error annotations
di: Zhang, Lily H., et al.
Pubblicazione: (2024) -
Introducing the NewsPaLM MBR and QE Dataset: LLM-Generated High-Quality Parallel Data Outperforms Traditional Web-Crawled Data
di: Finkelstein, Mara, et al.
Pubblicazione: (2024) -
Uncertainty-Aware Decoding with Minimum Bayes Risk
di: Daheim, Nico, et al.
Pubblicazione: (2025) -
Mitigating Metric Bias in Minimum Bayes Risk Decoding
di: Kovacs, Geza, et al.
Pubblicazione: (2024) -
Agreement-Constrained Probabilistic Minimum Bayes Risk Decoding
di: Natsumi, Koki, et al.
Pubblicazione: (2025)