Applying Intrinsic Debiasing on Downstream Tasks: Challenges and Considerations for Machine Translation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Iluz, Bar, Elazar, Yanai, Yehudai, Asaf, Stanovsky, Gabriel |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Nurse is Blue and Elephant is Rugby: Cross Domain Alignment in Large Language Models Reveal Human-like Patterns
par: Yehudai, Asaf, et autres
Publié: (2024)
par: Yehudai, Asaf, et autres
Publié: (2024)
LLM-Generated or Human-Written? Comparing Review and Non-Review Papers on ArXiv
par: Elazar, Yanai, et autres
Publié: (2026)
par: Elazar, Yanai, et autres
Publié: (2026)
Teaching Values to Machines: Simulating Human-Like Behavior in LLMs
par: Yehudai, Asaf, et autres
Publié: (2026)
par: Yehudai, Asaf, et autres
Publié: (2026)
Growing Pains: Extensible and Efficient LLM Benchmarking Via Fixed Parameter Calibration
par: Habba, Eliya, et autres
Publié: (2026)
par: Habba, Eliya, et autres
Publié: (2026)
Do Zombies Understand? A Choose-Your-Own-Adventure Exploration of Machine Cognition
par: Goldstein, Ariel, et autres
Publié: (2024)
par: Goldstein, Ariel, et autres
Publié: (2024)
Evaluating $n$-Gram Novelty of Language Models Using Rusty-DAWG
par: Merrill, William, et autres
Publié: (2024)
par: Merrill, William, et autres
Publié: (2024)
When LLMs are Unfit Use FastFit: Fast and Effective Text Classification with Many Classes
par: Yehudai, Asaf, et autres
Publié: (2024)
par: Yehudai, Asaf, et autres
Publié: (2024)
Rewriting History: A Recipe for Interventional Analyses to Study Data Effects on Model Behavior
par: Nadkarni, Rahul, et autres
Publié: (2025)
par: Nadkarni, Rahul, et autres
Publié: (2025)
Unlabeled Debiasing in Downstream Tasks via Class-wise Low Variance Regularization
par: Masoudian, Shahed, et autres
Publié: (2024)
par: Masoudian, Shahed, et autres
Publié: (2024)
Detection and Measurement of Syntactic Templates in Generated Text
par: Shaib, Chantal, et autres
Publié: (2024)
par: Shaib, Chantal, et autres
Publié: (2024)
On Linear Representations and Pretraining Data Frequency in Language Models
par: Merullo, Jack, et autres
Publié: (2025)
par: Merullo, Jack, et autres
Publié: (2025)
CLEAR: Error Analysis via LLM-as-a-Judge Made Easy
par: Yehudai, Asaf, et autres
Publié: (2025)
par: Yehudai, Asaf, et autres
Publié: (2025)
Agentic CLEAR: Automating Multi-Level Evaluation of LLM Agents
par: Yehudai, Asaf, et autres
Publié: (2026)
par: Yehudai, Asaf, et autres
Publié: (2026)
PromptSuite: A Task-Agnostic Framework for Multi-Prompt Generation
par: Habba, Eliya, et autres
Publié: (2025)
par: Habba, Eliya, et autres
Publié: (2025)
The State and Fate of Summarization Datasets: A Survey
par: Dahan, Noam, et autres
Publié: (2024)
par: Dahan, Noam, et autres
Publié: (2024)
Comparing Humans and Models on a Similar Scale: Towards Cognitive Gender Bias Evaluation in Coreference Resolution
par: Lior, Gili, et autres
Publié: (2023)
par: Lior, Gili, et autres
Publié: (2023)
Estimating the Causal Effect of Early ArXiving on Paper Acceptance
par: Elazar, Yanai, et autres
Publié: (2023)
par: Elazar, Yanai, et autres
Publié: (2023)
JuStRank: Benchmarking LLM Judges for System Ranking
par: Gera, Ariel, et autres
Publié: (2024)
par: Gera, Ariel, et autres
Publié: (2024)
Towards Understanding Task-agnostic Debiasing Through the Lenses of Intrinsic Bias and Forgetfulness
par: Liu, Guangliang, et autres
Publié: (2024)
par: Liu, Guangliang, et autres
Publié: (2024)
Mediocrity is the key for LLM as a Judge Anchor Selection
par: Don-Yehiya, Shachar, et autres
Publié: (2026)
par: Don-Yehiya, Shachar, et autres
Publié: (2026)
Better Aligned with Survey Respondents or Training Data? Unveiling Political Leanings of LLMs on U.S. Supreme Court Cases
par: Xu, Shanshan, et autres
Publié: (2025)
par: Xu, Shanshan, et autres
Publié: (2025)
The Gaps between Pre-train and Downstream Settings in Bias Evaluation and Debiasing
par: Kaneko, Masahiro, et autres
Publié: (2024)
par: Kaneko, Masahiro, et autres
Publié: (2024)
More Documents, Same Length: Isolating the Challenge of Multiple Documents in RAG
par: Levy, Shahar, et autres
Publié: (2025)
par: Levy, Shahar, et autres
Publié: (2025)
Guided Query Refinement: Multimodal Hybrid Retrieval with Test-Time Optimization
par: Uzan, Omri, et autres
Publié: (2025)
par: Uzan, Omri, et autres
Publié: (2025)
WildIFEval: Instruction Following in the Wild
par: Lior, Gili, et autres
Publié: (2025)
par: Lior, Gili, et autres
Publié: (2025)
SEAM: A Stochastic Benchmark for Multi-Document Tasks
par: Lior, Gili, et autres
Publié: (2024)
par: Lior, Gili, et autres
Publié: (2024)
Leveraging Collection-Wide Similarities for Unsupervised Document Structure Extraction
par: Lior, Gili, et autres
Publié: (2024)
par: Lior, Gili, et autres
Publié: (2024)
In-Context Learning on a Budget: A Case Study in Token Classification
par: Berger, Uri, et autres
Publié: (2024)
par: Berger, Uri, et autres
Publié: (2024)
Leveraging Digitized Newspapers to Collect Summarization Data in Low-Resource Languages
par: Dahan, Noam, et autres
Publié: (2025)
par: Dahan, Noam, et autres
Publié: (2025)
Beyond Memorization: Distinguishing between Reductive and Epistemic Reasoning in LLMs using Classic Logic Puzzles
par: Gabay, Adi, et autres
Publié: (2026)
par: Gabay, Adi, et autres
Publié: (2026)
A Survey on Multi-modal Machine Translation: Tasks, Methods and Challenges
par: Shen, Huangjun, et autres
Publié: (2024)
par: Shen, Huangjun, et autres
Publié: (2024)
Will it Merge? On The Causes of Model Mergeability
par: Rahamim, Adir, et autres
Publié: (2026)
par: Rahamim, Adir, et autres
Publié: (2026)
Selective Self-to-Supervised Fine-Tuning for Generalization in Large Language Models
par: Gupta, Sonam, et autres
Publié: (2025)
par: Gupta, Sonam, et autres
Publié: (2025)
Comparing the Framing Effect in Humans and LLMs on Naturally Occurring Texts
par: Lior, Gili, et autres
Publié: (2025)
par: Lior, Gili, et autres
Publié: (2025)
Survey on Evaluation of LLM-based Agents
par: Yehudai, Asaf, et autres
Publié: (2025)
par: Yehudai, Asaf, et autres
Publié: (2025)
Measuring and Improving Attentiveness to Partial Inputs with Counterfactuals
par: Elazar, Yanai, et autres
Publié: (2023)
par: Elazar, Yanai, et autres
Publié: (2023)
Instability in Downstream Task Performance During LLM Pretraining
par: Nishida, Yuto, et autres
Publié: (2025)
par: Nishida, Yuto, et autres
Publié: (2025)
Time to Talk: LLM Agents for Asynchronous Group Communication in Mafia Games
par: Eckhaus, Niv, et autres
Publié: (2025)
par: Eckhaus, Niv, et autres
Publié: (2025)
Planted in Pretraining, Swayed by Finetuning: A Case Study on the Origins of Cognitive Biases in LLMs
par: Itzhak, Itay, et autres
Publié: (2025)
par: Itzhak, Itay, et autres
Publié: (2025)
Can LLMs Detect Intrinsic Hallucinations in Paraphrasing and Machine Translation?
par: Gogoulou, Evangelia, et autres
Publié: (2025)
par: Gogoulou, Evangelia, et autres
Publié: (2025)
Documents similaires
-
A Nurse is Blue and Elephant is Rugby: Cross Domain Alignment in Large Language Models Reveal Human-like Patterns
par: Yehudai, Asaf, et autres
Publié: (2024) -
LLM-Generated or Human-Written? Comparing Review and Non-Review Papers on ArXiv
par: Elazar, Yanai, et autres
Publié: (2026) -
Teaching Values to Machines: Simulating Human-Like Behavior in LLMs
par: Yehudai, Asaf, et autres
Publié: (2026) -
Growing Pains: Extensible and Efficient LLM Benchmarking Via Fixed Parameter Calibration
par: Habba, Eliya, et autres
Publié: (2026) -
Do Zombies Understand? A Choose-Your-Own-Adventure Exploration of Machine Cognition
par: Goldstein, Ariel, et autres
Publié: (2024)