Rethinking Prompt-based Debiasing in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Xinyi, Zhan, Runzhe, Wong, Derek F., Yang, Shu, Wu, Junchao, Chao, Lidia S. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DetectRL: Benchmarking LLM-Generated Text Detection in Real-World Scenarios
di: Wu, Junchao, et al.
Pubblicazione: (2024)
di: Wu, Junchao, et al.
Pubblicazione: (2024)
Neuron-Aware Data Selection In Instruction Tuning For Large Language Models
di: Chen, Xin, et al.
Pubblicazione: (2026)
di: Chen, Xin, et al.
Pubblicazione: (2026)
Prefix Text as a Yarn: Eliciting Non-English Alignment in Foundation Language Model
di: Zhan, Runzhe, et al.
Pubblicazione: (2024)
di: Zhan, Runzhe, et al.
Pubblicazione: (2024)
A Survey on LLM-Generated Text Detection: Necessity, Methods, and Future Directions
di: Wu, Junchao, et al.
Pubblicazione: (2023)
di: Wu, Junchao, et al.
Pubblicazione: (2023)
Let's Focus on Neuron: Neuron-Level Supervised Fine-tuning for Large Language Model
di: Xu, Haoyun, et al.
Pubblicazione: (2024)
di: Xu, Haoyun, et al.
Pubblicazione: (2024)
Are Large Reasoning Models Good Translation Evaluators? Analysis and Performance Boost
di: Zhan, Runzhe, et al.
Pubblicazione: (2025)
di: Zhan, Runzhe, et al.
Pubblicazione: (2025)
Who Wrote This? The Key to Zero-Shot LLM-Generated Text Detection Is GECScore
di: Wu, Junchao, et al.
Pubblicazione: (2024)
di: Wu, Junchao, et al.
Pubblicazione: (2024)
Intrinsic Model Weaknesses: How Priming Attacks Unveil Vulnerabilities in Large Language Models
di: Huang, Yuyi, et al.
Pubblicazione: (2025)
di: Huang, Yuyi, et al.
Pubblicazione: (2025)
Path Drift in Large Reasoning Models:How First-Person Commitments Override Safety
di: Huang, Yuyi, et al.
Pubblicazione: (2025)
di: Huang, Yuyi, et al.
Pubblicazione: (2025)
RepreGuard: Detecting LLM-Generated Text by Revealing Hidden Representation Patterns
di: Chen, Xin, et al.
Pubblicazione: (2025)
di: Chen, Xin, et al.
Pubblicazione: (2025)
Understanding and Mitigating Political Stance Cross-topic Generalization in Large Language Models
di: Zhang, Jiayi, et al.
Pubblicazione: (2025)
di: Zhang, Jiayi, et al.
Pubblicazione: (2025)
Investigating CoT Monitorability in Large Reasoning Models
di: Yang, Shu, et al.
Pubblicazione: (2025)
di: Yang, Shu, et al.
Pubblicazione: (2025)
Understanding Aha Moments: from External Observations to Internal Mechanisms
di: Yang, Shu, et al.
Pubblicazione: (2025)
di: Yang, Shu, et al.
Pubblicazione: (2025)
Causal Prompting: Debiasing Large Language Model Prompting based on Front-Door Adjustment
di: Zhang, Congzhi, et al.
Pubblicazione: (2024)
di: Zhang, Congzhi, et al.
Pubblicazione: (2024)
VisAidMath: Benchmarking Visual-Aided Mathematical Reasoning
di: Ma, Jingkun, et al.
Pubblicazione: (2024)
di: Ma, Jingkun, et al.
Pubblicazione: (2024)
Can Large Language Models Identify Implicit Suicidal Ideation? An Empirical Evaluation
di: Li, Tong, et al.
Pubblicazione: (2025)
di: Li, Tong, et al.
Pubblicazione: (2025)
Exposing the Cracks: Vulnerabilities of Retrieval-Augmented LLM-based Machine Translation
di: Sun, Yanming, et al.
Pubblicazione: (2025)
di: Sun, Yanming, et al.
Pubblicazione: (2025)
Benchmarking the Detection of LLMs-Generated Modern Chinese Poetry
di: Wang, Shanshan, et al.
Pubblicazione: (2025)
di: Wang, Shanshan, et al.
Pubblicazione: (2025)
Is Long-to-Short a Free Lunch? Investigating Inconsistency and Reasoning Efficiency in LRMs
di: Yang, Shu, et al.
Pubblicazione: (2025)
di: Yang, Shu, et al.
Pubblicazione: (2025)
Teacher-Student Training for Debiasing: General Permutation Debiasing for Large Language Models
di: Liusie, Adian, et al.
Pubblicazione: (2024)
di: Liusie, Adian, et al.
Pubblicazione: (2024)
Rethinking Kullback-Leibler Divergence in Knowledge Distillation for Large Language Models
di: Wu, Taiqiang, et al.
Pubblicazione: (2024)
di: Wu, Taiqiang, et al.
Pubblicazione: (2024)
A Two-Stage Prediction-Aware Contrastive Learning Framework for Multi-Intent NLU
di: Chen, Guanhua, et al.
Pubblicazione: (2024)
di: Chen, Guanhua, et al.
Pubblicazione: (2024)
Debiasing Large Language Models via Adaptive Causal Prompting with Sketch-of-Thought
di: Li, Bowen, et al.
Pubblicazione: (2026)
di: Li, Bowen, et al.
Pubblicazione: (2026)
Rethinking Tokenization: Crafting Better Tokenizers for Large Language Models
di: Yang, Jinbiao
Pubblicazione: (2024)
di: Yang, Jinbiao
Pubblicazione: (2024)
Bi-directional Bias Attribution: Debiasing Large Language Models without Modifying Prompts
di: Lin, Yujie, et al.
Pubblicazione: (2026)
di: Lin, Yujie, et al.
Pubblicazione: (2026)
FOCUS: Forging Originality through Contrastive Use in Self-Plagiarism for Language Models
di: Lan, Kaixin, et al.
Pubblicazione: (2024)
di: Lan, Kaixin, et al.
Pubblicazione: (2024)
Thinking Fair and Slow: On the Efficacy of Structured Prompts for Debiasing Language Models
di: Furniturewala, Shaz, et al.
Pubblicazione: (2024)
di: Furniturewala, Shaz, et al.
Pubblicazione: (2024)
Mitigating Prompt-Induced Hallucinations in Large Language Models via Structured Reasoning
di: Hao, Jinbo, et al.
Pubblicazione: (2026)
di: Hao, Jinbo, et al.
Pubblicazione: (2026)
Unveiling LLMs' Metaphorical Understanding: Exploring Conceptual Irrelevance, Context Leveraging and Syntactic Influence
di: Ye, Fengying, et al.
Pubblicazione: (2025)
di: Ye, Fengying, et al.
Pubblicazione: (2025)
Can ChatGPT Really Understand Modern Chinese Poetry?
di: Wang, Shanshan, et al.
Pubblicazione: (2026)
di: Wang, Shanshan, et al.
Pubblicazione: (2026)
What is the Best Way for ChatGPT to Translate Poetry?
di: Wang, Shanshan, et al.
Pubblicazione: (2024)
di: Wang, Shanshan, et al.
Pubblicazione: (2024)
Large Language Model for Multi-Domain Translation: Benchmarking and Domain CoT Fine-tuning
di: Hu, Tianxiang, et al.
Pubblicazione: (2024)
di: Hu, Tianxiang, et al.
Pubblicazione: (2024)
Causal-Guided Active Learning for Debiasing Large Language Models
di: Du, Li, et al.
Pubblicazione: (2024)
di: Du, Li, et al.
Pubblicazione: (2024)
Any Large Language Model Can Be a Reliable Judge: Debiasing with a Reasoning-based Bias Detector
di: Yang, Haoyan, et al.
Pubblicazione: (2025)
di: Yang, Haoyan, et al.
Pubblicazione: (2025)
Fraud-R1 : A Multi-Round Benchmark for Assessing the Robustness of LLM Against Augmented Fraud and Phishing Inducements
di: Yang, Shu, et al.
Pubblicazione: (2025)
di: Yang, Shu, et al.
Pubblicazione: (2025)
SGIC: A Self-Guided Iterative Calibration Framework for RAG
di: Chen, Guanhua, et al.
Pubblicazione: (2025)
di: Chen, Guanhua, et al.
Pubblicazione: (2025)
Ensemble Debiasing Across Class and Sample Levels for Fairer Prompting Accuracy
di: Lin, Ruixi, et al.
Pubblicazione: (2025)
di: Lin, Ruixi, et al.
Pubblicazione: (2025)
Anchor-based Large Language Models
di: Pang, Jianhui, et al.
Pubblicazione: (2024)
di: Pang, Jianhui, et al.
Pubblicazione: (2024)
Lens: Rethinking Multilingual Enhancement for Large Language Models
di: Zhao, Weixiang, et al.
Pubblicazione: (2024)
di: Zhao, Weixiang, et al.
Pubblicazione: (2024)
BayesPrompt: Prompting Large-Scale Pre-Trained Language Models on Few-shot Inference via Debiased Domain Abstraction
di: Li, Jiangmeng, et al.
Pubblicazione: (2024)
di: Li, Jiangmeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DetectRL: Benchmarking LLM-Generated Text Detection in Real-World Scenarios
di: Wu, Junchao, et al.
Pubblicazione: (2024) -
Neuron-Aware Data Selection In Instruction Tuning For Large Language Models
di: Chen, Xin, et al.
Pubblicazione: (2026) -
Prefix Text as a Yarn: Eliciting Non-English Alignment in Foundation Language Model
di: Zhan, Runzhe, et al.
Pubblicazione: (2024) -
A Survey on LLM-Generated Text Detection: Necessity, Methods, and Future Directions
di: Wu, Junchao, et al.
Pubblicazione: (2023) -
Let's Focus on Neuron: Neuron-Level Supervised Fine-tuning for Large Language Model
di: Xu, Haoyun, et al.
Pubblicazione: (2024)