Self-Supervised Position Debiasing for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Zhongkun, Chen, Zheng, Zhang, Mengqi, Ren, Zhaochun, Ren, Pengjie, Chen, Zhumin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MELoRA: Mini-Ensemble Low-Rank Adapters for Parameter-Efficient Fine-Tuning
di: Ren, Pengjie, et al.
Pubblicazione: (2024)
di: Ren, Pengjie, et al.
Pubblicazione: (2024)
Large Language Model (LLM) Bias Index -- LLMBI
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
di: Peters, Sydney, et al.
Pubblicazione: (2025)
di: Peters, Sydney, et al.
Pubblicazione: (2025)
ProSparse: Introducing and Enhancing Intrinsic Activation Sparsity within Large Language Models
di: Song, Chenyang, et al.
Pubblicazione: (2024)
di: Song, Chenyang, et al.
Pubblicazione: (2024)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
di: Fadli, Samih
Pubblicazione: (2025)
di: Fadli, Samih
Pubblicazione: (2025)
Streamlining Redundant Layers to Compress Large Language Models
di: Chen, Xiaodong, et al.
Pubblicazione: (2024)
di: Chen, Xiaodong, et al.
Pubblicazione: (2024)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
RAVR: Reference-Answer-guided Variational Reasoning for Large Language Models
di: Lin, Tianqianjin, et al.
Pubblicazione: (2025)
di: Lin, Tianqianjin, et al.
Pubblicazione: (2025)
Painless Activation Steering: An Automated, Lightweight Approach for Post-Training Large Language Models
di: Cui, Sasha, et al.
Pubblicazione: (2025)
di: Cui, Sasha, et al.
Pubblicazione: (2025)
The Readout Shortcut: Positional Number Copying Dominates Arithmetic CoT Readout in Small Language Models
di: Liu, Ming
Pubblicazione: (2026)
di: Liu, Ming
Pubblicazione: (2026)
Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding
di: Chen, Haolin, et al.
Pubblicazione: (2024)
di: Chen, Haolin, et al.
Pubblicazione: (2024)
HAMMER: Hamiltonian Curiosity Augmented Large Language Model Reinforcement
di: Yang, Ming, et al.
Pubblicazione: (2025)
di: Yang, Ming, et al.
Pubblicazione: (2025)
AgentTTS: Large Language Model Agent for Test-time Compute-optimal Scaling Strategy in Complex Tasks
di: Wang, Fali, et al.
Pubblicazione: (2025)
di: Wang, Fali, et al.
Pubblicazione: (2025)
Evaluating Long Range Dependency Handling in Code Generation LLMs
di: Assogba, Yannick, et al.
Pubblicazione: (2024)
di: Assogba, Yannick, et al.
Pubblicazione: (2024)
Identifying and Mitigating the Influence of the Prior Distribution in Large Language Models
di: Zhang, Liyi, et al.
Pubblicazione: (2025)
di: Zhang, Liyi, et al.
Pubblicazione: (2025)
Random-Set Large Language Models
di: Mubashar, Muhammad, et al.
Pubblicazione: (2025)
di: Mubashar, Muhammad, et al.
Pubblicazione: (2025)
Danoliteracy of Generative Large Language Models
di: Holm, Søren Vejlgaard, et al.
Pubblicazione: (2024)
di: Holm, Søren Vejlgaard, et al.
Pubblicazione: (2024)
Large Language Models Generate Harmful Content Using a Distinct, Unified Mechanism
di: Orgad, Hadas, et al.
Pubblicazione: (2026)
di: Orgad, Hadas, et al.
Pubblicazione: (2026)
Distilling Knowledge from Large Language Models: A Concept Bottleneck Model for Hate and Counter Speech Recognition
di: Labadie-Tamayo, Roberto, et al.
Pubblicazione: (2025)
di: Labadie-Tamayo, Roberto, et al.
Pubblicazione: (2025)
Dual Debiasing for Noisy In-Context Learning for Text Generation
di: Liang, Siqi, et al.
Pubblicazione: (2025)
di: Liang, Siqi, et al.
Pubblicazione: (2025)
SWI: Speaking with Intent in Large Language Models
di: Yin, Yuwei, et al.
Pubblicazione: (2025)
di: Yin, Yuwei, et al.
Pubblicazione: (2025)
Uncovering Biases with Reflective Large Language Models
di: Chang, Edward Y.
Pubblicazione: (2024)
di: Chang, Edward Y.
Pubblicazione: (2024)
Turning the TIDE: Cross-Architecture Distillation for Diffusion Large Language Models
di: Zhang, Gongbo, et al.
Pubblicazione: (2026)
di: Zhang, Gongbo, et al.
Pubblicazione: (2026)
Benchmarking Cognitive Biases in Large Language Models as Evaluators
di: Koo, Ryan, et al.
Pubblicazione: (2023)
di: Koo, Ryan, et al.
Pubblicazione: (2023)
Robustness of Large Language Models to Perturbations in Text
di: Singh, Ayush, et al.
Pubblicazione: (2024)
di: Singh, Ayush, et al.
Pubblicazione: (2024)
PatentGPT: A Large Language Model for Intellectual Property
di: Bai, Zilong, et al.
Pubblicazione: (2024)
di: Bai, Zilong, et al.
Pubblicazione: (2024)
Generalizing Numerical Reasoning in Table Data through Operation Sketches and Self-Supervised Learning
di: Cho, Hanjun, et al.
Pubblicazione: (2026)
di: Cho, Hanjun, et al.
Pubblicazione: (2026)
Transforming Dutch: Debiasing Dutch Coreference Resolution Systems for Non-binary Pronouns
di: van Boven, Goya, et al.
Pubblicazione: (2024)
di: van Boven, Goya, et al.
Pubblicazione: (2024)
Metaphors are a Source of Cross-Domain Misalignment of Large Reasoning Models
di: Hu, Zhibo, et al.
Pubblicazione: (2026)
di: Hu, Zhibo, et al.
Pubblicazione: (2026)
UniHetero: Could Generation Enhance Understanding for Vision-Language-Model at Large Data Scale?
di: Chen, Fengjiao, et al.
Pubblicazione: (2025)
di: Chen, Fengjiao, et al.
Pubblicazione: (2025)
Do Personality Traits Interfere? Geometric Limitations of Steering in Large Language Models
di: Bhandari, Pranav, et al.
Pubblicazione: (2026)
di: Bhandari, Pranav, et al.
Pubblicazione: (2026)
Detecting Hallucinations in Large Language Model Generation: A Token Probability Approach
di: Quevedo, Ernesto, et al.
Pubblicazione: (2024)
di: Quevedo, Ernesto, et al.
Pubblicazione: (2024)
Mathador-LM: A Dynamic Benchmark for Mathematical Reasoning on Large Language Models
di: Kurtic, Eldar, et al.
Pubblicazione: (2024)
di: Kurtic, Eldar, et al.
Pubblicazione: (2024)
Consistency Evaluation of News Article Summaries Generated by Large (and Small) Language Models
di: Gilhuly, Colleen, et al.
Pubblicazione: (2025)
di: Gilhuly, Colleen, et al.
Pubblicazione: (2025)
External Hippocampus: Topological Cognitive Maps for Guiding Large Language Model Reasoning
di: Yan, Jian
Pubblicazione: (2025)
di: Yan, Jian
Pubblicazione: (2025)
Concept Navigation and Classification via Open-Source Large Language Model Processing
di: Kubli, Maël
Pubblicazione: (2025)
di: Kubli, Maël
Pubblicazione: (2025)
Thought-Like-Pro: Enhancing Reasoning of Large Language Models through Self-Driven Prolog-based Chain-of-Thought
di: Tan, Xiaoyu, et al.
Pubblicazione: (2024)
di: Tan, Xiaoyu, et al.
Pubblicazione: (2024)
Partially Recentralization Softmax Loss for Vision-Language Models Robustness
di: Wang, Hao, et al.
Pubblicazione: (2024)
di: Wang, Hao, et al.
Pubblicazione: (2024)
Self-Training Doesn't Flatten Language -- It Restructures It: Surface Markers Amplify While Deep Syntax Dies
di: Liu, Ming
Pubblicazione: (2026)
di: Liu, Ming
Pubblicazione: (2026)
Demystifying Instruction Mixing for Fine-tuning Large Language Models
di: Wang, Renxi, et al.
Pubblicazione: (2023)
di: Wang, Renxi, et al.
Pubblicazione: (2023)
Documenti analoghi
-
MELoRA: Mini-Ensemble Low-Rank Adapters for Parameter-Efficient Fine-Tuning
di: Ren, Pengjie, et al.
Pubblicazione: (2024) -
Large Language Model (LLM) Bias Index -- LLMBI
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023) -
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
di: Peters, Sydney, et al.
Pubblicazione: (2025) -
ProSparse: Introducing and Enhancing Intrinsic Activation Sparsity within Large Language Models
di: Song, Chenyang, et al.
Pubblicazione: (2024) -
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
di: Fadli, Samih
Pubblicazione: (2025)