Mitigating Strategy-Selection Bias in Reasoning for More Effective Test-Time Scaling
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Zongqian, Xu, Baoduo, Li, Tianyu, Sun, Zhu, Zhu, Xiaofeng, Feng, Lei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Is Depth All You Need? An Exploration of Iterative Reasoning in LLMs
di: Wu, Zongqian, et al.
Pubblicazione: (2025)
di: Wu, Zongqian, et al.
Pubblicazione: (2025)
Rethinking Chain-of-Thought from the Perspective of Self-Training
di: Wu, Zongqian, et al.
Pubblicazione: (2024)
di: Wu, Zongqian, et al.
Pubblicazione: (2024)
MatryoshkaThinking: Recursive Test-Time Scaling Enables Efficient Reasoning
di: Chen, Hongwei, et al.
Pubblicazione: (2025)
di: Chen, Hongwei, et al.
Pubblicazione: (2025)
ReasonGraph: Visualisation of Reasoning Paths
di: Li, Zongqian, et al.
Pubblicazione: (2025)
di: Li, Zongqian, et al.
Pubblicazione: (2025)
Scaling over Scaling: Exploring Test-Time Scaling Plateau in Large Reasoning Models
di: Wang, Jian, et al.
Pubblicazione: (2025)
di: Wang, Jian, et al.
Pubblicazione: (2025)
LIMOPro: Reasoning Refinement for Efficient and Effective Test-time Scaling
di: Xiao, Yang, et al.
Pubblicazione: (2025)
di: Xiao, Yang, et al.
Pubblicazione: (2025)
Bias Fitting to Mitigate Length Bias of Reward Model in RLHF
di: Zhao, Kangwen, et al.
Pubblicazione: (2025)
di: Zhao, Kangwen, et al.
Pubblicazione: (2025)
Test-Time Scaling in Reasoning Models Is Not Effective for Knowledge-Intensive Tasks Yet
di: Zhao, James Xu, et al.
Pubblicazione: (2025)
di: Zhao, James Xu, et al.
Pubblicazione: (2025)
Does Thinking More always Help? Mirage of Test-Time Scaling in Reasoning Models
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2025)
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2025)
Less is More: Improving LLM Reasoning with Minimal Test-Time Intervention
di: Yang, Zhen, et al.
Pubblicazione: (2025)
di: Yang, Zhen, et al.
Pubblicazione: (2025)
Mitigating Selection Bias with Node Pruning and Auxiliary Options
di: Choi, Hyeong Kyu, et al.
Pubblicazione: (2024)
di: Choi, Hyeong Kyu, et al.
Pubblicazione: (2024)
Does Reasoning Introduce Bias? A Study of Social Bias Evaluation and Mitigation in LLM Reasoning
di: Wu, Xuyang, et al.
Pubblicazione: (2025)
di: Wu, Xuyang, et al.
Pubblicazione: (2025)
UniBias: Unveiling and Mitigating LLM Bias through Internal Attention and FFN Manipulation
di: Zhou, Hanzhang, et al.
Pubblicazione: (2024)
di: Zhou, Hanzhang, et al.
Pubblicazione: (2024)
BiasBusters: Uncovering and Mitigating Tool Selection Bias in Large Language Models
di: Blankenstein, Thierry, et al.
Pubblicazione: (2025)
di: Blankenstein, Thierry, et al.
Pubblicazione: (2025)
Efficient Test-Time Scaling via Temporal Reasoning Aggregation
di: Li, Jiakun, et al.
Pubblicazione: (2026)
di: Li, Jiakun, et al.
Pubblicazione: (2026)
SLIM: Subtrajectory-Level Elimination for More Effective Reasoning
di: Yao, Xifeng, et al.
Pubblicazione: (2025)
di: Yao, Xifeng, et al.
Pubblicazione: (2025)
Entropy-Gated Branching for Efficient Test-Time Reasoning
di: Li, Xianzhi, et al.
Pubblicazione: (2025)
di: Li, Xianzhi, et al.
Pubblicazione: (2025)
KnowBias: Mitigating Social Bias in LLMs via Know-Bias Neuron Enhancement
di: Pan, Jinhao, et al.
Pubblicazione: (2026)
di: Pan, Jinhao, et al.
Pubblicazione: (2026)
More Thinking, More Bias: Length-Driven Position Bias in Reasoning Models
di: Wang, Xiao
Pubblicazione: (2026)
di: Wang, Xiao
Pubblicazione: (2026)
Test-Time Strategies for More Efficient and Accurate Agentic RAG
di: Zhang, Brian, et al.
Pubblicazione: (2026)
di: Zhang, Brian, et al.
Pubblicazione: (2026)
EconProver: Towards More Economical Test-Time Scaling for Automated Theorem Proving
di: Li, Mukai, et al.
Pubblicazione: (2025)
di: Li, Mukai, et al.
Pubblicazione: (2025)
PI-Mamba: Linear-Time Protein Backbone Generation via Spectrally Initialized Flow Matching
di: Wu, Tianyu, et al.
Pubblicazione: (2026)
di: Wu, Tianyu, et al.
Pubblicazione: (2026)
Uncovering Bias in Foundation Models: Impact, Testing, Harm, and Mitigation
di: Sun, Shuzhou, et al.
Pubblicazione: (2025)
di: Sun, Shuzhou, et al.
Pubblicazione: (2025)
When More Thinking Hurts: Overthinking in LLM Test-Time Compute Scaling
di: Zhou, Shu, et al.
Pubblicazione: (2026)
di: Zhou, Shu, et al.
Pubblicazione: (2026)
More Test-Time Compute Can Hurt: Overestimation Bias in LLM Beam Search
di: Dalal, Gal, et al.
Pubblicazione: (2026)
di: Dalal, Gal, et al.
Pubblicazione: (2026)
Reinforcement Learning Teachers of Test Time Scaling
di: Cetin, Edoardo, et al.
Pubblicazione: (2025)
di: Cetin, Edoardo, et al.
Pubblicazione: (2025)
Reasoning-as-Logic-Units: Scaling Test-Time Reasoning in Large Language Models Through Logic Unit Alignment
di: Li, Cheryl, et al.
Pubblicazione: (2025)
di: Li, Cheryl, et al.
Pubblicazione: (2025)
Decoding Ambiguous Emotions with Test-Time Scaling in Audio-Language Models
di: Jia, Hong, et al.
Pubblicazione: (2026)
di: Jia, Hong, et al.
Pubblicazione: (2026)
Language Bias in LVLMs: From In-Depth Analysis to Simple and Effective Mitigation
di: Chen, Yangneng, et al.
Pubblicazione: (2026)
di: Chen, Yangneng, et al.
Pubblicazione: (2026)
Popularity-Aware Alignment and Contrast for Mitigating Popularity Bias
di: Cai, Miaomiao, et al.
Pubblicazione: (2024)
di: Cai, Miaomiao, et al.
Pubblicazione: (2024)
AutoDAN-Reasoning: Enhancing Strategies Exploration based Jailbreak Attacks with Test-Time Scaling
di: Liu, Xiaogeng, et al.
Pubblicazione: (2025)
di: Liu, Xiaogeng, et al.
Pubblicazione: (2025)
FR-TTS: Test-Time Scaling for NTP-based Image Generation with Effective Filling-based Reward Signal
di: Xu, Hang, et al.
Pubblicazione: (2025)
di: Xu, Hang, et al.
Pubblicazione: (2025)
When to Vote, When to Rewrite: Disagreement-Guided Strategy Routing for Test-Time Scaling
di: Lin, Zhimin, et al.
Pubblicazione: (2026)
di: Lin, Zhimin, et al.
Pubblicazione: (2026)
PhysMem: Scaling Test-Time Memory for Embodied Physical Reasoning
di: Li, Haoyang, et al.
Pubblicazione: (2026)
di: Li, Haoyang, et al.
Pubblicazione: (2026)
Parallel Test-Time Scaling for Latent Reasoning Models
di: You, Runyang, et al.
Pubblicazione: (2025)
di: You, Runyang, et al.
Pubblicazione: (2025)
Mitigating Misleading Chain-of-Thought Reasoning with Selective Filtering
di: Wu, Yexin, et al.
Pubblicazione: (2024)
di: Wu, Yexin, et al.
Pubblicazione: (2024)
Knowledge Updating? No More Model Editing! Just Selective Contextual Reasoning
di: He, Guoxiu, et al.
Pubblicazione: (2025)
di: He, Guoxiu, et al.
Pubblicazione: (2025)
Bias Testing and Mitigation in LLM-based Code Generation
di: Huang, Dong, et al.
Pubblicazione: (2023)
di: Huang, Dong, et al.
Pubblicazione: (2023)
ARISE: An Adaptive Resolution-Aware Metric for Test-Time Scaling Evaluation in Large Reasoning Models
di: Yin, Zhangyue, et al.
Pubblicazione: (2025)
di: Yin, Zhangyue, et al.
Pubblicazione: (2025)
Revisiting Technical Bias Mitigation Strategies
di: Mahamadou, Abdoul Jalil Djiberou, et al.
Pubblicazione: (2024)
di: Mahamadou, Abdoul Jalil Djiberou, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Is Depth All You Need? An Exploration of Iterative Reasoning in LLMs
di: Wu, Zongqian, et al.
Pubblicazione: (2025) -
Rethinking Chain-of-Thought from the Perspective of Self-Training
di: Wu, Zongqian, et al.
Pubblicazione: (2024) -
MatryoshkaThinking: Recursive Test-Time Scaling Enables Efficient Reasoning
di: Chen, Hongwei, et al.
Pubblicazione: (2025) -
ReasonGraph: Visualisation of Reasoning Paths
di: Li, Zongqian, et al.
Pubblicazione: (2025) -
Scaling over Scaling: Exploring Test-Time Scaling Plateau in Large Reasoning Models
di: Wang, Jian, et al.
Pubblicazione: (2025)