TRACT: Regression-Aware Fine-tuning Meets Chain-of-Thought Reasoning for LLM-as-a-Judge
Fuente:
arXiv
Salvato in:
| Autori principali: | Chiang, Cheng-Han, Lee, Hung-yi, Lukasik, Michal |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Over-Reasoning and Redundant Calculation of Large Language Models
di: Chiang, Cheng-Han, et al.
Pubblicazione: (2024)
di: Chiang, Cheng-Han, et al.
Pubblicazione: (2024)
Merging Facts, Crafting Fallacies: Evaluating the Contradictory Nature of Aggregated Factual Claims in Long-Form Generations
di: Chiang, Cheng-Han, et al.
Pubblicazione: (2024)
di: Chiang, Cheng-Han, et al.
Pubblicazione: (2024)
Enhancing Chain-of-Thought Reasoning with Critical Representation Fine-tuning
di: Huang, Chenxi, et al.
Pubblicazione: (2025)
di: Huang, Chenxi, et al.
Pubblicazione: (2025)
Rethinking Dense Sequential Chains: Reasoning Language Models Can Extract Answers from Sparse, Order-Shuffling Chain-of-Thoughts
di: Chen, Yi-Chang, et al.
Pubblicazione: (2026)
di: Chen, Yi-Chang, et al.
Pubblicazione: (2026)
Systematic Analysis for Pretrained Language Model Priming for Parameter-Efficient Fine-tuning
di: Huang, Shih-Cheng, et al.
Pubblicazione: (2022)
di: Huang, Shih-Cheng, et al.
Pubblicazione: (2022)
Two-stage LLM Fine-tuning with Less Specialization and More Generalization
di: Wang, Yihan, et al.
Pubblicazione: (2022)
di: Wang, Yihan, et al.
Pubblicazione: (2022)
Reducing Object Hallucination in Large Audio-Language Models via Audio-Aware Decoding
di: Hsu, Tzu-wen, et al.
Pubblicazione: (2025)
di: Hsu, Tzu-wen, et al.
Pubblicazione: (2025)
Style Amnesia: Investigating Speaking Style Degradation and Mitigation in Multi-Turn Spoken Language Models
di: Lin, Yu-Xiang, et al.
Pubblicazione: (2025)
di: Lin, Yu-Xiang, et al.
Pubblicazione: (2025)
CodeJudgeBench: Benchmarking LLM-as-a-Judge for Coding Tasks
di: Jiang, Hongchao, et al.
Pubblicazione: (2025)
di: Jiang, Hongchao, et al.
Pubblicazione: (2025)
Advancing Large Language Models to Capture Varied Speaking Styles and Respond Properly in Spoken Conversations
di: Lin, Guan-Ting, et al.
Pubblicazione: (2024)
di: Lin, Guan-Ting, et al.
Pubblicazione: (2024)
SPAR-K: Scheduled Periodic Alternating Early Exit for Spoken Language Models
di: Huang, Hsiao-Ying, et al.
Pubblicazione: (2026)
di: Huang, Hsiao-Ying, et al.
Pubblicazione: (2026)
Nudging Hidden States: Training-Free Model Steering for Chain-of-Thought Reasoning in Large Audio-Language Models
di: Ieong, Lok-Lam, et al.
Pubblicazione: (2026)
di: Ieong, Lok-Lam, et al.
Pubblicazione: (2026)
Non-instructional Fine-tuning: Enabling Instruction-Following Capabilities in Pre-trained Language Models without Instruction-Following Data
di: Xie, Juncheng, et al.
Pubblicazione: (2024)
di: Xie, Juncheng, et al.
Pubblicazione: (2024)
On the Impact of Fine-Tuning on Chain-of-Thought Reasoning
di: Lobo, Elita, et al.
Pubblicazione: (2024)
di: Lobo, Elita, et al.
Pubblicazione: (2024)
Audio-Aware Large Language Models as Judges for Speaking Styles
di: Chiang, Cheng-Han, et al.
Pubblicazione: (2025)
di: Chiang, Cheng-Han, et al.
Pubblicazione: (2025)
Putting on the Thinking Hats: A Survey on Chain of Thought Fine-tuning from the Perspective of Human Reasoning Mechanism
di: Chen, Xiaoshu, et al.
Pubblicazione: (2025)
di: Chen, Xiaoshu, et al.
Pubblicazione: (2025)
C2-Faith: Benchmarking LLM Judges for Causal and Coverage Faithfulness in Chain-of-Thought Reasoning
di: Mittal, Avni, et al.
Pubblicazione: (2026)
di: Mittal, Avni, et al.
Pubblicazione: (2026)
An Empirical Study of LLM-as-a-Judge for LLM Evaluation: Fine-tuned Judge Model is not a General Substitute for GPT-4
di: Huang, Hui, et al.
Pubblicazione: (2024)
di: Huang, Hui, et al.
Pubblicazione: (2024)
Large Language Model as an Assignment Evaluator: Insights, Feedback, and Challenges in a 1000+ Student Course
di: Chiang, Cheng-Han, et al.
Pubblicazione: (2024)
di: Chiang, Cheng-Han, et al.
Pubblicazione: (2024)
When Silence Matters: The Impact of Irrelevant Audio on Text Reasoning in Large Audio-Language Models
di: Li, Chen-An, et al.
Pubblicazione: (2025)
di: Li, Chen-An, et al.
Pubblicazione: (2025)
Refining Input Guardrails: Enhancing LLM-as-a-Judge Efficiency Through Chain-of-Thought Fine-Tuning and Alignment
di: Rad, Melissa Kazemi, et al.
Pubblicazione: (2025)
di: Rad, Melissa Kazemi, et al.
Pubblicazione: (2025)
Learning When to Sample: Confidence-Aware Self-Consistency for Efficient LLM Chain-of-Thought Reasoning
di: Xiong, Juming, et al.
Pubblicazione: (2026)
di: Xiong, Juming, et al.
Pubblicazione: (2026)
Regression-aware Inference with LLMs
di: Lukasik, Michal, et al.
Pubblicazione: (2024)
di: Lukasik, Michal, et al.
Pubblicazione: (2024)
Gaming the Judge: Unfaithful Chain-of-Thought Can Undermine Agent Evaluation
di: Khalifa, Muhammad, et al.
Pubblicazione: (2026)
di: Khalifa, Muhammad, et al.
Pubblicazione: (2026)
Fine-Tuned Thoughts: Leveraging Chain-of-Thought Reasoning for Industrial Asset Health Monitoring
di: Lin, Shuxin, et al.
Pubblicazione: (2025)
di: Lin, Shuxin, et al.
Pubblicazione: (2025)
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
di: Zhou, Huichi, et al.
Pubblicazione: (2025)
di: Zhou, Huichi, et al.
Pubblicazione: (2025)
JudgeLM: Fine-tuned Large Language Models are Scalable Judges
di: Zhu, Lianghui, et al.
Pubblicazione: (2023)
di: Zhu, Lianghui, et al.
Pubblicazione: (2023)
Beyond Fine-Tuning: In-Context Learning and Chain-of-Thought for Reasoned Distractor Generation
di: Alhazmi, Elaf, et al.
Pubblicazione: (2026)
di: Alhazmi, Elaf, et al.
Pubblicazione: (2026)
GRACE: Discriminator-Guided Chain-of-Thought Reasoning
di: Khalifa, Muhammad, et al.
Pubblicazione: (2023)
di: Khalifa, Muhammad, et al.
Pubblicazione: (2023)
ReasonFlux-PRM: Trajectory-Aware PRMs for Long Chain-of-Thought Reasoning in LLMs
di: Zou, Jiaru, et al.
Pubblicazione: (2025)
di: Zou, Jiaru, et al.
Pubblicazione: (2025)
History-Aware Cross-Attention Reinforcement: Self-Supervised Multi Turn and Chain-of-Thought Fine-Tuning with vLLM
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
di: Kiruluta, Andrew, et al.
Pubblicazione: (2025)
Compressed Chain of Thought: Efficient Reasoning Through Dense Representations
di: Cheng, Jeffrey, et al.
Pubblicazione: (2024)
di: Cheng, Jeffrey, et al.
Pubblicazione: (2024)
Hierarchical Chain-of-Thought Prompting: Enhancing LLM Reasoning Performance and Efficiency
di: Huang, Xingshuai, et al.
Pubblicazione: (2026)
di: Huang, Xingshuai, et al.
Pubblicazione: (2026)
Scheherazade: Evaluating Chain-of-Thought Math Reasoning in LLMs with Chain-of-Problems
di: Miner, Stephen, et al.
Pubblicazione: (2024)
di: Miner, Stephen, et al.
Pubblicazione: (2024)
Speech-IFEval: Evaluating Instruction-Following and Quantifying Catastrophic Forgetting in Speech-Aware Language Models
di: Lu, Ke-Han, et al.
Pubblicazione: (2025)
di: Lu, Ke-Han, et al.
Pubblicazione: (2025)
EoRA: Fine-tuning-free Compensation for Compressed LLM with Eigenspace Low-Rank Approximation
di: Liu, Shih-Yang, et al.
Pubblicazione: (2024)
di: Liu, Shih-Yang, et al.
Pubblicazione: (2024)
On the Role of Reasoning Patterns in the Generalization Discrepancy of Long Chain-of-Thought Supervised Fine-Tuning
di: Li, Zhaoyi, et al.
Pubblicazione: (2026)
di: Li, Zhaoyi, et al.
Pubblicazione: (2026)
CARFT: Boosting LLM Reasoning via Contrastive Learning with Annotated Chain-of-Thought-based Reinforced Fine-Tuning
di: Zhu, Wenqiao, et al.
Pubblicazione: (2025)
di: Zhu, Wenqiao, et al.
Pubblicazione: (2025)
Faithful Logical Reasoning via Symbolic Chain-of-Thought
di: Xu, Jundong, et al.
Pubblicazione: (2024)
di: Xu, Jundong, et al.
Pubblicazione: (2024)
Explainable Chain-of-Thought Reasoning: An Empirical Analysis on State-Aware Reasoning Dynamics
di: Yu, Sheldon, et al.
Pubblicazione: (2025)
di: Yu, Sheldon, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Over-Reasoning and Redundant Calculation of Large Language Models
di: Chiang, Cheng-Han, et al.
Pubblicazione: (2024) -
Merging Facts, Crafting Fallacies: Evaluating the Contradictory Nature of Aggregated Factual Claims in Long-Form Generations
di: Chiang, Cheng-Han, et al.
Pubblicazione: (2024) -
Enhancing Chain-of-Thought Reasoning with Critical Representation Fine-tuning
di: Huang, Chenxi, et al.
Pubblicazione: (2025) -
Rethinking Dense Sequential Chains: Reasoning Language Models Can Extract Answers from Sparse, Order-Shuffling Chain-of-Thoughts
di: Chen, Yi-Chang, et al.
Pubblicazione: (2026) -
Systematic Analysis for Pretrained Language Model Priming for Parameter-Efficient Fine-tuning
di: Huang, Shih-Cheng, et al.
Pubblicazione: (2022)