From Misleading Queries to Accurate Answers: A Three-Stage Fine-Tuning Method for LLMs
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Guocong, Liu, Weize, Wu, Yihang, Wang, Ping, Huang, Shuaihan, Xu, Hongxia, Wu, Jian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mind's Mirror: Distilling Self-Evaluation Capability and Comprehensive Thinking from Large Language Models
di: Liu, Weize, et al.
Pubblicazione: (2023)
di: Liu, Weize, et al.
Pubblicazione: (2023)
Unraveling Babel: Exploring Multilingual Activation Patterns of LLMs and Their Applications
di: Liu, Weize, et al.
Pubblicazione: (2024)
di: Liu, Weize, et al.
Pubblicazione: (2024)
ClimateChat: Designing Data and Methods for Instruction Tuning LLMs to Answer Climate Change Queries
di: Chen, Zhou, et al.
Pubblicazione: (2025)
di: Chen, Zhou, et al.
Pubblicazione: (2025)
Answer-Centric or Reasoning-Driven? Uncovering the Latent Memory Anchor in LLMs
di: Wu, Yang, et al.
Pubblicazione: (2025)
di: Wu, Yang, et al.
Pubblicazione: (2025)
From Drafts to Answers: Unlocking LLM Potential via Aggregation Fine-Tuning
di: Li, Yafu, et al.
Pubblicazione: (2025)
di: Li, Yafu, et al.
Pubblicazione: (2025)
From Answers to Questions: EQGBench for Evaluating LLMs' Educational Question Generation
di: Zhou, Chengliang, et al.
Pubblicazione: (2025)
di: Zhou, Chengliang, et al.
Pubblicazione: (2025)
Unleashing the Reasoning Potential of Pre-trained LLMs by Critique Fine-Tuning on One Problem
di: Wang, Yubo, et al.
Pubblicazione: (2025)
di: Wang, Yubo, et al.
Pubblicazione: (2025)
InfiMed-Foundation: Pioneering Advanced Multimodal Medical Models with Compute-Efficient Pre-Training and Multi-Stage Fine-Tuning
di: Zhu, Guanghao, et al.
Pubblicazione: (2025)
di: Zhu, Guanghao, et al.
Pubblicazione: (2025)
Team-Based Self-Play With Dual Adaptive Weighting for Fine-Tuning LLMs
di: Li, Wu, et al.
Pubblicazione: (2026)
di: Li, Wu, et al.
Pubblicazione: (2026)
RuozhiBench: Evaluating LLMs with Logical Fallacies and Misleading Premises
di: Zhai, Zenan, et al.
Pubblicazione: (2025)
di: Zhai, Zenan, et al.
Pubblicazione: (2025)
From Parameters to Prompts: Understanding and Mitigating the Factuality Gap between Fine-Tuned LLMs
di: Gong, Xuan, et al.
Pubblicazione: (2025)
di: Gong, Xuan, et al.
Pubblicazione: (2025)
Adaptive Query Rewriting: Aligning Rewriters through Marginal Probability of Conversational Answers
di: Zhang, Tianhua, et al.
Pubblicazione: (2024)
di: Zhang, Tianhua, et al.
Pubblicazione: (2024)
SRFT: A Single-Stage Method with Supervised and Reinforcement Fine-Tuning for Reasoning
di: Fu, Yuqian, et al.
Pubblicazione: (2025)
di: Fu, Yuqian, et al.
Pubblicazione: (2025)
When Personalization Misleads: Understanding and Mitigating Hallucinations in Personalized LLMs
di: Sun, Zhongxiang, et al.
Pubblicazione: (2026)
di: Sun, Zhongxiang, et al.
Pubblicazione: (2026)
Sandwich Reasoning: An Answer-Reasoning-Answer Approach for Low-Latency Query Correction
di: Zhang, Chen, et al.
Pubblicazione: (2026)
di: Zhang, Chen, et al.
Pubblicazione: (2026)
The Art of (Mis)alignment: How Fine-Tuning Methods Effectively Misalign and Realign LLMs in Post-Training
di: Zhang, Rui, et al.
Pubblicazione: (2026)
di: Zhang, Rui, et al.
Pubblicazione: (2026)
NCL-UoR at SemEval-2026 Task 5: Embedding-Based Methods, Fine-Tuning, and LLMs for Word Sense Plausibility Rating
di: Wu, Tong, et al.
Pubblicazione: (2026)
di: Wu, Tong, et al.
Pubblicazione: (2026)
Enhancing Automated Essay Scoring with Three Techniques: Two-Stage Fine-Tuning, Score Alignment, and Self-Training
di: Choi, Hongseok, et al.
Pubblicazione: (2026)
di: Choi, Hongseok, et al.
Pubblicazione: (2026)
One-Token Rollout: Guiding Supervised Fine-Tuning of LLMs with Policy Gradient
di: Ming, Rui, et al.
Pubblicazione: (2025)
di: Ming, Rui, et al.
Pubblicazione: (2025)
Rethinking Supervised Fine-Tuning: Emphasizing Key Answer Tokens for Improved LLM Accuracy
di: Shi, Xiaofeng, et al.
Pubblicazione: (2025)
di: Shi, Xiaofeng, et al.
Pubblicazione: (2025)
Impact of Fine-Tuning Methods on Memorization in Large Language Models
di: Hou, Jie, et al.
Pubblicazione: (2025)
di: Hou, Jie, et al.
Pubblicazione: (2025)
Building Accurate Translation-Tailored LLMs with Language Aware Instruction Tuning
di: Zan, Changtong, et al.
Pubblicazione: (2024)
di: Zan, Changtong, et al.
Pubblicazione: (2024)
Mitigating Misleading Chain-of-Thought Reasoning with Selective Filtering
di: Wu, Yexin, et al.
Pubblicazione: (2024)
di: Wu, Yexin, et al.
Pubblicazione: (2024)
Spelling Correction in Healthcare Query-Answer Systems: Methods, Retrieval Impact, and Empirical Evaluation
di: Singh, Saurabh K
Pubblicazione: (2026)
di: Singh, Saurabh K
Pubblicazione: (2026)
Two-Stage Quranic QA via Ensemble Retrieval and Instruction-Tuned Answer Extraction
di: Basem, Mohamed, et al.
Pubblicazione: (2025)
di: Basem, Mohamed, et al.
Pubblicazione: (2025)
FineTuneBench: How well do commercial fine-tuning APIs infuse knowledge into LLMs?
di: Wu, Eric, et al.
Pubblicazione: (2024)
di: Wu, Eric, et al.
Pubblicazione: (2024)
HFT: Half Fine-Tuning for Large Language Models
di: Hui, Tingfeng, et al.
Pubblicazione: (2024)
di: Hui, Tingfeng, et al.
Pubblicazione: (2024)
LowRA: Accurate and Efficient LoRA Fine-Tuning of LLMs under 2 Bits
di: Zhou, Zikai, et al.
Pubblicazione: (2025)
di: Zhou, Zikai, et al.
Pubblicazione: (2025)
Leveraging Lora Fine-Tuning and Knowledge Bases for Construction Identification
di: Kaipeng, Liu, et al.
Pubblicazione: (2026)
di: Kaipeng, Liu, et al.
Pubblicazione: (2026)
LLMs-Powered Accurate Extraction, Querying and Intelligent Management of Literature derived 2D Materials Data
di: Shang, Lijun, et al.
Pubblicazione: (2025)
di: Shang, Lijun, et al.
Pubblicazione: (2025)
MeTA-LoRA: Data-Efficient Multi-Task Fine-Tuning for Large Language Models
di: Cheng, Bo, et al.
Pubblicazione: (2025)
di: Cheng, Bo, et al.
Pubblicazione: (2025)
ALLabel: Three-stage Active Learning for LLM-based Entity Recognition using Demonstration Retrieval
di: Chen, Zihan, et al.
Pubblicazione: (2025)
di: Chen, Zihan, et al.
Pubblicazione: (2025)
EBFT: Effective and Block-Wise Fine-Tuning for Sparse LLMs
di: Guo, Song, et al.
Pubblicazione: (2024)
di: Guo, Song, et al.
Pubblicazione: (2024)
Double-Checker: Enhancing Reasoning of Slow-Thinking LLMs via Self-Critical Fine-Tuning
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
Affordably Fine-tuned LLMs Provide Better Answers to Course-specific MCQs
di: Raimondi, Bianca, et al.
Pubblicazione: (2025)
di: Raimondi, Bianca, et al.
Pubblicazione: (2025)
Fine Tuning Methods for Low-resource Languages
di: Bakkenes, Tim, et al.
Pubblicazione: (2025)
di: Bakkenes, Tim, et al.
Pubblicazione: (2025)
Fine-Tuning LLMs with Fine-Grained Human Feedback on Text Spans
di: CH-Wang, Sky, et al.
Pubblicazione: (2025)
di: CH-Wang, Sky, et al.
Pubblicazione: (2025)
Context Misleads LLMs: The Role of Context Filtering in Maintaining Safe Alignment of LLMs
di: Kim, Jinhwa, et al.
Pubblicazione: (2025)
di: Kim, Jinhwa, et al.
Pubblicazione: (2025)
VisCoder: Fine-Tuning LLMs for Executable Python Visualization Code Generation
di: Ni, Yuansheng, et al.
Pubblicazione: (2025)
di: Ni, Yuansheng, et al.
Pubblicazione: (2025)
Towards Understanding Fine-Tuning Mechanisms of LLMs via Circuit Analysis
di: Wang, Xu, et al.
Pubblicazione: (2025)
di: Wang, Xu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Mind's Mirror: Distilling Self-Evaluation Capability and Comprehensive Thinking from Large Language Models
di: Liu, Weize, et al.
Pubblicazione: (2023) -
Unraveling Babel: Exploring Multilingual Activation Patterns of LLMs and Their Applications
di: Liu, Weize, et al.
Pubblicazione: (2024) -
ClimateChat: Designing Data and Methods for Instruction Tuning LLMs to Answer Climate Change Queries
di: Chen, Zhou, et al.
Pubblicazione: (2025) -
Answer-Centric or Reasoning-Driven? Uncovering the Latent Memory Anchor in LLMs
di: Wu, Yang, et al.
Pubblicazione: (2025) -
From Drafts to Answers: Unlocking LLM Potential via Aggregation Fine-Tuning
di: Li, Yafu, et al.
Pubblicazione: (2025)