A Framework for Fine-Tuning LLMs using Heterogeneous Feedback
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Aponte, Ryan, Rossi, Ryan A., Guo, Shunan, Dernoncourt, Franck, Yu, Tong, Chen, Xiang, Mitra, Subrata, Lipka, Nedim |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Fine-Tuning LLMs with Fine-Grained Human Feedback on Text Spans
par: CH-Wang, Sky, et autres
Publié: (2025)
par: CH-Wang, Sky, et autres
Publié: (2025)
"The Data Says Otherwise"-Towards Automated Fact-checking and Communication of Data Claims
par: Fu, Yu, et autres
Publié: (2024)
par: Fu, Yu, et autres
Publié: (2024)
Intent Classification for Bank Chatbots through LLM Fine-Tuning
par: Lajčinová, Bibiána, et autres
Publié: (2024)
par: Lajčinová, Bibiána, et autres
Publié: (2024)
Enhancing the Reasoning Capabilities of Small Language Models via Solution Guidance Fine-Tuning
par: Bi, Jing, et autres
Publié: (2024)
par: Bi, Jing, et autres
Publié: (2024)
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
par: Saji, Alan, et autres
Publié: (2025)
par: Saji, Alan, et autres
Publié: (2025)
Homogeneous Keys, Heterogeneous Values: Exploiting Local KV Cache Asymmetry for Long-Context LLMs
par: Cui, Wanyun, et autres
Publié: (2025)
par: Cui, Wanyun, et autres
Publié: (2025)
Structure-Guided Entity Resolution: Fine-Tuning LLMs for Robust Name Matching in Complex Linguistic Contexts
par: Chourasia, Shivam, et autres
Publié: (2026)
par: Chourasia, Shivam, et autres
Publié: (2026)
Efficient Toxicity Detection in Gaming Chats: A Comparative Study of Embeddings, Fine-Tuned Transformers and LLMs
par: Tereshchenko, Yehor, et autres
Publié: (2025)
par: Tereshchenko, Yehor, et autres
Publié: (2025)
Kastor: Fine-tuned Small Language Models for Shape-based Active Relation Extraction
par: Celian, Ringwald, et autres
Publié: (2025)
par: Celian, Ringwald, et autres
Publié: (2025)
Fine-Tuned 'Small' LLMs (Still) Significantly Outperform Zero-Shot Generative AI Models in Text Classification
par: Bucher, Martin Juan José, et autres
Publié: (2024)
par: Bucher, Martin Juan José, et autres
Publié: (2024)
GMoE: Empowering LLMs Fine-Tuning via MoE Graph Collaboration
par: Bai, Ting, et autres
Publié: (2024)
par: Bai, Ting, et autres
Publié: (2024)
AMELI: Enhancing Multimodal Entity Linking with Fine-Grained Attributes
par: Yao, Barry Menglong, et autres
Publié: (2023)
par: Yao, Barry Menglong, et autres
Publié: (2023)
Privately Fine-Tuned LLMs Preserve Temporal Dynamics in Tabular Data
par: Rosenblatt, Lucas, et autres
Publié: (2026)
par: Rosenblatt, Lucas, et autres
Publié: (2026)
EmoS: A High-Fidelity Multimodal Benchmark for Fine-grained Streaming Emotional Understanding
par: Guo, Pengze, et autres
Publié: (2026)
par: Guo, Pengze, et autres
Publié: (2026)
UM_FHS at the CLEF 2025 SimpleText Track: Comparing No-Context and Fine-Tune Approaches for GPT-4.1 Models in Sentence and Document-Level Text Simplification
par: Kocbek, Primoz, et autres
Publié: (2025)
par: Kocbek, Primoz, et autres
Publié: (2025)
CRISP: Persistent Concept Unlearning via Sparse Autoencoders
par: Ashuach, Tomer, et autres
Publié: (2025)
par: Ashuach, Tomer, et autres
Publié: (2025)
Budget-Xfer: Budget-Constrained Source Language Selection for Cross-Lingual Transfer to African Languages
par: Idris, Tewodros Kederalah, et autres
Publié: (2026)
par: Idris, Tewodros Kederalah, et autres
Publié: (2026)
NERCat: Fine-Tuning for Enhanced Named Entity Recognition in Catalan
par: Ferreres, Guillem Cadevall, et autres
Publié: (2025)
par: Ferreres, Guillem Cadevall, et autres
Publié: (2025)
Augmented Relevance Datasets with Fine-Tuned Small LLMs
par: Fitte-Rey, Quentin, et autres
Publié: (2025)
par: Fitte-Rey, Quentin, et autres
Publié: (2025)
Scaling Laws for Forgetting When Fine-Tuning Large Language Models
par: Kalajdzievski, Damjan
Publié: (2024)
par: Kalajdzievski, Damjan
Publié: (2024)
On the Effectiveness of LLM-Specific Fine-Tuning for Detecting AI-Generated Text
par: Gromadzki, Michał, et autres
Publié: (2026)
par: Gromadzki, Michał, et autres
Publié: (2026)
Arabic Hate Speech Identification and Masking in Social Media using Deep Learning Models and Pre-trained Models Fine-tuning
par: Doghmash, Salam Thabet, et autres
Publié: (2025)
par: Doghmash, Salam Thabet, et autres
Publié: (2025)
Automatic Task Detection and Heterogeneous LLM Speculative Decoding
par: Ge, Danying, et autres
Publié: (2025)
par: Ge, Danying, et autres
Publié: (2025)
MELoRA: Mini-Ensemble Low-Rank Adapters for Parameter-Efficient Fine-Tuning
par: Ren, Pengjie, et autres
Publié: (2024)
par: Ren, Pengjie, et autres
Publié: (2024)
ConPET: Continual Parameter-Efficient Tuning for Large Language Models
par: Song, Chenyang, et autres
Publié: (2023)
par: Song, Chenyang, et autres
Publié: (2023)
Discovering Transformer Circuits via a Hybrid Attribution and Pruning Framework
par: Gu, Hao, et autres
Publié: (2025)
par: Gu, Hao, et autres
Publié: (2025)
EduGuardBench: A Holistic Benchmark for Evaluating the Pedagogical Fidelity and Adversarial Safety of LLMs as Simulated Teachers
par: Jiang, Yilin, et autres
Publié: (2025)
par: Jiang, Yilin, et autres
Publié: (2025)
Fine-Tuned Large Language Models for Logical Translation: Reducing Hallucinations with Lang2Logic
par: Pan, Muyu, et autres
Publié: (2025)
par: Pan, Muyu, et autres
Publié: (2025)
Constructing Benchmarks and Interventions for Combating Hallucinations in LLMs
par: Simhi, Adi, et autres
Publié: (2024)
par: Simhi, Adi, et autres
Publié: (2024)
SLAP: Stratified Loss-based Pruning for On-Policy Data-Efficient Instruction Tuning
par: Zou, Run, et autres
Publié: (2026)
par: Zou, Run, et autres
Publié: (2026)
LLMs Are Not Scorers: Rethinking MT Evaluation with Generation-Based Methods
par: Cui, Hyang
Publié: (2025)
par: Cui, Hyang
Publié: (2025)
RAG-Optimized Tibetan Tourism LLMs: Enhancing Accuracy and Personalization
par: Qi, Jinhu, et autres
Publié: (2024)
par: Qi, Jinhu, et autres
Publié: (2024)
Neither Valid nor Reliable? Investigating the Use of LLMs as Judges
par: Chehbouni, Khaoula, et autres
Publié: (2025)
par: Chehbouni, Khaoula, et autres
Publié: (2025)
MAWARITH: A Dataset and Benchmark for Legal Inheritance Reasoning with LLMs
par: Bouchekif, Abdessalam, et autres
Publié: (2026)
par: Bouchekif, Abdessalam, et autres
Publié: (2026)
MIRIAD: Augmenting LLMs with millions of medical query-response pairs
par: Zheng, Qinyue, et autres
Publié: (2025)
par: Zheng, Qinyue, et autres
Publié: (2025)
Beyond Demographics: Fine-tuning Large Language Models to Predict Individuals' Subjective Text Perceptions
par: Orlikowski, Matthias, et autres
Publié: (2025)
par: Orlikowski, Matthias, et autres
Publié: (2025)
ManagerBench: Evaluating the Safety-Pragmatism Trade-off in Autonomous LLMs
par: Simhi, Adi, et autres
Publié: (2025)
par: Simhi, Adi, et autres
Publié: (2025)
Enhancing Automated Essay Scoring with Three Techniques: Two-Stage Fine-Tuning, Score Alignment, and Self-Training
par: Choi, Hongseok, et autres
Publié: (2026)
par: Choi, Hongseok, et autres
Publié: (2026)
Learning From Failure: Integrating Negative Examples when Fine-tuning Large Language Models as Agents
par: Wang, Renxi, et autres
Publié: (2024)
par: Wang, Renxi, et autres
Publié: (2024)
Annotation Entropy Predicts Per-Example Learning Dynamics in LoRA Fine-Tuning
par: Steele, Brady
Publié: (2026)
par: Steele, Brady
Publié: (2026)
Documents similaires
-
Fine-Tuning LLMs with Fine-Grained Human Feedback on Text Spans
par: CH-Wang, Sky, et autres
Publié: (2025) -
"The Data Says Otherwise"-Towards Automated Fact-checking and Communication of Data Claims
par: Fu, Yu, et autres
Publié: (2024) -
Intent Classification for Bank Chatbots through LLM Fine-Tuning
par: Lajčinová, Bibiána, et autres
Publié: (2024) -
Enhancing the Reasoning Capabilities of Small Language Models via Solution Guidance Fine-Tuning
par: Bi, Jing, et autres
Publié: (2024) -
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
par: Saji, Alan, et autres
Publié: (2025)