PANDA: Preference Adaptation for Enhancing Domain-Specific Abilities of LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, An, Yang, Zonghan, Zhang, Zhenhe, Hu, Qingyuan, Li, Peng, Yan, Ming, Zhang, Ji, Huang, Fei, Liu, Yang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ReAct Meets ActRe: When Language Agents Enjoy Training Data Autonomy
par: Yang, Zonghan, et autres
Publié: (2024)
par: Yang, Zonghan, et autres
Publié: (2024)
AIGS: Generating Science from AI-Powered Automated Falsification
par: Liu, Zijun, et autres
Publié: (2024)
par: Liu, Zijun, et autres
Publié: (2024)
Towards Unified Alignment Between Agents, Humans, and Environment
par: Yang, Zonghan, et autres
Publié: (2024)
par: Yang, Zonghan, et autres
Publié: (2024)
Enabling Weak LLMs to Judge Response Reliability via Meta Ranking
par: Liu, Zijun, et autres
Publié: (2024)
par: Liu, Zijun, et autres
Publié: (2024)
On the Generalization and Adaptation Ability of Machine-Generated Text Detectors in Academic Writing
par: Liu, Yule, et autres
Publié: (2024)
par: Liu, Yule, et autres
Publié: (2024)
SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization
par: Sun, Huashan, et autres
Publié: (2025)
par: Sun, Huashan, et autres
Publié: (2025)
Enhancing Reasoning Abilities of Small LLMs with Cognitive Alignment
par: Cai, Wenrui, et autres
Publié: (2025)
par: Cai, Wenrui, et autres
Publié: (2025)
SLearnLLM: A Self-Learning Framework for Efficient Domain-Specific Adaptation of Large Language Models
par: Liu, Xiang, et autres
Publié: (2025)
par: Liu, Xiang, et autres
Publié: (2025)
Enhancing the Geometric Problem-Solving Ability of Multimodal LLMs via Symbolic-Neural Integration
par: Pan, Yicheng, et autres
Publié: (2025)
par: Pan, Yicheng, et autres
Publié: (2025)
Domain-Specific Data Generation Framework for RAG Adaptation
par: Tian, Chris Xing, et autres
Publié: (2025)
par: Tian, Chris Xing, et autres
Publié: (2025)
Knowledgeable Preference Alignment for LLMs in Domain-specific Question Answering
par: Zhang, Yichi, et autres
Publié: (2023)
par: Zhang, Yichi, et autres
Publié: (2023)
Unleashing Embodied Task Planning Ability in LLMs via Reinforcement Learning
par: Fei, Zhaoye, et autres
Publié: (2025)
par: Fei, Zhaoye, et autres
Publié: (2025)
TrimLLM: Progressive Layer Dropping for Domain-Specific LLMs
par: Hu, Lanxiang, et autres
Publié: (2024)
par: Hu, Lanxiang, et autres
Publié: (2024)
An Empirical Investigation of Domain Adaptation Ability for Chinese Spelling Check Models
par: Wang, Xi, et autres
Publié: (2024)
par: Wang, Xi, et autres
Publié: (2024)
Enhancing the Medical Context-Awareness Ability of LLMs via Multifaceted Self-Refinement Learning
par: Zhou, Yuxuan, et autres
Publié: (2025)
par: Zhou, Yuxuan, et autres
Publié: (2025)
IOPO: Empowering LLMs with Complex Instruction Following via Input-Output Preference Optimization
par: Zhang, Xinghua, et autres
Publié: (2024)
par: Zhang, Xinghua, et autres
Publié: (2024)
Penrose Tiled Low-Rank Compression and Section-Wise Q&A Fine-Tuning: A General Framework for Domain-Specific Large Language Model Adaptation
par: Kuo, Chuan-Wei, et autres
Publié: (2025)
par: Kuo, Chuan-Wei, et autres
Publié: (2025)
Pi-SQL: Enhancing Text-to-SQL with Fine-Grained Guidance from Pivot Programming Languages
par: chi, Yongdong, et autres
Publié: (2025)
par: chi, Yongdong, et autres
Publié: (2025)
Small LLMs Are Weak Tool Learners: A Multi-LLM Agent
par: Shen, Weizhou, et autres
Publié: (2024)
par: Shen, Weizhou, et autres
Publié: (2024)
StealthGraph: Exposing Domain-Specific Risks in LLMs through Knowledge-Graph-Guided Harmful Prompt Generation
par: Zheng, Huawei, et autres
Publié: (2026)
par: Zheng, Huawei, et autres
Publié: (2026)
DO-RAG: A Domain-Specific QA Framework Using Knowledge Graph-Enhanced Retrieval-Augmented Generation
par: Opoku, David Osei, et autres
Publié: (2025)
par: Opoku, David Osei, et autres
Publié: (2025)
RoleLLM: Benchmarking, Eliciting, and Enhancing Role-Playing Abilities of Large Language Models
par: Wang, Zekun Moore, et autres
Publié: (2023)
par: Wang, Zekun Moore, et autres
Publié: (2023)
Domain Adaptation of LLMs for Process Data
par: Oyamada, Rafael Seidi, et autres
Publié: (2025)
par: Oyamada, Rafael Seidi, et autres
Publié: (2025)
Evaluation Ethics of LLMs in Legal Domain
par: Zhang, Ruizhe, et autres
Publié: (2024)
par: Zhang, Ruizhe, et autres
Publié: (2024)
PharmaGPT: Domain-Specific Large Language Models for Bio-Pharmaceutical and Chemistry
par: Chen, Linqing, et autres
Publié: (2024)
par: Chen, Linqing, et autres
Publié: (2024)
What External Knowledge is Preferred by LLMs? Characterizing and Exploring Chain of Evidence in Imperfect Context for Multi-Hop QA
par: Chang, Zhiyuan, et autres
Publié: (2024)
par: Chang, Zhiyuan, et autres
Publié: (2024)
Ranking LLMs by compression
par: Guo, Peijia, et autres
Publié: (2024)
par: Guo, Peijia, et autres
Publié: (2024)
Toward Robust Multilingual Adaptation of LLMs for Low-Resource Languages
par: Li, Haolin, et autres
Publié: (2025)
par: Li, Haolin, et autres
Publié: (2025)
KBAlign: Efficient Self Adaptation on Specific Knowledge Bases
par: Zeng, Zheni, et autres
Publié: (2024)
par: Zeng, Zheni, et autres
Publié: (2024)
TactfulToM: Do LLMs Have the Theory of Mind Ability to Understand White Lies?
par: Liu, Yiwei, et autres
Publié: (2025)
par: Liu, Yiwei, et autres
Publié: (2025)
Domain Knowledge-Enhanced LLMs for Fraud and Concept Drift Detection
par: Şenol, Ali, et autres
Publié: (2025)
par: Şenol, Ali, et autres
Publié: (2025)
All-in-One Tuning and Structural Pruning for Domain-Specific LLMs
par: Lu, Lei, et autres
Publié: (2024)
par: Lu, Lei, et autres
Publié: (2024)
MATH-Perturb: Benchmarking LLMs' Math Reasoning Abilities against Hard Perturbations
par: Huang, Kaixuan, et autres
Publié: (2025)
par: Huang, Kaixuan, et autres
Publié: (2025)
Enhancing Multi-Step Reasoning Abilities of Language Models through Direct Q-Function Optimization
par: Ji, Kaixuan, et autres
Publié: (2024)
par: Ji, Kaixuan, et autres
Publié: (2024)
LLMs to Support a Domain Specific Knowledge Assistant
par: Lovin, Maria-Flavia
Publié: (2025)
par: Lovin, Maria-Flavia
Publié: (2025)
Discrete Tokenization for Multimodal LLMs: A Comprehensive Survey
par: Li, Jindong, et autres
Publié: (2025)
par: Li, Jindong, et autres
Publié: (2025)
Towards Specialized Generalists: A Multi-Task MoE-LoRA Framework for Domain-Specific LLM Adaptation
par: Yang, Yuxin, et autres
Publié: (2026)
par: Yang, Yuxin, et autres
Publié: (2026)
Chain-of-Rank: Enhancing Large Language Models for Domain-Specific RAG in Edge Device
par: Lee, Juntae, et autres
Publié: (2025)
par: Lee, Juntae, et autres
Publié: (2025)
LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL
par: Peng, Yingzhe, et autres
Publié: (2025)
par: Peng, Yingzhe, et autres
Publié: (2025)
An Empirical Study of Data Ability Boundary in LLMs' Math Reasoning
par: Chen, Zui, et autres
Publié: (2024)
par: Chen, Zui, et autres
Publié: (2024)
Documents similaires
-
ReAct Meets ActRe: When Language Agents Enjoy Training Data Autonomy
par: Yang, Zonghan, et autres
Publié: (2024) -
AIGS: Generating Science from AI-Powered Automated Falsification
par: Liu, Zijun, et autres
Publié: (2024) -
Towards Unified Alignment Between Agents, Humans, and Environment
par: Yang, Zonghan, et autres
Publié: (2024) -
Enabling Weak LLMs to Judge Response Reliability via Meta Ranking
par: Liu, Zijun, et autres
Publié: (2024) -
On the Generalization and Adaptation Ability of Machine-Generated Text Detectors in Academic Writing
par: Liu, Yule, et autres
Publié: (2024)