TaP: A Taxonomy-Guided Framework for Automated and Scalable Preference Data Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Jin, Renren, Shen, Tianhao, Wu, Xinwei, Shi, Dan, Sun, Haoran, Ren, Yuqi, Huang, Wuwei, Wang, Quandong, Liu, Wei, Luan, Jian, Wang, Bin, Xiong, Deyi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Joint Training And Decoding for Multilingual End-to-End Simultaneous Speech Translation
by: Huang, Wuwei, et al.
Published: (2025)
by: Huang, Wuwei, et al.
Published: (2025)
IRCAN: Mitigating Knowledge Conflicts in LLM Generation via Identifying and Reweighting Context-Aware Neurons
by: Shi, Dan, et al.
Published: (2024)
by: Shi, Dan, et al.
Published: (2024)
A Comprehensive Evaluation of Quantization Strategies for Large Language Models
by: Jin, Renren, et al.
Published: (2024)
by: Jin, Renren, et al.
Published: (2024)
Revisiting Entropy in Reinforcement Learning for Large Reasoning Models
by: Jin, Renren, et al.
Published: (2025)
by: Jin, Renren, et al.
Published: (2025)
LHMKE: A Large-scale Holistic Multi-subject Knowledge Evaluation Benchmark for Chinese Large Language Models
by: Liu, Chuang, et al.
Published: (2024)
by: Liu, Chuang, et al.
Published: (2024)
Do Large Language Models Mirror Cognitive Language Processing?
by: Ren, Yuqi, et al.
Published: (2024)
by: Ren, Yuqi, et al.
Published: (2024)
AdaST: Dynamically Adapting Encoder States in the Decoder for End-to-End Speech-to-Text Translation
by: Huang, Wuwei, et al.
Published: (2025)
by: Huang, Wuwei, et al.
Published: (2025)
ConTrans: Weak-to-Strong Alignment Engineering via Concept Transplantation
by: Dong, Weilong, et al.
Published: (2024)
by: Dong, Weilong, et al.
Published: (2024)
Influence of anisotropy, tilt and pairing of Weyl nodes: The Weyl semimetals TaAs, TaP, NbAs and NbP
by: Grassano, Davide, et al.
Published: (2019)
by: Grassano, Davide, et al.
Published: (2019)
Anomalously High Phonon Thermal Conductivity Driven by Weak Electron-Phonon Coupling in Weyl Semimetals TaAs and TaP
by: Ding, Xianyong, et al.
Published: (2026)
by: Ding, Xianyong, et al.
Published: (2026)
MobileIPL: Enhancing Mobile Agents Thinking Process via Iterative Preference Learning
by: Huang, Kun, et al.
Published: (2025)
by: Huang, Kun, et al.
Published: (2025)
Large Language Model Safety: A Holistic Survey
by: Shi, Dan, et al.
Published: (2024)
by: Shi, Dan, et al.
Published: (2024)
FineMath: A Fine-Grained Mathematical Evaluation Benchmark for Chinese Large Language Models
by: Liu, Yan, et al.
Published: (2024)
by: Liu, Yan, et al.
Published: (2024)
Why Does Reinforcement Learning Generalize? A Feature-Level Mechanistic Study of Post-Training in Large Language Models
by: Shi, Dan, et al.
Published: (2026)
by: Shi, Dan, et al.
Published: (2026)
Automated Progressive Red Teaming
by: Jiang, Bojian, et al.
Published: (2024)
by: Jiang, Bojian, et al.
Published: (2024)
ProBench: Benchmarking Large Language Models in Competitive Programming
by: Yang, Lei, et al.
Published: (2025)
by: Yang, Lei, et al.
Published: (2025)
TaWRKY33 Positively Regulates TaERF1‐A, Thereby Activating TaP5CS 2 − Mediated Proline Biosynthesis, Which Enhances Drought Tolerance in Wheat ( Triticum aestivum L.)
by: Yang Yu, et al.
Published: (2026)
by: Yang Yu, et al.
Published: (2026)
RoleEval: A Bilingual Role Evaluation Benchmark for Large Language Models
by: Shen, Tianhao, et al.
Published: (2023)
by: Shen, Tianhao, et al.
Published: (2023)
SOUP: Token-level Single-sample Mix-policy Reinforcement Learning for Large Language Models
by: Yang, Lei, et al.
Published: (2026)
by: Yang, Lei, et al.
Published: (2026)
DVMap: Fine-Grained Pluralistic Value Alignment via High-Consensus Demographic-Value Mapping
by: Zhu, Pengyun, et al.
Published: (2026)
by: Zhu, Pengyun, et al.
Published: (2026)
From Curated Data to Scalable Models: Continual Pre-training of Dense and MoE Large Language Models for Tibetan
by: Yang, Lei, et al.
Published: (2025)
by: Yang, Lei, et al.
Published: (2025)
SUBLLM: A Novel Efficient Architecture with Token Sequence Subsampling for LLM
by: Wang, Quandong, et al.
Published: (2024)
by: Wang, Quandong, et al.
Published: (2024)
Finding the Translation Switch: Discovering and Exploiting the Task-Initiation Features in LLMs
by: Wu, Xinwei, et al.
Published: (2026)
by: Wu, Xinwei, et al.
Published: (2026)
CRiskEval: A Chinese Multi-Level Risk Evaluation Benchmark Dataset for Large Language Models
by: Shi, Ling, et al.
Published: (2024)
by: Shi, Ling, et al.
Published: (2024)
From Insight to Action: A Novel Framework for Interpretability-Guided Data Selection in Large Language Models
by: Shi, Ling, et al.
Published: (2026)
by: Shi, Ling, et al.
Published: (2026)
Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning
by: Zhou, Hang, et al.
Published: (2024)
by: Zhou, Hang, et al.
Published: (2024)
Multilingual Large Language Models: A Systematic Survey
by: Zhu, Shaolin, et al.
Published: (2024)
by: Zhu, Shaolin, et al.
Published: (2024)
TaSR-RAG: Taxonomy-guided Structured Reasoning for Retrieval-Augmented Generation
by: Sun, Jiashuo, et al.
Published: (2026)
by: Sun, Jiashuo, et al.
Published: (2026)
Environmental Regulation and Corporate Carbon Emission Reduction: A Supply Chain Spillover Perspective
by: Yu Shen, et al.
Published: (2026)
by: Yu Shen, et al.
Published: (2026)
Exploring Multilingual Concepts of Human Value in Large Language Models: Is Value Alignment Consistent, Transferable and Controllable across Languages?
by: Xu, Shaoyang, et al.
Published: (2024)
by: Xu, Shaoyang, et al.
Published: (2024)
Self-Organizing Agent Network for LLM-based Workflow Automation
by: Xiong, Yiming, et al.
Published: (2025)
by: Xiong, Yiming, et al.
Published: (2025)
MoE-CT: A Novel Approach For Large Language Models Training With Resistance To Catastrophic Forgetting
by: Li, Tianhao, et al.
Published: (2024)
by: Li, Tianhao, et al.
Published: (2024)
How Creativity is Changing China
by: Wuwei, Li
Published: (2022)
by: Wuwei, Li
Published: (2022)
Deep Learning for Short Term Equity Trend Forecasting: A Behavior Driven Multi Factor Approach
by: Luan, Yuqi
Published: (2025)
by: Luan, Yuqi
Published: (2025)
Acoustic Overspecification in Electronic Dance Music Taxonomy
by: Xu, Weilun, et al.
Published: (2025)
by: Xu, Weilun, et al.
Published: (2025)
FuxiTranyu: A Multilingual Large Language Model Trained with Balanced Data
by: Sun, Haoran, et al.
Published: (2024)
by: Sun, Haoran, et al.
Published: (2024)
Preference-Guided Refactored Tuning for Retrieval Augmented Code Generation
by: Gao, Xinyu, et al.
Published: (2024)
by: Gao, Xinyu, et al.
Published: (2024)
Lateral Driver‐Automation Driver Authority Decision Considering Safety of the Intended Functionality
by: Huiran Wang, et al.
Published: (2024)
by: Huiran Wang, et al.
Published: (2024)
Data Insights as Data: Quick Overview and Exploration of Automated Data Insights
by: Wu, Shangxuan, et al.
Published: (2025)
by: Wu, Shangxuan, et al.
Published: (2025)
TaWRKY17 Interacts With TaWRKY44 to Promote Expression of TaDHN7 for Salt Tolerance in Wheat
by: Zhenzhen Jia, et al.
Published: (2024)
by: Zhenzhen Jia, et al.
Published: (2024)
Similar Items
-
Joint Training And Decoding for Multilingual End-to-End Simultaneous Speech Translation
by: Huang, Wuwei, et al.
Published: (2025) -
IRCAN: Mitigating Knowledge Conflicts in LLM Generation via Identifying and Reweighting Context-Aware Neurons
by: Shi, Dan, et al.
Published: (2024) -
A Comprehensive Evaluation of Quantization Strategies for Large Language Models
by: Jin, Renren, et al.
Published: (2024) -
Revisiting Entropy in Reinforcement Learning for Large Reasoning Models
by: Jin, Renren, et al.
Published: (2025) -
LHMKE: A Large-scale Holistic Multi-subject Knowledge Evaluation Benchmark for Chinese Large Language Models
by: Liu, Chuang, et al.
Published: (2024)