Optimsyn: Influence-Guided Rubrics Optimization for Synthetic Data Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Fan, Zhiting, Chen, Ruizhe, Hu, Tianxiang, Peng, Ru, Huang, Zenan, Xu, Haokai, Chen, Yixin, Wu, Jian, Zhao, Junbo, Liu, Zuozhu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FairMT-Bench: Benchmarking Fairness for Multi-turn Dialogue in Conversational LLMs
par: Fan, Zhiting, et autres
Publié: (2024)
par: Fan, Zhiting, et autres
Publié: (2024)
BiasGuard: A Reasoning-enhanced Bias Detection Tool For Large Language Models
par: Fan, Zhiting, et autres
Publié: (2025)
par: Fan, Zhiting, et autres
Publié: (2025)
Reinforcement Learning with Rubric Anchors
par: Huang, Zenan, et autres
Publié: (2025)
par: Huang, Zenan, et autres
Publié: (2025)
BiasAlert: A Plug-and-play Tool for Social Bias Detection in LLMs
par: Fan, Zhiting, et autres
Publié: (2024)
par: Fan, Zhiting, et autres
Publié: (2024)
Learnable Privacy Neurons Localization in Language Models
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
Modality-Fair Preference Optimization for Trustworthy MLLM Alignment
par: Jiang, Songtao, et autres
Publié: (2024)
par: Jiang, Songtao, et autres
Publié: (2024)
FairSteer: Inference Time Debiasing for LLMs with Dynamic Activation Steering
par: Li, Yichen, et autres
Publié: (2025)
par: Li, Yichen, et autres
Publié: (2025)
Configurable Preference Tuning with Rubric-Guided Synthetic Data
par: Gallego, Víctor
Publié: (2025)
par: Gallego, Víctor
Publié: (2025)
GRIT: Graph-Regularized Logit Refinement for Zero-shot Cell Type Annotation
par: Hu, Tianxiang, et autres
Publié: (2025)
par: Hu, Tianxiang, et autres
Publié: (2025)
Energy-based Automated Model Evaluation
par: Peng, Ru, et autres
Publié: (2024)
par: Peng, Ru, et autres
Publié: (2024)
Enhancing Judgment Document Generation via Agentic Legal Information Collection and Rubric-Guided Optimization
par: Su, Weihang, et autres
Publié: (2026)
par: Su, Weihang, et autres
Publié: (2026)
Robustness-Guided Image Synthesis for Data-Free Quantization
par: Bai, Jianhong, et autres
Publié: (2023)
par: Bai, Jianhong, et autres
Publié: (2023)
OpenRubrics: Towards Scalable Synthetic Rubric Generation for Reward Modeling and LLM Alignment
par: Liu, Tianci, et autres
Publié: (2025)
par: Liu, Tianci, et autres
Publié: (2025)
Persona-judge: Personalized Alignment of Large Language Models via Token-level Self-judgment
par: Zhang, Xiaotian, et autres
Publié: (2025)
par: Zhang, Xiaotian, et autres
Publié: (2025)
Large Language Model Bias Mitigation from the Perspective of Knowledge Editing
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
FAIntbench: A Holistic and Precise Benchmark for Bias Evaluation in Text-to-Image Models
par: Luo, Hanjun, et autres
Publié: (2024)
par: Luo, Hanjun, et autres
Publié: (2024)
Distributional Priors Guided Diffusion for Generating 3D Molecules in Low Data Regimes
par: Hong, Haokai, et autres
Publié: (2024)
par: Hong, Haokai, et autres
Publié: (2024)
VersusDebias: Universal Zero-Shot Debiasing for Text-to-Image Models via SLM-Based Prompt Engineering and Generative Adversary
par: Luo, Hanjun, et autres
Publié: (2024)
par: Luo, Hanjun, et autres
Publié: (2024)
Identifying and Mitigating Social Bias Knowledge in Language Models
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
Datasets and Recipes for Video Temporal Grounding via Reinforcement Learning
par: Chen, Ruizhe, et autres
Publié: (2025)
par: Chen, Ruizhe, et autres
Publié: (2025)
Rubric-Guided Process Reward for Stepwise Model Routing
par: Ye, Shenghao, et autres
Publié: (2026)
par: Ye, Shenghao, et autres
Publié: (2026)
RubricBench: Aligning Model-Generated Rubrics with Human Standards
par: Zhang, Qiyuan, et autres
Publié: (2026)
par: Zhang, Qiyuan, et autres
Publié: (2026)
Towards Distribution-Agnostic Generalized Category Discovery
par: Bai, Jianhong, et autres
Publié: (2023)
par: Bai, Jianhong, et autres
Publié: (2023)
On LLMs-Driven Synthetic Data Generation, Curation, and Evaluation: A Survey
par: Long, Lin, et autres
Publié: (2024)
par: Long, Lin, et autres
Publié: (2024)
Ladder: A Model-Agnostic Framework Boosting LLM-based Machine Translation to the Next Level
par: Feng, Zhaopeng, et autres
Publié: (2024)
par: Feng, Zhaopeng, et autres
Publié: (2024)
PAD: Personalized Alignment of LLMs at Decoding-Time
par: Chen, Ruizhe, et autres
Publié: (2024)
par: Chen, Ruizhe, et autres
Publié: (2024)
Visual Preference Optimization with Rubric Rewards
par: Yu, Ya-Qi, et autres
Publié: (2026)
par: Yu, Ya-Qi, et autres
Publié: (2026)
Med-R2: An Adversarial Benchmark for Evidence-Grounded Reasoning in Medical VLMs
par: Ma, Wen, et autres
Publié: (2026)
par: Ma, Wen, et autres
Publié: (2026)
AMARIS: A Memory-Augmented Rubric Improvement System for Rubric-Based Reinforcement Learning
par: Wu, Peilin, et autres
Publié: (2026)
par: Wu, Peilin, et autres
Publié: (2026)
SynQP: A Framework and Metrics for Evaluating the Quality and Privacy Risk of Synthetic Data
par: Hu, Bing, et autres
Publié: (2026)
par: Hu, Bing, et autres
Publié: (2026)
WaferSAGE: Large Language Model-Powered Wafer Defect Analysis via Synthetic Data Generation and Rubric-Guided Reinforcement Learning
par: Xu, Ke, et autres
Publié: (2026)
par: Xu, Ke, et autres
Publié: (2026)
Synthetic Artifact Auditing: Tracing LLM-Generated Synthetic Data Usage in Downstream Applications
par: Wu, Yixin, et autres
Publié: (2025)
par: Wu, Yixin, et autres
Publié: (2025)
Enhancing Generalization and Scalability for Multi-Objective Optimization with Population Pre-Training
par: Hong, Haokai, et autres
Publié: (2023)
par: Hong, Haokai, et autres
Publié: (2023)
EvoRubric: Self-Evolving Rubric-Driven RL for Open-Ended Generation
par: Guan, Xin, et autres
Publié: (2026)
par: Guan, Xin, et autres
Publié: (2026)
AutoRubric: Rubric-Based Generative Rewards for Faithful Multimodal Reasoning
par: Jia, Mengzhao, et autres
Publié: (2025)
par: Jia, Mengzhao, et autres
Publié: (2025)
Harnessing Flexible Spatial and Temporal Data Center Workloads for Grid Regulation Services
par: Fan, Yingrui, et autres
Publié: (2026)
par: Fan, Yingrui, et autres
Publié: (2026)
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
par: Wei, Jianhui, et autres
Publié: (2025)
par: Wei, Jianhui, et autres
Publié: (2025)
DataMan: Data Manager for Pre-training Large Language Models
par: Peng, Ru, et autres
Publié: (2025)
par: Peng, Ru, et autres
Publié: (2025)
Merge-of-Thought Distillation
par: Shen, Zhanming, et autres
Publié: (2025)
par: Shen, Zhanming, et autres
Publié: (2025)
Towards Proactive Personalization through Profile Customization for Individual Users in Dialogues
par: Zhang, Xiaotian, et autres
Publié: (2025)
par: Zhang, Xiaotian, et autres
Publié: (2025)
Documents similaires
-
FairMT-Bench: Benchmarking Fairness for Multi-turn Dialogue in Conversational LLMs
par: Fan, Zhiting, et autres
Publié: (2024) -
BiasGuard: A Reasoning-enhanced Bias Detection Tool For Large Language Models
par: Fan, Zhiting, et autres
Publié: (2025) -
Reinforcement Learning with Rubric Anchors
par: Huang, Zenan, et autres
Publié: (2025) -
BiasAlert: A Plug-and-play Tool for Social Bias Detection in LLMs
par: Fan, Zhiting, et autres
Publié: (2024) -
Learnable Privacy Neurons Localization in Language Models
par: Chen, Ruizhe, et autres
Publié: (2024)