Add-One-In: Incremental Sample Selection for Large Language Models via a Choice-Based Greedy Paradigm
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Zhuo, Du, Yuhao, Jiao, Xiaoqi, Guo, Yiwen, Feng, Yuege, Wan, Xiang, Gao, Anningzhe, Hu, Jinpeng |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
APLOT: Robust Reward Modeling via Adaptive Preference Learning with Optimal Transport
by: Li, Zhuo, et al.
Published: (2025)
by: Li, Zhuo, et al.
Published: (2025)
Self-Instructed Derived Prompt Generation Meets In-Context Learning: Unlocking New Potential of Black-Box LLMs
by: Li, Zhuo, et al.
Published: (2024)
by: Li, Zhuo, et al.
Published: (2024)
Atoxia: Red-teaming Large Language Models with Target Toxic Answers
by: Du, Yuhao, et al.
Published: (2024)
by: Du, Yuhao, et al.
Published: (2024)
RLHF in an SFT Way: From Optimal Solution to Reward-Weighted Alignment
by: Du, Yuhao, et al.
Published: (2025)
by: Du, Yuhao, et al.
Published: (2025)
AudioRole: An Audio Dataset for Character Role-Playing in Large Language Models
by: Li, Wenyu, et al.
Published: (2025)
by: Li, Wenyu, et al.
Published: (2025)
Mamba Hawkes Process
by: Gao, Anningzhe, et al.
Published: (2024)
by: Gao, Anningzhe, et al.
Published: (2024)
RoTHP: Rotary Position Embedding-based Transformer Hawkes Process
by: Gao, Anningzhe, et al.
Published: (2024)
by: Gao, Anningzhe, et al.
Published: (2024)
Greedy Selection under Independent Increments: A Toy Model Analysis
by: Yang, Huitao
Published: (2025)
by: Yang, Huitao
Published: (2025)
The (Surprising) Sample Optimality of Greedy Procedures for Large-Scale Ranking and Selection
by: Li, Zaile, et al.
Published: (2023)
by: Li, Zaile, et al.
Published: (2023)
LLMs for Mathematical Modeling: Towards Bridging the Gap between Natural and Mathematical Languages
by: Huang, Xuhan, et al.
Published: (2024)
by: Huang, Xuhan, et al.
Published: (2024)
LLMs Could Autonomously Learn Without External Supervision
by: Ji, Ke, et al.
Published: (2024)
by: Ji, Ke, et al.
Published: (2024)
SPICE: Submodular Penalized Information-Conflict Selection for Efficient Large Language Model Training
by: Chang, Powei, et al.
Published: (2026)
by: Chang, Powei, et al.
Published: (2026)
Greedy Information Projection for LLM Data Selection
by: Dong, Victor Ye, et al.
Published: (2026)
by: Dong, Victor Ye, et al.
Published: (2026)
AOLO: Analysis and Optimization For Low-Carbon Oriented Wireless Large Language Model Services
by: Wang, Xiaoqi, et al.
Published: (2025)
by: Wang, Xiaoqi, et al.
Published: (2025)
Single-Sample Prophet Inequalities via Greedy-Ordered Selection
by: Caramanis, Constantine, et al.
Published: (2021)
by: Caramanis, Constantine, et al.
Published: (2021)
OVM, Outcome-supervised Value Models for Planning in Mathematical Reasoning
by: Yu, Fei, et al.
Published: (2023)
by: Yu, Fei, et al.
Published: (2023)
Image Quality Assessment for Machines: Paradigm, Large-scale Database, and Models
by: Wang, Xiaoqi, et al.
Published: (2025)
by: Wang, Xiaoqi, et al.
Published: (2025)
CoD, Towards an Interpretable Medical Agent using Chain of Diagnosis
by: Chen, Junying, et al.
Published: (2024)
by: Chen, Junying, et al.
Published: (2024)
TokenBinder: Text-Video Retrieval with One-to-Many Alignment Paradigm
by: Zhang, Bingqing, et al.
Published: (2024)
by: Zhang, Bingqing, et al.
Published: (2024)
Recent Advances in Speech Language Models: A Survey
by: Cui, Wenqian, et al.
Published: (2024)
by: Cui, Wenqian, et al.
Published: (2024)
Greedy Poisson Rejection Sampling
by: Flamich, Gergely
Published: (2023)
by: Flamich, Gergely
Published: (2023)
Adaptive Greedy Rejection Sampling
by: Flamich, Gergely, et al.
Published: (2023)
by: Flamich, Gergely, et al.
Published: (2023)
HuatuoGPT-II, One-stage Training for Medical Adaption of LLMs
by: Chen, Junying, et al.
Published: (2023)
by: Chen, Junying, et al.
Published: (2023)
Aligning Language Models Using Follow-up Likelihood as Reward Signal
by: Zhang, Chen, et al.
Published: (2024)
by: Zhang, Chen, et al.
Published: (2024)
Eliminating Inductive Bias in Reward Models with Information-Theoretic Guidance
by: Li, Zhuo, et al.
Published: (2025)
by: Li, Zhuo, et al.
Published: (2025)
Greedy Selection for Heterogeneous Sensors
by: Majumder, Kaushani, et al.
Published: (2023)
by: Majumder, Kaushani, et al.
Published: (2023)
OneDrive: Unified Multi-Paradigm Driving with Vision-Language-Action Models
by: Zhang, Yiwei, et al.
Published: (2026)
by: Zhang, Yiwei, et al.
Published: (2026)
Inspire or Predict? Exploring New Paradigms in Assisting Classical Planners with Large Language Models
by: Yu, Wenkai, et al.
Published: (2025)
by: Yu, Wenkai, et al.
Published: (2025)
Evaluating Retrieval-Augmented Generation Strategies for Large Language Models in Travel Mode Choice Prediction
by: Xu, Yiming, et al.
Published: (2025)
by: Xu, Yiming, et al.
Published: (2025)
Open Problems in Differentiable Social Choice: Learning Mechanisms, Decisions, and Alignment
by: An, Zhiyu, et al.
Published: (2026)
by: An, Zhiyu, et al.
Published: (2026)
Triple X: A LLM-Based Multilingual Speech Recognition System for the INTERSPEECH2025 MLC-SLM Challenge
by: Gao, Miaomiao, et al.
Published: (2025)
by: Gao, Miaomiao, et al.
Published: (2025)
Greedy Sampling Is Provably Efficient for RLHF
by: Wu, Di, et al.
Published: (2025)
by: Wu, Di, et al.
Published: (2025)
Superior Genetic Algorithms for the Target Set Selection Problem Based on Power-Law Parameter Choices and Simple Greedy Heuristics
by: Doerr, Benjamin, et al.
Published: (2024)
by: Doerr, Benjamin, et al.
Published: (2024)
inGRASS: Incremental Graph Spectral Sparsification via Low-Resistance-Diameter Decomposition
by: Aghdaei, Ali, et al.
Published: (2024)
by: Aghdaei, Ali, et al.
Published: (2024)
Tuning Sequential Monte Carlo Samplers via Greedy Incremental Divergence Minimization
by: Kim, Kyurae, et al.
Published: (2025)
by: Kim, Kyurae, et al.
Published: (2025)
SELF: Surrogate-light Feature Selection with Large Language Models in Deep Recommender Systems
by: Jia, Pengyue, et al.
Published: (2024)
by: Jia, Pengyue, et al.
Published: (2024)
Greedy Alignment Principle for Optimizer Selection
by: Lee, Jaerin, et al.
Published: (2025)
by: Lee, Jaerin, et al.
Published: (2025)
Transmission With Machine Language Tokens: A Paradigm for Task-Oriented Agent Communication
by: Xiao, Zhuoran, et al.
Published: (2025)
by: Xiao, Zhuoran, et al.
Published: (2025)
YOLOOC: YOLO-based Open-Class Incremental Object Detection with Novel Class Discovery
by: Wan, Qian, et al.
Published: (2024)
by: Wan, Qian, et al.
Published: (2024)
Lift&Add
by: Shukla, Navya, et al.
Published: (2026)
by: Shukla, Navya, et al.
Published: (2026)
Similar Items
-
APLOT: Robust Reward Modeling via Adaptive Preference Learning with Optimal Transport
by: Li, Zhuo, et al.
Published: (2025) -
Self-Instructed Derived Prompt Generation Meets In-Context Learning: Unlocking New Potential of Black-Box LLMs
by: Li, Zhuo, et al.
Published: (2024) -
Atoxia: Red-teaming Large Language Models with Target Toxic Answers
by: Du, Yuhao, et al.
Published: (2024) -
RLHF in an SFT Way: From Optimal Solution to Reward-Weighted Alignment
by: Du, Yuhao, et al.
Published: (2025) -
AudioRole: An Audio Dataset for Character Role-Playing in Large Language Models
by: Li, Wenyu, et al.
Published: (2025)