From Selection to Generation: A Survey of LLM-based Active Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Xia, Yu, Mukherjee, Subhojyoti, Xie, Zhouhang, Wu, Junda, Li, Xintong, Aponte, Ryan, Lyu, Hanjia, Barrow, Joe, Chen, Hongjie, Dernoncourt, Franck, Kveton, Branislav, Yu, Tong, Zhang, Ruiyi, Gu, Jiuxiang, Ahmed, Nesreen K., Wang, Yu, Chen, Xiang, Deilamsalehy, Hanieh, Kim, Sungchul, Hu, Zhengmian, Zhao, Yue, Lipka, Nedim, Yoon, Seunghyun, Huang, Ting-Hao Kenneth, Wang, Zichao, Mathur, Puneet, Pal, Soumyabrata, Mukherjee, Koyel, Zhang, Zhehao, Park, Namyong, Nguyen, Thien Huu, Luo, Jiebo, Rossi, Ryan A., McAuley, Julian |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Multi-LLM Debiasing Framework
por: Owens, Deonna M., et al.
Publicado: (2024)
por: Owens, Deonna M., et al.
Publicado: (2024)
Personalized Multimodal Large Language Models: A Survey
por: Wu, Junda, et al.
Publicado: (2024)
por: Wu, Junda, et al.
Publicado: (2024)
VipAct: Visual-Perception Enhancement via Specialized VLM Agent Collaboration and Tool-use
por: Zhang, Zhehao, et al.
Publicado: (2024)
por: Zhang, Zhehao, et al.
Publicado: (2024)
MLLM as a UI Judge: Benchmarking Multimodal LLMs for Predicting Human Perception of User Interfaces
por: Luera, Reuben A., et al.
Publicado: (2025)
por: Luera, Reuben A., et al.
Publicado: (2025)
Efficient and Interpretable Bandit Algorithms
por: Mukherjee, Subhojyoti, et al.
Publicado: (2023)
por: Mukherjee, Subhojyoti, et al.
Publicado: (2023)
Reasoning-Based Personalized Generation for Users with Sparse Data
por: Ni, Bo, et al.
Publicado: (2026)
por: Ni, Bo, et al.
Publicado: (2026)
Agentic Planning with Reasoning for Image Styling via Offline RL
por: Mukherjee, Subhojyoti, et al.
Publicado: (2026)
por: Mukherjee, Subhojyoti, et al.
Publicado: (2026)
Blind to the Human Touch: Overlap Bias in LLM-Based Summary Evaluation
por: Fang, Jiangnan, et al.
Publicado: (2026)
por: Fang, Jiangnan, et al.
Publicado: (2026)
Personalization of Large Language Models: A Survey
por: Zhang, Zhehao, et al.
Publicado: (2024)
por: Zhang, Zhehao, et al.
Publicado: (2024)
Self-Debiasing Large Language Models: Zero-Shot Recognition and Reduction of Stereotypes
por: Gallegos, Isabel O., et al.
Publicado: (2024)
por: Gallegos, Isabel O., et al.
Publicado: (2024)
A Survey of Small Language Models
por: Van Nguyen, Chien, et al.
Publicado: (2024)
por: Van Nguyen, Chien, et al.
Publicado: (2024)
Partial Policy Gradients for RL in LLMs
por: Mathur, Puneet, et al.
Publicado: (2026)
por: Mathur, Puneet, et al.
Publicado: (2026)
A Survey on LLM-based Conversational User Simulation
por: Ni, Bo, et al.
Publicado: (2026)
por: Ni, Bo, et al.
Publicado: (2026)
Personalized Graph-Based Retrieval for Large Language Models
por: Au, Steven, et al.
Publicado: (2025)
por: Au, Steven, et al.
Publicado: (2025)
Off-Policy Evaluation from Logged Human Feedback
por: Bhargava, Aniruddha, et al.
Publicado: (2024)
por: Bhargava, Aniruddha, et al.
Publicado: (2024)
Multi-Objective Alignment of Large Language Models Through Hypervolume Maximization
por: Mukherjee, Subhojyoti, et al.
Publicado: (2024)
por: Mukherjee, Subhojyoti, et al.
Publicado: (2024)
Trust but Verify: Introducing DAVinCI -- A Framework for Dual Attribution and Verification in Claim Inference for Language Models
por: Rawte, Vipula, et al.
Publicado: (2026)
por: Rawte, Vipula, et al.
Publicado: (2026)
Sparse Personalized Text Generation with Multi-Trajectory Reasoning
por: Ni, Bo, et al.
Publicado: (2026)
por: Ni, Bo, et al.
Publicado: (2026)
Optimizing Data Delivery: Insights from User Preferences on Visuals, Tables, and Text
por: Luera, Reuben, et al.
Publicado: (2024)
por: Luera, Reuben, et al.
Publicado: (2024)
StreamGaze: Gaze-Guided Temporal Reasoning and Proactive Understanding in Streaming Videos
por: Lee, Daeun, et al.
Publicado: (2025)
por: Lee, Daeun, et al.
Publicado: (2025)
Learning to Reason in LLMs by Expectation Maximization
por: Lee, Junghyun, et al.
Publicado: (2025)
por: Lee, Junghyun, et al.
Publicado: (2025)
Document Attribution: Examining Citation Relationships using Large Language Models
por: Rawte, Vipula, et al.
Publicado: (2025)
por: Rawte, Vipula, et al.
Publicado: (2025)
Survey of User Interface Design and Interaction Techniques in Generative AI Applications
por: Luera, Reuben, et al.
Publicado: (2024)
por: Luera, Reuben, et al.
Publicado: (2024)
Bias and Fairness in Large Language Models: A Survey
por: Gallegos, Isabel O., et al.
Publicado: (2023)
por: Gallegos, Isabel O., et al.
Publicado: (2023)
Multi-LLM Text Summarization
por: Fang, Jiangnan, et al.
Publicado: (2024)
por: Fang, Jiangnan, et al.
Publicado: (2024)
AdvantageFlow: Advantage-Weighted Least Squares for RL in Flow Models
por: Kveton, Branislav, et al.
Publicado: (2026)
por: Kveton, Branislav, et al.
Publicado: (2026)
Experimental Design for Active Transductive Inference in Large Language Models
por: Mukherjee, Subhojyoti, et al.
Publicado: (2024)
por: Mukherjee, Subhojyoti, et al.
Publicado: (2024)
LaMP-Cap: Personalized Figure Caption Generation With Multimodal Figure Profiles
por: Ng, Ho Yin 'Sam', et al.
Publicado: (2025)
por: Ng, Ho Yin 'Sam', et al.
Publicado: (2025)
GUI Agents: A Survey
por: Nguyen, Dang, et al.
Publicado: (2024)
por: Nguyen, Dang, et al.
Publicado: (2024)
FiRST: Finetuning Router-Selective Transformers for Input-Adaptive Latency Reduction
por: Jain, Akriti, et al.
Publicado: (2024)
por: Jain, Akriti, et al.
Publicado: (2024)
MOCHA: Multi-Objective Chebyshev Annealing for Agent Skill Optimization
por: Tanjim, Md Mehrab, et al.
Publicado: (2026)
por: Tanjim, Md Mehrab, et al.
Publicado: (2026)
A Personalized Conversational Benchmark: Towards Simulating Personalized Conversations
por: Li, Li, et al.
Publicado: (2025)
por: Li, Li, et al.
Publicado: (2025)
Optimal Design for Human Preference Elicitation
por: Mukherjee, Subhojyoti, et al.
Publicado: (2024)
por: Mukherjee, Subhojyoti, et al.
Publicado: (2024)
PromptRefine: Enhancing Few-Shot Performance on Low-Resource Indic Languages with Example Selection from Related Example Banks
por: Ghosal, Soumya Suvra, et al.
Publicado: (2024)
por: Ghosal, Soumya Suvra, et al.
Publicado: (2024)
A Framework for Fine-Tuning LLMs using Heterogeneous Feedback
por: Aponte, Ryan, et al.
Publicado: (2024)
por: Aponte, Ryan, et al.
Publicado: (2024)
Towards Enhancing Coherence in Extractive Summarization: Dataset and Experiments with LLMs
por: Parmar, Mihir, et al.
Publicado: (2024)
por: Parmar, Mihir, et al.
Publicado: (2024)
Offline RL by Reward-Weighted Fine-Tuning for Conversation Optimization
por: Mukherjee, Subhojyoti, et al.
Publicado: (2025)
por: Mukherjee, Subhojyoti, et al.
Publicado: (2025)
LongLaMP: A Benchmark for Personalized Long-form Text Generation
por: Kumar, Ishita, et al.
Publicado: (2024)
por: Kumar, Ishita, et al.
Publicado: (2024)
LLaVAR: Enhanced Visual Instruction Tuning for Text-Rich Image Understanding
por: Zhang, Yanzhe, et al.
Publicado: (2023)
por: Zhang, Yanzhe, et al.
Publicado: (2023)
Active Learning for Direct Preference Optimization
por: Kveton, Branislav, et al.
Publicado: (2025)
por: Kveton, Branislav, et al.
Publicado: (2025)
Ejemplares similares
-
A Multi-LLM Debiasing Framework
por: Owens, Deonna M., et al.
Publicado: (2024) -
Personalized Multimodal Large Language Models: A Survey
por: Wu, Junda, et al.
Publicado: (2024) -
VipAct: Visual-Perception Enhancement via Specialized VLM Agent Collaboration and Tool-use
por: Zhang, Zhehao, et al.
Publicado: (2024) -
MLLM as a UI Judge: Benchmarking Multimodal LLMs for Predicting Human Perception of User Interfaces
por: Luera, Reuben A., et al.
Publicado: (2025) -
Efficient and Interpretable Bandit Algorithms
por: Mukherjee, Subhojyoti, et al.
Publicado: (2023)