Experimental Design for Active Transductive Inference in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Mukherjee, Subhojyoti, Lalitha, Anusha, Deshmukh, Aniket, Liu, Ge, Ma, Yifei, Kveton, Branislav |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multi-Objective Alignment of Large Language Models Through Hypervolume Maximization
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2024)
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2024)
Optimal Design for Human Preference Elicitation
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2024)
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2024)
Efficient and Interpretable Bandit Algorithms
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2023)
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2023)
Learning to Reason in LLMs by Expectation Maximization
di: Lee, Junghyun, et al.
Pubblicazione: (2025)
di: Lee, Junghyun, et al.
Pubblicazione: (2025)
Off-Policy Evaluation from Logged Human Feedback
di: Bhargava, Aniruddha, et al.
Pubblicazione: (2024)
di: Bhargava, Aniruddha, et al.
Pubblicazione: (2024)
Offline RL by Reward-Weighted Fine-Tuning for Conversation Optimization
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2025)
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2025)
Partial Policy Gradients for RL in LLMs
di: Mathur, Puneet, et al.
Pubblicazione: (2026)
di: Mathur, Puneet, et al.
Pubblicazione: (2026)
AdvantageFlow: Advantage-Weighted Least Squares for RL in Flow Models
di: Kveton, Branislav, et al.
Pubblicazione: (2026)
di: Kveton, Branislav, et al.
Pubblicazione: (2026)
FisherSFT: Data-Efficient Supervised Fine-Tuning of Language Models Using Information Gain
di: Deb, Rohan, et al.
Pubblicazione: (2025)
di: Deb, Rohan, et al.
Pubblicazione: (2025)
Agentic Planning with Reasoning for Image Styling via Offline RL
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2026)
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2026)
Online Posterior Sampling with a Diffusion Prior
di: Kveton, Branislav, et al.
Pubblicazione: (2024)
di: Kveton, Branislav, et al.
Pubblicazione: (2024)
Logits are All We Need to Adapt Closed Models
di: Hiranandani, Gaurush, et al.
Pubblicazione: (2025)
di: Hiranandani, Gaurush, et al.
Pubblicazione: (2025)
OCEAN: Offline Chain-of-thought Evaluation and Alignment in Large Language Models
di: Wu, Junda, et al.
Pubblicazione: (2024)
di: Wu, Junda, et al.
Pubblicazione: (2024)
LLM-as-Judge on a Budget
di: Saha, Aadirupa, et al.
Pubblicazione: (2026)
di: Saha, Aadirupa, et al.
Pubblicazione: (2026)
Stepwise Credit Assignment for GRPO on Flow-Matching Models
di: Savani, Yash, et al.
Pubblicazione: (2026)
di: Savani, Yash, et al.
Pubblicazione: (2026)
From Selection to Generation: A Survey of LLM-based Active Learning
di: Xia, Yu, et al.
Pubblicazione: (2025)
di: Xia, Yu, et al.
Pubblicazione: (2025)
Active Model Selection for Large Language Models
di: Durmazkeser, Yavuz, et al.
Pubblicazione: (2025)
di: Durmazkeser, Yavuz, et al.
Pubblicazione: (2025)
Comparing Specialised Small and General Large Language Models on Text Classification: 100 Labelled Samples to Achieve Break-Even Performance
di: Pecher, Branislav, et al.
Pubblicazione: (2024)
di: Pecher, Branislav, et al.
Pubblicazione: (2024)
Revisiting Prompt Sensitivity in Large Language Models for Text Classification: The Role of Prompt Underspecification
di: Pecher, Branislav, et al.
Pubblicazione: (2026)
di: Pecher, Branislav, et al.
Pubblicazione: (2026)
Seed Diffusion: A Large-Scale Diffusion Language Model with High-Speed Inference
di: Song, Yuxuan, et al.
Pubblicazione: (2025)
di: Song, Yuxuan, et al.
Pubblicazione: (2025)
Aligning Large Language Models to Low-Resource Languages through LLM-Based Selective Translation: A Systematic Study
di: Paul, Rakesh, et al.
Pubblicazione: (2025)
di: Paul, Rakesh, et al.
Pubblicazione: (2025)
FlashDecoding++: Faster Large Language Model Inference on GPUs
di: Hong, Ke, et al.
Pubblicazione: (2023)
di: Hong, Ke, et al.
Pubblicazione: (2023)
Quantifying the Impact of Structured Output Format on Large Language Models through Causal Inference
di: Yuan, Han, et al.
Pubblicazione: (2025)
di: Yuan, Han, et al.
Pubblicazione: (2025)
Deep Bayesian Active Learning for Preference Modeling in Large Language Models
di: Melo, Luckeciano C., et al.
Pubblicazione: (2024)
di: Melo, Luckeciano C., et al.
Pubblicazione: (2024)
Distilling Large Language Models for Text-Attributed Graph Learning
di: Pan, Bo, et al.
Pubblicazione: (2024)
di: Pan, Bo, et al.
Pubblicazione: (2024)
Inference-Cost-Aware Dynamic Tree Construction for Efficient Inference in Large Language Models
di: Hong, Yinrong, et al.
Pubblicazione: (2025)
di: Hong, Yinrong, et al.
Pubblicazione: (2025)
Learning from a single labeled face and a stream of unlabeled data
di: Kveton, Branislav, et al.
Pubblicazione: (2026)
di: Kveton, Branislav, et al.
Pubblicazione: (2026)
Energy Considerations of Large Language Model Inference and Efficiency Optimizations
di: Fernandez, Jared, et al.
Pubblicazione: (2025)
di: Fernandez, Jared, et al.
Pubblicazione: (2025)
Active Preference Inference using Language Models and Probabilistic Reasoning
di: Piriyakulkij, Wasu Top, et al.
Pubblicazione: (2023)
di: Piriyakulkij, Wasu Top, et al.
Pubblicazione: (2023)
An Experimental Design Framework for Label-Efficient Supervised Finetuning of Large Language Models
di: Bhatt, Gantavya, et al.
Pubblicazione: (2024)
di: Bhatt, Gantavya, et al.
Pubblicazione: (2024)
Massive Editing for Large Language Models via Meta Learning
di: Tan, Chenmien, et al.
Pubblicazione: (2023)
di: Tan, Chenmien, et al.
Pubblicazione: (2023)
SPEED: Experimental Design for Policy Evaluation in Linear Heteroscedastic Bandits
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2023)
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2023)
Retrieval Backward Attention without Additional Training: Enhance Embeddings of Large Language Models via Repetition
di: Duan, Yifei, et al.
Pubblicazione: (2025)
di: Duan, Yifei, et al.
Pubblicazione: (2025)
Accelerating Large Language Model Inference with Self-Supervised Early Exits
di: Valade, Florian
Pubblicazione: (2024)
di: Valade, Florian
Pubblicazione: (2024)
On Almost Surely Safe Alignment of Large Language Models at Inference-Time
di: Ji, Xiaotong, et al.
Pubblicazione: (2025)
di: Ji, Xiaotong, et al.
Pubblicazione: (2025)
Active Preference Learning for Large Language Models
di: Muldrew, William, et al.
Pubblicazione: (2024)
di: Muldrew, William, et al.
Pubblicazione: (2024)
DebateBench: A Challenging Long Context Reasoning Benchmark For Large Language Models
di: Tiwari, Utkarsh, et al.
Pubblicazione: (2025)
di: Tiwari, Utkarsh, et al.
Pubblicazione: (2025)
Turning Trash into Treasure: Accelerating Inference of Large Language Models with Token Recycling
di: Luo, Xianzhen, et al.
Pubblicazione: (2024)
di: Luo, Xianzhen, et al.
Pubblicazione: (2024)
From Decoding to Meta-Generation: Inference-time Algorithms for Large Language Models
di: Welleck, Sean, et al.
Pubblicazione: (2024)
di: Welleck, Sean, et al.
Pubblicazione: (2024)
Towards Principled Design of Mixture-of-Experts Language Models under Memory and Inference Constraints
di: Liew, Seng Pei, et al.
Pubblicazione: (2026)
di: Liew, Seng Pei, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Multi-Objective Alignment of Large Language Models Through Hypervolume Maximization
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2024) -
Optimal Design for Human Preference Elicitation
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2024) -
Efficient and Interpretable Bandit Algorithms
di: Mukherjee, Subhojyoti, et al.
Pubblicazione: (2023) -
Learning to Reason in LLMs by Expectation Maximization
di: Lee, Junghyun, et al.
Pubblicazione: (2025) -
Off-Policy Evaluation from Logged Human Feedback
di: Bhargava, Aniruddha, et al.
Pubblicazione: (2024)