Active Preference Inference using Language Models and Probabilistic Reasoning
Fuente:
arXiv
Saved in:
| Main Authors: | Piriyakulkij, Wasu Top, Kuleshov, Volodymyr, Ellis, Kevin |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Doing Experiments and Revising Rules with Natural Language and Probabilistic Reasoning
by: Piriyakulkij, Wasu Top, et al.
Published: (2024)
by: Piriyakulkij, Wasu Top, et al.
Published: (2024)
Hypothesis Generation and Inductive Inference in Children and Language Models
by: Qin, Jeffrey, et al.
Published: (2026)
by: Qin, Jeffrey, et al.
Published: (2026)
Denoising Diffusion Variational Inference: Diffusion Models as Expressive Variational Posteriors
by: Piriyakulkij, Wasu Top, et al.
Published: (2024)
by: Piriyakulkij, Wasu Top, et al.
Published: (2024)
Joint Learning of Hierarchical Neural Options and Abstract World Model
by: Piriyakulkij, Wasu Top, et al.
Published: (2026)
by: Piriyakulkij, Wasu Top, et al.
Published: (2026)
PoE-World: Compositional World Modeling with Products of Programmatic Experts
by: Piriyakulkij, Wasu Top, et al.
Published: (2025)
by: Piriyakulkij, Wasu Top, et al.
Published: (2025)
Bongards at the Boundary of Perception and Reasoning: Programs or Language?
by: Langenfeld, Cassidy, et al.
Published: (2026)
by: Langenfeld, Cassidy, et al.
Published: (2026)
Simple and Effective Masked Diffusion Language Models
by: Sahoo, Subham Sekhar, et al.
Published: (2024)
by: Sahoo, Subham Sekhar, et al.
Published: (2024)
Active Preference Learning for Large Language Models
by: Muldrew, William, et al.
Published: (2024)
by: Muldrew, William, et al.
Published: (2024)
Is Active Persona Inference Necessary for Aligning Small Models to Personal Preferences?
by: Tang, Zilu, et al.
Published: (2025)
by: Tang, Zilu, et al.
Published: (2025)
QuIP#: Even Better LLM Quantization with Hadamard Incoherence and Lattice Codebooks
by: Tseng, Albert, et al.
Published: (2024)
by: Tseng, Albert, et al.
Published: (2024)
Probabilistic Inference in Language Models via Twisted Sequential Monte Carlo
by: Zhao, Stephen, et al.
Published: (2024)
by: Zhao, Stephen, et al.
Published: (2024)
Reducing the Probability of Undesirable Outputs in Language Models Using Probabilistic Inference
by: Zhao, Stephen, et al.
Published: (2025)
by: Zhao, Stephen, et al.
Published: (2025)
Would I Lie To You? Inference Time Alignment of Language Models using Direct Preference Heads
by: Hadji-Kyriacou, Avelina Asada, et al.
Published: (2024)
by: Hadji-Kyriacou, Avelina Asada, et al.
Published: (2024)
AdapThink: Adaptive Thinking Preferences for Reasoning Language Model
by: Wan, Xu, et al.
Published: (2025)
by: Wan, Xu, et al.
Published: (2025)
The Diffusion Duality
by: Sahoo, Subham Sekhar, et al.
Published: (2025)
by: Sahoo, Subham Sekhar, et al.
Published: (2025)
MAPLE: A Framework for Active Preference Learning Guided by Large Language Models
by: Mahmud, Saaduddin, et al.
Published: (2024)
by: Mahmud, Saaduddin, et al.
Published: (2024)
ActiveUltraFeedback: Efficient Preference Data Generation using Active Learning
by: Melikidze, Davit, et al.
Published: (2026)
by: Melikidze, Davit, et al.
Published: (2026)
Mercury: Ultra-Fast Language Models Based on Diffusion
by: Labs, Inception, et al.
Published: (2025)
by: Labs, Inception, et al.
Published: (2025)
Self-Evolved Preference Optimization for Enhancing Mathematical Reasoning in Small Language Models
by: Singh, Joykirat, et al.
Published: (2025)
by: Singh, Joykirat, et al.
Published: (2025)
Encoder-Decoder Diffusion Language Models for Efficient Training and Inference
by: Arriola, Marianne, et al.
Published: (2025)
by: Arriola, Marianne, et al.
Published: (2025)
Reasoning Circuits in Language Models: A Mechanistic Interpretation of Syllogistic Inference
by: Kim, Geonhee, et al.
Published: (2024)
by: Kim, Geonhee, et al.
Published: (2024)
AMPO: Active Multi-Preference Optimization for Self-play Preference Selection
by: Gupta, Taneesh, et al.
Published: (2025)
by: Gupta, Taneesh, et al.
Published: (2025)
Active Preference Optimization for Sample Efficient RLHF
by: Das, Nirjhar, et al.
Published: (2024)
by: Das, Nirjhar, et al.
Published: (2024)
OptScale: Probabilistic Optimality for Inference-time Scaling
by: Wang, Youkang, et al.
Published: (2025)
by: Wang, Youkang, et al.
Published: (2025)
Improving Context-Aware Preference Modeling for Language Models
by: Pitis, Silviu, et al.
Published: (2024)
by: Pitis, Silviu, et al.
Published: (2024)
CLadder: Assessing Causal Reasoning in Language Models
by: Jin, Zhijing, et al.
Published: (2023)
by: Jin, Zhijing, et al.
Published: (2023)
Probabilistic Token Alignment for Large Language Model Fusion
by: Zeng, Runjia, et al.
Published: (2025)
by: Zeng, Runjia, et al.
Published: (2025)
Memory Injections: Correcting Multi-Hop Reasoning Failures during Inference in Transformer-Based Language Models
by: Sakarvadia, Mansi, et al.
Published: (2023)
by: Sakarvadia, Mansi, et al.
Published: (2023)
Stabilizing Reasoning in Medical LLMs with Continued Pretraining and Reasoning Preference Optimization
by: Kawakami, Wataru, et al.
Published: (2025)
by: Kawakami, Wataru, et al.
Published: (2025)
From Passive to Active Reasoning: Can Large Language Models Ask the Right Questions under Incomplete Information?
by: Zhou, Zhanke, et al.
Published: (2025)
by: Zhou, Zhanke, et al.
Published: (2025)
Advancing LLM Reasoning Generalists with Preference Trees
by: Yuan, Lifan, et al.
Published: (2024)
by: Yuan, Lifan, et al.
Published: (2024)
ROPO: Robust Preference Optimization for Large Language Models
by: Liang, Xize, et al.
Published: (2024)
by: Liang, Xize, et al.
Published: (2024)
Accelerated Preference Optimization for Large Language Model Alignment
by: He, Jiafan, et al.
Published: (2024)
by: He, Jiafan, et al.
Published: (2024)
Self-Play Preference Optimization for Language Model Alignment
by: Wu, Yue, et al.
Published: (2024)
by: Wu, Yue, et al.
Published: (2024)
BayesAgent: Bayesian Agentic Reasoning Under Uncertainty via Verbalized Probabilistic Graphical Modeling
by: Huang, Hengguan, et al.
Published: (2024)
by: Huang, Hengguan, et al.
Published: (2024)
Scaling Inference-Efficient Language Models
by: Bian, Song, et al.
Published: (2025)
by: Bian, Song, et al.
Published: (2025)
PMPO: Probabilistic Metric Prompt Optimization for Small and Large Language Models
by: Zhao, Chenzhuo, et al.
Published: (2025)
by: Zhao, Chenzhuo, et al.
Published: (2025)
Variational Reasoning for Language Models
by: Zhou, Xiangxin, et al.
Published: (2025)
by: Zhou, Xiangxin, et al.
Published: (2025)
Reasoning Planning for Language Models
by: Nguyen, Bao, et al.
Published: (2025)
by: Nguyen, Bao, et al.
Published: (2025)
GreedLlama: Performance of Financial Value-Aligned Large Language Models in Moral Reasoning
by: Yu, Jeffy, et al.
Published: (2024)
by: Yu, Jeffy, et al.
Published: (2024)
Similar Items
-
Doing Experiments and Revising Rules with Natural Language and Probabilistic Reasoning
by: Piriyakulkij, Wasu Top, et al.
Published: (2024) -
Hypothesis Generation and Inductive Inference in Children and Language Models
by: Qin, Jeffrey, et al.
Published: (2026) -
Denoising Diffusion Variational Inference: Diffusion Models as Expressive Variational Posteriors
by: Piriyakulkij, Wasu Top, et al.
Published: (2024) -
Joint Learning of Hierarchical Neural Options and Abstract World Model
by: Piriyakulkij, Wasu Top, et al.
Published: (2026) -
PoE-World: Compositional World Modeling with Products of Programmatic Experts
by: Piriyakulkij, Wasu Top, et al.
Published: (2025)