Contextual Preference Collaborative Measure Framework Based on Belief System
Fuente:
arXiv
Saved in:
| Main Authors: | Yu, Hang, Wei, Wei, Tan, Zheng, Liu, Jing-lei |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Risk-aware Direct Preference Optimization under Nested Risk Measure
by: Zhang, Lijun, et al.
Published: (2025)
by: Zhang, Lijun, et al.
Published: (2025)
In-Context Reward Adaptation for Robust Preference Modeling
by: Sun, Zhenyu, et al.
Published: (2026)
by: Sun, Zhenyu, et al.
Published: (2026)
MC-DBN: A Deep Belief Network-Based Model for Modality Completion
by: Luo, Zihong, et al.
Published: (2024)
by: Luo, Zihong, et al.
Published: (2024)
Preference as Reward, Maximum Preference Optimization with Importance Sampling
by: Jiang, Zaifan, et al.
Published: (2023)
by: Jiang, Zaifan, et al.
Published: (2023)
TemporalBench: A Benchmark for Evaluating LLM-Based Agents on Contextual and Event-Informed Time Series Tasks
by: Weng, Muyan, et al.
Published: (2026)
by: Weng, Muyan, et al.
Published: (2026)
Using LLMs to Model the Beliefs and Preferences of Targeted Populations
by: Namikoshi, Keiichi, et al.
Published: (2024)
by: Namikoshi, Keiichi, et al.
Published: (2024)
When Should Models Change Their Minds? Contextual Belief Management in Large Language Models
by: Xu, Haoming, et al.
Published: (2026)
by: Xu, Haoming, et al.
Published: (2026)
Beyond One-Preference-Fits-All Alignment: Multi-Objective Direct Preference Optimization
by: Zhou, Zhanhui, et al.
Published: (2023)
by: Zhou, Zhanhui, et al.
Published: (2023)
Contextual Combinatorial Bandits with Probabilistically Triggered Arms
by: Liu, Xutong, et al.
Published: (2023)
by: Liu, Xutong, et al.
Published: (2023)
Anyprefer: An Agentic Framework for Preference Data Synthesis
by: Zhou, Yiyang, et al.
Published: (2025)
by: Zhou, Yiyang, et al.
Published: (2025)
Hindsight Preference Optimization for Financial Time Series Advisory
by: Cui, Yanwei, et al.
Published: (2026)
by: Cui, Yanwei, et al.
Published: (2026)
Talk Structurally, Act Hierarchically: A Collaborative Framework for LLM Multi-Agent Systems
by: Wang, Zhao, et al.
Published: (2025)
by: Wang, Zhao, et al.
Published: (2025)
TimeCAP: Learning to Contextualize, Augment, and Predict Time Series Events with Large Language Model Agents
by: Lee, Geon, et al.
Published: (2025)
by: Lee, Geon, et al.
Published: (2025)
Leveraging Offline Data in Linear Latent Contextual Bandits
by: Kausik, Chinmaya, et al.
Published: (2024)
by: Kausik, Chinmaya, et al.
Published: (2024)
Contextual Rollout Bandits for Reinforcement Learning with Verifiable Rewards
by: Lu, Xiaodong, et al.
Published: (2026)
by: Lu, Xiaodong, et al.
Published: (2026)
SpikeSTAG: Spatial-Temporal Forecasting via GNN-SNN Collaboration
by: Hu, Bang, et al.
Published: (2025)
by: Hu, Bang, et al.
Published: (2025)
Regularized Offline Policy Optimization with Posterior Hybrid Bayesian Belief
by: Lin, Hongqiang, et al.
Published: (2026)
by: Lin, Hongqiang, et al.
Published: (2026)
Mitigating Mismatch within Reference-based Preference Optimization
by: Yuan, Suqin, et al.
Published: (2026)
by: Yuan, Suqin, et al.
Published: (2026)
On the Utility of Accounting for Human Beliefs about AI Intention in Human-AI Collaboration
by: Yu, Guanghui, et al.
Published: (2024)
by: Yu, Guanghui, et al.
Published: (2024)
From Efficiency to Equity: Measuring Fairness in Preference Learning
by: Gowaikar, Shreeyash, et al.
Published: (2024)
by: Gowaikar, Shreeyash, et al.
Published: (2024)
Mobility-Aware Cache Framework for Scalable LLM-Based Human Mobility Simulation
by: Yan, Hua, et al.
Published: (2026)
by: Yan, Hua, et al.
Published: (2026)
VAGPO: Vision-augmented Asymmetric Group Preference Optimization for Graph Routing Problems
by: Liu, Shiyan, et al.
Published: (2025)
by: Liu, Shiyan, et al.
Published: (2025)
ICPL: Few-shot In-context Preference Learning via LLMs
by: Yu, Chao, et al.
Published: (2024)
by: Yu, Chao, et al.
Published: (2024)
FactReview: Evidence-Grounded Peer Review with Execution-Based Claim Verification
by: Yue, Ling, et al.
Published: (2026)
by: Yue, Ling, et al.
Published: (2026)
A General Anchor-Based Framework for Scalable Fair Clustering
by: Wei, Shengfei, et al.
Published: (2025)
by: Wei, Shengfei, et al.
Published: (2025)
NQKV: A KV Cache Quantization Scheme Based on Normal Distribution Characteristics
by: Cai, Zhihang, et al.
Published: (2025)
by: Cai, Zhihang, et al.
Published: (2025)
Collaborative Imputation of Urban Time Series through Cross-city Meta-learning
by: Nie, Tong, et al.
Published: (2025)
by: Nie, Tong, et al.
Published: (2025)
Refining Alignment Framework for Diffusion Models with Intermediate-Step Preference Ranking
by: Ren, Jie, et al.
Published: (2025)
by: Ren, Jie, et al.
Published: (2025)
Out of Context: Reliability in Multimodal Anomaly Detection Requires Contextual Inference
by: Wilkinghoff, Kevin, et al.
Published: (2026)
by: Wilkinghoff, Kevin, et al.
Published: (2026)
Actor-Critics Can Achieve Optimal Sample Efficiency
by: Tan, Kevin, et al.
Published: (2025)
by: Tan, Kevin, et al.
Published: (2025)
Collaborative Adaptive Curriculum for Progressive Knowledge Distillation
by: Liu, Jing, et al.
Published: (2026)
by: Liu, Jing, et al.
Published: (2026)
Preference-Based Self-Distillation: Beyond KL Matching via Reward Regularization
by: Yu, Xin, et al.
Published: (2026)
by: Yu, Xin, et al.
Published: (2026)
K-Edit: Language Model Editing with Contextual Knowledge Awareness
by: Markowitz, Elan, et al.
Published: (2025)
by: Markowitz, Elan, et al.
Published: (2025)
Enhancing Graph Representations with Neighborhood-Contextualized Message-Passing
by: Lim, Brian Godwin, et al.
Published: (2025)
by: Lim, Brian Godwin, et al.
Published: (2025)
Learning Preference-Based Objectives from Clinical Narratives for Dynamic Sepsis Treatment
by: Tan, Daniel J., et al.
Published: (2026)
by: Tan, Daniel J., et al.
Published: (2026)
PerPO: Perceptual Preference Optimization via Discriminative Rewarding
by: Zhu, Zining, et al.
Published: (2025)
by: Zhu, Zining, et al.
Published: (2025)
Contextual Molecule Representation Learning from Chemical Reaction Knowledge
by: Tang, Han, et al.
Published: (2024)
by: Tang, Han, et al.
Published: (2024)
Belief-Based Offline Reinforcement Learning for Delay-Robust Policy Optimization
by: Zhan, Simon Sinong, et al.
Published: (2025)
by: Zhan, Simon Sinong, et al.
Published: (2025)
PROF: An LLM-based Reward Code Preference Optimization Framework for Offline Imitation Learning
by: Sun, Shengjie, et al.
Published: (2025)
by: Sun, Shengjie, et al.
Published: (2025)
Large-Small Model Collaborative Framework for Federated Continual Learning
by: Yu, Hao, et al.
Published: (2025)
by: Yu, Hao, et al.
Published: (2025)
Similar Items
-
Risk-aware Direct Preference Optimization under Nested Risk Measure
by: Zhang, Lijun, et al.
Published: (2025) -
In-Context Reward Adaptation for Robust Preference Modeling
by: Sun, Zhenyu, et al.
Published: (2026) -
MC-DBN: A Deep Belief Network-Based Model for Modality Completion
by: Luo, Zihong, et al.
Published: (2024) -
Preference as Reward, Maximum Preference Optimization with Importance Sampling
by: Jiang, Zaifan, et al.
Published: (2023) -
TemporalBench: A Benchmark for Evaluating LLM-Based Agents on Contextual and Event-Informed Time Series Tasks
by: Weng, Muyan, et al.
Published: (2026)