MALLES: A Multi-agent LLMs-based Economic Sandbox with Consumer Preference Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Yusen, Liu, Yiran, Deng, Xiaotie |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HCAG: Hierarchical Abstraction and Retrieval-Augmented Generation on Theoretical Repositories with LLMs
par: Wu, Yusen, et autres
Publié: (2026)
par: Wu, Yusen, et autres
Publié: (2026)
Implementing Long Text Style Transfer with LLMs through Dual-Layered Sentence and Paragraph Structure Extraction and Mapping
par: Wu, Yusen, et autres
Publié: (2025)
par: Wu, Yusen, et autres
Publié: (2025)
How Social is It? A Benchmark for LLMs' Capabilities in Multi-user Multi-turn Social Agent Tasks
par: Wu, Yusen, et autres
Publié: (2025)
par: Wu, Yusen, et autres
Publié: (2025)
DeepRule: An Integrated Framework for Automated Business Rule Generation via Deep Predictive Modeling and Hybrid Search Optimization
par: Wu, Yusen, et autres
Publié: (2025)
par: Wu, Yusen, et autres
Publié: (2025)
Hummer: Towards Limited Competitive Preference Dataset
par: Jiang, Li, et autres
Publié: (2024)
par: Jiang, Li, et autres
Publié: (2024)
How Large Language Models Need Symbolism
par: Deng, Xiaotie, et autres
Publié: (2025)
par: Deng, Xiaotie, et autres
Publié: (2025)
Game Theory Meets Large Language Models: A Systematic Survey with Taxonomy and New Frontiers
par: Sun, Haoran, et autres
Publié: (2025)
par: Sun, Haoran, et autres
Publié: (2025)
Will AI Trade? A Computational Inversion of the No-Trade Theorem
par: Li, Hanyu, et autres
Publié: (2025)
par: Li, Hanyu, et autres
Publié: (2025)
Meta-Aligner: Bidirectional Preference-Policy Optimization for Multi-Objective LLMs Alignment
par: Xu, Wenzhe, et autres
Publié: (2026)
par: Xu, Wenzhe, et autres
Publié: (2026)
When and How Human Curation Backfires: Preference Alignment under Multi-Model Self-Consuming Loop
par: Zhang, Yang, et autres
Publié: (2026)
par: Zhang, Yang, et autres
Publié: (2026)
Reward-Augmented Data Enhances Direct Preference Alignment of LLMs
par: Zhang, Shenao, et autres
Publié: (2024)
par: Zhang, Shenao, et autres
Publié: (2024)
IDA-Bench: Evaluating LLMs on Interactive Guided Data Analysis
par: Li, Hanyu, et autres
Publié: (2025)
par: Li, Hanyu, et autres
Publié: (2025)
An Information-Theoretic Criterion for Efficient Data Synthesis
par: Li, Hanyu, et autres
Publié: (2026)
par: Li, Hanyu, et autres
Publié: (2026)
The Sandbox Configurator: A Framework to Support Technical Assessment in AI Regulatory Sandboxes
par: Buscemi, Alessio, et autres
Publié: (2025)
par: Buscemi, Alessio, et autres
Publié: (2025)
Arithmetic Control of LLMs for Diverse User Preferences: Directional Preference Alignment with Multi-Objective Rewards
par: Wang, Haoxiang, et autres
Publié: (2024)
par: Wang, Haoxiang, et autres
Publié: (2024)
PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference
par: Ji, Jiaming, et autres
Publié: (2024)
par: Ji, Jiaming, et autres
Publié: (2024)
Implementing Rational Choice Functions with LLMs and Measuring their Alignment with User Preferences
par: Karnysheva, Anna, et autres
Publié: (2025)
par: Karnysheva, Anna, et autres
Publié: (2025)
Grounding Natural Language for Multi-agent Decision-Making with Multi-agentic LLMs
par: Huh, Dom, et autres
Publié: (2025)
par: Huh, Dom, et autres
Publié: (2025)
More is Less: The Pitfalls of Multi-Model Synthetic Preference Data in DPO Safety Alignment
par: Wang, Yifan, et autres
Publié: (2025)
par: Wang, Yifan, et autres
Publié: (2025)
Multi-Value Alignment for LLMs via Value Decorrelation and Extrapolation
par: Xu, Hefei, et autres
Publié: (2025)
par: Xu, Hefei, et autres
Publié: (2025)
Retrieval-Infused Reasoning Sandbox: A Benchmark for Decoupling Retrieval and Reasoning Capabilities
par: Ying, Shuangshuang, et autres
Publié: (2026)
par: Ying, Shuangshuang, et autres
Publié: (2026)
Sample Efficient Preference Alignment in LLMs via Active Exploration
par: Mehta, Viraj, et autres
Publié: (2023)
par: Mehta, Viraj, et autres
Publié: (2023)
Knowledgeable Preference Alignment for LLMs in Domain-specific Question Answering
par: Zhang, Yichi, et autres
Publié: (2023)
par: Zhang, Yichi, et autres
Publié: (2023)
Beyond One-Preference-Fits-All Alignment: Multi-Objective Direct Preference Optimization
par: Zhou, Zhanhui, et autres
Publié: (2023)
par: Zhou, Zhanhui, et autres
Publié: (2023)
Can LLMs Help You at Work? A Sandbox for Evaluating LLM Agents in Enterprise Environments
par: Vishwakarma, Harsh, et autres
Publié: (2025)
par: Vishwakarma, Harsh, et autres
Publié: (2025)
Property-driven Protein Inverse Folding With Multi-Objective Preference Alignment
par: Hou, Xiaoyang, et autres
Publié: (2026)
par: Hou, Xiaoyang, et autres
Publié: (2026)
A Systematic Evaluation of Preference Aggregation in Federated RLHF for Pluralistic Alignment of LLMs
par: Srewa, Mahmoud, et autres
Publié: (2025)
par: Srewa, Mahmoud, et autres
Publié: (2025)
Coverage-based Fairness in Multi-document Summarization
par: Li, Haoyuan, et autres
Publié: (2024)
par: Li, Haoyuan, et autres
Publié: (2024)
Computational Challenges in Token Economics: Bridging Economic Theory and AI System Design
par: Wu, Ou, et autres
Publié: (2026)
par: Wu, Ou, et autres
Publié: (2026)
APPA: Adaptive Preference Pluralistic Alignment for Fair Federated RLHF of LLMs
par: Srewa, Mahmoud, et autres
Publié: (2026)
par: Srewa, Mahmoud, et autres
Publié: (2026)
When Weak LLMs Speak with Confidence, Preference Alignment Gets Stronger
par: Afzali, Amirabbas, et autres
Publié: (2026)
par: Afzali, Amirabbas, et autres
Publié: (2026)
Aligning CodeLLMs with Direct Preference Optimization
par: Miao, Yibo, et autres
Publié: (2024)
par: Miao, Yibo, et autres
Publié: (2024)
Are LLMs (Really) Ideological? An IRT-based Analysis and Alignment Tool for Perceived Socio-Economic Bias in LLMs
par: Wachter, Jasmin, et autres
Publié: (2025)
par: Wachter, Jasmin, et autres
Publié: (2025)
PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
par: Wu, Jiayi, et autres
Publié: (2024)
par: Wu, Jiayi, et autres
Publié: (2024)
HPS: Hard Preference Sampling for Human Preference Alignment
par: Zou, Xiandong, et autres
Publié: (2025)
par: Zou, Xiandong, et autres
Publié: (2025)
Crab: A Semantics-Aware Checkpoint/Restore Runtime for Agent Sandboxes
par: Wu, Tianyuan, et autres
Publié: (2026)
par: Wu, Tianyuan, et autres
Publié: (2026)
InterMT: Multi-Turn Interleaved Preference Alignment with Human Feedback
par: Chen, Boyuan, et autres
Publié: (2025)
par: Chen, Boyuan, et autres
Publié: (2025)
MIND: A Multi-agent Framework for Zero-shot Harmful Meme Detection
par: Liu, Ziyan, et autres
Publié: (2025)
par: Liu, Ziyan, et autres
Publié: (2025)
Word Alignment as Preference for Machine Translation
par: Wu, Qiyu, et autres
Publié: (2024)
par: Wu, Qiyu, et autres
Publié: (2024)
Beyond Preferences in AI Alignment
par: Zhi-Xuan, Tan, et autres
Publié: (2024)
par: Zhi-Xuan, Tan, et autres
Publié: (2024)
Documents similaires
-
HCAG: Hierarchical Abstraction and Retrieval-Augmented Generation on Theoretical Repositories with LLMs
par: Wu, Yusen, et autres
Publié: (2026) -
Implementing Long Text Style Transfer with LLMs through Dual-Layered Sentence and Paragraph Structure Extraction and Mapping
par: Wu, Yusen, et autres
Publié: (2025) -
How Social is It? A Benchmark for LLMs' Capabilities in Multi-user Multi-turn Social Agent Tasks
par: Wu, Yusen, et autres
Publié: (2025) -
DeepRule: An Integrated Framework for Automated Business Rule Generation via Deep Predictive Modeling and Hybrid Search Optimization
par: Wu, Yusen, et autres
Publié: (2025) -
Hummer: Towards Limited Competitive Preference Dataset
par: Jiang, Li, et autres
Publié: (2024)