Salvato in:
| Autori principali: | Tennenholtz, Guy, Chow, Yinlam, Hsu, Chih-Wei, Jeong, Jihwan, Shani, Lior, Tulepbergenov, Azamat, Ramachandran, Deepak, Mladenov, Martin, Boutilier, Craig |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2310.04475 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Embedding-Aligned Language Models
di: Tennenholtz, Guy, et al.
Pubblicazione: (2024)
di: Tennenholtz, Guy, et al.
Pubblicazione: (2024)
Descriptive History Representations: Learning Representations by Answering Questions
di: Tennenholtz, Guy, et al.
Pubblicazione: (2025)
di: Tennenholtz, Guy, et al.
Pubblicazione: (2025)
Preference Adaptive and Sequential Text-to-Image Generation
di: Nabati, Ofir, et al.
Pubblicazione: (2024)
di: Nabati, Ofir, et al.
Pubblicazione: (2024)
DynaMITE-RL: A Dynamic Model for Improved Temporal Meta-Reinforcement Learning
di: Liang, Anthony, et al.
Pubblicazione: (2024)
di: Liang, Anthony, et al.
Pubblicazione: (2024)
Synthetic Dialogue Generation for Interactive Conversational Elicitation & Recommendation (ICER)
di: Ryu, Moonkyung, et al.
Pubblicazione: (2025)
di: Ryu, Moonkyung, et al.
Pubblicazione: (2025)
Controllable User Simulation
di: Tennenholtz, Guy, et al.
Pubblicazione: (2026)
di: Tennenholtz, Guy, et al.
Pubblicazione: (2026)
Inference-Aware Fine-Tuning for Best-of-N Sampling in Large Language Models
di: Chow, Yinlam, et al.
Pubblicazione: (2024)
di: Chow, Yinlam, et al.
Pubblicazione: (2024)
Asking Clarifying Questions for Preference Elicitation With Large Language Models
di: Montazeralghaem, Ali, et al.
Pubblicazione: (2025)
di: Montazeralghaem, Ali, et al.
Pubblicazione: (2025)
ConvApparel: A Benchmark Dataset and Validation Framework for User Simulators in Conversational Recommenders
di: Meshi, Ofer, et al.
Pubblicazione: (2026)
di: Meshi, Ofer, et al.
Pubblicazione: (2026)
Diffusion Controller: Framework, Algorithms and Parameterization
di: Yang, Tong, et al.
Pubblicazione: (2026)
di: Yang, Tong, et al.
Pubblicazione: (2026)
Spectral Souping: A Unified Framework for Online Preference Alignment
di: Chow, Yinlam, et al.
Pubblicazione: (2026)
di: Chow, Yinlam, et al.
Pubblicazione: (2026)
Minimizing Live Experiments in Recommender Systems: User Simulation to Evaluate Preference Elicitation Policies
di: Hsu, Chih-Wei, et al.
Pubblicazione: (2024)
di: Hsu, Chih-Wei, et al.
Pubblicazione: (2024)
pyRDDLGym: From RDDL to Gym Environments
di: Taitler, Ayal, et al.
Pubblicazione: (2022)
di: Taitler, Ayal, et al.
Pubblicazione: (2022)
Heuristics for Partially Observable Stochastic Contingent Planning
di: Shani, Guy
Pubblicazione: (2024)
di: Shani, Guy
Pubblicazione: (2024)
Benchmarks for Reinforcement Learning with Biased Offline Data and Imperfect Simulators
di: Linial, Ori, et al.
Pubblicazione: (2024)
di: Linial, Ori, et al.
Pubblicazione: (2024)
Bayesian Regret Minimization in Offline Bandits
di: Petrik, Marek, et al.
Pubblicazione: (2023)
di: Petrik, Marek, et al.
Pubblicazione: (2023)
Representation-Driven Reinforcement Learning
di: Nabati, Ofir, et al.
Pubblicazione: (2023)
di: Nabati, Ofir, et al.
Pubblicazione: (2023)
Predicting User Satisfaction in Online Education Platforms: A Large Language Model Based Multi-Modal Review Mining Framework
di: Bekov, Arman, et al.
Pubblicazione: (2026)
di: Bekov, Arman, et al.
Pubblicazione: (2026)
White Hat Search Engine Optimization using Large Language Models
di: Bardas, Niv, et al.
Pubblicazione: (2025)
di: Bardas, Niv, et al.
Pubblicazione: (2025)
Advanced Memristor Modeling
di: Mladenov, Valeri
Pubblicazione: (2022)
di: Mladenov, Valeri
Pubblicazione: (2022)
Differential graded categories in holomorphic symplectic geometry
di: Mladenov, Borislav
Pubblicazione: (2026)
di: Mladenov, Borislav
Pubblicazione: (2026)
Formality of differential graded algebras and complex Lagrangian submanifolds
di: Mladenov, Borislav
Pubblicazione: (2020)
di: Mladenov, Borislav
Pubblicazione: (2020)
Spectral Bellman Method: Unifying Representation and Exploration in RL
di: Nabati, Ofir, et al.
Pubblicazione: (2025)
di: Nabati, Ofir, et al.
Pubblicazione: (2025)
O'QUVCHILARINI MA'NAVIY AXLOQIY RUHDA TARBIYALASH
di: Ilhomov, Azamat
Pubblicazione: (2025)
di: Ilhomov, Azamat
Pubblicazione: (2025)
REKLAMA XIZMATLARIDA MAVJUD MUAMMOLAR VA ULARNING YECHIMLARI
di: Xamrakulov, Azamat
Pubblicazione: (2025)
di: Xamrakulov, Azamat
Pubblicazione: (2025)
THEORETICAL FOUNDATIONS OF THE SEMANTICS OF IDIOMS: COMPREHENSIVE ANALYSIS OF THE SEMANTIC SYSTEM OF PHRASEOLOGICAL UNITS
di: Jurakhonov, Azamat
Pubblicazione: (2026)
di: Jurakhonov, Azamat
Pubblicazione: (2026)
FOREIGN EXPERIENCE IN STAFFING THE ACTIVITIES OF INVESTIGATIVE UNITS
di: Abdreimov, Azamat
Pubblicazione: (2026)
di: Abdreimov, Azamat
Pubblicazione: (2026)
WHAT DO FLEXIBLE WORKERS WANT FROM MANAGERS?
di: Azamat Sulaymonov
Pubblicazione: (2025)
di: Azamat Sulaymonov
Pubblicazione: (2025)
O'ZBEKISTON IQTISODIYOTIGA TO'G'RIDAN-TO'G'RI XORIJIY INVESTITSIYALAR OQIMINI OSHIRISH OMILLARI
di: Madaminov, Azamat
Pubblicazione: (2025)
di: Madaminov, Azamat
Pubblicazione: (2025)
METHODOLOGICAL BASIS FOR DEVELOPING DEONTOLOGICAL READINESS IN FUTURE SPECIALISTS
di: Kabulov, Azamat
Pubblicazione: (2026)
di: Kabulov, Azamat
Pubblicazione: (2026)
Desarrollo fiscal progresivo en el sistema tributario: un análisis comparativo de la UE y los países de Asia Central
di: Azamat Baimagambetov
Pubblicazione: (2025)
di: Azamat Baimagambetov
Pubblicazione: (2025)
SoK: Demystifying the multiverse of MPC protocols
di: De Viti, Roberta, et al.
Pubblicazione: (2025)
di: De Viti, Roberta, et al.
Pubblicazione: (2025)
Enhancing Personalized Multi-Turn Dialogue with Curiosity Reward
di: Wan, Yanming, et al.
Pubblicazione: (2025)
di: Wan, Yanming, et al.
Pubblicazione: (2025)
Demystifying Singular Defects in Large Language Models
di: Wang, Haoqi, et al.
Pubblicazione: (2025)
di: Wang, Haoqi, et al.
Pubblicazione: (2025)
Demystifying Verbatim Memorization in Large Language Models
di: Huang, Jing, et al.
Pubblicazione: (2024)
di: Huang, Jing, et al.
Pubblicazione: (2024)
Density-based User Representation using Gaussian Process Regression for Multi-interest Personalized Retrieval
di: Wu, Haolun, et al.
Pubblicazione: (2023)
di: Wu, Haolun, et al.
Pubblicazione: (2023)
Privacy Preserving Multi Agent Path Finding
di: Lehman, Rotem Lev, et al.
Pubblicazione: (2026)
di: Lehman, Rotem Lev, et al.
Pubblicazione: (2026)
Processes of control and verification of settlements with employees and scholarship recipients in budget organizations
di: Shonazarovich, Kuliboyev Azamat
Pubblicazione: (2025)
di: Shonazarovich, Kuliboyev Azamat
Pubblicazione: (2025)
LITSENZIYALASH TIZIMI ISLOHOTIDA KORRUPSIYAGA QARSHI KURASHISH OMILINI KUCHAYTIRISH
di: Bahodirov, Azamat Alimovich
Pubblicazione: (2025)
di: Bahodirov, Azamat Alimovich
Pubblicazione: (2025)
Mechanisms of control and audit of settlements with employees and scholarship recipients in budgetary organizations
di: Shonazarovich, Kuliboyev Azamat
Pubblicazione: (2025)
di: Shonazarovich, Kuliboyev Azamat
Pubblicazione: (2025)
Documenti analoghi
-
Embedding-Aligned Language Models
di: Tennenholtz, Guy, et al.
Pubblicazione: (2024) -
Descriptive History Representations: Learning Representations by Answering Questions
di: Tennenholtz, Guy, et al.
Pubblicazione: (2025) -
Preference Adaptive and Sequential Text-to-Image Generation
di: Nabati, Ofir, et al.
Pubblicazione: (2024) -
DynaMITE-RL: A Dynamic Model for Improved Temporal Meta-Reinforcement Learning
di: Liang, Anthony, et al.
Pubblicazione: (2024) -
Synthetic Dialogue Generation for Interactive Conversational Elicitation & Recommendation (ICER)
di: Ryu, Moonkyung, et al.
Pubblicazione: (2025)