Trust, Don't Trust, or Flip: Robust Preference-Based Reinforcement Learning with Multi-Expert Feedback

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Hosseini, Seyed Amir, Abdolali, Maryam, Tavakkoli, Amirhosein, Ayar, Fardin, Javanmardi, Ehsan, Tsukada, Manabu, Javanmardi, Mahdi
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!