Mapping out the Space of Human Feedback for Reinforcement Learning: A Conceptual Framework
Fuente:
arXiv
Saved in:
| Main Authors: | Metz, Yannick, Lindner, David, Baur, Raphaël, El-Assady, Mennatallah |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
iNNspector: Visual, Interactive Deep Model Debugging
by: Spinner, Thilo, et al.
Published: (2024)
by: Spinner, Thilo, et al.
Published: (2024)
Reward Learning from Multiple Feedback Types
by: Metz, Yannick, et al.
Published: (2025)
by: Metz, Yannick, et al.
Published: (2025)
Deconstructing Human-AI Collaboration: Agency, Interaction, and Adaptation
by: Holter, Steffen, et al.
Published: (2024)
by: Holter, Steffen, et al.
Published: (2024)
TopoAlign: Topology-Aware Visual Representation Alignment
by: Yan, Xinyuan, et al.
Published: (2026)
by: Yan, Xinyuan, et al.
Published: (2026)
DxHF: Providing High-Quality Human Feedback for LLM Alignment via Interactive Decomposition
by: Shi, Danqing, et al.
Published: (2025)
by: Shi, Danqing, et al.
Published: (2025)
ProvenanceWidgets: A Library of UI Control Elements to Track and Dynamically Overlay Analytic Provenance
by: Narechania, Arpit, et al.
Published: (2024)
by: Narechania, Arpit, et al.
Published: (2024)
CafGa: Customizing Feature Attributions to Explain Language Models
by: Boyle, Alan, et al.
Published: (2025)
by: Boyle, Alan, et al.
Published: (2025)
SemanticTours: A Conceptual Framework for Non-Linear, Knowledge Graph-Driven Data Tours
by: Fürst, Daniel, et al.
Published: (2025)
by: Fürst, Daniel, et al.
Published: (2025)
MAVRL: Learning Reward Functions from Multiple Feedback Types with Amortized Variational Inference
by: Baur, Raphaël, et al.
Published: (2026)
by: Baur, Raphaël, et al.
Published: (2026)
Dia-Lingle: A Gamified Interface for Dialectal Data Collection
by: Sun, Jiugeng, et al.
Published: (2025)
by: Sun, Jiugeng, et al.
Published: (2025)
A Design Space for Intelligent Agents in Mixed-Initiative Visual Analytics
by: Stähle, Tobias, et al.
Published: (2025)
by: Stähle, Tobias, et al.
Published: (2025)
GEMS -- Guided Evolutionary Molecule Design for Sustainable Chemicals
by: Robinson, Coelina, et al.
Published: (2026)
by: Robinson, Coelina, et al.
Published: (2026)
To Ask or Not to Ask: Learning to Require Human Feedback
by: Pugnana, Andrea, et al.
Published: (2025)
by: Pugnana, Andrea, et al.
Published: (2025)
Exploring Empty Spaces: Human-in-the-Loop Data Augmentation
by: Yeh, Catherine, et al.
Published: (2024)
by: Yeh, Catherine, et al.
Published: (2024)
Multidimensional Human Activity Recognition With Large Language Model: A Conceptual Framework
by: Hasan, Syed Mhamudul
Published: (2024)
by: Hasan, Syed Mhamudul
Published: (2024)
PleaSQLarify: Visual Pragmatic Repair for Natural Language Database Querying
by: Chan, Robin Shing Moon, et al.
Published: (2026)
by: Chan, Robin Shing Moon, et al.
Published: (2026)
MENTOR: Guiding Hierarchical Reinforcement Learning with Human Feedback and Dynamic Distance Constraint
by: Zhou, Xinglin, et al.
Published: (2024)
by: Zhou, Xinglin, et al.
Published: (2024)
generAItor: Tree-in-the-Loop Text Generation for Language Model Explainability and Adaptation
by: Spinner, Thilo, et al.
Published: (2024)
by: Spinner, Thilo, et al.
Published: (2024)
Improving Human Sequential Decision-Making with Reinforcement Learning
by: Bastani, Hamsa, et al.
Published: (2021)
by: Bastani, Hamsa, et al.
Published: (2021)
Challenges and Opportunities for Visual Analytics in Jurisprudence
by: Fürst, Daniel, et al.
Published: (2024)
by: Fürst, Daniel, et al.
Published: (2024)
VACP: Visual Analytics Context Protocol
by: Stähle, Tobias, et al.
Published: (2026)
by: Stähle, Tobias, et al.
Published: (2026)
Online Learning of Human Constraints from Feedback in Shared Autonomy
by: Zhu, Shibei, et al.
Published: (2024)
by: Zhu, Shibei, et al.
Published: (2024)
Towards Interactive Reinforcement Learning with Intrinsic Feedback
by: Poole, Benjamin, et al.
Published: (2021)
by: Poole, Benjamin, et al.
Published: (2021)
Trustworthy Human-AI Collaboration: Reinforcement Learning with Human Feedback and Physics Knowledge for Safe Autonomous Driving
by: Huang, Zilin, et al.
Published: (2024)
by: Huang, Zilin, et al.
Published: (2024)
RELIC: Investigating Large Language Model Responses using Self-Consistency
by: Cheng, Furui, et al.
Published: (2023)
by: Cheng, Furui, et al.
Published: (2023)
iToT: An Interactive System for Customized Tree-of-Thought Generation
by: Boyle, Alan, et al.
Published: (2024)
by: Boyle, Alan, et al.
Published: (2024)
Uni-RLHF: Universal Platform and Benchmark Suite for Reinforcement Learning with Diverse Human Feedback
by: Yuan, Yifu, et al.
Published: (2024)
by: Yuan, Yifu, et al.
Published: (2024)
Understanding Large Language Model Behaviors through Interactive Counterfactual Generation and Analysis
by: Cheng, Furui, et al.
Published: (2024)
by: Cheng, Furui, et al.
Published: (2024)
ShapDBM: Exploring Decision Boundary Maps in Shapley Space
by: Watkin, Luke, et al.
Published: (2026)
by: Watkin, Luke, et al.
Published: (2026)
Domain Knowledge in Artificial Intelligence: Using Conceptual Modeling to Increase Machine Learning Accuracy and Explainability
by: Storey, V. C., et al.
Published: (2025)
by: Storey, V. C., et al.
Published: (2025)
Principled Reinforcement Learning with Human Feedback from Pairwise or $K$-wise Comparisons
by: Zhu, Banghua, et al.
Published: (2023)
by: Zhu, Banghua, et al.
Published: (2023)
Abstraction Alignment: Comparing Model-Learned and Human-Encoded Conceptual Relationships
by: Boggust, Angie, et al.
Published: (2024)
by: Boggust, Angie, et al.
Published: (2024)
A Reliable Framework for Human-in-the-Loop Anomaly Detection in Time Series
by: Deng, Ziquan, et al.
Published: (2024)
by: Deng, Ziquan, et al.
Published: (2024)
A Survey on Federated Learning in Human Sensing
by: Li, Mohan, et al.
Published: (2025)
by: Li, Mohan, et al.
Published: (2025)
HERO: Human-Feedback Efficient Reinforcement Learning for Online Diffusion Model Finetuning
by: Hiranaka, Ayano, et al.
Published: (2024)
by: Hiranaka, Ayano, et al.
Published: (2024)
A2C: A Modular Multi-stage Collaborative Decision Framework for Human-AI Teams
by: Tariq, Shahroz, et al.
Published: (2024)
by: Tariq, Shahroz, et al.
Published: (2024)
Quantifying the Effect of Feedback Frequency in Interactive Reinforcement Learning for Robotic Tasks
by: Harnack, Daniel, et al.
Published: (2022)
by: Harnack, Daniel, et al.
Published: (2022)
CautionSuicide: A Deep Learning Based Approach for Detecting Suicidal Ideation in Real Time Chatbot Conversation
by: Elsayed, Nelly, et al.
Published: (2024)
by: Elsayed, Nelly, et al.
Published: (2024)
Understanding Impact of Human Feedback via Influence Functions
by: Min, Taywon, et al.
Published: (2025)
by: Min, Taywon, et al.
Published: (2025)
Characterizing Grounded Theory Approaches in Visualization
by: Diehl, Alexandra, et al.
Published: (2022)
by: Diehl, Alexandra, et al.
Published: (2022)
Similar Items
-
iNNspector: Visual, Interactive Deep Model Debugging
by: Spinner, Thilo, et al.
Published: (2024) -
Reward Learning from Multiple Feedback Types
by: Metz, Yannick, et al.
Published: (2025) -
Deconstructing Human-AI Collaboration: Agency, Interaction, and Adaptation
by: Holter, Steffen, et al.
Published: (2024) -
TopoAlign: Topology-Aware Visual Representation Alignment
by: Yan, Xinyuan, et al.
Published: (2026) -
DxHF: Providing High-Quality Human Feedback for LLM Alignment via Interactive Decomposition
by: Shi, Danqing, et al.
Published: (2025)