ACE and Diverse Generalization via Selective Disagreement
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Daniels, Oliver, Armstrong, Stuart, Maranhão, Alexandre, Rahman, Mahirah Fairuz, Marlin, Benjamin M., Gorman, Rebecca |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Combining LLM decision and RL action selection to improve RL policy for adaptive interventions
par: Karine, Karine, et autres
Publié: (2025)
par: Karine, Karine, et autres
Publié: (2025)
StepCountJITAI: simulation environment for RL with application to physical activity adaptive intervention
par: Karine, Karine, et autres
Publié: (2024)
par: Karine, Karine, et autres
Publié: (2024)
Heteroscedastic Temporal Variational Autoencoder For Irregular Time Series
par: Shukla, Satya Narayan, et autres
Publié: (2021)
par: Shukla, Satya Narayan, et autres
Publié: (2021)
BOTS: Batch Bayesian Optimization of Extended Thompson Sampling for Severely Episode-Limited RL Settings
par: Karine, Karine, et autres
Publié: (2024)
par: Karine, Karine, et autres
Publié: (2024)
Enhancing Adaptive Behavioral Interventions with LLM Inference from Participant-Described States
par: Karine, Karine, et autres
Publié: (2025)
par: Karine, Karine, et autres
Publié: (2025)
Mitigating Spurious Correlations via Disagreement Probability
par: Han, Hyeonggeun, et autres
Publié: (2024)
par: Han, Hyeonggeun, et autres
Publié: (2024)
AI Chaperones Are (Really) All You Need to Prevent Parasocial Relationships with Chatbots
par: Rath, Emma, et autres
Publié: (2025)
par: Rath, Emma, et autres
Publié: (2025)
DIVE: Subgraph Disagreement for Graph Out-of-Distribution Generalization
par: Sun, Xin, et autres
Publié: (2024)
par: Sun, Xin, et autres
Publié: (2024)
DARC: Disagreement-Aware Alignment via Risk-Constrained Decoding
par: Zou, Mingxi, et autres
Publié: (2026)
par: Zou, Mingxi, et autres
Publié: (2026)
FedDiverse: Tackling Data Heterogeneity in Federated Learning with Diversity-Driven Client Selection
par: Németh, Gergely D., et autres
Publié: (2025)
par: Németh, Gergely D., et autres
Publié: (2025)
Liquid Ensemble Selection for Continual Learning
par: Blair, Carter, et autres
Publié: (2024)
par: Blair, Carter, et autres
Publié: (2024)
STABLEVAL: Disagreement-Aware and Stable Evaluation of AI Systems
par: Bonagiri, Akash, et autres
Publié: (2026)
par: Bonagiri, Akash, et autres
Publié: (2026)
Worker Disagreement Reveals Sharp Directions in Local SGD
par: Dimlioglu, Tolga, et autres
Publié: (2026)
par: Dimlioglu, Tolga, et autres
Publié: (2026)
Hybrid Disagreement-Diversity Active Learning for Bioacoustic Sound Event Detection
par: Zhang, Shiqi, et autres
Publié: (2025)
par: Zhang, Shiqi, et autres
Publié: (2025)
The Disagreement Problem in Explainable Machine Learning: A Practitioner's Perspective
par: Krishna, Satyapriya, et autres
Publié: (2022)
par: Krishna, Satyapriya, et autres
Publié: (2022)
Stress-Testing Alignment Audits With Prompt-Level Strategic Deception
par: Daniels, Oliver, et autres
Publié: (2026)
par: Daniels, Oliver, et autres
Publié: (2026)
Diversity Progress for Goal Selection in Discriminability-Motivated RL
par: Lintunen, Erik M., et autres
Publié: (2024)
par: Lintunen, Erik M., et autres
Publié: (2024)
Safe Learning Under Irreversible Dynamics via Asking for Help
par: Plaut, Benjamin, et autres
Publié: (2025)
par: Plaut, Benjamin, et autres
Publié: (2025)
EMoE: Training-Free Expert Disagreement for Uncertainty-Aware Text-to-Image Diffusion
par: Berry, Lucas, et autres
Publié: (2025)
par: Berry, Lucas, et autres
Publié: (2025)
ToolACE-MT: Non-Autoregressive Generation for Agentic Multi-Turn Interaction
par: Zeng, Xingshan, et autres
Publié: (2025)
par: Zeng, Xingshan, et autres
Publié: (2025)
BOHM: Zero-Cost Hierarchical Attribution for Compound AI Systems
par: Armstrong, Joss
Publié: (2026)
par: Armstrong, Joss
Publié: (2026)
PromptSplit: Revealing Prompt-Level Disagreement in Generative Models
par: Lotfian, Mehdi, et autres
Publié: (2026)
par: Lotfian, Mehdi, et autres
Publié: (2026)
Learning and Generating Diverse Residential Load Patterns Using GAN with Weakly-Supervised Training and Weight Selection
par: Liang, Xinyu, et autres
Publié: (2025)
par: Liang, Xinyu, et autres
Publié: (2025)
Avoiding Catastrophe in Online Learning by Asking for Help
par: Plaut, Benjamin, et autres
Publié: (2024)
par: Plaut, Benjamin, et autres
Publié: (2024)
Learning from Disagreement: Clinician Overrides as Implicit Preference Signals for Clinical AI in Value-Based Care
par: Singh, Prabhjot, et autres
Publié: (2026)
par: Singh, Prabhjot, et autres
Publié: (2026)
SPARQ: Synthetic Problem Generation for Reasoning via Quality-Diversity Algorithms
par: Havrilla, Alex, et autres
Publié: (2025)
par: Havrilla, Alex, et autres
Publié: (2025)
Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning
par: Reizinger, Patrik, et autres
Publié: (2025)
par: Reizinger, Patrik, et autres
Publié: (2025)
ToolACE: Winning the Points of LLM Function Calling
par: Liu, Weiwen, et autres
Publié: (2024)
par: Liu, Weiwen, et autres
Publié: (2024)
Towards Diverse Perspective Learning with Selection over Multiple Temporal Poolings
par: Seong, Jihyeon, et autres
Publié: (2024)
par: Seong, Jihyeon, et autres
Publié: (2024)
Multi-Objective Hardware Aware Neural Architecture Search using Hardware Cost Diversity
par: Sinha, Nilotpal, et autres
Publié: (2024)
par: Sinha, Nilotpal, et autres
Publié: (2024)
The Laminar Flow Hypothesis: Detecting Jailbreaks via Semantic Turbulence in Large Language Models
par: Rahman, Md. Hasib Ur
Publié: (2025)
par: Rahman, Md. Hasib Ur
Publié: (2025)
H-FLTN: A Privacy-Preserving Hierarchical Framework for Electric Vehicle Spatio-Temporal Charge Prediction
par: Marlin, Robert, et autres
Publié: (2025)
par: Marlin, Robert, et autres
Publié: (2025)
Affinity and Diversity: A Unified Metric for Demonstration Selection via Internal Representations
par: Kato, Mariko, et autres
Publié: (2025)
par: Kato, Mariko, et autres
Publié: (2025)
Leveraging Ensemble Diversity for Robust Self-Training in the Presence of Sample Selection Bias
par: Odonnat, Ambroise, et autres
Publié: (2023)
par: Odonnat, Ambroise, et autres
Publié: (2023)
ACES: Generating Diverse Programming Puzzles with with Autotelic Generative Models
par: Pourcel, Julien, et autres
Publié: (2023)
par: Pourcel, Julien, et autres
Publié: (2023)
DiZiNER: Disagreement-guided Instruction Refinement via Pilot Annotation Simulation for Zero-shot Named Entity Recognition
par: Kim, Siun, et autres
Publié: (2026)
par: Kim, Siun, et autres
Publié: (2026)
Latent Variable Modeling in Multi-Agent Reinforcement Learning via Expectation-Maximization for UAV-Based Wildlife Protection
par: Taghavi, Mazyar, et autres
Publié: (2025)
par: Taghavi, Mazyar, et autres
Publié: (2025)
ACE : Off-Policy Actor-Critic with Causality-Aware Entropy Regularization
par: Ji, Tianying, et autres
Publié: (2024)
par: Ji, Tianying, et autres
Publié: (2024)
SlotFM: A Motion Foundation Model with Slot Attention for Diverse Downstream Tasks
par: Park, Junyong, et autres
Publié: (2025)
par: Park, Junyong, et autres
Publié: (2025)
Enhancing Stability in Training Conditional Generative Adversarial Networks via Selective Data Matching
par: Kong, Kyeongbo, et autres
Publié: (2021)
par: Kong, Kyeongbo, et autres
Publié: (2021)
Documents similaires
-
Combining LLM decision and RL action selection to improve RL policy for adaptive interventions
par: Karine, Karine, et autres
Publié: (2025) -
StepCountJITAI: simulation environment for RL with application to physical activity adaptive intervention
par: Karine, Karine, et autres
Publié: (2024) -
Heteroscedastic Temporal Variational Autoencoder For Irregular Time Series
par: Shukla, Satya Narayan, et autres
Publié: (2021) -
BOTS: Batch Bayesian Optimization of Extended Thompson Sampling for Severely Episode-Limited RL Settings
par: Karine, Karine, et autres
Publié: (2024) -
Enhancing Adaptive Behavioral Interventions with LLM Inference from Participant-Described States
par: Karine, Karine, et autres
Publié: (2025)