Abstract Counterfactuals for Language Model Agents
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Pona, Edoardo, Kazemi, Milad, Du, Yali, Watson, David, Paoletti, Nicola |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Calibrate-Then-Delegate: Safety Monitoring with Risk and Budget Guarantees via Model Cascades
von: Pona, Edoardo, et al.
Veröffentlicht: (2026)
von: Pona, Edoardo, et al.
Veröffentlicht: (2026)
CONFEX: Uncertainty-Aware Counterfactual Explanations with Conformal Guarantees
von: Bilkhoo, Aman, et al.
Veröffentlicht: (2025)
von: Bilkhoo, Aman, et al.
Veröffentlicht: (2025)
Physics-Informed Neural Operators for Cardiac Electrophysiology
von: Lydon, Hannah, et al.
Veröffentlicht: (2025)
von: Lydon, Hannah, et al.
Veröffentlicht: (2025)
Conformal Off-Policy Prediction for Multi-Agent Systems
von: Kuipers, Tom, et al.
Veröffentlicht: (2024)
von: Kuipers, Tom, et al.
Veröffentlicht: (2024)
Robust Counterfactual Inference in Markov Decision Processes
von: Lally, Jessica, et al.
Veröffentlicht: (2025)
von: Lally, Jessica, et al.
Veröffentlicht: (2025)
Causal Temporal Reasoning for Markov Decision Processes
von: Kazemi, Milad, et al.
Veröffentlicht: (2022)
von: Kazemi, Milad, et al.
Veröffentlicht: (2022)
Counterfactual Influence in Markov Decision Processes
von: Kazemi, Milad, et al.
Veröffentlicht: (2024)
von: Kazemi, Milad, et al.
Veröffentlicht: (2024)
Towards Personalized Treatment Plan: Geometrical Model-Agnostic Approach to Counterfactual Explanations
von: Sin, Daniel, et al.
Veröffentlicht: (2025)
von: Sin, Daniel, et al.
Veröffentlicht: (2025)
All Language Models Large and Small
von: Chen, Zhixun, et al.
Veröffentlicht: (2024)
von: Chen, Zhixun, et al.
Veröffentlicht: (2024)
Certified Guidance for Planning with Deep Generative Models
von: Giacomarra, Francesco, et al.
Veröffentlicht: (2025)
von: Giacomarra, Francesco, et al.
Veröffentlicht: (2025)
Reliable Inference in Edge-Cloud Model Cascades via Conformal Alignment
von: Huang, Jiayi, et al.
Veröffentlicht: (2025)
von: Huang, Jiayi, et al.
Veröffentlicht: (2025)
Exogenous Isomorphism for Counterfactual Identifiability
von: Chen, Yikang, et al.
Veröffentlicht: (2025)
von: Chen, Yikang, et al.
Veröffentlicht: (2025)
Learning Instruction-Following Policies through Open-Ended Instruction Relabeling with Large Language Models
von: Zhang, Zhicheng, et al.
Veröffentlicht: (2025)
von: Zhang, Zhicheng, et al.
Veröffentlicht: (2025)
Safe Reinforcement Learning with Free-form Natural Language Constraints and Pre-Trained Language Models
von: Lou, Xingzhou, et al.
Veröffentlicht: (2024)
von: Lou, Xingzhou, et al.
Veröffentlicht: (2024)
Remote Timing Attacks on Efficient Language Model Inference
von: Carlini, Nicholas, et al.
Veröffentlicht: (2024)
von: Carlini, Nicholas, et al.
Veröffentlicht: (2024)
SimICD: A Closed-Loop Simulation Framework For ICD Therapy
von: Lydon, Hannah, et al.
Veröffentlicht: (2025)
von: Lydon, Hannah, et al.
Veröffentlicht: (2025)
Polaris: A Gödel Agent Framework for Small Language Models through Experience-Abstracted Policy Repair
von: Kakade, Aditya, et al.
Veröffentlicht: (2026)
von: Kakade, Aditya, et al.
Veröffentlicht: (2026)
Explaining an Agent's Future Beliefs through Temporally Decomposing Future Reward Estimators
von: Towers, Mark, et al.
Veröffentlicht: (2024)
von: Towers, Mark, et al.
Veröffentlicht: (2024)
Counterfactual Fairness by Combining Factual and Counterfactual Predictions
von: Zhou, Zeyu, et al.
Veröffentlicht: (2024)
von: Zhou, Zeyu, et al.
Veröffentlicht: (2024)
Learning to Orchestrate Agents in Natural Language with the Conductor
von: Nielsen, Stefan, et al.
Veröffentlicht: (2025)
von: Nielsen, Stefan, et al.
Veröffentlicht: (2025)
Flow-based Generative Modeling of Potential Outcomes and Counterfactuals
von: Wu, Dongze, et al.
Veröffentlicht: (2025)
von: Wu, Dongze, et al.
Veröffentlicht: (2025)
Ensemble Value Functions for Efficient Exploration in Multi-Agent Reinforcement Learning
von: Schäfer, Lukas, et al.
Veröffentlicht: (2023)
von: Schäfer, Lukas, et al.
Veröffentlicht: (2023)
ECOR: Explainable CLIP for Object Recognition
von: Rasekh, Ali, et al.
Veröffentlicht: (2024)
von: Rasekh, Ali, et al.
Veröffentlicht: (2024)
Graph Diffusion Counterfactual Explanation
von: Bechtoldt, David, et al.
Veröffentlicht: (2025)
von: Bechtoldt, David, et al.
Veröffentlicht: (2025)
CASCADE: Case-Based Continual Adaptation for Large Language Models During Deployment
von: Guo, Siyuan, et al.
Veröffentlicht: (2026)
von: Guo, Siyuan, et al.
Veröffentlicht: (2026)
Exogenous Matching: Learning Good Proposals for Tractable Counterfactual Estimation
von: Chen, Yikang, et al.
Veröffentlicht: (2024)
von: Chen, Yikang, et al.
Veröffentlicht: (2024)
Distilling Calibration via Conformalized Credal Inference
von: Huang, Jiayi, et al.
Veröffentlicht: (2025)
von: Huang, Jiayi, et al.
Veröffentlicht: (2025)
Gumbel Counterfactual Generation From Language Models
von: Ravfogel, Shauli, et al.
Veröffentlicht: (2024)
von: Ravfogel, Shauli, et al.
Veröffentlicht: (2024)
Counterfactual Token Generation in Large Language Models
von: Chatzi, Ivi, et al.
Veröffentlicht: (2024)
von: Chatzi, Ivi, et al.
Veröffentlicht: (2024)
Hunt Instead of Wait: Evaluating Deep Data Research on Large Language Models
von: Liu, Wei, et al.
Veröffentlicht: (2026)
von: Liu, Wei, et al.
Veröffentlicht: (2026)
A Single Neuron Is Sufficient to Bypass Safety Alignment in Large Language Models
von: Kazemi, Hamid, et al.
Veröffentlicht: (2026)
von: Kazemi, Hamid, et al.
Veröffentlicht: (2026)
VLP: Vision-Language Preference Learning for Embodied Manipulation
von: Liu, Runze, et al.
Veröffentlicht: (2025)
von: Liu, Runze, et al.
Veröffentlicht: (2025)
CausalGaze: Unveiling Hallucinations via Counterfactual Graph Intervention in Large Language Models
von: Kong, Linggang, et al.
Veröffentlicht: (2026)
von: Kong, Linggang, et al.
Veröffentlicht: (2026)
Ablation Based Counterfactuals
von: Dai, Zheng, et al.
Veröffentlicht: (2024)
von: Dai, Zheng, et al.
Veröffentlicht: (2024)
Learning Robust Social Strategies with Large Language Models
von: Piche, Dereck, et al.
Veröffentlicht: (2025)
von: Piche, Dereck, et al.
Veröffentlicht: (2025)
NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement Learning
von: Liu, Wei, et al.
Veröffentlicht: (2025)
von: Liu, Wei, et al.
Veröffentlicht: (2025)
RAT: Adversarial Attacks on Deep Reinforcement Agents for Targeted Behaviors
von: Bai, Fengshuo, et al.
Veröffentlicht: (2024)
von: Bai, Fengshuo, et al.
Veröffentlicht: (2024)
Generative Myopia: Why Diffusion Models Fail at Structure
von: Siami, Milad
Veröffentlicht: (2025)
von: Siami, Milad
Veröffentlicht: (2025)
CARE-ECG: Causal Agent-based Reasoning for Explainable and Counterfactual ECG Interpretation
von: Khatibi, Elahe, et al.
Veröffentlicht: (2026)
von: Khatibi, Elahe, et al.
Veröffentlicht: (2026)
Counterfactual Reasoning for Steerable Pluralistic Value Alignment of Large Language Models
von: Guo, Hanze, et al.
Veröffentlicht: (2025)
von: Guo, Hanze, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Calibrate-Then-Delegate: Safety Monitoring with Risk and Budget Guarantees via Model Cascades
von: Pona, Edoardo, et al.
Veröffentlicht: (2026) -
CONFEX: Uncertainty-Aware Counterfactual Explanations with Conformal Guarantees
von: Bilkhoo, Aman, et al.
Veröffentlicht: (2025) -
Physics-Informed Neural Operators for Cardiac Electrophysiology
von: Lydon, Hannah, et al.
Veröffentlicht: (2025) -
Conformal Off-Policy Prediction for Multi-Agent Systems
von: Kuipers, Tom, et al.
Veröffentlicht: (2024) -
Robust Counterfactual Inference in Markov Decision Processes
von: Lally, Jessica, et al.
Veröffentlicht: (2025)