Agentic Uncertainty Reveals Agentic Overconfidence
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kaddour, Jean, Patel, Srijan, Dovonon, Gbètondji, Richter, Leo, Minervini, Pasquale, Kusner, Matt J. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Attention Is All You Need But You Don't Need All Of It For Inference of Large Language Models
par: Tyukin, Georgy, et autres
Publié: (2024)
par: Tyukin, Georgy, et autres
Publié: (2024)
Setting the Record Straight on Transformer Oversmoothing
par: Dovonon, Gbètondji J-S, et autres
Publié: (2024)
par: Dovonon, Gbètondji J-S, et autres
Publié: (2024)
An Auditing Test To Detect Behavioral Shift in Language Models
par: Richter, Leo, et autres
Publié: (2024)
par: Richter, Leo, et autres
Publié: (2024)
When Can Proxies Improve the Sample Complexity of Preference Learning?
par: Zhu, Yuchen, et autres
Publié: (2024)
par: Zhu, Yuchen, et autres
Publié: (2024)
Low-Rank Compression of Language Models via Differentiable Rank Selection
par: Sundrani, Sidhant, et autres
Publié: (2025)
par: Sundrani, Sidhant, et autres
Publié: (2025)
Calibrated Physics-Informed Uncertainty Quantification
par: Gopakumar, Vignesh, et autres
Publié: (2025)
par: Gopakumar, Vignesh, et autres
Publié: (2025)
Causal Machine Learning: A Survey and Open Problems
par: Kaddour, Jean, et autres
Publié: (2022)
par: Kaddour, Jean, et autres
Publié: (2022)
Agentics 2.0: Logical Transduction Algebra for Agentic Data Workflows
par: Gliozzo, Alfio Massimiliano, et autres
Publié: (2026)
par: Gliozzo, Alfio Massimiliano, et autres
Publié: (2026)
Probing the Emergence of Cross-lingual Alignment during LLM Training
par: Wang, Hetong, et autres
Publié: (2024)
par: Wang, Hetong, et autres
Publié: (2024)
Harnessing Agentic Evolution
par: Zhang, Jiayi, et autres
Publié: (2026)
par: Zhang, Jiayi, et autres
Publié: (2026)
On the Independence Assumption in Neurosymbolic Learning
par: van Krieken, Emile, et autres
Publié: (2024)
par: van Krieken, Emile, et autres
Publié: (2024)
SynDARin: Synthesising Datasets for Automated Reasoning in Low-Resource Languages
par: Ghazaryan, Gayane, et autres
Publié: (2024)
par: Ghazaryan, Gayane, et autres
Publié: (2024)
Architectures for Building Agentic AI
par: Nowaczyk, Sławomir
Publié: (2025)
par: Nowaczyk, Sławomir
Publié: (2025)
ACT: Agentic Classification Tree
par: Grari, Vincent, et autres
Publié: (2025)
par: Grari, Vincent, et autres
Publié: (2025)
Agentic Skill Discovery
par: Zhao, Xufeng, et autres
Publié: (2024)
par: Zhao, Xufeng, et autres
Publié: (2024)
Uncalibrated Reasoning: GRPO Induces Overconfidence for Stochastic Outcomes
par: Bereket, Michael, et autres
Publié: (2025)
par: Bereket, Michael, et autres
Publié: (2025)
STRIDE: A Systematic Framework for Selecting AI Modalities -- Agentic AI, AI Assistants, or LLM Calls
par: Asthana, Shubhi, et autres
Publié: (2025)
par: Asthana, Shubhi, et autres
Publié: (2025)
ADR: An Agentic Detection System for Enterprise Agentic AI Security
par: Li, Chenning, et autres
Publié: (2026)
par: Li, Chenning, et autres
Publié: (2026)
Skill Reuse as Compression in Agentic RL
par: Xu, Zhikun, et autres
Publié: (2026)
par: Xu, Zhikun, et autres
Publié: (2026)
Learning to Construct Practical Agentic Systems
par: Kumar, Aditya, et autres
Publié: (2026)
par: Kumar, Aditya, et autres
Publié: (2026)
Sanity Checks for Agentic Data Science
par: Rewolinski, Zachary T., et autres
Publié: (2026)
par: Rewolinski, Zachary T., et autres
Publié: (2026)
UProp: Investigating the Uncertainty Propagation of LLMs in Multi-Step Agentic Decision-Making
par: Duan, Jinhao, et autres
Publié: (2025)
par: Duan, Jinhao, et autres
Publié: (2025)
What Limits Agentic Systems Efficiency?
par: Bian, Song, et autres
Publié: (2025)
par: Bian, Song, et autres
Publié: (2025)
Agentic Additive Manufacturing Alloy Evaluation
par: Pak, Peter, et autres
Publié: (2025)
par: Pak, Peter, et autres
Publié: (2025)
Conditional computation in neural networks: principles and research trends
par: Scardapane, Simone, et autres
Publié: (2024)
par: Scardapane, Simone, et autres
Publié: (2024)
Mitigating Overconfidence in Out-of-Distribution Detection by Capturing Extreme Activations
par: Azizmalayeri, Mohammad, et autres
Publié: (2024)
par: Azizmalayeri, Mohammad, et autres
Publié: (2024)
Optimizing Agentic Workflows using Meta-tools
par: Abuzakuk, Sami, et autres
Publié: (2026)
par: Abuzakuk, Sami, et autres
Publié: (2026)
Agentic Critical Training
par: Liu, Weize, et autres
Publié: (2026)
par: Liu, Weize, et autres
Publié: (2026)
On Randomness in Agentic Evals
par: Bjarnason, Bjarni Haukur, et autres
Publié: (2026)
par: Bjarnason, Bjarni Haukur, et autres
Publié: (2026)
BayesAgent: Bayesian Agentic Reasoning Under Uncertainty via Verbalized Probabilistic Graphical Modeling
par: Huang, Hengguan, et autres
Publié: (2024)
par: Huang, Hengguan, et autres
Publié: (2024)
Supplement Generation Training for Enhancing Agentic Task Performance
par: Cho, Young Min, et autres
Publié: (2026)
par: Cho, Young Min, et autres
Publié: (2026)
Beyond Fluency: Toward Reliable Trajectories in Agentic IR
par: Sinha, Anushree, et autres
Publié: (2026)
par: Sinha, Anushree, et autres
Publié: (2026)
MOSAIC: Modular Orchestration for Structured Agentic Intelligence and Composition
par: Bao, Yifan, et autres
Publié: (2026)
par: Bao, Yifan, et autres
Publié: (2026)
On Effectiveness and Efficiency of Agentic Tool-calling and RL Training
par: Liu, Tong, et autres
Publié: (2026)
par: Liu, Tong, et autres
Publié: (2026)
RMA: an Agentic System for Research-Level Mathematical Problems
par: Zhao, Zelin, et autres
Publié: (2026)
par: Zhao, Zelin, et autres
Publié: (2026)
AMIGO: Agentic Multi-Image Grounding Oracle Benchmark
par: Wang, Min, et autres
Publié: (2026)
par: Wang, Min, et autres
Publié: (2026)
Agentic Risk-Aware Set-Based Engineering Design
par: Kumar, Varun, et autres
Publié: (2026)
par: Kumar, Varun, et autres
Publié: (2026)
Agentic Retrieval of Topics and Insights from Earnings Calls
par: Gupta, Anant, et autres
Publié: (2025)
par: Gupta, Anant, et autres
Publié: (2025)
GeoFlow: Agentic Workflow Automation for Geospatial Tasks
par: Bhattaram, Amulya, et autres
Publié: (2025)
par: Bhattaram, Amulya, et autres
Publié: (2025)
Agentic AI for Mobile Network RAN Management and Optimization
par: Pellejero, Jorge, et autres
Publié: (2025)
par: Pellejero, Jorge, et autres
Publié: (2025)
Documents similaires
-
Attention Is All You Need But You Don't Need All Of It For Inference of Large Language Models
par: Tyukin, Georgy, et autres
Publié: (2024) -
Setting the Record Straight on Transformer Oversmoothing
par: Dovonon, Gbètondji J-S, et autres
Publié: (2024) -
An Auditing Test To Detect Behavioral Shift in Language Models
par: Richter, Leo, et autres
Publié: (2024) -
When Can Proxies Improve the Sample Complexity of Preference Learning?
par: Zhu, Yuchen, et autres
Publié: (2024) -
Low-Rank Compression of Language Models via Differentiable Rank Selection
par: Sundrani, Sidhant, et autres
Publié: (2025)