Structure Enables Effective Self-Localization of Errors in LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Samanta, Ankur, Magesh, Akshayaa, Jain, Ayush, Asadi, Kavosh, Yu, Youliang, Jiang, Daniel, Vidolov, Boris, Hassani, Kaveh, Sajda, Paul, Bhandari, Jalaj, Efroni, Yonathan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Credit Assignment with Resets in Language Model Reasoning
par: Samanta, Ankur, et autres
Publié: (2026)
par: Samanta, Ankur, et autres
Publié: (2026)
Self-Improvement of Language Models by Post-Training on Multi-Agent Debate
par: Samanta, Ankur, et autres
Publié: (2025)
par: Samanta, Ankur, et autres
Publié: (2025)
Imbalanced Gradients in RL Post-Training of Multi-Task LLMs
par: Wu, Runzhe, et autres
Publié: (2025)
par: Wu, Runzhe, et autres
Publié: (2025)
Aligned Multi Objective Optimization
par: Efroni, Yonathan, et autres
Publié: (2025)
par: Efroni, Yonathan, et autres
Publié: (2025)
Hack-Verifiable Environments: Towards Evaluating Reward Hacking at Scale
par: Roth, Amit, et autres
Publié: (2026)
par: Roth, Amit, et autres
Publié: (2026)
Heterogeneous Multi-Player Multi-Armed Bandits Robust To Adversarial Attacks
par: Magesh, Akshayaa, et autres
Publié: (2025)
par: Magesh, Akshayaa, et autres
Publié: (2025)
Principled Detection of Hallucinations in Large Language Models via Multiple Testing
par: Li, Jiawei, et autres
Publié: (2025)
par: Li, Jiawei, et autres
Publié: (2025)
Gradient Free Deep Reinforcement Learning With TabPFN
par: Schiff, David, et autres
Publié: (2025)
par: Schiff, David, et autres
Publié: (2025)
Simple Optimizers for Convex Aligned Multi-Objective Optimization
par: Kretzu, Ben, et autres
Publié: (2025)
par: Kretzu, Ben, et autres
Publié: (2025)
Robust Multi-Hypothesis Testing with Moment Constrained Uncertainty Sets
par: Magesh, Akshayaa, et autres
Publié: (2022)
par: Magesh, Akshayaa, et autres
Publié: (2022)
Gaze patterns predict preference and confidence in pairwise AI image evaluation
par: Papadopoulos, Nikolas, et autres
Publié: (2026)
par: Papadopoulos, Nikolas, et autres
Publié: (2026)
RL in Latent MDPs is Tractable: Online Guarantees via Off-Policy Evaluation
par: Kwon, Jeongyeol, et autres
Publié: (2024)
par: Kwon, Jeongyeol, et autres
Publié: (2024)
The Bias of Harmful Label Associations in Vision-Language Models
par: Hazirbas, Caner, et autres
Publié: (2024)
par: Hazirbas, Caner, et autres
Publié: (2024)
Adjoint sharding for very long context training of state space models
par: Xu, Xingzi, et autres
Publié: (2025)
par: Xu, Xingzi, et autres
Publié: (2025)
Displacement-Resistant Extensions of DPO with Nonconvex $f$-Divergences
par: Pipano, Idan, et autres
Publié: (2026)
par: Pipano, Idan, et autres
Publié: (2026)
Exploiting Structure in Offline Multi-Agent RL: The Benefits of Low Interaction Rank
par: Zhan, Wenhao, et autres
Publié: (2024)
par: Zhan, Wenhao, et autres
Publié: (2024)
Aligning LLMs Toward Multi-Turn Conversational Outcomes Using Iterative PPO
par: Jiang, Daniel R., et autres
Publié: (2025)
par: Jiang, Daniel R., et autres
Publié: (2025)
Learning to Reason Efficiently with Discounted Reinforcement Learning
par: Ayoub, Alex, et autres
Publié: (2025)
par: Ayoub, Alex, et autres
Publié: (2025)
Learning the Target Network in Function Space
par: Asadi, Kavosh, et autres
Publié: (2024)
par: Asadi, Kavosh, et autres
Publié: (2024)
Generalizing Multi-Step Inverse Models for Representation Learning to Finite-Memory POMDPs
par: Wu, Lili, et autres
Publié: (2024)
par: Wu, Lili, et autres
Publié: (2024)
Full-Duplex Beyond Self-Interference: The Unlimited Sensing Way
par: Liu, Ziang, et autres
Publié: (2024)
par: Liu, Ziang, et autres
Publié: (2024)
Pearl: A Production-ready Reinforcement Learning Agent
par: Zhu, Zheqing, et autres
Publié: (2023)
par: Zhu, Zheqing, et autres
Publié: (2023)
Predicting Public Transportation Crowd Using Weather API and Social Media
par: Akshayaa Shree.M, Maheshwari.S
Publié: (2026)
par: Akshayaa Shree.M, Maheshwari.S
Publié: (2026)
Almost Tight Error Bounds on Differentially Private Continual Counting
par: Henzinger, Monika, et autres
Publié: (2022)
par: Henzinger, Monika, et autres
Publié: (2022)
Time After Time: Deep-Q Effect Estimation for Interventions on When and What to do
par: Wald, Yoav, et autres
Publié: (2025)
par: Wald, Yoav, et autres
Publié: (2025)
Ossarth : An Open-Source Customizable LLMOS
par: Magesh, Siddharth
Publié: (2026)
par: Magesh, Siddharth
Publié: (2026)
Unleashing Dynamic Range and Resolution in Unlimited Sensing Framework via Novel Hardware
par: Zhu, Yuliang, et autres
Publié: (2024)
par: Zhu, Yuliang, et autres
Publié: (2024)
Unlimited Sampling of Multiband Signals: Single-Channel Acquisition and Recovery
par: Shtendel, Gal, et autres
Publié: (2025)
par: Shtendel, Gal, et autres
Publié: (2025)
1-Bit Unlimited Sampling Beyond Fourier Domain: Low-Resolution Sampling of Quantization Noise
par: Pavlicek, Vaclav, et autres
Publié: (2025)
par: Pavlicek, Vaclav, et autres
Publié: (2025)
USF Spectral Estimation: Prevalence of Gaussian Cramér-Rao Bounds Despite Modulo Folding
par: Guo, Ruiming, et autres
Publié: (2025)
par: Guo, Ruiming, et autres
Publié: (2025)
Sparse Sampling in Fractional Fourier Domain: Recovery Guarantees and Cramér-Rao Bounds
par: Pavlíček, Václav, et autres
Publié: (2024)
par: Pavlíček, Václav, et autres
Publié: (2024)
Blind Time-of-Flight Imaging: Sparse Deconvolution on the Continuum with Unknown Kernels
par: Guo, Ruiming, et autres
Publié: (2024)
par: Guo, Ruiming, et autres
Publié: (2024)
Unlocking Off-the-Grid Sparse Recovery with Unlimited Sensing: Simultaneous Super-Resolution in Time and Amplitude
par: Guo, Ruiming, et autres
Publié: (2025)
par: Guo, Ruiming, et autres
Publié: (2025)
Enabling Multi-Robot Collaboration from Single-Human Guidance
par: Ji, Zhengran, et autres
Publié: (2024)
par: Ji, Zhengran, et autres
Publié: (2024)
Identification of Potent Molecule for Rifampicin‐Resistant Mycobacterium tuberculosis using Natural Compounds by Structure‐Based Analysis
par: Madhana Priya N, et autres
Publié: (2026)
par: Madhana Priya N, et autres
Publié: (2026)
polyGen: A Learning Framework for Atomic-level Polymer Structure Generation
par: Jain, Ayush, et autres
Publié: (2025)
par: Jain, Ayush, et autres
Publié: (2025)
Exact analysis of potential flow past bodies of irregular shapes
par: Jain, Ankur
Publié: (2025)
par: Jain, Ankur
Publié: (2025)
Detecting Causality with Symplectic Quandles
par: Jain, Ayush
Publié: (2023)
par: Jain, Ayush
Publié: (2023)
Energy‐Related Discussion in Fed Speeches and Options‐Implied Equity Risk Premium
par: Alok Dixit, et autres
Publié: (2026)
par: Alok Dixit, et autres
Publié: (2026)
TAIL: Task-specific Adapters for Imitation Learning with Large Pretrained Models
par: Liu, Zuxin, et autres
Publié: (2023)
par: Liu, Zuxin, et autres
Publié: (2023)
Documents similaires
-
Credit Assignment with Resets in Language Model Reasoning
par: Samanta, Ankur, et autres
Publié: (2026) -
Self-Improvement of Language Models by Post-Training on Multi-Agent Debate
par: Samanta, Ankur, et autres
Publié: (2025) -
Imbalanced Gradients in RL Post-Training of Multi-Task LLMs
par: Wu, Runzhe, et autres
Publié: (2025) -
Aligned Multi Objective Optimization
par: Efroni, Yonathan, et autres
Publié: (2025) -
Hack-Verifiable Environments: Towards Evaluating Reward Hacking at Scale
par: Roth, Amit, et autres
Publié: (2026)