Enregistré dans:
| Auteurs principaux: | Khan, Zaid, Chen, Justin Chih-Yao, Cho, Jaemin, Stengel-Eskin, Elias, Bansal, Mohit |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2605.31464 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DataEnvGym: Data Generation Agents in Teacher Environments with Student Feedback
par: Khan, Zaid, et autres
Publié: (2024)
par: Khan, Zaid, et autres
Publié: (2024)
One Life to Learn: Inferring Symbolic World Models for Stochastic Environments from Unguided Exploration
par: Khan, Zaid, et autres
Publié: (2025)
par: Khan, Zaid, et autres
Publié: (2025)
Executable Functional Abstractions: Inferring Generative Programs for Advanced Math Problems
par: Khan, Zaid, et autres
Publié: (2025)
par: Khan, Zaid, et autres
Publié: (2025)
Contrastive Region Guidance: Improving Grounding in Vision-Language Models without Training
par: Wan, David, et autres
Publié: (2024)
par: Wan, David, et autres
Publié: (2024)
Learning to Generate Unit Tests for Automated Debugging
par: Prasad, Archiki, et autres
Publié: (2025)
par: Prasad, Archiki, et autres
Publié: (2025)
PRInTS: Reward Modeling for Long-Horizon Information Seeking
par: Lee, Jaewoo, et autres
Publié: (2025)
par: Lee, Jaewoo, et autres
Publié: (2025)
RotBench: Evaluating Multimodal Large Language Models on Identifying Image Rotation
par: Niu, Tianyi, et autres
Publié: (2025)
par: Niu, Tianyi, et autres
Publié: (2025)
CAPTURe: Evaluating Spatial Reasoning in Vision Language Models via Occluded Object Counting
par: Pothiraj, Atin, et autres
Publié: (2025)
par: Pothiraj, Atin, et autres
Publié: (2025)
Cog-DRIFT: Exploration on Adaptively Reformulated Instances Enables Learning from Hard Reasoning Problems
par: Chen, Justin Chih-Yao, et autres
Publié: (2026)
par: Chen, Justin Chih-Yao, et autres
Publié: (2026)
UPCORE: Utility-Preserving Coreset Selection for Balanced Unlearning
par: Patil, Vaidehi, et autres
Publié: (2025)
par: Patil, Vaidehi, et autres
Publié: (2025)
System-1.x: Learning to Balance Fast and Slow Planning with Language Models
par: Saha, Swarnadeep, et autres
Publié: (2024)
par: Saha, Swarnadeep, et autres
Publié: (2024)
Skill-Based Mixture-of-Experts: Adaptive Routing for Heterogeneous Reasoning via Inferred Skills
par: Chen, Justin Chih-Yao, et autres
Publié: (2025)
par: Chen, Justin Chih-Yao, et autres
Publié: (2025)
Rephrase, Augment, Reason: Visual Grounding of Questions for Vision-Language Models
par: Prasad, Archiki, et autres
Publié: (2023)
par: Prasad, Archiki, et autres
Publié: (2023)
Soft Self-Consistency Improves Language Model Agents
par: Wang, Han, et autres
Publié: (2024)
par: Wang, Han, et autres
Publié: (2024)
Multi-Attribute Steering of Language Models via Targeted Intervention
par: Nguyen, Duy, et autres
Publié: (2025)
par: Nguyen, Duy, et autres
Publié: (2025)
Playing Along: Learning a Double-Agent Defender for Belief Steering via Theory of Mind
par: Xiao, Hanqi, et autres
Publié: (2026)
par: Xiao, Hanqi, et autres
Publié: (2026)
MAMM-Refine: A Recipe for Improving Faithfulness in Generation with Multi-Agent Collaboration
par: Wan, David, et autres
Publié: (2025)
par: Wan, David, et autres
Publié: (2025)
Language Models Identify Ambiguities and Exploit Loopholes
par: Choi, Jio, et autres
Publié: (2025)
par: Choi, Jio, et autres
Publié: (2025)
Think Right: Learning to Mitigate Under-Over Thinking via Adaptive, Attentive Compression
par: Singh, Joykirat, et autres
Publié: (2025)
par: Singh, Joykirat, et autres
Publié: (2025)
LACIE: Listener-Aware Finetuning for Confidence Calibration in Large Language Models
par: Stengel-Eskin, Elias, et autres
Publié: (2024)
par: Stengel-Eskin, Elias, et autres
Publié: (2024)
ReGAL: Refactoring Programs to Discover Generalizable Abstractions
par: Stengel-Eskin, Elias, et autres
Publié: (2024)
par: Stengel-Eskin, Elias, et autres
Publié: (2024)
Teaching Models to Balance Resisting and Accepting Persuasion
par: Stengel-Eskin, Elias, et autres
Publié: (2024)
par: Stengel-Eskin, Elias, et autres
Publié: (2024)
Agent-BRACE: Decoupling Beliefs from Actions in Long-Horizon Tasks via Verbalized State Uncertainty
par: Singh, Joykirat, et autres
Publié: (2026)
par: Singh, Joykirat, et autres
Publié: (2026)
Task-Circuit Quantization: Leveraging Knowledge Localization and Interpretability for Compression
par: Xiao, Hanqi, et autres
Publié: (2025)
par: Xiao, Hanqi, et autres
Publié: (2025)
The Sum Leaks More Than Its Parts: Compositional Privacy Risks and Mitigations in Multi-Agent Collaboration
par: Patil, Vaidehi, et autres
Publié: (2025)
par: Patil, Vaidehi, et autres
Publié: (2025)
Routing with Generated Data: Annotation-Free LLM Skill Estimation and Expert Selection
par: Niu, Tianyi, et autres
Publié: (2026)
par: Niu, Tianyi, et autres
Publié: (2026)
Are language models rational? The case of coherence norms and belief revision
par: Hofweber, Thomas, et autres
Publié: (2024)
par: Hofweber, Thomas, et autres
Publié: (2024)
Retrieval-Augmented Generation with Conflicting Evidence
par: Wang, Han, et autres
Publié: (2025)
par: Wang, Han, et autres
Publié: (2025)
AVSD: Adaptive-View Self-Distillation by Balancing Consensus and Teacher-Specific Privileged Signals
par: Nguyen, Duy, et autres
Publié: (2026)
par: Nguyen, Duy, et autres
Publié: (2026)
See It from My Perspective: How Language Affects Cultural Bias in Image Understanding
par: Ananthram, Amith, et autres
Publié: (2024)
par: Ananthram, Amith, et autres
Publié: (2024)
Generalized Correctness Models: Learning Calibrated and Model-Agnostic Correctness Predictors from Historical Patterns
par: Xiao, Hanqi, et autres
Publié: (2025)
par: Xiao, Hanqi, et autres
Publié: (2025)
GrAInS: Gradient-based Attribution for Inference-Time Steering of LLMs and VLMs
par: Nguyen, Duy, et autres
Publié: (2025)
par: Nguyen, Duy, et autres
Publié: (2025)
Fundamental Problems With Model Editing: How Should Rational Belief Revision Work in LLMs?
par: Hase, Peter, et autres
Publié: (2024)
par: Hase, Peter, et autres
Publié: (2024)
DART: Leveraging Multi-Agent Disagreement for Tool Recruitment in Multimodal Reasoning
par: Sivakumaran, Nithin, et autres
Publié: (2025)
par: Sivakumaran, Nithin, et autres
Publié: (2025)
MAGDi: Structured Distillation of Multi-Agent Interaction Graphs Improves Reasoning in Smaller Language Models
par: Chen, Justin Chih-Yao, et autres
Publié: (2024)
par: Chen, Justin Chih-Yao, et autres
Publié: (2024)
LASeR: Learning to Adaptively Select Reward Models with Multi-Armed Bandits
par: Nguyen, Duy, et autres
Publié: (2024)
par: Nguyen, Duy, et autres
Publié: (2024)
GenerationPrograms: Fine-grained Attribution with Executable Programs
par: Wan, David, et autres
Publié: (2025)
par: Wan, David, et autres
Publié: (2025)
ReConcile: Round-Table Conference Improves Reasoning via Consensus among Diverse LLMs
par: Chen, Justin Chih-Yao, et autres
Publié: (2023)
par: Chen, Justin Chih-Yao, et autres
Publié: (2023)
Ctrl-Adapter: An Efficient and Versatile Framework for Adapting Diverse Controls to Any Diffusion Model
par: Lin, Han, et autres
Publié: (2024)
par: Lin, Han, et autres
Publié: (2024)
GTBench: Uncovering the Strategic Reasoning Limitations of LLMs via Game-Theoretic Evaluations
par: Duan, Jinhao, et autres
Publié: (2024)
par: Duan, Jinhao, et autres
Publié: (2024)
Documents similaires
-
DataEnvGym: Data Generation Agents in Teacher Environments with Student Feedback
par: Khan, Zaid, et autres
Publié: (2024) -
One Life to Learn: Inferring Symbolic World Models for Stochastic Environments from Unguided Exploration
par: Khan, Zaid, et autres
Publié: (2025) -
Executable Functional Abstractions: Inferring Generative Programs for Advanced Math Problems
par: Khan, Zaid, et autres
Publié: (2025) -
Contrastive Region Guidance: Improving Grounding in Vision-Language Models without Training
par: Wan, David, et autres
Publié: (2024) -
Learning to Generate Unit Tests for Automated Debugging
par: Prasad, Archiki, et autres
Publié: (2025)