Enregistré dans:
| Auteurs principaux: | Zhao, Wanjia, Yuksekgonul, Mert, Wu, Shirley, Zou, James |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2502.04780 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Inefficiencies of Meta Agents for Agent Design
par: El, Batu, et autres
Publié: (2025)
par: El, Batu, et autres
Publié: (2025)
Cost-of-Pass: An Economic Framework for Evaluating Language Models
par: Erol, Mehmet Hamza, et autres
Publié: (2025)
par: Erol, Mehmet Hamza, et autres
Publié: (2025)
Diversity of Thought Improves Reasoning Abilities of LLMs
par: Naik, Ranjita, et autres
Publié: (2023)
par: Naik, Ranjita, et autres
Publié: (2023)
ZEBRAARENA: A Diagnostic Simulation Environment for Studying Reasoning-Action Coupling in Tool-Augmented LLMs
par: Zhao, Wanjia, et autres
Publié: (2026)
par: Zhao, Wanjia, et autres
Publié: (2026)
TextGrad: Automatic "Differentiation" via Text
par: Yuksekgonul, Mert, et autres
Publié: (2024)
par: Yuksekgonul, Mert, et autres
Publié: (2024)
How Well Can LLMs Negotiate? NegotiationArena Platform and Analysis
par: Bianchi, Federico, et autres
Publié: (2024)
par: Bianchi, Federico, et autres
Publié: (2024)
On Information Self-Locking in Reinforcement Learning for Active Reasoning of LLM agents
par: Zou, Deyu, et autres
Publié: (2026)
par: Zou, Deyu, et autres
Publié: (2026)
GeoAda: Efficiently Finetune Geometric Diffusion Models with Equivariant Adapters
par: Zhao, Wanjia, et autres
Publié: (2025)
par: Zhao, Wanjia, et autres
Publié: (2025)
Can LLM feedback enhance review quality? A randomized study of 20K reviews at ICLR 2025
par: Thakkar, Nitya, et autres
Publié: (2025)
par: Thakkar, Nitya, et autres
Publié: (2025)
Sparse Reward Subsystem in Large Language Models
par: Xu, Guowei, et autres
Publié: (2026)
par: Xu, Guowei, et autres
Publié: (2026)
Learning to Discover at Test Time
par: Yuksekgonul, Mert, et autres
Publié: (2026)
par: Yuksekgonul, Mert, et autres
Publié: (2026)
Step-On-Feet Tuning: Scaling Self-Alignment of LLMs via Bootstrapping
par: Wang, Haoyu, et autres
Publié: (2024)
par: Wang, Haoyu, et autres
Publié: (2024)
CopT: Contrastive On-Policy Thinking with Continuous Spaces for General and Agentic Reasoning
par: Shi, Dachuan, et autres
Publié: (2026)
par: Shi, Dachuan, et autres
Publié: (2026)
Attention Satisfies: A Constraint-Satisfaction Lens on Factual Errors of Language Models
par: Yuksekgonul, Mert, et autres
Publié: (2023)
par: Yuksekgonul, Mert, et autres
Publié: (2023)
The Self-Improvement Paradox: Can Language Models Bootstrap Reasoning Capabilities without External Scaffolding?
par: Sun, Yutao, et autres
Publié: (2025)
par: Sun, Yutao, et autres
Publié: (2025)
AceSearcher: Bootstrapping Reasoning and Search for LLMs via Reinforced Self-Play
par: Xu, Ran, et autres
Publié: (2025)
par: Xu, Ran, et autres
Publié: (2025)
Multi-agent Self-triage System with Medical Flowcharts
par: Liu, Yujia, et autres
Publié: (2025)
par: Liu, Yujia, et autres
Publié: (2025)
Self-Supervised Bootstrapping of Action-Predictive Embodied Reasoning
par: Ganai, Milan, et autres
Publié: (2026)
par: Ganai, Milan, et autres
Publié: (2026)
Learn to Think: Bootstrapping LLM Reasoning Capability Through Graph Representation Learning
par: Gao, Hang, et autres
Publié: (2025)
par: Gao, Hang, et autres
Publié: (2025)
Attention Bootstrapping for Multi-Modal Test-Time Adaptation
par: Zhao, Yusheng, et autres
Publié: (2025)
par: Zhao, Yusheng, et autres
Publié: (2025)
LLMs are Superior Feedback Providers: Bootstrapping Reasoning for Lie Detection with Self-Generated Feedback
par: Banerjee, Tanushree, et autres
Publié: (2024)
par: Banerjee, Tanushree, et autres
Publié: (2024)
metaTextGrad: Automatically optimizing language model optimizers
par: Xu, Guowei, et autres
Publié: (2025)
par: Xu, Guowei, et autres
Publié: (2025)
Reasoning Curriculum: Bootstrapping Broad LLM Reasoning from Math
par: Pang, Bo, et autres
Publié: (2025)
par: Pang, Bo, et autres
Publié: (2025)
AgentPSO: Evolving Agent Reasoning Skill via Multi-agent Particle Swarm Optimization
par: Hwang, Hyunmin, et autres
Publié: (2026)
par: Hwang, Hyunmin, et autres
Publié: (2026)
MARSHAL: Incentivizing Multi-Agent Reasoning via Self-Play with Strategic LLMs
par: Yuan, Huining, et autres
Publié: (2025)
par: Yuan, Huining, et autres
Publié: (2025)
Bootstrapping LLM-based Task-Oriented Dialogue Agents via Self-Talk
par: Ulmer, Dennis, et autres
Publié: (2024)
par: Ulmer, Dennis, et autres
Publié: (2024)
QuantAgents: Towards Multi-agent Financial System via Simulated Trading
par: Li, Xiangyu, et autres
Publié: (2025)
par: Li, Xiangyu, et autres
Publié: (2025)
h1: Bootstrapping LLMs to Reason over Longer Horizons via Reinforcement Learning
par: Motwani, Sumeet Ramesh, et autres
Publié: (2025)
par: Motwani, Sumeet Ramesh, et autres
Publié: (2025)
Physics-Informed Regularization for Domain-Agnostic Dynamical System Modeling
par: Huang, Zijie, et autres
Publié: (2024)
par: Huang, Zijie, et autres
Publié: (2024)
Boosting LLM Reasoning via Spontaneous Self-Correction
par: Zhao, Xutong, et autres
Publié: (2025)
par: Zhao, Xutong, et autres
Publié: (2025)
BOOST: Bootstrapping Strategy-Driven Reasoning Programs for Program-Guided Fact-Checking
par: Hu, Qisheng, et autres
Publié: (2025)
par: Hu, Qisheng, et autres
Publié: (2025)
ReasonOps: Operator Segmentation for LLM Reasoning Traces
par: Lee, Daniel, et autres
Publié: (2026)
par: Lee, Daniel, et autres
Publié: (2026)
MIRROR: Multi-agent Intra- and Inter-Reflection for Optimized Reasoning in Tool Learning
par: Guo, Zikang, et autres
Publié: (2025)
par: Guo, Zikang, et autres
Publié: (2025)
Single-agent or Multi-agent Systems? Why Not Both?
par: Gao, Mingyan, et autres
Publié: (2025)
par: Gao, Mingyan, et autres
Publié: (2025)
PARTNR: A Benchmark for Planning and Reasoning in Embodied Multi-agent Tasks
par: Chang, Matthew, et autres
Publié: (2024)
par: Chang, Matthew, et autres
Publié: (2024)
MeTHanol: Modularized Thinking Language Models with Intermediate Layer Thinking, Decoding and Bootstrapping Reasoning
par: Xi, Ningyuan, et autres
Publié: (2024)
par: Xi, Ningyuan, et autres
Publié: (2024)
DIAGPaper: Diagnosing Valid and Specific Weaknesses in Scientific Papers via Multi-Agent Reasoning
par: Zou, Zhuoyang, et autres
Publié: (2026)
par: Zou, Zhuoyang, et autres
Publié: (2026)
Bootstrapping Imitation Learning for Long-horizon Manipulation via Hierarchical Data Collection Space
par: Yang, Jinrong, et autres
Publié: (2025)
par: Yang, Jinrong, et autres
Publié: (2025)
Enhancing the Efficiency and Accuracy of Underlying Asset Reviews in Structured Finance: The Application of Multi-agent Framework
par: Wan, Xiangpeng, et autres
Publié: (2024)
par: Wan, Xiangpeng, et autres
Publié: (2024)
Visual Attention Reasoning via Hierarchical Search and Self-Verification
par: Cai, Wei, et autres
Publié: (2025)
par: Cai, Wei, et autres
Publié: (2025)
Documents similaires
-
Inefficiencies of Meta Agents for Agent Design
par: El, Batu, et autres
Publié: (2025) -
Cost-of-Pass: An Economic Framework for Evaluating Language Models
par: Erol, Mehmet Hamza, et autres
Publié: (2025) -
Diversity of Thought Improves Reasoning Abilities of LLMs
par: Naik, Ranjita, et autres
Publié: (2023) -
ZEBRAARENA: A Diagnostic Simulation Environment for Studying Reasoning-Action Coupling in Tool-Augmented LLMs
par: Zhao, Wanjia, et autres
Publié: (2026) -
TextGrad: Automatic "Differentiation" via Text
par: Yuksekgonul, Mert, et autres
Publié: (2024)