Efficient Tool Use with Chain-of-Abstraction Reasoning
Fuente:
arXiv
Guardado en:
| Autores principales: | Gao, Silin, Dwivedi-Yu, Jane, Yu, Ping, Tan, Xiaoqing Ellen, Pasunuru, Ramakanth, Golovneva, Olga, Sinha, Koustuv, Celikyilmaz, Asli, Bosselut, Antoine, Wang, Tianlu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Don't throw away your value model! Generating more preferable text with Value-Guided Monte-Carlo Tree Search decoding
por: Liu, Jiacheng, et al.
Publicado: (2023)
por: Liu, Jiacheng, et al.
Publicado: (2023)
AbstRaL: Augmenting LLMs' Reasoning by Reinforcing Abstract Thinking
por: Gao, Silin, et al.
Publicado: (2025)
por: Gao, Silin, et al.
Publicado: (2025)
Multi-Token Attention
por: Golovneva, Olga, et al.
Publicado: (2025)
por: Golovneva, Olga, et al.
Publicado: (2025)
Contextual Position Encoding: Learning to Count What's Important
por: Golovneva, Olga, et al.
Publicado: (2024)
por: Golovneva, Olga, et al.
Publicado: (2024)
Open-Domain Text Evaluation via Contrastive Distribution Methods
por: Lu, Sidi, et al.
Publicado: (2023)
por: Lu, Sidi, et al.
Publicado: (2023)
Self-Taught Evaluators
por: Wang, Tianlu, et al.
Publicado: (2024)
por: Wang, Tianlu, et al.
Publicado: (2024)
Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning
por: Paul, Debjit, et al.
Publicado: (2024)
por: Paul, Debjit, et al.
Publicado: (2024)
CoT-Self-Instruct: Building high-quality synthetic prompts for reasoning and non-reasoning tasks
por: Yu, Ping, et al.
Publicado: (2025)
por: Yu, Ping, et al.
Publicado: (2025)
HoneyBee: Data Recipes for Vision-Language Reasoners
por: Bansal, Hritik, et al.
Publicado: (2025)
por: Bansal, Hritik, et al.
Publicado: (2025)
Designing a Future-Proof Cryptography Strategy for Quantum Computing
por: Sreekanth Pasunuru
Publicado: (2024)
por: Sreekanth Pasunuru
Publicado: (2024)
PERK: Long-Context Reasoning as Parameter-Efficient Test-Time Learning
por: Chen, Zeming, et al.
Publicado: (2025)
por: Chen, Zeming, et al.
Publicado: (2025)
Do LLMs Game Formalization? Evaluating Faithfulness in Logical Reasoning
por: Kim, Kyuhee, et al.
Publicado: (2026)
por: Kim, Kyuhee, et al.
Publicado: (2026)
Adaptive Decoding via Latent Preference Optimization
por: Dhuliawala, Shehzaad, et al.
Publicado: (2024)
por: Dhuliawala, Shehzaad, et al.
Publicado: (2024)
Explore Theory of Mind: Program-guided adversarial data generation for theory of mind reasoning
por: Sclar, Melanie, et al.
Publicado: (2024)
por: Sclar, Melanie, et al.
Publicado: (2024)
DiffuCOMET: Contextual Commonsense Knowledge Diffusion
por: Gao, Silin, et al.
Publicado: (2024)
por: Gao, Silin, et al.
Publicado: (2024)
Self-Improving Pretraining: using post-trained models to pretrain better models
por: Tan, Ellen Xiaoqing, et al.
Publicado: (2026)
por: Tan, Ellen Xiaoqing, et al.
Publicado: (2026)
EgoToM: Benchmarking Theory of Mind Reasoning from Egocentric Videos
por: Li, Yuxuan, et al.
Publicado: (2025)
por: Li, Yuxuan, et al.
Publicado: (2025)
Complex Reasoning over Logical Queries on Commonsense Knowledge Graphs
por: Fang, Tianqing, et al.
Publicado: (2024)
por: Fang, Tianqing, et al.
Publicado: (2024)
FairPair: A Robust Evaluation of Biases in Language Models through Paired Perturbations
por: Dwivedi-Yu, Jane, et al.
Publicado: (2024)
por: Dwivedi-Yu, Jane, et al.
Publicado: (2024)
RLCD: Reinforcement Learning from Contrastive Distillation for Language Model Alignment
por: Yang, Kevin, et al.
Publicado: (2023)
por: Yang, Kevin, et al.
Publicado: (2023)
R.I.P.: Better Models by Survival of the Fittest Prompts
por: Yu, Ping, et al.
Publicado: (2025)
por: Yu, Ping, et al.
Publicado: (2025)
Retrieval-Based Interleaved Visual Chain-of-Thought in Real-World Driving Scenarios
por: Corbière, Charles, et al.
Publicado: (2025)
por: Corbière, Charles, et al.
Publicado: (2025)
ComperDial: Commonsense Persona-grounded Dialogue Dataset and Benchmark
por: Wakaki, Hiromi, et al.
Publicado: (2024)
por: Wakaki, Hiromi, et al.
Publicado: (2024)
Brittlebench: Quantifying LLM robustness via prompt sensitivity
por: Romanou, Angelika, et al.
Publicado: (2026)
por: Romanou, Angelika, et al.
Publicado: (2026)
StepWiser: Stepwise Generative Judges for Wiser Reasoning
por: Xiong, Wei, et al.
Publicado: (2025)
por: Xiong, Wei, et al.
Publicado: (2025)
Improving Chain-of-Thought Reasoning via Quasi-Symbolic Abstractions
por: Ranaldi, Leonardo, et al.
Publicado: (2025)
por: Ranaldi, Leonardo, et al.
Publicado: (2025)
RLMEval: Evaluating Research-Level Neural Theorem Proving
por: Poiroux, Auguste, et al.
Publicado: (2025)
por: Poiroux, Auguste, et al.
Publicado: (2025)
Crosscoding Through Time: Tracking Emergence & Consolidation Of Linguistic Representations Throughout LLM Pretraining
por: Bayazit, Deniz, et al.
Publicado: (2025)
por: Bayazit, Deniz, et al.
Publicado: (2025)
Tracking the Limits of Knowledge Propagation: How LLMs Fail at Multi-Step Reasoning with Conflicting Knowledge
por: Feng, Yiyang, et al.
Publicado: (2026)
por: Feng, Yiyang, et al.
Publicado: (2026)
The Majority is not always right: RL training for solution aggregation
por: Zhao, Wenting, et al.
Publicado: (2025)
por: Zhao, Wenting, et al.
Publicado: (2025)
reWordBench: Benchmarking and Improving the Robustness of Reward Models with Transformed Inputs
por: Wu, Zhaofeng, et al.
Publicado: (2025)
por: Wu, Zhaofeng, et al.
Publicado: (2025)
Learning to Interrupt in Language-based Multi-agent Communication
por: Wang, Danqing, et al.
Publicado: (2026)
por: Wang, Danqing, et al.
Publicado: (2026)
Branch-Solve-Merge Improves Large Language Model Evaluation and Generation
por: Saha, Swarnadeep, et al.
Publicado: (2023)
por: Saha, Swarnadeep, et al.
Publicado: (2023)
CausalVQA: A Physically Grounded Causal Reasoning Benchmark for Video Models
por: Foss, Aaron, et al.
Publicado: (2025)
por: Foss, Aaron, et al.
Publicado: (2025)
Reverse Training to Nurse the Reversal Curse
por: Golovneva, Olga, et al.
Publicado: (2024)
por: Golovneva, Olga, et al.
Publicado: (2024)
VinaBench: Benchmark for Faithful and Consistent Visual Narratives
por: Gao, Silin, et al.
Publicado: (2025)
por: Gao, Silin, et al.
Publicado: (2025)
TOOLVERIFIER: Generalization to New Tools via Self-Verification
por: Mekala, Dheeraj, et al.
Publicado: (2024)
por: Mekala, Dheeraj, et al.
Publicado: (2024)
Mixture of Cognitive Reasoners: Modular Reasoning with Brain-Like Specialization
por: AlKhamissi, Badr, et al.
Publicado: (2025)
por: AlKhamissi, Badr, et al.
Publicado: (2025)
Exploring Defeasibility in Causal Reasoning
por: Cui, Shaobo, et al.
Publicado: (2024)
por: Cui, Shaobo, et al.
Publicado: (2024)
Explainable Chain-of-Thought Reasoning: An Empirical Analysis on State-Aware Reasoning Dynamics
por: Yu, Sheldon, et al.
Publicado: (2025)
por: Yu, Sheldon, et al.
Publicado: (2025)
Ejemplares similares
-
Don't throw away your value model! Generating more preferable text with Value-Guided Monte-Carlo Tree Search decoding
por: Liu, Jiacheng, et al.
Publicado: (2023) -
AbstRaL: Augmenting LLMs' Reasoning by Reinforcing Abstract Thinking
por: Gao, Silin, et al.
Publicado: (2025) -
Multi-Token Attention
por: Golovneva, Olga, et al.
Publicado: (2025) -
Contextual Position Encoding: Learning to Count What's Important
por: Golovneva, Olga, et al.
Publicado: (2024) -
Open-Domain Text Evaluation via Contrastive Distribution Methods
por: Lu, Sidi, et al.
Publicado: (2023)