GRACE: Discriminator-Guided Chain-of-Thought Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Khalifa, Muhammad, Logeswaran, Lajanugen, Lee, Moontae, Lee, Honglak, Wang, Lu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Gaming the Judge: Unfaithful Chain-of-Thought Can Undermine Agent Evaluation
di: Khalifa, Muhammad, et al.
Pubblicazione: (2026)
di: Khalifa, Muhammad, et al.
Pubblicazione: (2026)
Process Reward Models That Think
di: Khalifa, Muhammad, et al.
Pubblicazione: (2025)
di: Khalifa, Muhammad, et al.
Pubblicazione: (2025)
Small Language Models Need Strong Verifiers to Self-Correct Reasoning
di: Zhang, Yunxiang, et al.
Pubblicazione: (2024)
di: Zhang, Yunxiang, et al.
Pubblicazione: (2024)
SPRIG: Improving Large Language Model Performance by System Prompt Optimization
di: Zhang, Lechen, et al.
Pubblicazione: (2024)
di: Zhang, Lechen, et al.
Pubblicazione: (2024)
When "A Helpful Assistant" Is Not Really Helpful: Personas in System Prompts Do Not Improve Performances of Large Language Models
di: Zheng, Mingqian, et al.
Pubblicazione: (2023)
di: Zheng, Mingqian, et al.
Pubblicazione: (2023)
Auto-Intent: Automated Intent Discovery and Self-Exploration for Large Language Model Web Agents
di: Kim, Jaekyeom, et al.
Pubblicazione: (2024)
di: Kim, Jaekyeom, et al.
Pubblicazione: (2024)
Revisiting LLM Value Probing Strategies: Are They Robust and Expressive?
di: Shen, Siqi, et al.
Pubblicazione: (2025)
di: Shen, Siqi, et al.
Pubblicazione: (2025)
Understanding the Capabilities and Limitations of Large Language Models for Cultural Commonsense
di: Shen, Siqi, et al.
Pubblicazione: (2024)
di: Shen, Siqi, et al.
Pubblicazione: (2024)
Cross-Lingual Prompt Steerability: Towards Accurate and Robust LLM Behavior across Languages
di: Zhang, Lechen, et al.
Pubblicazione: (2025)
di: Zhang, Lechen, et al.
Pubblicazione: (2025)
MLRC-Bench: Can Language Agents Solve Machine Learning Research Challenges?
di: Zhang, Yunxiang, et al.
Pubblicazione: (2025)
di: Zhang, Yunxiang, et al.
Pubblicazione: (2025)
Visual Test-time Scaling for GUI Agent Grounding
di: Luo, Tiange, et al.
Pubblicazione: (2025)
di: Luo, Tiange, et al.
Pubblicazione: (2025)
You don't need a personality test to know these models are unreliable: Assessing the Reliability of Large Language Models on Psychometric Instruments
di: Shu, Bangzhao, et al.
Pubblicazione: (2023)
di: Shu, Bangzhao, et al.
Pubblicazione: (2023)
Selective LoRA for Visual Tokens and Attention Heads
di: Luo, Tiange, et al.
Pubblicazione: (2025)
di: Luo, Tiange, et al.
Pubblicazione: (2025)
Scaling Web Agent Training through Automatic Data Generation and Fine-grained Evaluation
di: Logeswaran, Lajanugen, et al.
Pubblicazione: (2026)
di: Logeswaran, Lajanugen, et al.
Pubblicazione: (2026)
Scalable Video-to-Dataset Generation for Cross-Platform Mobile Agents
di: Jang, Yunseok, et al.
Pubblicazione: (2025)
di: Jang, Yunseok, et al.
Pubblicazione: (2025)
Source-Aware Training Enables Knowledge Attribution in Language Models
di: Khalifa, Muhammad, et al.
Pubblicazione: (2024)
di: Khalifa, Muhammad, et al.
Pubblicazione: (2024)
Lost in the Noise: How Reasoning Models Fail with Contextual Distractors
di: Lee, Seongyun, et al.
Pubblicazione: (2026)
di: Lee, Seongyun, et al.
Pubblicazione: (2026)
If You Can't Use Them, Recycle Them: Optimizing Merging at Scale Mitigates Performance Tradeoffs
di: Khalifa, Muhammad, et al.
Pubblicazione: (2024)
di: Khalifa, Muhammad, et al.
Pubblicazione: (2024)
DICE: Structured Reasoning in LLMs through SLM-Guided Chain-of-Thought Correction
di: Li, Yiqi, et al.
Pubblicazione: (2025)
di: Li, Yiqi, et al.
Pubblicazione: (2025)
GRACE: Generative Recommendation via Journey-Aware Sparse Attention on Chain-of-Thought Tokenization
di: Ma, Luyi, et al.
Pubblicazione: (2025)
di: Ma, Luyi, et al.
Pubblicazione: (2025)
Value-Guided Search for Efficient Chain-of-Thought Reasoning
di: Wang, Kaiwen, et al.
Pubblicazione: (2025)
di: Wang, Kaiwen, et al.
Pubblicazione: (2025)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
di: Lee, Jooyoung, et al.
Pubblicazione: (2024)
di: Lee, Jooyoung, et al.
Pubblicazione: (2024)
AutoGuide: Automated Generation and Selection of Context-Aware Guidelines for Large Language Model Agents
di: Fu, Yao, et al.
Pubblicazione: (2024)
di: Fu, Yao, et al.
Pubblicazione: (2024)
Latent Chain-of-Thought for Visual Reasoning
di: Sun, Guohao, et al.
Pubblicazione: (2025)
di: Sun, Guohao, et al.
Pubblicazione: (2025)
Strategic Chain-of-Thought: Guiding Accurate Reasoning in LLMs through Strategy Elicitation
di: Wang, Yu, et al.
Pubblicazione: (2024)
di: Wang, Yu, et al.
Pubblicazione: (2024)
LaRS: Latent Reasoning Skills for Chain-of-Thought Reasoning
di: Xu, Zifan, et al.
Pubblicazione: (2023)
di: Xu, Zifan, et al.
Pubblicazione: (2023)
Logit Arithmetic Elicits Long Reasoning Capabilities Without Training
di: Zhang, Yunxiang, et al.
Pubblicazione: (2025)
di: Zhang, Yunxiang, et al.
Pubblicazione: (2025)
Understanding Reasoning in Chain-of-Thought from the Hopfieldian View
di: Hu, Lijie, et al.
Pubblicazione: (2024)
di: Hu, Lijie, et al.
Pubblicazione: (2024)
How does Chain of Thought Think? Mechanistic Interpretability of Chain-of-Thought Reasoning with Sparse Autoencoding
di: Chen, Xi, et al.
Pubblicazione: (2025)
di: Chen, Xi, et al.
Pubblicazione: (2025)
The Molecular Structure of Thought: Mapping the Topology of Long Chain-of-Thought Reasoning
di: Chen, Qiguang, et al.
Pubblicazione: (2026)
di: Chen, Qiguang, et al.
Pubblicazione: (2026)
CAC-CoT: Connector-Aware Compact Chain-of-Thought for Efficient Reasoning Data Synthesis Across Dual-System Cognitive Tasks
di: Choi, Sunguk, et al.
Pubblicazione: (2025)
di: Choi, Sunguk, et al.
Pubblicazione: (2025)
Markov Chain of Thought for Efficient Mathematical Reasoning
di: Yang, Wen, et al.
Pubblicazione: (2024)
di: Yang, Wen, et al.
Pubblicazione: (2024)
Reinforcement Learning from Reflective Feedback (RLRF): Aligning and Improving LLMs via Fine-Grained Self-Reflection
di: Lee, Kyungjae, et al.
Pubblicazione: (2024)
di: Lee, Kyungjae, et al.
Pubblicazione: (2024)
Latent Chain-of-Thought as Planning: Decoupling Reasoning from Verbalization
di: Wang, Jiecong, et al.
Pubblicazione: (2026)
di: Wang, Jiecong, et al.
Pubblicazione: (2026)
Reason Like a Radiologist: Chain-of-Thought and Reinforcement Learning for Verifiable Report Generation
di: Jing, Peiyuan, et al.
Pubblicazione: (2025)
di: Jing, Peiyuan, et al.
Pubblicazione: (2025)
DRT: Deep Reasoning Translation via Long Chain-of-Thought
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
di: Wang, Jiaan, et al.
Pubblicazione: (2024)
Fractured Chain-of-Thought Reasoning
di: Liao, Baohao, et al.
Pubblicazione: (2025)
di: Liao, Baohao, et al.
Pubblicazione: (2025)
ETR: Entropy Trend Reward for Efficient Chain-of-Thought Reasoning
di: Xiong, Xuan, et al.
Pubblicazione: (2026)
di: Xiong, Xuan, et al.
Pubblicazione: (2026)
Latent Chain-of-Thought? Decoding the Depth-Recurrent Transformer
di: Lu, Wenquan, et al.
Pubblicazione: (2025)
di: Lu, Wenquan, et al.
Pubblicazione: (2025)
Enhancing Zero-Shot Chain-of-Thought Reasoning in Large Language Models through Logic
di: Zhao, Xufeng, et al.
Pubblicazione: (2023)
di: Zhao, Xufeng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Gaming the Judge: Unfaithful Chain-of-Thought Can Undermine Agent Evaluation
di: Khalifa, Muhammad, et al.
Pubblicazione: (2026) -
Process Reward Models That Think
di: Khalifa, Muhammad, et al.
Pubblicazione: (2025) -
Small Language Models Need Strong Verifiers to Self-Correct Reasoning
di: Zhang, Yunxiang, et al.
Pubblicazione: (2024) -
SPRIG: Improving Large Language Model Performance by System Prompt Optimization
di: Zhang, Lechen, et al.
Pubblicazione: (2024) -
When "A Helpful Assistant" Is Not Really Helpful: Personas in System Prompts Do Not Improve Performances of Large Language Models
di: Zheng, Mingqian, et al.
Pubblicazione: (2023)