Salvato in:
| Autori principali: | Zhu, Fangwei, Sui, Zhifang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.04246 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Chain-of-Thought Tokens are Computer Program Variables
di: Zhu, Fangwei, et al.
Pubblicazione: (2025)
di: Zhu, Fangwei, et al.
Pubblicazione: (2025)
Reducing Hallucinations in Entity Abstract Summarization with Facts-Template Decomposition
di: Zhu, Fangwei, et al.
Pubblicazione: (2024)
di: Zhu, Fangwei, et al.
Pubblicazione: (2024)
Language Models Encode the Value of Numbers Linearly
di: Zhu, Fangwei, et al.
Pubblicazione: (2024)
di: Zhu, Fangwei, et al.
Pubblicazione: (2024)
RICo: Refined In-Context Contribution for Automatic Instruction-Tuning Data Selection
di: Yang, Yixin, et al.
Pubblicazione: (2025)
di: Yang, Yixin, et al.
Pubblicazione: (2025)
Chip-Tuning: Classify Before Language Models Say
di: Zhu, Fangwei, et al.
Pubblicazione: (2024)
di: Zhu, Fangwei, et al.
Pubblicazione: (2024)
SCRIBE: Structured Chain Reasoning for Interactive Behaviour Explanations using Tool Calling
di: Fawzi, Fares, et al.
Pubblicazione: (2025)
di: Fawzi, Fares, et al.
Pubblicazione: (2025)
CoLT: The conditional localization test for assessing the accuracy of neural posterior estimates
di: Chen, Tianyu, et al.
Pubblicazione: (2025)
di: Chen, Tianyu, et al.
Pubblicazione: (2025)
Chain-of-Tools: Utilizing Massive Unseen Tools in the CoT Reasoning of Frozen Language Models
di: Wu, Mengsong, et al.
Pubblicazione: (2025)
di: Wu, Mengsong, et al.
Pubblicazione: (2025)
Latent Preference Modeling for Cross-Session Personalized Tool Calling
di: Yoon, Yejin, et al.
Pubblicazione: (2026)
di: Yoon, Yejin, et al.
Pubblicazione: (2026)
CoMet: Metaphor-Driven Covert Communication for Multi-Agent Language Games
di: Xu, Shuhang, et al.
Pubblicazione: (2025)
di: Xu, Shuhang, et al.
Pubblicazione: (2025)
SCoRE: Benchmarking Long-Chain Reasoning in Commonsense Scenarios
di: Zhan, Weidong, et al.
Pubblicazione: (2025)
di: Zhan, Weidong, et al.
Pubblicazione: (2025)
LLM Latent Reasoning as Chain of Superposition
di: Deng, Jingcheng, et al.
Pubblicazione: (2025)
di: Deng, Jingcheng, et al.
Pubblicazione: (2025)
Exploring Activation Patterns of Parameters in Language Models
di: Wang, Yudong, et al.
Pubblicazione: (2024)
di: Wang, Yudong, et al.
Pubblicazione: (2024)
CoUDA: Coherence Evaluation via Unified Data Augmentation
di: Zhu, Dawei, et al.
Pubblicazione: (2024)
di: Zhu, Dawei, et al.
Pubblicazione: (2024)
SelfBudgeter: Adaptive Token Allocation for Efficient LLM Reasoning
di: Li, Zheng, et al.
Pubblicazione: (2025)
di: Li, Zheng, et al.
Pubblicazione: (2025)
How Far are LLMs from Being Our Digital Twins? A Benchmark for Persona-Based Behavior Chain Simulation
di: Li, Rui, et al.
Pubblicazione: (2025)
di: Li, Rui, et al.
Pubblicazione: (2025)
When2Call: When (not) to Call Tools
di: Ross, Hayley, et al.
Pubblicazione: (2025)
di: Ross, Hayley, et al.
Pubblicazione: (2025)
Reinforced Context Order Recovery for Adaptive Reasoning and Planning
di: Ma, Long, et al.
Pubblicazione: (2025)
di: Ma, Long, et al.
Pubblicazione: (2025)
HistLens: Mapping Idea Change across Concepts and Corpora
di: Jing, Yi, et al.
Pubblicazione: (2026)
di: Jing, Yi, et al.
Pubblicazione: (2026)
Towards Better RL Training Data Utilization via Second-Order Rollout
di: Yang, Zhe, et al.
Pubblicazione: (2026)
di: Yang, Zhe, et al.
Pubblicazione: (2026)
Not All Demonstration Examples are Equally Beneficial: Reweighting Demonstration Examples for In-Context Learning
di: Yang, Zhe, et al.
Pubblicazione: (2023)
di: Yang, Zhe, et al.
Pubblicazione: (2023)
Latent Chain-of-Thought for Visual Reasoning
di: Sun, Guohao, et al.
Pubblicazione: (2025)
di: Sun, Guohao, et al.
Pubblicazione: (2025)
Efficient Tool Use with Chain-of-Abstraction Reasoning
di: Gao, Silin, et al.
Pubblicazione: (2024)
di: Gao, Silin, et al.
Pubblicazione: (2024)
L2V-CoT: Cross-Modal Transfer of Chain-of-Thought Reasoning via Latent Intervention
di: Zhan, Yuliang, et al.
Pubblicazione: (2025)
di: Zhan, Yuliang, et al.
Pubblicazione: (2025)
LLM Agents Already Know When to Call Tools -- Even Without Reasoning
di: Sun, Chung-En, et al.
Pubblicazione: (2026)
di: Sun, Chung-En, et al.
Pubblicazione: (2026)
CoT-Evo: Evolutionary Distillation of Chain-of-Thought for Scientific Reasoning
di: Feng, Kehua, et al.
Pubblicazione: (2025)
di: Feng, Kehua, et al.
Pubblicazione: (2025)
Alignment for Efficient Tool Calling of Large Language Models
di: Xu, Hongshen, et al.
Pubblicazione: (2025)
di: Xu, Hongshen, et al.
Pubblicazione: (2025)
LaRS: Latent Reasoning Skills for Chain-of-Thought Reasoning
di: Xu, Zifan, et al.
Pubblicazione: (2023)
di: Xu, Zifan, et al.
Pubblicazione: (2023)
From Mathematical Reasoning to Code: Generalization of Process Reward Models in Test-Time Scaling
di: Chen, Zhengyu, et al.
Pubblicazione: (2025)
di: Chen, Zhengyu, et al.
Pubblicazione: (2025)
Reasoning Beyond Language: A Comprehensive Survey on Latent Chain-of-Thought Reasoning
di: Chen, Xinghao, et al.
Pubblicazione: (2025)
di: Chen, Xinghao, et al.
Pubblicazione: (2025)
Selective Latent Thinking: Adaptive Compression of LLM Reasoning Chains
di: Xie, Hui, et al.
Pubblicazione: (2026)
di: Xie, Hui, et al.
Pubblicazione: (2026)
PruneTIR: Inference-Time Tool Call Pruning for Effective yet Efficient Tool-Integrated Reasoning
di: Zhang, Luan, et al.
Pubblicazione: (2026)
di: Zhang, Luan, et al.
Pubblicazione: (2026)
HauntAttack: When Attack Follows Reasoning as a Shadow
di: Ma, Jingyuan, et al.
Pubblicazione: (2025)
di: Ma, Jingyuan, et al.
Pubblicazione: (2025)
Plug-and-Play Training Framework for Preference Optimization
di: Ma, Jingyuan, et al.
Pubblicazione: (2024)
di: Ma, Jingyuan, et al.
Pubblicazione: (2024)
Enhancing Reliability across Short and Long-Form QA via Reinforcement Learning
di: Wang, Yudong, et al.
Pubblicazione: (2025)
di: Wang, Yudong, et al.
Pubblicazione: (2025)
Can Large Multimodal Models Uncover Deep Semantics Behind Images?
di: Yang, Yixin, et al.
Pubblicazione: (2024)
di: Yang, Yixin, et al.
Pubblicazione: (2024)
Thinking Without Words: Efficient Latent Reasoning with Abstract Chain-of-Thought
di: Ramji, Keshav, et al.
Pubblicazione: (2026)
di: Ramji, Keshav, et al.
Pubblicazione: (2026)
The Landscape of Emerging AI Agent Architectures for Reasoning, Planning, and Tool Calling: A Survey
di: Masterman, Tula, et al.
Pubblicazione: (2024)
di: Masterman, Tula, et al.
Pubblicazione: (2024)
Fine-Tuning on Diverse Reasoning Chains Drives Within-Inference CoT Refinement in LLMs
di: Puerto, Haritz, et al.
Pubblicazione: (2024)
di: Puerto, Haritz, et al.
Pubblicazione: (2024)
Decompose, Look, and Reason: Reinforced Latent Reasoning for VLMs
di: Zhu, Mengdan, et al.
Pubblicazione: (2026)
di: Zhu, Mengdan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Chain-of-Thought Tokens are Computer Program Variables
di: Zhu, Fangwei, et al.
Pubblicazione: (2025) -
Reducing Hallucinations in Entity Abstract Summarization with Facts-Template Decomposition
di: Zhu, Fangwei, et al.
Pubblicazione: (2024) -
Language Models Encode the Value of Numbers Linearly
di: Zhu, Fangwei, et al.
Pubblicazione: (2024) -
RICo: Refined In-Context Contribution for Automatic Instruction-Tuning Data Selection
di: Yang, Yixin, et al.
Pubblicazione: (2025) -
Chip-Tuning: Classify Before Language Models Say
di: Zhu, Fangwei, et al.
Pubblicazione: (2024)