HeavySkill: Heavy Thinking as the Inner Skill in Agentic Harness
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Jianing, Guo, Linsen, Chen, Zhengyu, Guo, Qi, Zang, Hongyu, Shi, Wenjie, Ma, Haoxiang, Xi, Xiangyu, Li, Xiaoyu, Wang, Wei, Cai, Xunliang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Skill0.5: Joint Skill Internalization and Utilization for Out-of-Distribution Generalization in Agentic Reinforcement Learning
di: Zhu, Jiapeng, et al.
Pubblicazione: (2026)
di: Zhu, Jiapeng, et al.
Pubblicazione: (2026)
LongCat-Flash-Prover: Advancing Native Formal Reasoning via Agentic Tool-Integrated Reinforcement Learning
di: Wang, Jianing, et al.
Pubblicazione: (2026)
di: Wang, Jianing, et al.
Pubblicazione: (2026)
Skill1: Unified Evolution of Skill-Augmented Agents via Reinforcement Learning
di: Shi, Yaorui, et al.
Pubblicazione: (2026)
di: Shi, Yaorui, et al.
Pubblicazione: (2026)
SKILL0: In-Context Agentic Reinforcement Learning for Skill Internalization
di: Lu, Zhengxi, et al.
Pubblicazione: (2026)
di: Lu, Zhengxi, et al.
Pubblicazione: (2026)
Harnessing AtomisticSkills for Agentic Atomistic Research
di: Deng, Bowen, et al.
Pubblicazione: (2026)
di: Deng, Bowen, et al.
Pubblicazione: (2026)
SkillClaw: Let Skills Evolve Collectively with Agentic Evolver
di: Ma, Ziyu, et al.
Pubblicazione: (2026)
di: Ma, Ziyu, et al.
Pubblicazione: (2026)
R-Horizon: How Far Can Your Large Reasoning Model Really Go in Breadth and Depth?
di: Lu, Yi, et al.
Pubblicazione: (2025)
di: Lu, Yi, et al.
Pubblicazione: (2025)
Autoformalizer with Tool Feedback
di: Guo, Qi, et al.
Pubblicazione: (2025)
di: Guo, Qi, et al.
Pubblicazione: (2025)
Prejudge-Before-Think: Enhancing Large Language Models at Test-Time by Process Prejudge Reasoning
di: Wang, Jianing, et al.
Pubblicazione: (2025)
di: Wang, Jianing, et al.
Pubblicazione: (2025)
Rethinking the Sampling Criteria in Reinforcement Learning for LLM Reasoning: A Competence-Difficulty Alignment Perspective
di: Kong, Deyang, et al.
Pubblicazione: (2025)
di: Kong, Deyang, et al.
Pubblicazione: (2025)
OPE: Overcoming Information Saturation in Parallel Thinking via Outline-Guided Path Exploration
di: Guo, Qi, et al.
Pubblicazione: (2026)
di: Guo, Qi, et al.
Pubblicazione: (2026)
Possible bound states of Heavy Baryonium and Heavy Dibaryon systems
di: Qi, Jing-Juan, et al.
Pubblicazione: (2024)
di: Qi, Jing-Juan, et al.
Pubblicazione: (2024)
SkillGraph: Skill-Augmented Reinforcement Learning for Agents via Evolving Skill Graphs
di: Li, Xiaoyuan, et al.
Pubblicazione: (2026)
di: Li, Xiaoyuan, et al.
Pubblicazione: (2026)
ReSkill: Reconciling Skill Creation with Policy Optimization in Agentic RL
di: He, Zelin, et al.
Pubblicazione: (2026)
di: He, Zelin, et al.
Pubblicazione: (2026)
Neural Unfolding of the Chiral Magnetic Effect in Heavy-Ion Collisions
di: Guo, Shuang, et al.
Pubblicazione: (2025)
di: Guo, Shuang, et al.
Pubblicazione: (2025)
HALO:Closing Sim-to-Real Gap for Heavy-loaded Humanoid Agile Motion Skills via Differentiable Simulation
di: Wang, Xingyi, et al.
Pubblicazione: (2026)
di: Wang, Xingyi, et al.
Pubblicazione: (2026)
Skill Reuse as Compression in Agentic RL
di: Xu, Zhikun, et al.
Pubblicazione: (2026)
di: Xu, Zhikun, et al.
Pubblicazione: (2026)
Inducing Programmatic Skills for Agentic Tasks
di: Wang, Zora Zhiruo, et al.
Pubblicazione: (2025)
di: Wang, Zora Zhiruo, et al.
Pubblicazione: (2025)
Agentic Skill Discovery
di: Zhao, Xufeng, et al.
Pubblicazione: (2024)
di: Zhao, Xufeng, et al.
Pubblicazione: (2024)
Affordance Agent Harness: Verification-Gated Skill Orchestration
di: Huang, Haojian, et al.
Pubblicazione: (2026)
di: Huang, Haojian, et al.
Pubblicazione: (2026)
Factorization Formula Connecting the Shape Functions of Heavy Meson in QCD and Heavy Quark Effective Theory
di: Wang, Wei, et al.
Pubblicazione: (2025)
di: Wang, Wei, et al.
Pubblicazione: (2025)
Reinforcement Learning for Tool-Integrated Interleaved Thinking towards Cross-Domain Generalization
di: Chen, Zhengyu, et al.
Pubblicazione: (2025)
di: Chen, Zhengyu, et al.
Pubblicazione: (2025)
SampleMix: A Sample-wise Pre-training Data Mixing Strategey by Coordinating Data Quality and Diversity
di: Xi, Xiangyu, et al.
Pubblicazione: (2025)
di: Xi, Xiangyu, et al.
Pubblicazione: (2025)
To Retrieve or To Think? An Agentic Approach for Context Evolution
di: Chen, Rubing, et al.
Pubblicazione: (2026)
di: Chen, Rubing, et al.
Pubblicazione: (2026)
Think Before You Speak: Cultivating Communication Skills of Large Language Models via Inner Monologue
di: Zhou, Junkai, et al.
Pubblicazione: (2023)
di: Zhou, Junkai, et al.
Pubblicazione: (2023)
Energy Loss of a Heavy Quark in a Collisional Quark-Gluon Plasma
di: Cai, Mingda, et al.
Pubblicazione: (2025)
di: Cai, Mingda, et al.
Pubblicazione: (2025)
Skill-as-Pseudocode: Refactoring Skill Libraries to Pseudocode for LLM Agents
di: Li, Xinze, et al.
Pubblicazione: (2026)
di: Li, Xinze, et al.
Pubblicazione: (2026)
Commonalities in Critical Thinking Skills Instruction and Library Skills Instruction.
di: Brown, Anita Fay
Pubblicazione: (1993)
di: Brown, Anita Fay
Pubblicazione: (1993)
SoK: Agentic Skills -- Beyond Tool Use in LLM Agents
di: Jiang, Yanna, et al.
Pubblicazione: (2026)
di: Jiang, Yanna, et al.
Pubblicazione: (2026)
Thinking Skills and Creativity Journal
Pubblicazione: (2025)
Pubblicazione: (2025)
Using Books for Thinking Skills.
Pubblicazione: (1994)
Pubblicazione: (1994)
Thinking (Higher Order) Skills.
di: Callison, Daniel
Pubblicazione: (2002)
di: Callison, Daniel
Pubblicazione: (2002)
Latent Representation Learning in Heavy-Ion Collisions with MaskPoint Transformer
di: Zhang, Jing-Zong, et al.
Pubblicazione: (2025)
di: Zhang, Jing-Zong, et al.
Pubblicazione: (2025)
Linear Depth QFT over IBM Heavy-hex Architecture
di: Gao, Xiangyu, et al.
Pubblicazione: (2024)
di: Gao, Xiangyu, et al.
Pubblicazione: (2024)
Harnessing LLM Agents with Skill Programs
di: Liu, Hongjun, et al.
Pubblicazione: (2026)
di: Liu, Hongjun, et al.
Pubblicazione: (2026)
Interaction Effects of Lead and Cadmium Concentrations on Heavy Metal Accumulation and Transport in Rice
di: Lang Yang, et al.
Pubblicazione: (2026)
di: Lang Yang, et al.
Pubblicazione: (2026)
SkillRevise: Improving LLM-Authored Agent Skills via Trace-Conditioned Skill Revision
di: Liu, Yuxuan, et al.
Pubblicazione: (2026)
di: Liu, Yuxuan, et al.
Pubblicazione: (2026)
PolySkill: Learning Generalizable Skills Through Polymorphic Abstraction
di: Yu, Simon, et al.
Pubblicazione: (2025)
di: Yu, Simon, et al.
Pubblicazione: (2025)
Thinking with Reasoning Skills: Fewer Tokens, More Accuracy
di: Zhao, Guangxiang, et al.
Pubblicazione: (2026)
di: Zhao, Guangxiang, et al.
Pubblicazione: (2026)
SkillFlow: Flow-Driven Recursive Skill Evolution for Agentic Orchestration
di: Zhang, Mingda, et al.
Pubblicazione: (2026)
di: Zhang, Mingda, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Skill0.5: Joint Skill Internalization and Utilization for Out-of-Distribution Generalization in Agentic Reinforcement Learning
di: Zhu, Jiapeng, et al.
Pubblicazione: (2026) -
LongCat-Flash-Prover: Advancing Native Formal Reasoning via Agentic Tool-Integrated Reinforcement Learning
di: Wang, Jianing, et al.
Pubblicazione: (2026) -
Skill1: Unified Evolution of Skill-Augmented Agents via Reinforcement Learning
di: Shi, Yaorui, et al.
Pubblicazione: (2026) -
SKILL0: In-Context Agentic Reinforcement Learning for Skill Internalization
di: Lu, Zhengxi, et al.
Pubblicazione: (2026) -
Harnessing AtomisticSkills for Agentic Atomistic Research
di: Deng, Bowen, et al.
Pubblicazione: (2026)