Salvato in:
| Autori principali: | Wang, Haorui, Zhang, Rongzhi, Li, Yinghao, Kong, Lingkai, Zhuang, Yuchen, Chen, Xiusi, Zhang, Chao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2401.13849 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Precise Attribute Intensity Control in Large Language Models via Targeted Representation Editing
di: Zhang, Rongzhi, et al.
Pubblicazione: (2025)
di: Zhang, Rongzhi, et al.
Pubblicazione: (2025)
Aligning Large Language Models with Representation Editing: A Control Perspective
di: Kong, Lingkai, et al.
Pubblicazione: (2024)
di: Kong, Lingkai, et al.
Pubblicazione: (2024)
Two Birds with One Stone: Enhancing Uncertainty Quantification and Interpretability with Graph Functional Neural Process
di: Kong, Lingkai, et al.
Pubblicazione: (2025)
di: Kong, Lingkai, et al.
Pubblicazione: (2025)
PLaD: Preference-based Large Language Model Distillation with Pseudo-Preference Pairs
di: Zhang, Rongzhi, et al.
Pubblicazione: (2024)
di: Zhang, Rongzhi, et al.
Pubblicazione: (2024)
LLM-Augmented Chemical Synthesis and Design Decision Programs
di: Wang, Haorui, et al.
Pubblicazione: (2025)
di: Wang, Haorui, et al.
Pubblicazione: (2025)
WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning
di: Zhuang, Yuchen, et al.
Pubblicazione: (2025)
di: Zhuang, Yuchen, et al.
Pubblicazione: (2025)
Semi-supervised Fine-tuning for Large Language Models
di: Luo, Junyu, et al.
Pubblicazione: (2024)
di: Luo, Junyu, et al.
Pubblicazione: (2024)
Assessing Logical Puzzle Solving in Large Language Models: Insights from a Minesweeper Case Study
di: Li, Yinghao, et al.
Pubblicazione: (2023)
di: Li, Yinghao, et al.
Pubblicazione: (2023)
When Can Large Reasoning Models Save Thinking? Mechanistic Analysis of Behavioral Divergence in Reasoning
di: Zhu, Rongzhi, et al.
Pubblicazione: (2025)
di: Zhu, Rongzhi, et al.
Pubblicazione: (2025)
BBox-Adapter: Lightweight Adapting for Black-Box Large Language Models
di: Sun, Haotian, et al.
Pubblicazione: (2024)
di: Sun, Haotian, et al.
Pubblicazione: (2024)
InftyThink: Breaking the Length Limits of Long-Context Reasoning in Large Language Models
di: Yan, Yuchen, et al.
Pubblicazione: (2025)
di: Yan, Yuchen, et al.
Pubblicazione: (2025)
Meaningful Learning: Enhancing Abstract Reasoning in Large Language Models via Generic Fact Guidance
di: Xiong, Kai, et al.
Pubblicazione: (2024)
di: Xiong, Kai, et al.
Pubblicazione: (2024)
MathFimer: Enhancing Mathematical Reasoning by Expanding Reasoning Steps through Fill-in-the-Middle Task
di: Yan, Yuchen, et al.
Pubblicazione: (2025)
di: Yan, Yuchen, et al.
Pubblicazione: (2025)
RM-R1: Reward Modeling as Reasoning
di: Chen, Xiusi, et al.
Pubblicazione: (2025)
di: Chen, Xiusi, et al.
Pubblicazione: (2025)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
di: Wang, Jingyuan, et al.
Pubblicazione: (2025)
di: Wang, Jingyuan, et al.
Pubblicazione: (2025)
MSQA: Benchmarking LLMs on Graduate-Level Materials Science Reasoning and Knowledge
di: Cheung, Jerry Junyang, et al.
Pubblicazione: (2025)
di: Cheung, Jerry Junyang, et al.
Pubblicazione: (2025)
Inference-Time Language Model Alignment via Integrated Value Guidance
di: Liu, Zhixuan, et al.
Pubblicazione: (2024)
di: Liu, Zhixuan, et al.
Pubblicazione: (2024)
Hephaestus: Improving Fundamental Agent Capabilities of Large Language Models through Continual Pre-Training
di: Zhuang, Yuchen, et al.
Pubblicazione: (2025)
di: Zhuang, Yuchen, et al.
Pubblicazione: (2025)
SecureReviewer: Enhancing Large Language Models for Secure Code Review through Secure-aware Fine-tuning
di: Liu, Fang, et al.
Pubblicazione: (2025)
di: Liu, Fang, et al.
Pubblicazione: (2025)
Self-Rewarding PPO: Aligning Large Language Models with Demonstrations Only
di: Zhang, Qingru, et al.
Pubblicazione: (2025)
di: Zhang, Qingru, et al.
Pubblicazione: (2025)
Seeing Symbols, Missing Cultures: Probing Vision-Language Models' Reasoning on Fire Imagery and Cultural Meaning
di: Yu, Haorui, et al.
Pubblicazione: (2025)
di: Yu, Haorui, et al.
Pubblicazione: (2025)
Non-myopic Generation of Language Models for Reasoning and Planning
di: Ma, Chang, et al.
Pubblicazione: (2024)
di: Ma, Chang, et al.
Pubblicazione: (2024)
Beyond Answers: Transferring Reasoning Capabilities to Smaller LLMs Using Multi-Teacher Knowledge Distillation
di: Tian, Yijun, et al.
Pubblicazione: (2024)
di: Tian, Yijun, et al.
Pubblicazione: (2024)
LLMatDesign: Autonomous Materials Discovery with Large Language Models
di: Jia, Shuyi, et al.
Pubblicazione: (2024)
di: Jia, Shuyi, et al.
Pubblicazione: (2024)
Incentivizing Dual Process Thinking for Efficient Large Language Model Reasoning
di: Cheng, Xiaoxue, et al.
Pubblicazione: (2025)
di: Cheng, Xiaoxue, et al.
Pubblicazione: (2025)
AdaSwitch: Balancing Exploration and Guidance in Knowledge Distillation via Adaptive Switching
di: Peng, Jingyu, et al.
Pubblicazione: (2025)
di: Peng, Jingyu, et al.
Pubblicazione: (2025)
DF2: Distribution-Free Decision-Focused Learning
di: Kong, Lingkai, et al.
Pubblicazione: (2023)
di: Kong, Lingkai, et al.
Pubblicazione: (2023)
Latent Principle Discovery for Language Model Self-Improvement
di: Ramji, Keshav, et al.
Pubblicazione: (2025)
di: Ramji, Keshav, et al.
Pubblicazione: (2025)
Reliable Reasoning Path: Distilling Effective Guidance for LLM Reasoning with Knowledge Graphs
di: Xiao, Yilin, et al.
Pubblicazione: (2025)
di: Xiao, Yilin, et al.
Pubblicazione: (2025)
Acting Less is Reasoning More! Teaching Model to Act Efficiently
di: Wang, Hongru, et al.
Pubblicazione: (2025)
di: Wang, Hongru, et al.
Pubblicazione: (2025)
Step Guided Reasoning: Improving Mathematical Reasoning using Guidance Generation and Step Reasoning
di: Cao, Lang, et al.
Pubblicazione: (2024)
di: Cao, Lang, et al.
Pubblicazione: (2024)
InftyThink+: Effective and Efficient Infinite-Horizon Reasoning via Reinforcement Learning
di: Yan, Yuchen, et al.
Pubblicazione: (2026)
di: Yan, Yuchen, et al.
Pubblicazione: (2026)
SpatialLadder: Progressive Training for Spatial Reasoning in Vision-Language Models
di: Li, Hongxing, et al.
Pubblicazione: (2025)
di: Li, Hongxing, et al.
Pubblicazione: (2025)
EHRAgent: Code Empowers Large Language Models for Few-shot Complex Tabular Reasoning on Electronic Health Records
di: Shi, Wenqi, et al.
Pubblicazione: (2024)
di: Shi, Wenqi, et al.
Pubblicazione: (2024)
MedAdapter: Efficient Test-Time Adaptation of Large Language Models towards Medical Reasoning
di: Shi, Wenqi, et al.
Pubblicazione: (2024)
di: Shi, Wenqi, et al.
Pubblicazione: (2024)
FeatBench: Towards More Realistic Evaluation of Feature-level Code Generation
di: Chen, Haorui, et al.
Pubblicazione: (2025)
di: Chen, Haorui, et al.
Pubblicazione: (2025)
Speculative Thinking: Enhancing Small-Model Reasoning with Large Model Guidance at Inference Time
di: Yang, Wang, et al.
Pubblicazione: (2025)
di: Yang, Wang, et al.
Pubblicazione: (2025)
Do Large Language Models Excel in Complex Logical Reasoning with Formal Language?
di: Jiang, Jin, et al.
Pubblicazione: (2025)
di: Jiang, Jin, et al.
Pubblicazione: (2025)
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models
di: Cui, Ganqu, et al.
Pubblicazione: (2025)
di: Cui, Ganqu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Precise Attribute Intensity Control in Large Language Models via Targeted Representation Editing
di: Zhang, Rongzhi, et al.
Pubblicazione: (2025) -
Aligning Large Language Models with Representation Editing: A Control Perspective
di: Kong, Lingkai, et al.
Pubblicazione: (2024) -
Two Birds with One Stone: Enhancing Uncertainty Quantification and Interpretability with Graph Functional Neural Process
di: Kong, Lingkai, et al.
Pubblicazione: (2025) -
PLaD: Preference-based Large Language Model Distillation with Pseudo-Preference Pairs
di: Zhang, Rongzhi, et al.
Pubblicazione: (2024) -
LLM-Augmented Chemical Synthesis and Design Decision Programs
di: Wang, Haorui, et al.
Pubblicazione: (2025)