Self-Discover: Large Language Models Self-Compose Reasoning Structures
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhou, Pei, Pujara, Jay, Ren, Xiang, Chen, Xinyun, Cheng, Heng-Tze, Le, Quoc V., Chi, Ed H., Zhou, Denny, Mishra, Swaroop, Zheng, Huaixiu Steven |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Take a Step Back: Evoking Reasoning via Abstraction in Large Language Models
di: Zheng, Huaixiu Steven, et al.
Pubblicazione: (2023)
di: Zheng, Huaixiu Steven, et al.
Pubblicazione: (2023)
Large Language Models Cannot Self-Correct Reasoning Yet
di: Huang, Jie, et al.
Pubblicazione: (2023)
di: Huang, Jie, et al.
Pubblicazione: (2023)
NATURAL PLAN: Benchmarking LLMs on Natural Language Planning
di: Zheng, Huaixiu Steven, et al.
Pubblicazione: (2024)
di: Zheng, Huaixiu Steven, et al.
Pubblicazione: (2024)
Premise Order Matters in Reasoning with Large Language Models
di: Chen, Xinyun, et al.
Pubblicazione: (2024)
di: Chen, Xinyun, et al.
Pubblicazione: (2024)
Large Language Models as Analogical Reasoners
di: Yasunaga, Michihiro, et al.
Pubblicazione: (2023)
di: Yasunaga, Michihiro, et al.
Pubblicazione: (2023)
Large Language Models as Optimizers
di: Yang, Chengrun, et al.
Pubblicazione: (2023)
di: Yang, Chengrun, et al.
Pubblicazione: (2023)
Large Language Models as Tool Makers
di: Cai, Tianle, et al.
Pubblicazione: (2023)
di: Cai, Tianle, et al.
Pubblicazione: (2023)
Toward Better Temporal Structures for Geopolitical Events Forecasting
di: Ahrabian, Kian, et al.
Pubblicazione: (2026)
di: Ahrabian, Kian, et al.
Pubblicazione: (2026)
Chain-of-Thought Reasoning Without Prompting
di: Wang, Xuezhi, et al.
Pubblicazione: (2024)
di: Wang, Xuezhi, et al.
Pubblicazione: (2024)
REALTALK: A 21-Day Real-World Dataset for Long-Term Conversation
di: Lee, Dong-Ho, et al.
Pubblicazione: (2025)
di: Lee, Dong-Ho, et al.
Pubblicazione: (2025)
Large Language Models can Learn Rules
di: Zhu, Zhaocheng, et al.
Pubblicazione: (2023)
di: Zhu, Zhaocheng, et al.
Pubblicazione: (2023)
Transformers Can Achieve Length Generalization But Not Robustly
di: Zhou, Yongchao, et al.
Pubblicazione: (2024)
di: Zhou, Yongchao, et al.
Pubblicazione: (2024)
Mid-Training with Self-Generated Data Improves Reinforcement Learning in Language Models
di: RRV, Aswin, et al.
Pubblicazione: (2026)
di: RRV, Aswin, et al.
Pubblicazione: (2026)
Simple synthetic data reduces sycophancy in large language models
di: Wei, Jerry, et al.
Pubblicazione: (2023)
di: Wei, Jerry, et al.
Pubblicazione: (2023)
AnchorSteer: Self-Discovered Concept Injection for Structure-Preserving Music Editing
di: Chang, Chih-Heng, et al.
Pubblicazione: (2026)
di: Chang, Chih-Heng, et al.
Pubblicazione: (2026)
SAS-Prompt: Large Language Models as Numerical Optimizers for Robot Self-Improvement
di: Amor, Heni Ben, et al.
Pubblicazione: (2025)
di: Amor, Heni Ben, et al.
Pubblicazione: (2025)
The Curious Case of Nonverbal Abstract Reasoning with Multi-Modal Large Language Models
di: Ahrabian, Kian, et al.
Pubblicazione: (2024)
di: Ahrabian, Kian, et al.
Pubblicazione: (2024)
Symbol tuning improves in-context learning in language models
di: Wei, Jerry, et al.
Pubblicazione: (2023)
di: Wei, Jerry, et al.
Pubblicazione: (2023)
Knowledge-Powered Recommendation for an Improved Diet Water Footprint
di: Joshi, Saurav, et al.
Pubblicazione: (2024)
di: Joshi, Saurav, et al.
Pubblicazione: (2024)
Preventing Curriculum Collapse in Self-Evolving Reasoning Systems
di: Mishra, Vaibhav
Pubblicazione: (2026)
di: Mishra, Vaibhav
Pubblicazione: (2026)
Speculative RAG: Enhancing Retrieval Augmented Generation through Drafting
di: Wang, Zilong, et al.
Pubblicazione: (2024)
di: Wang, Zilong, et al.
Pubblicazione: (2024)
SETS: Leveraging Self-Verification and Self-Correction for Improved Test-Time Scaling
di: Chen, Jiefeng, et al.
Pubblicazione: (2025)
di: Chen, Jiefeng, et al.
Pubblicazione: (2025)
Discovering Self-Regulated Learning Patterns in Chatbot-Powered Education Environment
di: Lyu, Yilin, et al.
Pubblicazione: (2025)
di: Lyu, Yilin, et al.
Pubblicazione: (2025)
Surprising Resilience of Science During a Global Pandemic: A Large-Scale Descriptive Analysis
di: Ahrabian, Kian, et al.
Pubblicazione: (2024)
di: Ahrabian, Kian, et al.
Pubblicazione: (2024)
Self‐Adaptive Dielectrics with Tunable Nonlinear Electrical Conductivity via Virus‐Like Structures Composed of Metal Particles
di: Daoming Zhang, et al.
Pubblicazione: (2025)
di: Daoming Zhang, et al.
Pubblicazione: (2025)
Surprising Resilience of Scientific Publication during a Global Pandemic: A Large‐Scale Bibliometric Analysis
di: Casandra Rusti, et al.
Pubblicazione: (2025)
di: Casandra Rusti, et al.
Pubblicazione: (2025)
Discovering Physical Directions in Weight Space: Composing Neural PDE Experts
di: Wang, Pengkai, et al.
Pubblicazione: (2026)
di: Wang, Pengkai, et al.
Pubblicazione: (2026)
Diving into Self-Evolving Training for Multimodal Reasoning
di: Liu, Wei, et al.
Pubblicazione: (2024)
di: Liu, Wei, et al.
Pubblicazione: (2024)
Socrates-Mol: Self-Oriented Cognitive Reasoning through Autonomous Trial-and-Error with Empirical-Bayesian Screening for Molecules
di: Wang, Xiangru, et al.
Pubblicazione: (2025)
di: Wang, Xiangru, et al.
Pubblicazione: (2025)
HTDC: Hesitation-Triggered Differential Calibration for Mitigating Hallucination in Large Vision-Language Models
di: Liu, Xinyun
Pubblicazione: (2026)
di: Liu, Xinyun
Pubblicazione: (2026)
Robust Uncertainty Quantification for Self-Evolving Large Language Models via Continual Domain Pretraining
di: Zhou, Xiaofan, et al.
Pubblicazione: (2025)
di: Zhou, Xiaofan, et al.
Pubblicazione: (2025)
ESC-Skills: Discovering and Self-Evolving Skills for Emotional Support Conversations
di: Zhu, Jie, et al.
Pubblicazione: (2026)
di: Zhu, Jie, et al.
Pubblicazione: (2026)
RED QUEEN: Safeguarding Large Language Models against Concealed Multi-Turn Jailbreaking
di: Jiang, Yifan, et al.
Pubblicazione: (2024)
di: Jiang, Yifan, et al.
Pubblicazione: (2024)
WildRayZer: Self-supervised Large View Synthesis in Dynamic Environments
di: Chen, Xuweiyi, et al.
Pubblicazione: (2026)
di: Chen, Xuweiyi, et al.
Pubblicazione: (2026)
SSR: Socratic Self-Refine for Large Language Model Reasoning
di: Shi, Haizhou, et al.
Pubblicazione: (2025)
di: Shi, Haizhou, et al.
Pubblicazione: (2025)
Discovering and Reasoning of Causality in the Hidden World with Large Language Models
di: Liu, Chenxi, et al.
Pubblicazione: (2024)
di: Liu, Chenxi, et al.
Pubblicazione: (2024)
Ransomware 3.0: Self-Composing and LLM-Orchestrated
di: Raz, Md, et al.
Pubblicazione: (2025)
di: Raz, Md, et al.
Pubblicazione: (2025)
Self-Composing Policies for Scalable Continual Reinforcement Learning
di: Malagón, Mikel, et al.
Pubblicazione: (2025)
di: Malagón, Mikel, et al.
Pubblicazione: (2025)
Learning by Teaching: Engaging Students as Instructors of Large Language Models in Computer Science Education
di: Yang, Xinming, et al.
Pubblicazione: (2025)
di: Yang, Xinming, et al.
Pubblicazione: (2025)
Circular Reasoning: Understanding Self-Reinforcing Loops in Large Reasoning Models
di: Duan, Zenghao, et al.
Pubblicazione: (2026)
di: Duan, Zenghao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Take a Step Back: Evoking Reasoning via Abstraction in Large Language Models
di: Zheng, Huaixiu Steven, et al.
Pubblicazione: (2023) -
Large Language Models Cannot Self-Correct Reasoning Yet
di: Huang, Jie, et al.
Pubblicazione: (2023) -
NATURAL PLAN: Benchmarking LLMs on Natural Language Planning
di: Zheng, Huaixiu Steven, et al.
Pubblicazione: (2024) -
Premise Order Matters in Reasoning with Large Language Models
di: Chen, Xinyun, et al.
Pubblicazione: (2024) -
Large Language Models as Analogical Reasoners
di: Yasunaga, Michihiro, et al.
Pubblicazione: (2023)