Scaffolded Language Models with Language Supervision for Mixed-Autonomy: A Survey
Fuente:
arXiv
Salvato in:
| Autori principali: | Lin, Matthieu, Sheng, Jenny, Zhao, Andrew, Wang, Shenzhi, Yue, Yang, Huang, Victor Shea Jay, Liu, Huan, Liu, Jun, Huang, Gao, Liu, Yong-Jin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DiveR-CT: Diversity-enhanced Red Teaming Large Language Model Assistants with Relaxing Constraints
di: Zhao, Andrew, et al.
Pubblicazione: (2024)
di: Zhao, Andrew, et al.
Pubblicazione: (2024)
ExpeL: LLM Agents Are Experiential Learners
di: Zhao, Andrew, et al.
Pubblicazione: (2023)
di: Zhao, Andrew, et al.
Pubblicazione: (2023)
EventRL: Enhancing Event Extraction with Outcome Supervision for Large Language Models
di: Gao, Jun, et al.
Pubblicazione: (2024)
di: Gao, Jun, et al.
Pubblicazione: (2024)
Absolute Zero: Reinforced Self-play Reasoning with Zero Data
di: Zhao, Andrew, et al.
Pubblicazione: (2025)
di: Zhao, Andrew, et al.
Pubblicazione: (2025)
Towards Adaptive Mechanism Activation in Language Agent
di: Huang, Ziyang, et al.
Pubblicazione: (2024)
di: Huang, Ziyang, et al.
Pubblicazione: (2024)
From Reasoning Chains to Verifiable Subproblems: Curriculum Reinforcement Learning Enables Credit Assignment for LLM Reasoning
di: Jiang, Xitai, et al.
Pubblicazione: (2026)
di: Jiang, Xitai, et al.
Pubblicazione: (2026)
The Flexibility Trap: Why Arbitrary Order Limits Reasoning Potential in Diffusion Language Models
di: Ni, Zanlin, et al.
Pubblicazione: (2026)
di: Ni, Zanlin, et al.
Pubblicazione: (2026)
A Comprehensive Survey of Large Language Models and Multimodal Large Language Models in Medicine
di: Xiao, Hanguang, et al.
Pubblicazione: (2024)
di: Xiao, Hanguang, et al.
Pubblicazione: (2024)
HopChain: Multi-Hop Data Synthesis for Generalizable Vision-Language Reasoning
di: Wang, Shenzhi, et al.
Pubblicazione: (2026)
di: Wang, Shenzhi, et al.
Pubblicazione: (2026)
Explainable and Interpretable Multimodal Large Language Models: A Comprehensive Survey
di: Dang, Yunkai, et al.
Pubblicazione: (2024)
di: Dang, Yunkai, et al.
Pubblicazione: (2024)
A Survey on Open Information Extraction from Rule-based Model to Large Language Model
di: Liu, Pai, et al.
Pubblicazione: (2022)
di: Liu, Pai, et al.
Pubblicazione: (2022)
SI-Bench: Benchmarking Social Intelligence of Large Language Models in Human-to-Human Conversations
di: Huang, Shuai, et al.
Pubblicazione: (2025)
di: Huang, Shuai, et al.
Pubblicazione: (2025)
TASE: Token Awareness and Structured Evaluation for Multilingual Language Models
di: Zhao, Chenzhuo, et al.
Pubblicazione: (2025)
di: Zhao, Chenzhuo, et al.
Pubblicazione: (2025)
ReAct Meets ActRe: When Language Agents Enjoy Training Data Autonomy
di: Yang, Zonghan, et al.
Pubblicazione: (2024)
di: Yang, Zonghan, et al.
Pubblicazione: (2024)
Beyond Accuracy: The Role of Calibration in Self-Improving Large Language Models
di: Huang, Liangjie, et al.
Pubblicazione: (2025)
di: Huang, Liangjie, et al.
Pubblicazione: (2025)
Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?
di: Li, Wenzhe, et al.
Pubblicazione: (2025)
di: Li, Wenzhe, et al.
Pubblicazione: (2025)
Large Language Models for Planning: A Comprehensive and Systematic Survey
di: Cao, Pengfei, et al.
Pubblicazione: (2025)
di: Cao, Pengfei, et al.
Pubblicazione: (2025)
Datasets for Large Language Models: A Comprehensive Survey
di: Liu, Yang, et al.
Pubblicazione: (2024)
di: Liu, Yang, et al.
Pubblicazione: (2024)
S3Eval: A Synthetic, Scalable, Systematic Evaluation Suite for Large Language Models
di: Lei, Fangyu, et al.
Pubblicazione: (2023)
di: Lei, Fangyu, et al.
Pubblicazione: (2023)
From Automation to Autonomy: A Survey on Large Language Models in Scientific Discovery
di: Zheng, Tianshi, et al.
Pubblicazione: (2025)
di: Zheng, Tianshi, et al.
Pubblicazione: (2025)
MixRea: Benchmarking Explicit-Implicit Reasoning in Large Language Models
di: Cai, Yuanqing, et al.
Pubblicazione: (2026)
di: Cai, Yuanqing, et al.
Pubblicazione: (2026)
BlackDAN: A Black-Box Multi-Objective Approach for Effective and Contextual Jailbreaking of Large Language Models
di: Wang, Xinyuan, et al.
Pubblicazione: (2024)
di: Wang, Xinyuan, et al.
Pubblicazione: (2024)
Enhancing Autonomy in Language Education
di: Jimenez Raya, Manuel, et al.
Pubblicazione: (2019)
di: Jimenez Raya, Manuel, et al.
Pubblicazione: (2019)
Scaffold-BPE: Enhancing Byte Pair Encoding for Large Language Models with Simple and Effective Scaffold Token Removal
di: Lian, Haoran, et al.
Pubblicazione: (2024)
di: Lian, Haoran, et al.
Pubblicazione: (2024)
Optimizing Language Model's Reasoning Abilities with Weak Supervision
di: Tong, Yongqi, et al.
Pubblicazione: (2024)
di: Tong, Yongqi, et al.
Pubblicazione: (2024)
Survey on Large Language Model-Enhanced Reinforcement Learning: Concept, Taxonomy, and Methods
di: Cao, Yuji, et al.
Pubblicazione: (2024)
di: Cao, Yuji, et al.
Pubblicazione: (2024)
T$^3$Bench: Benchmarking Current Progress in Text-to-3D Generation
di: He, Yuze, et al.
Pubblicazione: (2023)
di: He, Yuze, et al.
Pubblicazione: (2023)
Logical Reasoning in Large Language Models: A Survey
di: Liu, Hanmeng, et al.
Pubblicazione: (2025)
di: Liu, Hanmeng, et al.
Pubblicazione: (2025)
Survey of Specialized Large Language Model
di: Yang, Chenghan, et al.
Pubblicazione: (2025)
di: Yang, Chenghan, et al.
Pubblicazione: (2025)
A Survey on Model Compression for Large Language Models
di: Zhu, Xunyu, et al.
Pubblicazione: (2023)
di: Zhu, Xunyu, et al.
Pubblicazione: (2023)
SliM-LLM: Salience-Driven Mixed-Precision Quantization for Large Language Models
di: Huang, Wei, et al.
Pubblicazione: (2024)
di: Huang, Wei, et al.
Pubblicazione: (2024)
Multistage Collaborative Knowledge Distillation from a Large Language Model for Semi-Supervised Sequence Generation
di: Zhao, Jiachen, et al.
Pubblicazione: (2023)
di: Zhao, Jiachen, et al.
Pubblicazione: (2023)
One Mind, Many Tongues: A Deep Dive into Language-Agnostic Knowledge Neurons in Large Language Models
di: Cao, Pengfei, et al.
Pubblicazione: (2024)
di: Cao, Pengfei, et al.
Pubblicazione: (2024)
Scaffolding Language Learning via Multi-modal Tutoring Systems with Pedagogical Instructions
di: Liu, Zhengyuan, et al.
Pubblicazione: (2024)
di: Liu, Zhengyuan, et al.
Pubblicazione: (2024)
Hypergraph as Language
di: Lei, Mengqi, et al.
Pubblicazione: (2026)
di: Lei, Mengqi, et al.
Pubblicazione: (2026)
Instruction Pre-Training: Language Models are Supervised Multitask Learners
di: Cheng, Daixuan, et al.
Pubblicazione: (2024)
di: Cheng, Daixuan, et al.
Pubblicazione: (2024)
FedJudge: Federated Legal Large Language Model
di: Yue, Linan, et al.
Pubblicazione: (2023)
di: Yue, Linan, et al.
Pubblicazione: (2023)
JPS: Jailbreak Multimodal Large Language Models with Collaborative Visual Perturbation and Textual Steering
di: Chen, Renmiao, et al.
Pubblicazione: (2025)
di: Chen, Renmiao, et al.
Pubblicazione: (2025)
ControlLM: Crafting Diverse Personalities for Language Models
di: Weng, Yixuan, et al.
Pubblicazione: (2024)
di: Weng, Yixuan, et al.
Pubblicazione: (2024)
GUNDAM: Aligning Large Language Models with Graph Understanding
di: Ouyang, Sheng, et al.
Pubblicazione: (2024)
di: Ouyang, Sheng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
DiveR-CT: Diversity-enhanced Red Teaming Large Language Model Assistants with Relaxing Constraints
di: Zhao, Andrew, et al.
Pubblicazione: (2024) -
ExpeL: LLM Agents Are Experiential Learners
di: Zhao, Andrew, et al.
Pubblicazione: (2023) -
EventRL: Enhancing Event Extraction with Outcome Supervision for Large Language Models
di: Gao, Jun, et al.
Pubblicazione: (2024) -
Absolute Zero: Reinforced Self-play Reasoning with Zero Data
di: Zhao, Andrew, et al.
Pubblicazione: (2025) -
Towards Adaptive Mechanism Activation in Language Agent
di: Huang, Ziyang, et al.
Pubblicazione: (2024)