Vocabulary Dropout for Curriculum Diversity in LLM Co-Evolution
Fuente:
arXiv
Salvato in:
| Autori principali: | Dineen, Jacob, RRV, Aswin, Xu, Zhikun, Zhou, Ben |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ThinkTuning: Instilling Cognitive Reflections without Distillation
di: RRV, Aswin, et al.
Pubblicazione: (2025)
di: RRV, Aswin, et al.
Pubblicazione: (2025)
ToW: Thoughts of Words Improve Reasoning in Large Language Models
di: Xu, Zhikun, et al.
Pubblicazione: (2024)
di: Xu, Zhikun, et al.
Pubblicazione: (2024)
Mid-Training with Self-Generated Data Improves Reinforcement Learning in Language Models
di: RRV, Aswin, et al.
Pubblicazione: (2026)
di: RRV, Aswin, et al.
Pubblicazione: (2026)
Scaling LLM Pre-training with Vocabulary Curriculum
di: Yu, Fangyuan
Pubblicazione: (2025)
di: Yu, Fangyuan
Pubblicazione: (2025)
ArenaBencher: Automatic Benchmark Evolution via Multi-Model Competitive Evaluation
di: Liu, Qin, et al.
Pubblicazione: (2025)
di: Liu, Qin, et al.
Pubblicazione: (2025)
QA-LIGN: Aligning LLMs through Constitutionally Decomposed QA
di: Dineen, Jacob, et al.
Pubblicazione: (2025)
di: Dineen, Jacob, et al.
Pubblicazione: (2025)
When "Competency" in Reasoning Opens the Door to Vulnerability: Jailbreaking LLMs via Novel Complex Ciphers
di: Handa, Divij, et al.
Pubblicazione: (2024)
di: Handa, Divij, et al.
Pubblicazione: (2024)
Step-by-Step Reasoning to Solve Grid Puzzles: Where do LLMs Falter?
di: Tyagi, Nemika, et al.
Pubblicazione: (2024)
di: Tyagi, Nemika, et al.
Pubblicazione: (2024)
PHANTOM RECALL: When Familiar Puzzles Fool Smart Models
di: Mukhopadhyay, Souradeep, et al.
Pubblicazione: (2025)
di: Mukhopadhyay, Souradeep, et al.
Pubblicazione: (2025)
BOW: Reinforcement Learning for Bottlenecked Next Word Prediction
di: Shen, Ming, et al.
Pubblicazione: (2025)
di: Shen, Ming, et al.
Pubblicazione: (2025)
DARC: Decoupled Asymmetric Reasoning Curriculum for LLM Evolution
di: Fan, Shengda, et al.
Pubblicazione: (2026)
di: Fan, Shengda, et al.
Pubblicazione: (2026)
Nova: An Iterative Planning and Search Approach to Enhance Novelty and Diversity of LLM Generated Ideas
di: Hu, Xiang, et al.
Pubblicazione: (2024)
di: Hu, Xiang, et al.
Pubblicazione: (2024)
Dropouts in Confidence: Moral Uncertainty in Human-LLM Alignment
di: Kwon, Jea, et al.
Pubblicazione: (2025)
di: Kwon, Jea, et al.
Pubblicazione: (2025)
Unbiased Visual Reasoning with Controlled Visual Inputs
di: Li, Zhaonan, et al.
Pubblicazione: (2025)
di: Li, Zhaonan, et al.
Pubblicazione: (2025)
Vocabulary embeddings organize linguistic structure early in language model training
di: Papadimitriou, Isabel, et al.
Pubblicazione: (2025)
di: Papadimitriou, Isabel, et al.
Pubblicazione: (2025)
Layer-wise Regularized Dropout for Neural Language Models
di: Ni, Shiwen, et al.
Pubblicazione: (2024)
di: Ni, Shiwen, et al.
Pubblicazione: (2024)
Skill Reuse as Compression in Agentic RL
di: Xu, Zhikun, et al.
Pubblicazione: (2026)
di: Xu, Zhikun, et al.
Pubblicazione: (2026)
Reasoning Curriculum: Bootstrapping Broad LLM Reasoning from Math
di: Pang, Bo, et al.
Pubblicazione: (2025)
di: Pang, Bo, et al.
Pubblicazione: (2025)
AgentDropout: Dynamic Agent Elimination for Token-Efficient and High-Performance LLM-Based Multi-Agent Collaboration
di: Wang, Zhexuan, et al.
Pubblicazione: (2025)
di: Wang, Zhexuan, et al.
Pubblicazione: (2025)
Propensity Inference: Environmental Contributors to LLM Behaviour
di: Järviniemi, Olli, et al.
Pubblicazione: (2026)
di: Järviniemi, Olli, et al.
Pubblicazione: (2026)
CSV-Decode: Certifiable Sub-Vocabulary Decoding for Efficient Large Language Model Inference
di: Liu, Dong, et al.
Pubblicazione: (2025)
di: Liu, Dong, et al.
Pubblicazione: (2025)
Drop Dropout on Single-Epoch Language Model Pretraining
di: Liu, Houjun, et al.
Pubblicazione: (2025)
di: Liu, Houjun, et al.
Pubblicazione: (2025)
Polysemantic Dropout: Conformal OOD Detection for Specialized LLMs
di: Gupta, Ayush, et al.
Pubblicazione: (2025)
di: Gupta, Ayush, et al.
Pubblicazione: (2025)
Balancing Coverage and Draft Latency in Vocabulary Trimming for Faster Speculative Decoding
di: Shoham, Ofir Ben
Pubblicazione: (2026)
di: Shoham, Ofir Ben
Pubblicazione: (2026)
Co-EPG: A Framework for Co-Evolution of Planning and Grounding in Autonomous GUI Agents
di: Zhao, Yuan, et al.
Pubblicazione: (2025)
di: Zhao, Yuan, et al.
Pubblicazione: (2025)
LoRA Meets Dropout under a Unified Framework
di: Wang, Sheng, et al.
Pubblicazione: (2024)
di: Wang, Sheng, et al.
Pubblicazione: (2024)
Scaling Laws with Vocabulary: Larger Models Deserve Larger Vocabularies
di: Tao, Chaofan, et al.
Pubblicazione: (2024)
di: Tao, Chaofan, et al.
Pubblicazione: (2024)
Trivial Vocabulary Bans Improve LLM Reasoning More Than Deep Linguistic Constraints
di: Jehu-Appiah, Rodney
Pubblicazione: (2026)
di: Jehu-Appiah, Rodney
Pubblicazione: (2026)
DSGBench: A Diverse Strategic Game Benchmark for Evaluating LLM-based Agents in Complex Decision-Making Environments
di: Tang, Wenjie, et al.
Pubblicazione: (2025)
di: Tang, Wenjie, et al.
Pubblicazione: (2025)
Overcoming Vocabulary Mismatch: Vocabulary-agnostic Teacher Guided Language Modeling
di: Shin, Haebin, et al.
Pubblicazione: (2025)
di: Shin, Haebin, et al.
Pubblicazione: (2025)
SSG: Logit-Balanced Vocabulary Partitioning for LLM Watermarking
di: Gu, Chenxi, et al.
Pubblicazione: (2026)
di: Gu, Chenxi, et al.
Pubblicazione: (2026)
Plug, Play, and Fuse: Zero-Shot Joint Decoding via Word-Level Re-ranking Across Diverse Vocabularies
di: Koneru, Sai, et al.
Pubblicazione: (2024)
di: Koneru, Sai, et al.
Pubblicazione: (2024)
Evidence-Augmented Policy Optimization with Reward Co-Evolution for Long-Context Reasoning
di: Guan, Xin, et al.
Pubblicazione: (2026)
di: Guan, Xin, et al.
Pubblicazione: (2026)
TildeOpen LLM: Leveraging Curriculum Learning to Achieve Equitable Language Representation
di: Bergmanis, Toms, et al.
Pubblicazione: (2026)
di: Bergmanis, Toms, et al.
Pubblicazione: (2026)
LLMCL-GEC: Advancing Grammatical Error Correction with LLM-Driven Curriculum Learning
di: Fang, Tao, et al.
Pubblicazione: (2024)
di: Fang, Tao, et al.
Pubblicazione: (2024)
Agent Data Protocol: Unifying Datasets for Diverse, Effective Fine-tuning of LLM Agents
di: Song, Yueqi, et al.
Pubblicazione: (2025)
di: Song, Yueqi, et al.
Pubblicazione: (2025)
AgentDropoutV2: Optimizing Information Flow in Multi-Agent Systems via Test-Time Rectify-or-Reject Pruning
di: Wang, Yutong, et al.
Pubblicazione: (2026)
di: Wang, Yutong, et al.
Pubblicazione: (2026)
Exploring and Controlling Diversity in LLM-Agent Conversation
di: Chu, KuanChao, et al.
Pubblicazione: (2024)
di: Chu, KuanChao, et al.
Pubblicazione: (2024)
Evaluating the Diversity and Quality of LLM Generated Content
di: Shypula, Alexander, et al.
Pubblicazione: (2025)
di: Shypula, Alexander, et al.
Pubblicazione: (2025)
Preference Curriculum: LLMs Should Always Be Pretrained on Their Preferred Data
di: Zhang, Xuemiao, et al.
Pubblicazione: (2025)
di: Zhang, Xuemiao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ThinkTuning: Instilling Cognitive Reflections without Distillation
di: RRV, Aswin, et al.
Pubblicazione: (2025) -
ToW: Thoughts of Words Improve Reasoning in Large Language Models
di: Xu, Zhikun, et al.
Pubblicazione: (2024) -
Mid-Training with Self-Generated Data Improves Reinforcement Learning in Language Models
di: RRV, Aswin, et al.
Pubblicazione: (2026) -
Scaling LLM Pre-training with Vocabulary Curriculum
di: Yu, Fangyuan
Pubblicazione: (2025) -
ArenaBencher: Automatic Benchmark Evolution via Multi-Model Competitive Evaluation
di: Liu, Qin, et al.
Pubblicazione: (2025)