Understanding and Enhancing the Planning Capability of Language Models via Multi-Token Prediction
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhong, Qimin, Liao, Hao, Wang, Siwei, Zhou, Mingyang, Wu, Xiaoqun, Mao, Rui, Chen, Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Toward Consistent World Models with Multi-Token Prediction and Latent Semantic Enhancement
di: Zhong, Qimin, et al.
Pubblicazione: (2026)
di: Zhong, Qimin, et al.
Pubblicazione: (2026)
Exploring Loss Landscapes through the Lens of Spin Glass Theory
di: Liao, Hao, et al.
Pubblicazione: (2024)
di: Liao, Hao, et al.
Pubblicazione: (2024)
ALPINE: Unveiling the Planning Capability of Autoregressive Learning in Language Models
di: Wang, Siwei, et al.
Pubblicazione: (2024)
di: Wang, Siwei, et al.
Pubblicazione: (2024)
How Transformers Learn to Plan via Multi-Token Prediction
di: Huang, Jianhao, et al.
Pubblicazione: (2026)
di: Huang, Jianhao, et al.
Pubblicazione: (2026)
Fine-Tuning Medical Language Models for Enhanced Long-Contextual Understanding and Domain Expertise
di: Yang, Qimin, et al.
Pubblicazione: (2024)
di: Yang, Qimin, et al.
Pubblicazione: (2024)
Large Language Model's Multi-Capability Alignment in Biomedical Domain
di: Wu, Wentao, et al.
Pubblicazione: (2025)
di: Wu, Wentao, et al.
Pubblicazione: (2025)
PersonaArena: Dynamic Simulation for Evaluating and Enhancing Persona-Level Role-Playing in Large Language Models
di: Shi, Wenlong, et al.
Pubblicazione: (2026)
di: Shi, Wenlong, et al.
Pubblicazione: (2026)
CNSL-bench: Benchmarking the Sign Language Understanding Capabilities of MLLMs on Chinese National Sign Language
di: Zhao, Rui, et al.
Pubblicazione: (2026)
di: Zhao, Rui, et al.
Pubblicazione: (2026)
Revisiting the Travel Planning Capabilities of Large Language Models
di: Zhang, Bo-Wen, et al.
Pubblicazione: (2026)
di: Zhang, Bo-Wen, et al.
Pubblicazione: (2026)
Enhancing Emotional Generation Capability of Large Language Models via Emotional Chain-of-Thought
di: Li, Zaijing, et al.
Pubblicazione: (2024)
di: Li, Zaijing, et al.
Pubblicazione: (2024)
Scaling Capability in Token Space: An Analysis of Large Vision Language Model
di: Li, Tenghui, et al.
Pubblicazione: (2024)
di: Li, Tenghui, et al.
Pubblicazione: (2024)
Sheet as Token: A Graph-Enhanced Representation for Multi-Sheet Spreadsheet Understanding
di: Lei, Yiming, et al.
Pubblicazione: (2026)
di: Lei, Yiming, et al.
Pubblicazione: (2026)
LLM-State: Open World State Representation for Long-horizon Task Planning with Large Language Model
di: Chen, Siwei, et al.
Pubblicazione: (2023)
di: Chen, Siwei, et al.
Pubblicazione: (2023)
Cooperative Strategic Planning Enhances Reasoning Capabilities in Large Language Models
di: Wang, Danqing, et al.
Pubblicazione: (2024)
di: Wang, Danqing, et al.
Pubblicazione: (2024)
Token-Supervised Value Models for Enhancing Mathematical Problem-Solving Capabilities of Large Language Models
di: Lee, Jung Hyun, et al.
Pubblicazione: (2024)
di: Lee, Jung Hyun, et al.
Pubblicazione: (2024)
VocalNet-M2: Advancing Low-Latency Spoken Language Modeling via Integrated Multi-Codebook Tokenization and Multi-Token Prediction
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
Aligning Large Language Models for Controllable Recommendations
di: Lu, Wensheng, et al.
Pubblicazione: (2024)
di: Lu, Wensheng, et al.
Pubblicazione: (2024)
GenSwarm: Scalable Multi-Robot Code-Policy Generation and Deployment via Language Models
di: Ji, Wenkang, et al.
Pubblicazione: (2025)
di: Ji, Wenkang, et al.
Pubblicazione: (2025)
Unlocking Large Language Model's Planning Capabilities with Maximum Diversity Fine-tuning
di: Li, Wenjun, et al.
Pubblicazione: (2024)
di: Li, Wenjun, et al.
Pubblicazione: (2024)
Re-Search for The Truth: Multi-round Retrieval-augmented Large Language Models are Strong Fake News Detectors
di: Li, Guanghua, et al.
Pubblicazione: (2024)
di: Li, Guanghua, et al.
Pubblicazione: (2024)
DuoTok: Source-Aware Dual-Track Tokenization for Multi-Track Music Language Modeling
di: Lin, Rui, et al.
Pubblicazione: (2025)
di: Lin, Rui, et al.
Pubblicazione: (2025)
Enhancing Conflict Resolution in Language Models via Abstract Argumentation
di: Li, Zhaoqun, et al.
Pubblicazione: (2024)
di: Li, Zhaoqun, et al.
Pubblicazione: (2024)
Pre-Training Curriculum for Multi-Token Prediction in Language Models
di: Aynetdinov, Ansar, et al.
Pubblicazione: (2025)
di: Aynetdinov, Ansar, et al.
Pubblicazione: (2025)
Perceptio: Perception Enhanced Vision Language Models via Spatial Token Generation
di: Li, Yuchen, et al.
Pubblicazione: (2026)
di: Li, Yuchen, et al.
Pubblicazione: (2026)
Benefits and Pitfalls of Reinforcement Learning for Language Model Planning: A Theoretical Perspective
di: Wang, Siwei, et al.
Pubblicazione: (2025)
di: Wang, Siwei, et al.
Pubblicazione: (2025)
Understanding Textual Capability Degradation in Speech LLMs via Parameter Importance Analysis
di: Wang, Chao, et al.
Pubblicazione: (2025)
di: Wang, Chao, et al.
Pubblicazione: (2025)
Beyond Hard Masks: Progressive Token Evolution for Diffusion Language Models
di: Zhong, Linhao, et al.
Pubblicazione: (2026)
di: Zhong, Linhao, et al.
Pubblicazione: (2026)
Biology-Instructions: A Dataset and Benchmark for Multi-Omics Sequence Understanding Capability of Large Language Models
di: He, Haonan, et al.
Pubblicazione: (2024)
di: He, Haonan, et al.
Pubblicazione: (2024)
How Confident Is the First Token? An Uncertainty-Calibrated Prompt Optimization Framework for Large Language Model Classification and Understanding
di: Chen, Wei, et al.
Pubblicazione: (2026)
di: Chen, Wei, et al.
Pubblicazione: (2026)
IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment
di: Ming, Chenlin, et al.
Pubblicazione: (2025)
di: Ming, Chenlin, et al.
Pubblicazione: (2025)
WorkflowLLM: Enhancing Workflow Orchestration Capability of Large Language Models
di: Fan, Shengda, et al.
Pubblicazione: (2024)
di: Fan, Shengda, et al.
Pubblicazione: (2024)
Enhancing Text-to-SQL Capabilities of Large Language Models via Domain Database Knowledge Injection
di: Ma, Xingyu, et al.
Pubblicazione: (2024)
di: Ma, Xingyu, et al.
Pubblicazione: (2024)
Multi-RAG: A Multimodal Retrieval-Augmented Generation System for Adaptive Video Understanding
di: Mao, Mingyang, et al.
Pubblicazione: (2025)
di: Mao, Mingyang, et al.
Pubblicazione: (2025)
FastMTP: Accelerating LLM Inference with Enhanced Multi-Token Prediction
di: Cai, Yuxuan, et al.
Pubblicazione: (2025)
di: Cai, Yuxuan, et al.
Pubblicazione: (2025)
Preservation of Language Understanding Capabilities in Speech-aware Large Language Models
di: Kubis, Marek, et al.
Pubblicazione: (2025)
di: Kubis, Marek, et al.
Pubblicazione: (2025)
Tokenization Allows Multimodal Large Language Models to Understand, Generate and Edit Architectural Floor Plans
di: Qin, Sizhong, et al.
Pubblicazione: (2026)
di: Qin, Sizhong, et al.
Pubblicazione: (2026)
Learning Planning Abstractions from Language
di: Liu, Weiyu, et al.
Pubblicazione: (2024)
di: Liu, Weiyu, et al.
Pubblicazione: (2024)
R-Capsule: Compressing High-Level Plans for Efficient Large Language Model Reasoning
di: Shan, Hongyu, et al.
Pubblicazione: (2025)
di: Shan, Hongyu, et al.
Pubblicazione: (2025)
What Kind of Visual Tokens Do We Need? Training-free Visual Token Pruning for Multi-modal Large Language Models from the Perspective of Graph
di: Jiang, Yutao, et al.
Pubblicazione: (2025)
di: Jiang, Yutao, et al.
Pubblicazione: (2025)
LLMdoctor: Token-Level Flow-Guided Preference Optimization for Efficient Test-Time Alignment of Large Language Models
di: Shen, Tiesunlong, et al.
Pubblicazione: (2026)
di: Shen, Tiesunlong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Toward Consistent World Models with Multi-Token Prediction and Latent Semantic Enhancement
di: Zhong, Qimin, et al.
Pubblicazione: (2026) -
Exploring Loss Landscapes through the Lens of Spin Glass Theory
di: Liao, Hao, et al.
Pubblicazione: (2024) -
ALPINE: Unveiling the Planning Capability of Autoregressive Learning in Language Models
di: Wang, Siwei, et al.
Pubblicazione: (2024) -
How Transformers Learn to Plan via Multi-Token Prediction
di: Huang, Jianhao, et al.
Pubblicazione: (2026) -
Fine-Tuning Medical Language Models for Enhanced Long-Contextual Understanding and Domain Expertise
di: Yang, Qimin, et al.
Pubblicazione: (2024)