ALPINE: Unveiling the Planning Capability of Autoregressive Learning in Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Siwei, Shen, Yifei, Feng, Shi, Sun, Haoran, Teng, Shang-Hua, Chen, Wei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Benefits and Pitfalls of Reinforcement Learning for Language Model Planning: A Theoretical Perspective
por: Wang, Siwei, et al.
Publicado: (2025)
por: Wang, Siwei, et al.
Publicado: (2025)
Advancing Sequential Numerical Prediction in Autoregressive Models
por: Fei, Xiang, et al.
Publicado: (2025)
por: Fei, Xiang, et al.
Publicado: (2025)
On Calibration of Large Language Models: From Response To Capability
por: Yang, Sin-Han, et al.
Publicado: (2026)
por: Yang, Sin-Han, et al.
Publicado: (2026)
Exploring and Benchmarking the Planning Capabilities of Large Language Models
por: Bohnet, Bernd, et al.
Publicado: (2024)
por: Bohnet, Bernd, et al.
Publicado: (2024)
Understanding and Enhancing the Planning Capability of Language Models via Multi-Token Prediction
por: Zhong, Qimin, et al.
Publicado: (2025)
por: Zhong, Qimin, et al.
Publicado: (2025)
Fundamental Safety-Capability Trade-offs in Fine-tuning Large Language Models
por: Chen, Pin-Yu, et al.
Publicado: (2025)
por: Chen, Pin-Yu, et al.
Publicado: (2025)
SLOT: Structuring the Output of Large Language Models
por: Wang, Darren Yow-Bang, et al.
Publicado: (2025)
por: Wang, Darren Yow-Bang, et al.
Publicado: (2025)
A Theory of Time-Sensitive Language Generation: Sparse Hallucination Beats Mode Collapse
por: Ganju, Atul, et al.
Publicado: (2026)
por: Ganju, Atul, et al.
Publicado: (2026)
Continuous Autoregressive Language Models
por: Shao, Chenze, et al.
Publicado: (2025)
por: Shao, Chenze, et al.
Publicado: (2025)
When Linear Attention Meets Autoregressive Decoding: Towards More Effective and Efficient Linearized Large Language Models
por: You, Haoran, et al.
Publicado: (2024)
por: You, Haoran, et al.
Publicado: (2024)
Synthesizing Programmatic Reinforcement Learning Policies with Large Language Model Guided Search
por: Liu, Max, et al.
Publicado: (2024)
por: Liu, Max, et al.
Publicado: (2024)
Unveiling and Addressing Pseudo Forgetting in Large Language Models
por: Sun, Huashan, et al.
Publicado: (2024)
por: Sun, Huashan, et al.
Publicado: (2024)
Context Dependence and Reliability in Autoregressive Language Models
por: Sengupta, Poushali, et al.
Publicado: (2026)
por: Sengupta, Poushali, et al.
Publicado: (2026)
ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
por: Li, Jia-Nan, et al.
Publicado: (2025)
por: Li, Jia-Nan, et al.
Publicado: (2025)
Unveiling the Mystery of Weight in Large Foundation Models: Gaussian Distribution Never Fades
por: Si, Chongjie, et al.
Publicado: (2025)
por: Si, Chongjie, et al.
Publicado: (2025)
Disentangling Logic: The Role of Context in Large Language Model Reasoning Capabilities
por: Hua, Wenyue, et al.
Publicado: (2024)
por: Hua, Wenyue, et al.
Publicado: (2024)
Projected Autoregression: Autoregressive Language Generation in Continuous State Space
por: Naparstek, Oshri
Publicado: (2026)
por: Naparstek, Oshri
Publicado: (2026)
Unveiling Causal Reasoning in Large Language Models: Reality or Mirage?
por: Chi, Haoang, et al.
Publicado: (2025)
por: Chi, Haoang, et al.
Publicado: (2025)
FBI-LLM: Scaling Up Fully Binarized LLMs from Scratch via Autoregressive Distillation
por: Ma, Liqun, et al.
Publicado: (2024)
por: Ma, Liqun, et al.
Publicado: (2024)
Personalized Wireless Federated Learning for Large Language Models
por: Jiang, Feibo, et al.
Publicado: (2024)
por: Jiang, Feibo, et al.
Publicado: (2024)
CityBench: Evaluating the Capabilities of Large Language Models for Urban Tasks
por: Feng, Jie, et al.
Publicado: (2024)
por: Feng, Jie, et al.
Publicado: (2024)
Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning
por: Jin, Jikai, et al.
Publicado: (2025)
por: Jin, Jikai, et al.
Publicado: (2025)
Unveiling Imitation Learning: Exploring the Impact of Data Falsity to Large Language Model
por: Cho, Hyunsoo
Publicado: (2024)
por: Cho, Hyunsoo
Publicado: (2024)
Planner and Executor: Collaboration between Discrete Diffusion And Autoregressive Models in Reasoning
por: Berrayana, Lina, et al.
Publicado: (2025)
por: Berrayana, Lina, et al.
Publicado: (2025)
Critique of Impure Reason: Unveiling the reasoning behaviour of medical Large Language Models
por: Sim, Shamus, et al.
Publicado: (2024)
por: Sim, Shamus, et al.
Publicado: (2024)
Efficient-DLM: From Autoregressive to Diffusion Language Models, and Beyond in Speed
por: Fu, Yonggan, et al.
Publicado: (2025)
por: Fu, Yonggan, et al.
Publicado: (2025)
Why Larger Language Models Do In-context Learning Differently?
por: Shi, Zhenmei, et al.
Publicado: (2024)
por: Shi, Zhenmei, et al.
Publicado: (2024)
Unveiling Narrative Reasoning Limits of Large Language Models with Trope in Movie Synopses
por: Su, Hung-Ting, et al.
Publicado: (2024)
por: Su, Hung-Ting, et al.
Publicado: (2024)
Prescriptive Scaling Reveals the Evolution of Language Model Capabilities
por: Zhang, Hanlin, et al.
Publicado: (2026)
por: Zhang, Hanlin, et al.
Publicado: (2026)
System-1.x: Learning to Balance Fast and Slow Planning with Language Models
por: Saha, Swarnadeep, et al.
Publicado: (2024)
por: Saha, Swarnadeep, et al.
Publicado: (2024)
A Pseudo-Semantic Loss for Autoregressive Models with Logical Constraints
por: Ahmed, Kareem, et al.
Publicado: (2023)
por: Ahmed, Kareem, et al.
Publicado: (2023)
Breach in the Shield: Unveiling the Vulnerabilities of Large Language Models
por: Dai, Runpeng, et al.
Publicado: (2025)
por: Dai, Runpeng, et al.
Publicado: (2025)
Reasoning Planning for Language Models
por: Nguyen, Bao, et al.
Publicado: (2025)
por: Nguyen, Bao, et al.
Publicado: (2025)
Uncertainty of Thoughts: Uncertainty-Aware Planning Enhances Information Seeking in Large Language Models
por: Hu, Zhiyuan, et al.
Publicado: (2024)
por: Hu, Zhiyuan, et al.
Publicado: (2024)
Mechanism Shift During Post-training from Autoregressive to Masked Diffusion Language Models
por: Kong, Injin, et al.
Publicado: (2026)
por: Kong, Injin, et al.
Publicado: (2026)
MixCE: Training Autoregressive Language Models by Mixing Forward and Reverse Cross-Entropies
por: Zhang, Shiyue, et al.
Publicado: (2023)
por: Zhang, Shiyue, et al.
Publicado: (2023)
MAP-Neo: Highly Capable and Transparent Bilingual Large Language Model Series
por: Zhang, Ge, et al.
Publicado: (2024)
por: Zhang, Ge, et al.
Publicado: (2024)
Unlocking Reasoning Capabilities in LLMs via Reinforcement Learning Exploration
por: Deng, Wenhao, et al.
Publicado: (2025)
por: Deng, Wenhao, et al.
Publicado: (2025)
Reviving The Classics: Active Reward Modeling in Large Language Model Alignment
por: Shen, Yunyi, et al.
Publicado: (2025)
por: Shen, Yunyi, et al.
Publicado: (2025)
EffGen: Enabling Small Language Models as Capable Autonomous Agents
por: Srivastava, Gaurav, et al.
Publicado: (2026)
por: Srivastava, Gaurav, et al.
Publicado: (2026)
Ejemplares similares
-
Benefits and Pitfalls of Reinforcement Learning for Language Model Planning: A Theoretical Perspective
por: Wang, Siwei, et al.
Publicado: (2025) -
Advancing Sequential Numerical Prediction in Autoregressive Models
por: Fei, Xiang, et al.
Publicado: (2025) -
On Calibration of Large Language Models: From Response To Capability
por: Yang, Sin-Han, et al.
Publicado: (2026) -
Exploring and Benchmarking the Planning Capabilities of Large Language Models
por: Bohnet, Bernd, et al.
Publicado: (2024) -
Understanding and Enhancing the Planning Capability of Language Models via Multi-Token Prediction
por: Zhong, Qimin, et al.
Publicado: (2025)