MARS: Enabling Autoregressive Models Multi-Token Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Jin, Ziqi, Wang, Lei, Luo, Ziwei, Sun, Aixin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
L-MARS: Legal Multi-Agent Workflow with Orchestrated Reasoning and Agentic Search
por: Wang, Ziqi, et al.
Publicado: (2025)
por: Wang, Ziqi, et al.
Publicado: (2025)
On the Role of Discreteness in Diffusion LLMs
por: Jin, Ziqi, et al.
Publicado: (2025)
por: Jin, Ziqi, et al.
Publicado: (2025)
Enabling Autoregressive Models to Fill In Masked Tokens
por: Israel, Daniel, et al.
Publicado: (2025)
por: Israel, Daniel, et al.
Publicado: (2025)
GCRE-GPT: A Generative Model for Comparative Relation Extraction
por: Wang, Yequan, et al.
Publicado: (2023)
por: Wang, Yequan, et al.
Publicado: (2023)
PGMEL: Policy Gradient-based Generative Adversarial Network for Multimodal Entity Linking
por: Pooja, KM, et al.
Publicado: (2025)
por: Pooja, KM, et al.
Publicado: (2025)
Cultural Value Differences of LLMs: Prompt, Language, and Model Size
por: Zhong, Qishuai, et al.
Publicado: (2024)
por: Zhong, Qishuai, et al.
Publicado: (2024)
MARS: Benchmarking the Metaphysical Reasoning Abilities of Language Models with a Multi-task Evaluation Dataset
por: Wang, Weiqi, et al.
Publicado: (2024)
por: Wang, Weiqi, et al.
Publicado: (2024)
Benchmarking and Rethinking Knowledge Editing for Large Language Models
por: He, Guoxiu, et al.
Publicado: (2025)
por: He, Guoxiu, et al.
Publicado: (2025)
Towards Verifiable Generation: A Benchmark for Knowledge-aware Language Model Attribution
por: Li, Xinze, et al.
Publicado: (2023)
por: Li, Xinze, et al.
Publicado: (2023)
Knowledge Updating? No More Model Editing! Just Selective Contextual Reasoning
por: He, Guoxiu, et al.
Publicado: (2025)
por: He, Guoxiu, et al.
Publicado: (2025)
Entropy-Guided Token Dropout: Training Autoregressive Language Models with Limited Domain Data
por: Wang, Jiapeng, et al.
Publicado: (2025)
por: Wang, Jiapeng, et al.
Publicado: (2025)
MARS$^2$: Scaling Multi-Agent Tree Search via Reinforcement Learning for Code Generation
por: Li, Pengfei, et al.
Publicado: (2026)
por: Li, Pengfei, et al.
Publicado: (2026)
On Context Utilization in Summarization with Large Language Models
por: Ravaut, Mathieu, et al.
Publicado: (2023)
por: Ravaut, Mathieu, et al.
Publicado: (2023)
Skill-as-Pseudocode: Refactoring Skill Libraries to Pseudocode for LLM Agents
por: Li, Xinze, et al.
Publicado: (2026)
por: Li, Xinze, et al.
Publicado: (2026)
FourierSampler: Unlocking Non-Autoregressive Potential in Diffusion Language Models via Frequency-Guided Generation
por: He, Siyang, et al.
Publicado: (2026)
por: He, Siyang, et al.
Publicado: (2026)
MARS: Multi-Agent Adaptive Reasoning with Socratic Guidance for Automated Prompt Optimization
por: Zhang, Jian, et al.
Publicado: (2025)
por: Zhang, Jian, et al.
Publicado: (2025)
MARS: Multilingual Aspect-centric Review Summarisation
por: Mukku, Sandeep Sricharan, et al.
Publicado: (2024)
por: Mukku, Sandeep Sricharan, et al.
Publicado: (2024)
Problematic Tokens: Tokenizer Bias in Large Language Models
por: Yang, Jin, et al.
Publicado: (2024)
por: Yang, Jin, et al.
Publicado: (2024)
SOUP: Token-level Single-sample Mix-policy Reinforcement Learning for Large Language Models
por: Yang, Lei, et al.
Publicado: (2026)
por: Yang, Lei, et al.
Publicado: (2026)
Direct Multi-Token Decoding
por: Luo, Xuan, et al.
Publicado: (2025)
por: Luo, Xuan, et al.
Publicado: (2025)
MARS-Bench: A Multi-turn Athletic Real-world Scenario Benchmark for Dialogue Evaluation
por: Yang, Chenghao, et al.
Publicado: (2025)
por: Yang, Chenghao, et al.
Publicado: (2025)
MARS: Memory-Enhanced Agents with Reflective Self-improvement
por: Liang, Xuechen, et al.
Publicado: (2025)
por: Liang, Xuechen, et al.
Publicado: (2025)
Compressing Sequences in the Latent Embedding Space: $K$-Token Merging for Large Language Models
por: Xu, Zihao, et al.
Publicado: (2026)
por: Xu, Zihao, et al.
Publicado: (2026)
Evaluation Agent: Efficient and Promptable Evaluation Framework for Visual Generative Models
por: Zhang, Fan, et al.
Publicado: (2024)
por: Zhang, Fan, et al.
Publicado: (2024)
The Price of a Second Thought: On the Evaluation of Reasoning Efficiency in Large Language Models
por: Fan, Siqi, et al.
Publicado: (2025)
por: Fan, Siqi, et al.
Publicado: (2025)
MARS: Meaning-Aware Response Scoring for Uncertainty Estimation in Generative LLMs
por: Bakman, Yavuz Faruk, et al.
Publicado: (2024)
por: Bakman, Yavuz Faruk, et al.
Publicado: (2024)
Long Context vs. RAG for LLMs: An Evaluation and Revisits
por: Li, Xinze, et al.
Publicado: (2024)
por: Li, Xinze, et al.
Publicado: (2024)
Differences in Text Generated by Diffusion and Autoregressive Language Models
por: Zhang, Zeyang, et al.
Publicado: (2026)
por: Zhang, Zeyang, et al.
Publicado: (2026)
Lossless Token Sequence Compression via Meta-Tokens
por: Harvill, John, et al.
Publicado: (2025)
por: Harvill, John, et al.
Publicado: (2025)
SONAR-LLM: Autoregressive Transformer that Thinks in Sentence Embeddings and Speaks in Tokens
por: Dragunov, Nikita, et al.
Publicado: (2025)
por: Dragunov, Nikita, et al.
Publicado: (2025)
Open-domain Implicit Format Control for Large Language Model Generation
por: Yao, Yiqun, et al.
Publicado: (2024)
por: Yao, Yiqun, et al.
Publicado: (2024)
Large Language Model Is Not a Good Few-shot Information Extractor, but a Good Reranker for Hard Samples!
por: Ma, Yubo, et al.
Publicado: (2023)
por: Ma, Yubo, et al.
Publicado: (2023)
MARS: Co-evolving Dual-System Deep Research via Multi-Agent Reinforcement Learning
por: Chen, Guoxin, et al.
Publicado: (2025)
por: Chen, Guoxin, et al.
Publicado: (2025)
FELLE: Autoregressive Speech Synthesis with Token-Wise Coarse-to-Fine Flow Matching
por: Wang, Hui, et al.
Publicado: (2025)
por: Wang, Hui, et al.
Publicado: (2025)
MARS: toward more efficient multi-agent collaboration for LLM reasoning
por: Wang, Xiao, et al.
Publicado: (2025)
por: Wang, Xiao, et al.
Publicado: (2025)
DiSTAR: Diffusion over a Scalable Token Autoregressive Representation for Speech Generation
por: Song, Yakun, et al.
Publicado: (2025)
por: Song, Yakun, et al.
Publicado: (2025)
Word Recovery in Large Language Models Enables Character-Level Tokenization Robustness
por: Yang, Zhipeng, et al.
Publicado: (2026)
por: Yang, Zhipeng, et al.
Publicado: (2026)
Autoregressive Models Rival Diffusion Models at ANY-ORDER Generation
por: Du, Tianqi, et al.
Publicado: (2026)
por: Du, Tianqi, et al.
Publicado: (2026)
Hessian-Enhanced Token Attribution (HETA): Interpreting Autoregressive LLMs
por: Pramanik, Vishal, et al.
Publicado: (2026)
por: Pramanik, Vishal, et al.
Publicado: (2026)
Multi-Token Attention
por: Golovneva, Olga, et al.
Publicado: (2025)
por: Golovneva, Olga, et al.
Publicado: (2025)
Ejemplares similares
-
L-MARS: Legal Multi-Agent Workflow with Orchestrated Reasoning and Agentic Search
por: Wang, Ziqi, et al.
Publicado: (2025) -
On the Role of Discreteness in Diffusion LLMs
por: Jin, Ziqi, et al.
Publicado: (2025) -
Enabling Autoregressive Models to Fill In Masked Tokens
por: Israel, Daniel, et al.
Publicado: (2025) -
GCRE-GPT: A Generative Model for Comparative Relation Extraction
por: Wang, Yequan, et al.
Publicado: (2023) -
PGMEL: Policy Gradient-based Generative Adversarial Network for Multimodal Entity Linking
por: Pooja, KM, et al.
Publicado: (2025)