Guardado en:
| Autores principales: | Wen, Jianyu, Wei, Yang, Yu, Xiongxi, Xiao, Changxuan, Zeng, Ke |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2601.16596 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MoA: Heterogeneous Mixture of Adapters for Parameter-Efficient Fine-Tuning of Large Language Models
por: Cao, Jie, et al.
Publicado: (2025)
por: Cao, Jie, et al.
Publicado: (2025)
MoA: Mixture-of-Attention for Subject-Context Disentanglement in Personalized Image Generation
por: Wang, Kuan-Chieh, et al.
Publicado: (2024)
por: Wang, Kuan-Chieh, et al.
Publicado: (2024)
Mixture-of-Depths Attention
por: Zhu, Lianghui, et al.
Publicado: (2026)
por: Zhu, Lianghui, et al.
Publicado: (2026)
Pyramid MoA: A Probabilistic Framework for Cost-Optimized Anytime Inference
por: Khaled, Arindam
Publicado: (2026)
por: Khaled, Arindam
Publicado: (2026)
MoBA: Mixture of Block Attention for Long-Context LLMs
por: Lu, Enzhe, et al.
Publicado: (2025)
por: Lu, Enzhe, et al.
Publicado: (2025)
Mixture of Attentions For Speculative Decoding
por: Zimmer, Matthieu, et al.
Publicado: (2024)
por: Zimmer, Matthieu, et al.
Publicado: (2024)
Depth-Recurrent Attention Mixtures: Giving Latent Reasoning the Attention it Deserves
por: Knupp, Jonas, et al.
Publicado: (2026)
por: Knupp, Jonas, et al.
Publicado: (2026)
ReachAgent: Enhancing Mobile Agent via Page Reaching and Operation
por: Wu, Qinzhuo, et al.
Publicado: (2025)
por: Wu, Qinzhuo, et al.
Publicado: (2025)
Yuan 2.0-M32: Mixture of Experts with Attention Router
por: Wu, Shaohua, et al.
Publicado: (2024)
por: Wu, Shaohua, et al.
Publicado: (2024)
Skywork-MoE: A Deep Dive into Training Techniques for Mixture-of-Experts Language Models
por: Wei, Tianwen, et al.
Publicado: (2024)
por: Wei, Tianwen, et al.
Publicado: (2024)
HCAttention: Extreme KV Cache Compression via Heterogeneous Attention Computing for LLMs
por: Yang, Dongquan, et al.
Publicado: (2025)
por: Yang, Dongquan, et al.
Publicado: (2025)
AgentRefine: Enhancing Agent Generalization through Refinement Tuning
por: Fu, Dayuan, et al.
Publicado: (2025)
por: Fu, Dayuan, et al.
Publicado: (2025)
Multi-granularity Interactive Attention Framework for Residual Hierarchical Pronunciation Assessment
por: Han, Hong, et al.
Publicado: (2026)
por: Han, Hong, et al.
Publicado: (2026)
Interpretable Emergent Language Using Inter-Agent Transformers
por: Bhardwaj, Mannan
Publicado: (2025)
por: Bhardwaj, Mannan
Publicado: (2025)
Mixture-of-Minds: Multi-Agent Reinforcement Learning for Table Understanding
por: Zhou, Yuhang, et al.
Publicado: (2025)
por: Zhou, Yuhang, et al.
Publicado: (2025)
ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks
por: Li, Minghao, et al.
Publicado: (2025)
por: Li, Minghao, et al.
Publicado: (2025)
Semia: Auditing Agent Skills via Constraint-Guided Representation Synthesis
por: Wen, Hongbo, et al.
Publicado: (2026)
por: Wen, Hongbo, et al.
Publicado: (2026)
DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning
por: Huang, Haoyu, et al.
Publicado: (2026)
por: Huang, Haoyu, et al.
Publicado: (2026)
AgentBank: Towards Generalized LLM Agents via Fine-Tuning on 50000+ Interaction Trajectories
por: Song, Yifan, et al.
Publicado: (2024)
por: Song, Yifan, et al.
Publicado: (2024)
SR-KI: Scalable and Real-Time Knowledge Integration into LLMs via Supervised Attention
por: Yu, Bohan, et al.
Publicado: (2025)
por: Yu, Bohan, et al.
Publicado: (2025)
Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention
por: Yuan, Jingyang, et al.
Publicado: (2025)
por: Yuan, Jingyang, et al.
Publicado: (2025)
GEM: Graph-Enhanced Mixture-of-Experts with ReAct Agents for Dialogue State Tracking
por: Zhu, Ziqi, et al.
Publicado: (2026)
por: Zhu, Ziqi, et al.
Publicado: (2026)
BacktrackAgent: Enhancing GUI Agent with Error Detection and Backtracking Mechanism
por: Wu, Qinzhuo, et al.
Publicado: (2025)
por: Wu, Qinzhuo, et al.
Publicado: (2025)
HySparse: A Hybrid Sparse Attention Architecture with Oracle Token Selection and KV Cache Sharing
por: Gao, Yizhao, et al.
Publicado: (2026)
por: Gao, Yizhao, et al.
Publicado: (2026)
From Reactive to Proactive: Assessing the Proactivity of Voice Agents via ProVoice-Bench
por: Xu, Ke, et al.
Publicado: (2026)
por: Xu, Ke, et al.
Publicado: (2026)
DeepEra: A Deep Evidence Reranking Agent for Scientific Retrieval-Augmented Generated Question Answering
por: Chen, Haotian, et al.
Publicado: (2026)
por: Chen, Haotian, et al.
Publicado: (2026)
Pre-Attention Expert Prediction and Prefetching for Mixture-of-Experts Large Language Models
por: Zhu, Shien, et al.
Publicado: (2025)
por: Zhu, Shien, et al.
Publicado: (2025)
Enhancing Diagnostic Accuracy through Multi-Agent Conversations: Using Large Language Models to Mitigate Cognitive Bias
por: Ke, Yu He, et al.
Publicado: (2024)
por: Ke, Yu He, et al.
Publicado: (2024)
DeepPlanner: Scaling Planning Capability for Deep Research Agents via Advantage Shaping
por: Fan, Wei, et al.
Publicado: (2025)
por: Fan, Wei, et al.
Publicado: (2025)
Explicit Multi-head Attention for Inter-head Interaction in Large Language Models
por: Peng, Runyu, et al.
Publicado: (2026)
por: Peng, Runyu, et al.
Publicado: (2026)
Agent-World: Scaling Real-World Environment Synthesis for Evolving General Agent Intelligence
por: Dong, Guanting, et al.
Publicado: (2026)
por: Dong, Guanting, et al.
Publicado: (2026)
ChinaTravel: An Open-Ended Travel Planning Benchmark with Compositional Constraint Validation for Language Agents
por: Shao, Jie-Jing, et al.
Publicado: (2024)
por: Shao, Jie-Jing, et al.
Publicado: (2024)
Attention-guided Evidence Grounding for Spoken Question Answering
por: Yang, Ke, et al.
Publicado: (2026)
por: Yang, Ke, et al.
Publicado: (2026)
Positional Encoding via Token-Aware Phase Attention
por: Wang, Yu, et al.
Publicado: (2025)
por: Wang, Yu, et al.
Publicado: (2025)
MoKA: Mixture of Kronecker Adapters
por: Sadeghi, Mohammadreza, et al.
Publicado: (2025)
por: Sadeghi, Mohammadreza, et al.
Publicado: (2025)
The Lighthouse of Language: Enhancing LLM Agents via Critique-Guided Improvement
por: Yang, Ruihan, et al.
Publicado: (2025)
por: Yang, Ruihan, et al.
Publicado: (2025)
Deep Reasoning in General Purpose Agents via Structured Meta-Cognition
por: Light, Dean, et al.
Publicado: (2026)
por: Light, Dean, et al.
Publicado: (2026)
CodeARC: Benchmarking Reasoning Capabilities of LLM Agents for Inductive Program Synthesis
por: Wei, Anjiang, et al.
Publicado: (2025)
por: Wei, Anjiang, et al.
Publicado: (2025)
Attention Editing: A Versatile Framework for Cross-Architecture Attention Conversion
por: Cheng, Zhen, et al.
Publicado: (2026)
por: Cheng, Zhen, et al.
Publicado: (2026)
TRAD: Enhancing LLM Agents with Step-Wise Thought Retrieval and Aligned Decision
por: Zhou, Ruiwen, et al.
Publicado: (2024)
por: Zhou, Ruiwen, et al.
Publicado: (2024)
Ejemplares similares
-
MoA: Heterogeneous Mixture of Adapters for Parameter-Efficient Fine-Tuning of Large Language Models
por: Cao, Jie, et al.
Publicado: (2025) -
MoA: Mixture-of-Attention for Subject-Context Disentanglement in Personalized Image Generation
por: Wang, Kuan-Chieh, et al.
Publicado: (2024) -
Mixture-of-Depths Attention
por: Zhu, Lianghui, et al.
Publicado: (2026) -
Pyramid MoA: A Probabilistic Framework for Cost-Optimized Anytime Inference
por: Khaled, Arindam
Publicado: (2026) -
MoBA: Mixture of Block Attention for Long-Context LLMs
por: Lu, Enzhe, et al.
Publicado: (2025)