State Rank Dynamics in Linear Attention LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Ao, Zhang, Hongtao, Zhou, Heng, Ma, Yixuan, Qin, Yiran, Su, Tongrui, Liu, Yan, Ma, Zhanyu, Xu, Jun, Gao, Jiuchong, Hao, Jinghua, He, Renqing |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Silence the Judge: Reinforcement Learning with Self-Verifier via Latent Geometric Clustering
par: Zhang, Nonghai, et autres
Publié: (2026)
par: Zhang, Nonghai, et autres
Publié: (2026)
LTS-VoiceAgent: A Listen-Think-Speak Framework for Efficient Streaming Voice Interaction via Semantic Triggering and Incremental Reasoning
par: Zou, Wenhao, et autres
Publié: (2026)
par: Zou, Wenhao, et autres
Publié: (2026)
Efficient Paths and Dense Rewards: Probabilistic Flow Reasoning for Large Language Models
par: Liu, Yan, et autres
Publié: (2026)
par: Liu, Yan, et autres
Publié: (2026)
GeoRA: Geometry-Aware Low-Rank Adaptation for RLVR
par: Zhang, Jiaying, et autres
Publié: (2026)
par: Zhang, Jiaying, et autres
Publié: (2026)
Fine-Mem: Fine-Grained Feedback Alignment for Long-Horizon Memory Management
par: Ma, Weitao, et autres
Publié: (2026)
par: Ma, Weitao, et autres
Publié: (2026)
UserLM-R1: Modeling Human Reasoning in User Language Models with Multi-Reward Reinforcement Learning
par: Zhang, Feng, et autres
Publié: (2026)
par: Zhang, Feng, et autres
Publié: (2026)
Long-term Task-oriented Agent: Proactive Long-term Intent Maintenance in Dynamic Environments
par: Shi, Qinglong, et autres
Publié: (2026)
par: Shi, Qinglong, et autres
Publié: (2026)
MUSE: Multi-Domain Chinese User Simulation via Self-Evolving Profiles and Rubric-Guided Alignment
par: Liu, Zihao, et autres
Publié: (2026)
par: Liu, Zihao, et autres
Publié: (2026)
Hidden States Know Where Reasoning Diverges: Credit Assignment via Span-Level Wasserstein Distance
par: Chen, Xinzhu, et autres
Publié: (2026)
par: Chen, Xinzhu, et autres
Publié: (2026)
VoiceAgentEval: A Dual-Dimensional Benchmark for Expert-Level Intelligent Voice-Agent Evaluation of Xbench's Professional-Aligned Series
par: Xu, Pengyu, et autres
Publié: (2025)
par: Xu, Pengyu, et autres
Publié: (2025)
From Absolute to Relative: Rethinking Reward Shaping in Group-Based Reinforcement Learning
par: Niu, Wenzhe, et autres
Publié: (2026)
par: Niu, Wenzhe, et autres
Publié: (2026)
Elucidating the Design Space of Decay in Linear Attention
par: Qin, Zhen, et autres
Publié: (2025)
par: Qin, Zhen, et autres
Publié: (2025)
Linear Attention Sequence Parallelism
par: Sun, Weigao, et autres
Publié: (2024)
par: Sun, Weigao, et autres
Publié: (2024)
Measurement-Constrained Sampling for Text-Prompted Blind Face Restoration
par: Li, Wenjie, et autres
Publié: (2025)
par: Li, Wenjie, et autres
Publié: (2025)
Self-Supervised Selective-Guided Diffusion Model for Old-Photo Face Restoration
par: Li, Wenjie, et autres
Publié: (2025)
par: Li, Wenjie, et autres
Publié: (2025)
Dual-domain Modulation Network for Lightweight Image Super-Resolution
par: Li, Wenjie, et autres
Publié: (2025)
par: Li, Wenjie, et autres
Publié: (2025)
An Integral Equation Method for Linear Two-Point Boundary Value Systems
par: Zhang, Tianze, et autres
Publié: (2025)
par: Zhang, Tianze, et autres
Publié: (2025)
Breaking the Low-Rank Dilemma of Linear Attention
par: Fan, Qihang, et autres
Publié: (2024)
par: Fan, Qihang, et autres
Publié: (2024)
FourierSR: A Fourier Token-based Plugin for Efficient Image Super-Resolution
par: Li, Wenjie, et autres
Publié: (2025)
par: Li, Wenjie, et autres
Publié: (2025)
SpecGen: Neural Spectral BRDF Generation via Spectral-Spatial Tri-plane Aggregation
par: Jin, Zhenyu, et autres
Publié: (2025)
par: Jin, Zhenyu, et autres
Publié: (2025)
Harvesting Efficient On-Demand Order Pooling from Skilled Couriers: Enhancing Graph Representation Learning for Refining Real-time Many-to-One Assignments
par: Liang, Yile, et autres
Publié: (2024)
par: Liang, Yile, et autres
Publié: (2024)
Benchmarking Semantic Segmentation Models via Appearance and Geometry Attribute Editing
par: Yin, Zijin, et autres
Publié: (2026)
par: Yin, Zijin, et autres
Publié: (2026)
Multiplicity one for equivariant min-max theory in prescribed homology classes
par: Wang, Tongrui
Publié: (2026)
par: Wang, Tongrui
Publié: (2026)
Equivariant min-max hypersurface in $G$-manifolds with positive Ricci curvature
par: Wang, Tongrui
Publié: (2023)
par: Wang, Tongrui
Publié: (2023)
HGRN2: Gated Linear RNNs with State Expansion
par: Qin, Zhen, et autres
Publié: (2024)
par: Qin, Zhen, et autres
Publié: (2024)
Reduction of $ε$-expanded Feynman integrals
par: Ma, Yan-Qing, et autres
Publié: (2025)
par: Ma, Yan-Qing, et autres
Publié: (2025)
The Key to State Reduction in Linear Attention: A Rank-based Perspective
par: Nazari, Philipp, et autres
Publié: (2026)
par: Nazari, Philipp, et autres
Publié: (2026)
HFFO ‐ ACRP : Hybrid Fruit Fly Optimization‐Ant Colony Routing Protocol
par: Lijun Hao, et autres
Publié: (2025)
par: Lijun Hao, et autres
Publié: (2025)
MixTex: Unambiguous Recognition Should Not Rely Solely on Real Data
par: Luo, Renqing, et autres
Publié: (2024)
par: Luo, Renqing, et autres
Publié: (2024)
Dynamic Experts Search: Enhancing Reasoning in Mixture-of-Experts LLMs at Test Time
par: Han, Yixuan, et autres
Publié: (2025)
par: Han, Yixuan, et autres
Publié: (2025)
PMNI: Pose-free Multi-view Normal Integration for Reflective and Textureless Surface Reconstruction
par: Pei, Mingzhi, et autres
Publié: (2025)
par: Pei, Mingzhi, et autres
Publié: (2025)
Seeing Through the Rain: Resolving High-Frequency Conflicts in Deraining and Super-Resolution via Diffusion Guidance
par: Li, Wenjie, et autres
Publié: (2025)
par: Li, Wenjie, et autres
Publié: (2025)
Detailed Object Description with Controllable Dimensions
par: Wang, Xinran, et autres
Publié: (2024)
par: Wang, Xinran, et autres
Publié: (2024)
LASP-2: Rethinking Sequence Parallelism for Linear Attention and Its Hybrid
par: Sun, Weigao, et autres
Publié: (2025)
par: Sun, Weigao, et autres
Publié: (2025)
Multimodal Conditional Information Bottleneck for Generalizable AI-Generated Image Detection
par: Qin, Haotian, et autres
Publié: (2025)
par: Qin, Haotian, et autres
Publié: (2025)
IncreFA: Breaking the Static Wall of Generative Model Attribution
par: Qin, Haotian, et autres
Publié: (2026)
par: Qin, Haotian, et autres
Publié: (2026)
Efficient Face Super-Resolution via Wavelet-based Feature Enhancement Network
par: Li, Wenjie, et autres
Publié: (2024)
par: Li, Wenjie, et autres
Publié: (2024)
Cyanogroup‐Modified PEO‐Based Electrolytes Achieve High Free Al 3+ Concentration and Improve the Transport Dynamics in Solid‐State Aluminum‐Ion Batteries
par: Hongquan Pan, et autres
Publié: (2024)
par: Hongquan Pan, et autres
Publié: (2024)
Amorphization Engineering via Multi‐Anion Doping Toward Fast Li + Transport and Conformable Interfaces for Stable Solid‐State Batteries
par: Haiming Su, et autres
Publié: (2026)
par: Haiming Su, et autres
Publié: (2026)
RURANET++: An Unsupervised Learning Method for Diabetic Macular Edema Based on SCSE Attention Mechanisms and Dynamic Multi-Projection Head Clustering
par: Yang, Wei, et autres
Publié: (2025)
par: Yang, Wei, et autres
Publié: (2025)
Documents similaires
-
Silence the Judge: Reinforcement Learning with Self-Verifier via Latent Geometric Clustering
par: Zhang, Nonghai, et autres
Publié: (2026) -
LTS-VoiceAgent: A Listen-Think-Speak Framework for Efficient Streaming Voice Interaction via Semantic Triggering and Incremental Reasoning
par: Zou, Wenhao, et autres
Publié: (2026) -
Efficient Paths and Dense Rewards: Probabilistic Flow Reasoning for Large Language Models
par: Liu, Yan, et autres
Publié: (2026) -
GeoRA: Geometry-Aware Low-Rank Adaptation for RLVR
par: Zhang, Jiaying, et autres
Publié: (2026) -
Fine-Mem: Fine-Grained Feedback Alignment for Long-Horizon Memory Management
par: Ma, Weitao, et autres
Publié: (2026)